同家族裡更快
面向高併發對話与程式,把大量短中程请求从 Pro 分流出来。
DeepSeek · V4 Flash · 2026 年 4 月
免費面向高吞吐程式、對話与短中程 Agent 的 V4 高效 MoE — 可在 iMini Agent 免費試用。
DeepSeek V4 Flash 是 DeepSeek 于 2026 年 4 月發佈的 V4 高效向模型,面向高吞吐程式、對話与短中程 Agent。相較 V3.2 与更重的 V4 Pro,它更強調速度与成本;加大思考預算时,Flash-Max 在部分推理任務上可接近 Pro。本站幫助你在 iMini 免费線上 AI Agent 中直接開啟使用,無需本機安裝。
DeepSeek V4 Flash 是 2026 年 4 月發佈的 DeepSeek V4 家族中的高效档。它是一个混合专家(MoE)模型,總參數约 284B、每 token 啟用约 13B——這正是它能快速回應、同时仍與 V4 Pro 共享百万 token 上下文的原因。
V4 系列取消了以往「對話模型」與「推理模型」分开命名的做法:推理強度改为請求參數,因此同一個 Flash 可以執行在不思考、思考,或 Flash-Max 模式下。加大思考預算后,Flash-Max 在偏推理的題目上能追回一部分與 Pro 的差距。
實際使用中,Flash 適合高頻重複的任務——程式碼走查、快速修復、問答、信息抽取、短中程 Agent 迴圈——單次答得不完美的代價足夠低,你寧願重試也不願等待。
吞吐、同架構长上下文,以及可加深的 Flash-Max——選高效檔前先看清这些邊界。
面向高併發對話与程式,把大量短中程请求从 Pro 分流出来。
与 Pro 同属长上下文档,短輪任務也能带着更长材料跑。
加大思考預算后,部分推理結果可接近 Pro,适合先快後深的流水線。
日常工具呼叫与快速迭代很合适;先線上試用,再決定是否接本地 API。
以下數據來自 DeepSeek-V4 技术報告與公开 API 定價。要結合起来看:Flash 用一部分推理上限換來了很大的效率提升。
100 万
與 V4 Pro 同属長上下文档,短轮任務也能带着大體量材料跑。
约 13B
總 MoE 參數 284B 中的啟用部分,这是延遲與成本能壓下來的原因。
约 10%
百万上下文場景下相对 DeepSeek V3.2 的单 token FLOPs,KV 快取约降到 7%。
0.84–0.91
Flash-Max 在 128K 以内多数取点的檢索準確率;满 100 万时约 0.49。
$0.14
每百万 token(快取未命中),约为 V4 Pro 輸入價的三分之一。
$0.28
每百万 token,这也是與旗艦档成本差距最明顯的一项。
數據來源:DeepSeek-V4 技术報告(arXiv:2606.19348)與公开的 DeepSeek API 定價。評測分数会隨推理強度變化,投入生產前請先在自己的真實任務上驗證。
DeepSeek V4 Flash 适合失敗成本相對可控、需要高頻週轉的工作。
日常功能与小修小補。最重的長程任務再升級到 V4 Pro。
問答、說明性草稿与結構化輸出。
步驟清晰的工具呼叫。需要頂配推理时再切 Pro。
試用 Flash 不需要 DeepSeek API Key。在 iMini Agent 里開啟它,描述一个真實任務,直接在瀏覽器里看它規劃并呼叫工具。
不用 API Key、不用本機 CLI、不用改設定檔,開啟就能提問。
Flash 会規劃、呼叫工具、持續迭代,而不只是回一条聊天訊息。
先用 Flash 起步;同一工作階段里發現任務更難,可直接升到 V4 Pro。
兩者都是各自家族里又快又便宜的一檔,面向延遲和價格比能力上限更重要的高頻場景。
| 對比项 | DeepSeek V4 Flash | GPT-5.6 Luna |
|---|---|---|
| 發佈時間 | 2026 年 4 月 | 2026 年 7 月 |
| 上下文視窗 | 100 万 tokens | 105 万 tokens |
| 推理模式 | 不思考 / Think High / Flash-Max | 最高 max(不支援 ultra) |
| API 價格(每百万 輸入/輸出) | $0.14 / $0.28 | $1.00 / $6.00 |
| 權重 | 開放,MIT 授權 | 閉源,仅 API |
| 主要面向 | 高吞吐程式、對話、短中程 Agent | 分類、抽取、路由、初稿生成 |
| 升級路徑 | DeepSeek V4 Pro | GPT-5.6 Terra 或 Sol |
最直觀的差距在成本:Luna 本身是很好的走量档,但 Flash 的輸入價格约为 Luna 的七分之一,而且權重開放,可自部署、可審計。Luna 的優勢是視窗略大、OpenAI 生態工具更全。最快的判斷辦法是同一個提示詞各跑一遍——現在就能在 iMini Agent 里免費试 Flash。
免費試用 iMini Agent →两者都是百万上下文。差距主要在能力上限與吞吐——按任務选,不必先站隊。
| 對比項 | DeepSeek V4 Flash | DeepSeek V4 Pro |
|---|---|---|
| 上下文 | 100 万 tokens | 100 万 tokens |
| 推理 | 支援 Flash-Max | Think High / Max |
| 程式与 Agent | 高吞吐程式 | 复杂程式与長程 Agent |
| 長程工具 | 更适合短中程 | 長程自動化姿态 |
| 速度姿态 | 吞吐优先 | 更偏完成質量 |
| 優先場景 | 高頻週轉的 DeepSeek 工作 | 代码与硬推理旗艦 |
也可查看 DeepSeek V4 Pro
三步在免费線上 Agent 中运行这款 DeepSeek V4 模型——無需 DeepSeek API Key。
点击按钮,在瀏覽器启动免费線上 Agent。
要吞吐/成本选 Flash,要更深推理选 Pro。
让 Agent 规划、呼叫工具并交付;不满意再追問迭代。
免费額度、模型命名、關鍵規格,以及 Flash 与 Pro 的差異。
百万上下文、更快吞吐——适合日常程式与對話。無需 DeepSeek API Key。
線上 Agent 由 iMini 提供。本站为独立指南,与 DeepSeek 官方无关联。