DeepSeek V4.1 Flash 是值得測試的目前 Flash checkpoint,適合長上下文、原生影像輸入、低價時段 API 或開放權重部署。最重要的是名稱:官方 API 叫 deepseek-flash,deepseek-v4-flash 現在只是暫時相容別名。舊版 V4 Flash 評測可能對應另一個模型,即使程式仍能執行。
時間錨點是 DeepSeek 2026 年 9 月 10 日發布和 9 月 20 日查看的價格表:552B MoE、prefill 啟用 8B、decode 啟用 16B、100 萬上下文、最高 384K 輸出、思考/非思考、原生視覺與峰谷價格。V4 Pro 是獨立路線。先看 DeepSeek V4.1 Flash 模型頁 (简体中文),再在客戶端確認 ID。
快速判斷
需要長上下文、視覺輸入和可安排的 Agent 工作時可試。
新 API 使用
deepseek-flash;舊名是相容路由,不是舊模型仍在服務的證據。官方分數要連同任務版本和 harness 閱讀,不能合成獨立排行榜。
API、開放權重、合作夥伴產品與 Tabbit 存取要分開。
寫入型 Agent 必須有 diff、測試和人工檢查點。
規格一覽
| 項目 | 2026-09-20 查看內容 | 邊界 |
|---|---|---|
| 目前 API | deepseek-flash,版本 DeepSeek-V4.1-Flash | 仍需確認地區和帳戶。 |
| 舊名稱 | deepseek-v4-flash 暫時路由到 V4.1 | 舊版評測不會自動適用。 |
| 架構 | 552B MoE;prefill 8B、decode 16B 啟用 | 不直接預測延遲或本地吞吐。 |
| 上下文/輸出 | 1M;最高 384K | 最大值不是每個客戶端的有效值。 |
| 功能 | 視覺、JSON、工具、Responses/Anthropic API、非思考 FIM | 不同路線可能有不同開放程度。 |
| 並發 | 官方表列 2,500 | 帳戶、地區和服務會變。 |
先讀 什麼是 Agent 瀏覽器,再看 AI 瀏覽器比較 與 Tabbit Browser 實務。
新架構與官方結果
DeepSeek 介紹因果編碼器—解碼器結構,用 8B prefill、16B decode 的非對稱路徑降低快取壓力,並聲稱相比上一代只需四分之一 HBM、八分之一 SSD。Hugging Face 卡片提供 Transformers、vLLM、SGLang 和量化連結,但 552B 模型的硬體、監控和故障恢復仍要自行規劃。任務材料可看 DeepSeek prompts (简体中文),本文不複製長提示詞。
官方更新日誌列出 Terminal-Bench 2.1 90.6、DeepSWE 74.2、CyberGym 88.1、SEC-Bench Pro 62.8、HLE with tools 63.9、Chartography with tools 78.9、BabyVision with tools 89.6 和 Automation-Bench 54.8。它們使用不同任務、工具和版本,不能平均成一個分數。7 月 V4 Flash 0731 使用的 DeepSeek Harness、最高 effort、top-p 0.95、temperature 1 也不會自動適用 V4.1。詳情見 DeepSeek reviews (简体中文)。
V4 Flash、V4.1 Flash 與 V4 Pro
V4 Flash 0731 是歷史版本;V4.1 Flash 是目前 deepseek-flash API 和開放權重;V4 Pro 是獨立路線,DeepSeek 的過渡政策可能影響舊請求,但 Pro 分數不是 Flash 測量。舊 deepseek-v4-flash 會暫時路由到 V4.1 並按 Flash 收費。現有 DeepSeek V4 Flash 價格指南負責算費和遷移歷史,本文只討論目前 checkpoint;評測設計可參考 Agent 深度研究。
價格與部署
官方表的每百萬 token 價格是:離峰快取命中/未命中輸入 $0.003/$0.15、輸出 $0.60;尖峰 $0.006/$0.30/$1.20。尖峰為週一至週五 UTC 01:00–04:00、06:00–10:00(中國公共假日除外),其餘為離峰。思考、非思考、輸出、工具和重試都會影響成本。
MIT 開放權重適合想控制程式碼和資料的團隊,但不是硬體報價。OpenCode、WorkBuddy/CodeBuddy 等合作夥伴可能有自己的配額和帳單。瀏覽器自動化能協助設計任務,但不能把本地或 API 模型變成 Tabbit 可用模型。
社群觀察、風險與自檢
一位 r/opencode 使用者報告用 OpenCode 約十分鐘完成瀏覽器遊戲,約 300K token、花費 $0.28,並公開程式碼;但沒有精確 prompt、API 模式、日誌和驗收標準。另一篇舊版 V4 Flash 0731 帖子稱複雜網頁除錯約 30 分鐘完成,留言討論容量、本地硬體和幻覺;這條不作為 V4.1 證據。X 曾有 Agent Arena 成本快照,但正文與表格出現 $0.07/$0.06 衝突,未採用;YouTube 僅搜尋,未用標題或播放量證明能力。
| 場景 | 第一個測試 | 驗收 |
|---|---|---|
| 程式 Agent | 小儲存庫、固定問題和測試 | diff、測試與工具日誌一致。 |
| 視覺抽取 | 已知標籤的公開圖片 | 每個值可追溯,不確定項明確保留。 |
| 長文件 | 多位置 needle 的日期語料 | 測量不同上下文長度的召回。 |
| 成本批次 | 尖峰/離峰重複任務並記錄快取 | 總成本包括輸出和重試。 |
本文沒有執行已登入的 DeepSeek V4.1 Flash Tabbit 任務,也沒有 4–8 張合格截圖,因此不聲稱 Tabbit 選擇器、有效上下文、視覺、延遲、配額或價格。若帳戶展示該模型,先從公開圖片或文件提取五項事實與連結,人工核對後再授予權限。
結論
DeepSeek V4.1 Flash 是長上下文、多模態和成本敏感 Agent 試點的強候選。架構和 API 表解釋了快取密集型工作的吸引力,別名政策則提醒不能把舊 V4 Flash 或 V4 Pro 經驗套到目前 checkpoint。新 API 使用 deepseek-flash,記錄時段和模式並用固定 fixture 驗收。只有硬體計畫真實時才選本地權重;Tabbit 則先確認即時選擇器與產品條款。
來源
常見問題
DeepSeek V4.1 Flash 是什麼?
它是 DeepSeek 目前的 Flash checkpoint,官方 API 名稱為 `deepseek-flash`。它提供 100 萬上下文、最高 384K 輸出、思考與非思考模式、原生視覺、工具與結構化 API。
DeepSeek V4.1 Flash 和 V4 Flash 一樣嗎?
不一樣。V4 Flash 和 V4 Flash Vision Exp 已退役,舊名稱暫時作為相容別名路由到 V4.1 Flash,因此舊 benchmark 和價格假設不能直接代表目前 checkpoint。
DeepSeek V4.1 Flash 價格是多少?
2026 年 9 月 20 日核對的官方表顯示,離峰快取命中/未命中輸入為每百萬 0.003/0.15 美元,輸出 0.60 美元;尖峰為 0.006/0.30/1.20 美元。預算前要重新查看。
它適合程式 Agent 嗎?
DeepSeek 更新日誌報告 Terminal-Bench 2.1 為 90.6、DeepSWE v1.1 為 74.2。一則目前 Reddit 作品報告也很正面,但 prompt、harness 和驗收條件不完整,仍需自行測試。
它是開源模型嗎?
Hugging Face 卡片以 MIT 授權發布權重,並提供 Transformers、vLLM、SGLang 路徑。開放權重不代表硬體成本低,也不證明 Tabbit 可用。
可以在 Tabbit 使用嗎?
本文沒有執行已登入的 DeepSeek V4.1 Flash Tabbit 任務。請查看即時選擇器與帳戶條款;API 名稱和價格不能證明 Tabbit 可用。