Tabbit博客

DeepSeek V4 Pro:有哪些变化、如何计费,适合谁使用

用可回溯来源拆解 DeepSeek V4 Pro 0813 的 Agent 升级、API 限制、价格边界、独立测评与安全试用方法。

本文目录
  1. 先看结论
  2. DeepSeek V4 Pro 规格速览
  3. 相比 4 月预览版改了什么?
  4. 为什么要记录这个数字
  5. 仍然未知的风险
  6. 社区反馈:有用的分歧
  7. 谁适合先试?
  8. 下一步:只测一个可回滚任务
  9. 结论
  10. 来源

如果任务需要长链路规划、工具调用或大上下文,DeepSeek V4 Pro 值得小规模试用。但它不适合默认接管所有请求:当前价格分时段计算,输出可能很长,独立反馈也提到过度思考,因此路由和复核必须一起设计。

DeepSeek 在 2026 年 8 月 13 日宣布 GA。本文的决策锚点是实时目录中的 deepseek-v4-pro、版本 DeepSeek-V4-Pro-0813,以及 2026 年 9 月 20 日核对的 Artificial Analysis 快照:Intelligence Index 36,排名 7/113,每个指数任务成本 0.67 美元(max 档)。这些数字都有日期,不是永久排名。(DeepSeek GA 发布说明Artificial Analysis

先看结论

  • GA 版本增加 low、high、max 推理档位、原生 Responses API 和 Codex 接入指引。

  • 官方目录列出 100 万 token 上下文、38.4 万 token 最大输出、工具调用和 Responses/Anthropic API;当前 API 不支持 vision。

  • 官方价格按高峰和低峰变化。高峰输出为每百万 token 3.96 美元,低峰为 1.98 美元,预算前应重新核对。

  • MindStudio 八题实测给 V4-Pro-0813 打出 61/80(76.25%),预览版为 24.8%;提示词、参数和重复次数未公开。

  • 独立证据更支持规划和前端任务,但过度工程、冗长和延迟仍是风险。

  • 本文没有完成 Tabbit V4 Pro 实测或截图。请先查看 DeepSeek V4 Pro 模型页

DeepSeek V4 Pro 规格速览

问题当前快照决策边界
模型 ID/版本deepseek-v4-proDeepSeek-V4-Pro-0813日志中同时固定两者。
发布2026-08-13 宣布 GA比较时保持同一版本和测试夹具。
上下文/最大输出100 万 / 38.4 万 token目录上限不等于客户端实际额度。
推理low、high、max比较档位,而非只比较模型名。
功能JSON、工具调用、Responses API、Anthropic API、Chat Prefix/FIM beta仍取决于接入路由。
视觉当前 API 表格不支持图片任务需要其他模型或路由。
API 价格命中 0.022/0.044;未命中 0.66/1.32;输出 1.98/3.96 美元/百万 token,低峰/高峰缓存、时间窗和未来调整都会改变成本。
获取DeepSeek API;发布说明列出网页/App Expert Mode仍需确认账号、地区、额度和选择器。

官方表格定义的高峰时段是周一至周五 UTC 01:00–04:00、06:00–10:00(中国公共假期除外),并列出 500 并发限制。它们来自动态页面,应在预算前复核。

相比 4 月预览版改了什么?

维度4 月预览V4-Pro-0813 GA读者该怎么用
产品状态预览讨论和早期测试8 月 13 日正式发布固定日期和版本。
推理控制现有笔记未记录公开的 low/high/max提供 low、high、max分别测质量与成本。
Agent 接口早期 Agent 场景原生 Responses API、Codex 指引记录工具调用和停止条件。
八题实测预览版 24.8%同文 V4-Pro-0813 为 61/80只作同一测试内的方向性比较。
已知取舍早期反馈按任务波动MindStudio 看到前端/规划强,SVG/润色和过度工程弱保留人工复核。

MindStudio 的八项任务包括电梯逻辑、3D 镜头、折叠桌动画、SVG、游戏、排列数学、长链路 Agent 和双时区手表。任务具体,但完整提示词、模型参数、重复次数和工具配置没有公开,因此不能推导出普遍提升。可在 DeepSeek V4 Pro 测评集合 查看证据边界。

为什么要记录这个数字

Artificial Analysis 当前快照的每指数任务 0.67 美元只是规划参考,不是账单。它对应 2026 年 9 月 20 日看到的 max 档 V4 Pro 0813,当前显示 Index 36、排名 7/113。旧研究笔记曾记录 Index 53、排名 3/107;页面和样本集合已经变化,不能拼成趋势线。

因此应比较“完成一个合格任务的成本”,而不是只看排名。长输出、重试和人工修改都会抬高实际成本。可以结合 Agent 推理指南拆分模型能力与工作流质量。

仍然未知的风险

  • 测试夹具不完整: XSCT 记录的规划结果(基础 98.0、高级 92.6)和澄清结果(68.5)都由 LLM 评审,系统提示、工具、温度和重试规则未公开。

  • 快照会变化: 不要把当前 Index 36 与旧笔记的 Index 53 混用。

  • 任务成本不稳定: 高低峰、缓存命中、推理档位、长输出和重试都会改变账单。

  • 行为取舍: MindStudio 观察到简单任务上的过度思考和过度工程,大上下文不代表会选择正确上下文。

  • 模态限制: 当前官方 API 不支持 vision。

  • 可用性差异: API、App Expert Mode 和第三方选择器不是同一项承诺。

社区反馈:有用的分歧

Reddit 长上下文讨论的原帖已被删除,以下是仍可见的评论,不是代表性调查:

  • DeciusCurusProbinus(约 2026 年 6 月)说:“Pretty much, if you are not a vibe coder.” 没有可复现任务或推理档位。

  • SiteSpecialist6295(约 2026 年 6 月)称 Pro 是“massive improvement over other DS models for agentic coding”,同时提醒模糊截图提示可能带来后续或安全问题;原帖正文已删除。

  • The_Meme_Economy(约 2026 年 8 月)报告约 90% 的应用和美元级成本,并把多数执行交给 Flash、把 Pro 留给规划和复核;这是个人路由选择,不是价格依据。

  • burntoutdev8291(约 2026 年 8 月)认为 Flash 适合架构/计划,但 Pro “very slow”;硬件、档位和提示词未知。

它们共同指向一个可执行做法:给 Pro 明确计划、验收条件和可回滚空间;常规执行可交给更快的模型,但要通过同一验收。也可以参考 AI 浏览器对比,区分模型选择和产品选择。

谁适合先试?

如果你的工作是第一步原因
多文件编码,有测试和停止条件high 档小规模试用,记录工具调用规划和长链路是最有力的适用场景。
大型代码库或文档先测试受控片段,不要一次塞入全部语料100 万上下文不保证检索正确或成本低。
价格敏感的常规生成先比较 Flash 或其他便宜路由高峰输出和长回答可能抵消 token 价格。
视觉调试或截图理解不要默认 Pro 可以完成当前 API 表格不支持 vision。
安全敏感的改动要求测试、diff 复核和人工签字公开证据不能证明漏洞已被关闭。
浏览器工作先读 Agent 浏览器指南并核对权限浏览器提供工具和权限,不提供认证。

下一步:只测一个可回滚任务

选择一个小型多文件改动、结构化文档抽取,或“先规划、再单独执行”的任务。记录模型 ID、推理档位、上下文大小、工具权限、输入/输出/思考 token、延迟、重试、工具调用和人工修正,并用当前模型跑同一夹具。只有当每个合格结果的成本下降或人工干预明显减少时,才扩大使用。

如果工作发生在浏览器中,可以阅读 浏览器自动化指南Tabbit Browser 介绍。本文没有验证 V4 Pro 账号或任务,因此上线前请先核对实时选择器。

需要起步样例时,可以查看模型的 Prompt 库,再参考 最佳 AI 浏览器指南。这些页面用于发现方向,不代表某个提示词或客户端一定适合你的账号。

Tabbit Browser

结论

DeepSeek V4 Pro 值得用于长链路规划、Agent 编码和大上下文工作的受控试点。GA 后的推理档位和 API 让它比预览版更容易测,但它不是普遍赢家:分时价格、输出量、过度工程、延迟、不支持视觉,以及不同路由的可用性都必须纳入决策。

固定模型和档位,选择可回滚任务并设置独立验收。让每个合格结果的成本和人工干预,决定 Pro 是否长期留在执行模型旁边。

来源

常见问题

DeepSeek V4 Pro 是什么?

DeepSeek V4 Pro 是面向推理和 Agent 工作的通用模型。当前 API 目录将其标为 deepseek-v4-pro,版本为 DeepSeek-V4-Pro-0813,上下文窗口 100 万 token,最大输出 38.4 万 token。

DeepSeek V4 Pro 0813 有什么变化?

2026 年 8 月 13 日 GA 发布增加了 low、high、max 推理档位、Responses API 和 Codex 优化指引。独立八题测试也显示它高于预览版,但完整测试配置没有公开。

DeepSeek V4 Pro 如何收费?

2026 年 9 月 20 日核对的官方表格显示,缓存命中输入为每百万 token 0.022/0.044 美元,缓存未命中为 0.66/1.32 美元,输出为 1.98/3.96 美元,依次对应低峰/高峰。价格和时间窗会变化。

在哪里可以使用 DeepSeek V4 Pro?

DeepSeek 发布说明列出 API、OpenAI 兼容与 Anthropic 兼容接口,以及网页和 App 的 Expert Mode。实际可用性仍取决于账号、地区、额度和客户端。

DeepSeek V4 Pro 支持视觉吗?

当前官方 API 表格标注不支持 vision。涉及截图或图片时,应使用明确支持视觉的路由或模型。

切换前如何测试 DeepSeek V4 Pro?

固定模型 ID 和推理档位,选择一个可回滚任务,记录 token、工具调用、延迟、重试和人工修正,再与当前模型比较每个合格结果的成本。

下一步

让 Tabbit 与你并肩工作。

跨标签页调研、自动化重复的浏览器工作,让每一处上下文都触手可及。