DeepSeek V4 Pro 0813正式发布,引入峰谷定价机制
DeepSeek V4 Pro 0813更新公告已发布,并确认采用峰谷定价:高峰时段API价格翻倍,Pro模型输出峰值达12元/百万token。
DeepSeek V4 Pro 0813的正式更新公告已发布,同时新的API定价策略也尘埃落定。据社区消息,今天下午的V4 Pro 0813模型可能存在问题,而此次正式公告意味着修复后的版本已上线。
新定价采用峰谷机制:高峰时段(北京时间9:00-12:00、14:00-18:00)API价格直接翻倍。具体来看,V4 Pro缓存命中输入从0.025元涨至0.05元/百万token,缓存未命中从3元涨至6元,输出从6元涨至12元。V4 Flash也执行同样的峰谷定价。
此次调价使得高峰时段Pro输出价格比此前贵了4倍以上,而空闲时段的Pro输出也较原来贵了一倍多。官方希望通过峰谷定价将算力选择权交给用户,鼓励非紧急任务在低谷时段运行,以降低成本。
此外,DeepSeek Harness已开启内测,正式版发布也不远了。第三方测试显示,不同Harness工具的token消耗差异很大,这可能影响整体使用成本。
来源证据
歸藏的个人主页m.okjike.com · supporting### 歸藏: DeepSeek V4 Pro 正式版 0813 发布了! 从流传的测试成绩来看依然相当爆炸
DeepSeek Harness开启内测?看来V4正式版也不远了-钛媒体官方网站tmtpost.com · supporting再说价格,这是争议最大的部分。 V4正式版将引入峰谷定价机制,高峰时段(北京时间9:00-12:00和14:00-18:00)API价格直接翻倍。具体来看,V4 Pro缓存命中输入平时0.025元/百万 token,高峰0.05元;缓存未命中平时3元,高峰6元;输出平时6元,高峰12元。V4 Flash 缓存命中平时0.02元,高峰0.04元;缓存未命中平时1元,高峰2元;输出平时2元,高峰4元。 峰谷定价这件事,往好了说是把算力选择权还给用户,不急的任务挪到低谷时段跑,成本更低。可另一方面,在平时的办公时间,跑相同的任务,成本就会增加。 这不是DeepSeek第一次在定价上换思路。 2025年2月搞过夜间错峰优惠,V3五折、R1二五折。2025年9月 V3.1发布,取消夜间优惠,全天统一价,输出价格还往上抬了50%。 但关键问题不在于价格涨没涨,而在于结合Harness之后,整体使用成本会如何? 第三方测试显示,不同的harness 在完成同样任务时,token消耗差异巨大。测试机构用DeepSeek V4 Flash,分别测试了Claude Code、OpenCode和Pi这三个市面上最常见的Harness工具。发现,三种工具的代码质量基本一致,但Claude Code 每个任务平均跑约70次工具调用,OpenCode只有约22次。 此外,同一个任务,在弱Harness(Pi)里失败了,换到强Harness(Claude Code)里居然成功了。 因此,如何去平衡价格与性能,这是DeepSeek做Harness必须要面对的问题。 不过有一点我很放心,在省钱这件事上,梁文锋还是太权威了。 投稿 [...] 那么正式版比预览版强在哪? 综合多个内测信源的说法,称V4正式版在三个方向上做了升级: 核心推理能力再上一个台阶。 日常对话的响应速度明显优化。 Agent能力针对性迭代。 有参与灰度测试的人总结,V4正式版整体表现接近Opus 4.8级别,编码能力不弱于GPT-5.6 Sol,Agent能力和3D、SVG生成能力大幅提升。同样的任务比Claude Fable 5迭代轮数还少。 不过这些说法都来自非官方渠道,DeepSeek没有公开确认。 预览版的问题其实社区里讨论得不少。V4 Preview在编程能力上和Kimi K2.7、G
歸藏(guizang.ai) (@op7418) / Posts / Xx.com · supporting歸藏(guizang.ai) @op7418 5h SpaceX AI 发布了 Grok 4.6 模型,然后价格还行,每百万输入输出分别为 2 和 6 美元。 当然,如果你有 Twitter 的 Premium+的会员的话,依然可以通过 Grok Build 授权来白嫖。 user avatar SpaceXAI @SpaceXAI 7h Introducing Grok 4.6. It delivers frontier intelligence and is a significant improvement over Grok 4.5 at the same price. user avatar 歸藏(guizang.ai) @op7418 5h DeepSeek V4 Pro 正式版 0813 发布了! 从流传的测试成绩来看依然相当爆炸 user avatar 歸藏(guizang.ai) @op7418 11h 又有羊毛薅了,Manus 从 Meta 剥离以后开启了限免。 如果你之前自己买过 Manus 会员,或者是通过 Lenny's Newsletter 领过会员的话,最近可以用一用。 仅限 Manus 1.6 和 Manus Lite 两个模型 [...] Log inSign up 歸藏(guizang.ai) profile banner user avatar # 歸藏(guizang.ai) 关注人工智能、LLM 、 AI 图像视频和设计(Interested in AI, LLM, Stable Diffusion, and design) 歸藏的 AIGC 周刊|公众号:歸藏的AI工具箱 guizang.ai Joined August 2013 1,286 Following167.6K Followers RepliesRepliesArticlesArticlesMediaMedia Pinned user avatar 歸藏(guizang.ai) @op7418 Aug 10 Article cover image Article 开源一个非
DeepSeek V4 Pro 正式版0813 发布了! 从流传的测试成绩 ...x.com · supportingLog inSign up ## Post # 歸藏(guizang.ai) on X: "DeepSeek V4 Pro 正式版 0813 发布了! 从流传的测试成绩来看依然相当爆炸 user avatar 歸藏(guizang.ai) @op7418 DeepSeek V4 Pro 正式版 0813 发布了! 从流传的测试成绩来看依然相当爆炸 4:41 PM · Aug 12, 202652.9KViews user avatar 歸藏(guizang.ai) @op7418 14h 流传的测试成绩 user avatar 歸藏(guizang.ai) @op7418 14h 已经可以在 OpenCode Go 上使用 user avatar OpenCode Anomaly @opencode 15h There's been a week of hype for DeepSeek Flash So good time to announce that the newest DeepSeek V4 Pro is now available in OpenCode Go user avatar Kevin Kan @xmhomebody 14h 关键还便宜,6块,笑死我了啊
DeepSeek Harness开启内测?看来V4正式版也不远了_ZAKER新闻app.myzaker.com · supporting再说价格,这是争议最大的部分。 V4 正式版将引入峰谷定价机制,高峰时段(北京时间 9:00-12:00 和 14:00-18:00)API 价格直接翻倍。具体来看,V4 Pro 缓存命中输入平时 0.025 元 / 百万 token,高峰 0.05 元;缓存未命中平时 3 元,高峰 6 元;输出平时 6 元,高峰 12 元。V4 Flash 缓存命中平时 0.02 元,高峰 0.04 元;缓存未命中平时 1 元,高峰 2 元;输出平时 2 元,高峰 4 元。 峰谷定价这件事,往好了说是把算力选择权还给用户,不急的任务挪到低谷时段跑,成本更低。可另一方面,在平时的办公时间,跑相同的任务,成本就会增加。 这不是 DeepSeek 第一次在定价上换思路。 2025 年 2 月搞过夜间错峰优惠,V3 五折、R1 二五折。2025 年 9 月 V3.1 发布,取消夜间优惠,全天统一价,输出价格还往上抬了 50%。 但关键问题不在于价格涨没涨,而在于结合 Harness 之后,整体使用成本会如何? 第三方测试显示,不同的 harness 在完成同样任务时,token 消耗差异巨大。测试机构用 DeepSeek V4 Flash,分别测试了 Claude Code、OpenCode 和 Pi 这三个市面上最常见的 Harness 工具。发现,三种工具的代码质量基本一致,但 Claude Code 每个任务平均跑约 70 次工具调用,OpenCode 只有约 22 次。 此外,同一个任务,在弱 Harness(Pi)里失败了,换到强 Harness(Claude Code)里居然成功了。 因此,如何去平衡价格与性能,这是 DeepSeek 做 Harness 必须要面对的问题。 不过有一点我很放心,在省钱这件事上,梁文锋还是太权威了。 宙世代 ## 宙世代 [...] 核心推理能力再上一个台阶。 日常对话的响应速度明显优化。 Agent 能力针对性迭代。 有参与灰度测试的人总结,V4 正式版整体表现接近 Opus 4.8 级别,编码能力不弱于 GPT-5.6 Sol,Agent 能力和 3D、SVG 生成能力大幅提升。同样的任务比 Claude Fable 5 迭代轮数还少。 不过这些说法都来自非官方渠道,DeepSeek 没有公开确认。 预览版的
DeepSeek Harness開啟內測?看來V4正式版也不遠了hao.cnyes.com · supporting再說價格,這是爭議最大的部分。 V4正式版將引入峰谷定價機制,高峰時段(北京時間9:00-12:00和14:00-18:00)API價格直接翻倍。具體來看,V4 Pro快取命中輸入平時0.025元/百萬 token,高峰0.05元;快取未命中平時3元,高峰6元;輸出平時6元,高峰12元。V4 Flash 快取命中平時0.02元,高峰0.04元;快取未命中平時1元,高峰2元;輸出平時2元,高峰4元。 峰谷定價這件事,往好了說是把算力選擇權還給使用者,不急的任務挪到低谷時段跑,成本更低。可另一方面,在平時的辦公時間,跑相同的任務,成本就會增加。 這不是DeepSeek第一次在定價上換思路。 2025年2月搞過夜間錯峰優惠,V3五折、R1二五折。2025年9月 V3.1發佈,取消夜間優惠,全天統一價,輸出價格還往上抬了50%。 但關鍵問題不在於價格漲沒漲,而在於結合Harness之後,整體使用成本會如何? 第三方測試顯示,不同的harness 在完成同樣任務時,token消耗差異巨大。測試機構用DeepSeek V4 Flash,分別測試了Claude Code、OpenCode和Pi這三個市面上最常見的Harness工具。發現,三種工具的程式碼質量基本一致,但Claude Code 每個任務平均跑約70次工具呼叫,OpenCode只有約22次。 此外,同一個任務,在弱Harness(Pi)裡失敗了,換到強Harness(Claude Code)裡居然成功了。 科技 從這裡可透過《Google 新聞》追蹤 鉅亨號創作者 [...] 那麼正式版比預覽版強在哪? 綜合多個內測信源的說法,稱V4正式版在三個方向上做了升級: 核心推理能力再上一個台階。 日常對話的響應速度明顯最佳化。 Agent能力針對性迭代。 有參與灰度測試的人總結,V4正式版整體表現接近Opus 4.8等級,編碼能力不弱於GPT-5.6 Sol,Agent能力和3D、SVG生成能力大幅提升。同樣的任務比Claude Fable 5迭代輪數還少。 不過這些說法都來自非官方管道,DeepSeek沒有公開確認。 預覽版的問題其實社區裡討論得不少。V4 Preview在程式設計能力上和Kimi K2.7、GLM 5.1接近,但仍然遜色當前的主流模型。 尤其是在那些複雜的任務上。有測試