兄弟们,DeepSeek 又搞事了! 4 月预览版已经震撼一波,现在 DeepSeek-V4-Pro-0813 正式推送到 API。1.6 万亿总参数、49B 激活,原生 100 万 token 上下文,混合注意力把长文本成本砍到前代的 27%/10%。 编码实测 SWE-bench 80.6%、LiveCodeBench 93.5%,Agent 能力开源第一梯队,思考模式拉满后推理直接对标顶级闭源。最关键的是 MIT 开源 + 价格白菜(Pro 输入大概 3 元/百万,Flash 更便宜)。 程序员、做 Agent 的、搞长文档分析的,现在就可以去 chat.deepseek.com 或改 API model 名试。权重也在 Hugging Face 等着你。 又是一个“开源打闭源”的时刻。你们测了吗?评论区晒截图!
省流版:
-
DeepSeek-V4-Pro-0813:开源性价比之王,纯文本编码/算法最强,价格极低,MIT 完全开源。
-
Claude Fable 5:当前公开可用峰值能力最强的闭源旗舰(Mythos-class),长时程 Agent 与复杂工程遥遥领先,但最贵。
-
Kimi K3:最大开源权重模型(2.8T),多模态 + 前端/终端编码强,整体接近 Fable 5,成本介于两者之间。
![]()
总结
2026 年 8 月的格局是典型的“三强鼎立”:
-
Fable 5 继续定义“最强闭源天花板”。
-
Kimi K3 用开源规模把开源阵营拉到接近前沿。
-
DeepSeek-V4-Pro-0813 用极致效率与价格继续降维打击日常工作负载。
实际落地建议:用同一 harness 跑你自己的真实任务(尤其是代码库和 Agent 流程),公开榜单与真实体验常有差距。grok4.6也出了,到时再一起比比看,都是前后脚。
![]()
