比特币橙子Trader|2026年08月13日 07:37
DeepSeek V4 Pro vs Grok 4.6 到底谁更厉害? @grok
Artificial Analysis 最新结果里,Grok 4.6 High 的 Intelligence Index 是 61,DeepSeek V4 Pro 0813 Max 是 53。
单看综合智力,Grok 4.6 明显领先,而且已经和 GPT-5.6 Sol Max 处在同一档。
Grok 自己公布的 GDPVal-AA v2 达到 1753,甚至超过 GPT-5.6 Sol 的 1728 和 Fable 5 的 1741,知识工作、复杂推理和综合任务确实很强。
但到了 Agent 和真实干活场景,DeepSeek 就开始变得很恐怖。
DeepSWE 上,Grok 4.6 是 65.9%,DeepSeek V4 Pro 是 62.7%,已经非常接近。
DeepSeek 在 Terminal Bench 2.1 做到 87.9,Fable 5 是 88.0,CyberGym 83.3,Toolathlon-Verified 74.1。
这一代 V4 Pro 很明显不是单纯追求考试更聪明,而是在疯狂补工具调用、终端操作、代码 Agent 和长任务执行能力。
然后看价格,差距一下就拉开了,下巴直接惊掉了😲😲
DeepSeek V4 Pro API 每百万 Token 输入 $0.435、输出 $0.87,上下文 100 万。
Grok 4.6 是输入 $2、输出 $6,上下文 50 万。
Artificial Analysis 跑完整套 Intelligence Index,Grok 4.6 花了 $1,068.47,DeepSeek V4 Pro 只花了 $135.03,前者接近后者的 8 倍。
更离谱的是,DeepSeek 实测输出速度约 83 tokens/s,Grok 约 66 tokens/s。
所以这次我反而觉得,DeepSeek 和 Grok 谁更强已经不是最有价值的问题了。
如果你追求目前最强的综合能力、知识工作、多模态和能力上限,Grok 4.6 更强。
但如果你准备每天让几百、几千个 Agent 去写代码、跑终端、调工具、处理重复任务,DeepSeek V4 Pro 的经济性太夸张了。(比特币橙子Trader)
分享至:
热门快讯
APP下载
X
Telegram
复制链接