博主头像

DeepSeek V4 Pro发布,价格不到Fable的2% | 撞车Grok 4.6 | Qwen

外来客 • 2026-08-13 11:03:11

分享
𝕏 f
声明:本文为对公开视频内容的摘要整理, 未经本站独立核实,可能与原视频存在出入,不代表本站立场、观点或建议; 观点与版权归原作者及原平台所有。 如涉及版权问题,请联系我们,核实后立即删除。 [ 免责声明 ]

📢 核心观点

AI行业近期迎来密集更新,DeepSeek V4 Pro、Grok 4.6与阿里千问3.8 MAX相继发布或开放权重。三大模型在长上下文、智能体自主能力及性价比上展开激烈竞争,标志着前沿AI能力正以更低成本普及,多步骤长周期自主工作成为新焦点。

📊 关键事实/论据

  • DeepSeek V4 Pro:MoE架构,总参数1.6万亿,激活490亿,上下文窗口100万Token。API定价极具竞争力(输入$0.435/M tokens,输出$0.87/M tokens)。在CyberDream、Automation Bench等评测中表现优异,软件工程智能体得分从预览版12.8分暴涨至62.7分。思维链呈现极度精简风格,虽节省Token但可能影响写作能力。
  • Grok 4.6:马斯克发布的新旗舰,主打低成本高性能。在GPVALAVR、AA Briefcase及HarveyLab等评测中超越GPT-5.6和Claude Opus 4.8。实测显示其完成特定任务成本高于DeepSeek V4 Pro(如Flappy Bird开发成本$0.03 vs $0.019),但在部分综合智能指数上领先。
  • 阿里千问3.8 MAX:开放2.4万亿参数模型权重,激活95B,支持扩展至100万Token上下文。在Paperbench(93.0分)和OS World Verified(86.1分)中位居前列。具备长周期自主工作能力,曾连续自主编程16天复现论文并改进。国内API定价为输入12元/M tokens,输出36元/M tokens。

🏁 结论

DeepSeek V4 Pro、Grok 4.6与千问3.8 MAX在性能上已处于同一梯队,难分伯仲。行业趋势显示,模型正从单一任务处理转向独立承接完整项目与自主闭环的智能体应用。随着算力成本优化和架构创新(如注意力变体),AI能力天花板被不断击穿,“强大且实惠”成为现实。未来竞争将聚焦于更复杂的长周期任务及生态落地,Grok 4.7等后续版本即将加入战局。

0 条评论

发表评论

请先 登录 后参与讨论。