DeepSeek V4 Pro发布,价格不到Fable的2% | 撞车Grok 4.6 | Qwen
外来客 • 2026-08-13 11:03:11
声明:本文为对公开视频内容的摘要整理,
未经本站独立核实,可能与原视频存在出入,不代表本站立场、观点或建议;
观点与版权归原作者及原平台所有。
如涉及版权问题,请联系我们,核实后立即删除。
[ 免责声明 ]
📢 核心观点
AI行业近期迎来密集更新,DeepSeek V4 Pro、Grok 4.6与阿里千问3.8 MAX相继发布或开放权重。三大模型在长上下文、智能体自主能力及性价比上展开激烈竞争,标志着前沿AI能力正以更低成本普及,多步骤长周期自主工作成为新焦点。
📊 关键事实/论据
- DeepSeek V4 Pro:MoE架构,总参数1.6万亿,激活490亿,上下文窗口100万Token。API定价极具竞争力(输入$0.435/M tokens,输出$0.87/M tokens)。在CyberDream、Automation Bench等评测中表现优异,软件工程智能体得分从预览版12.8分暴涨至62.7分。思维链呈现极度精简风格,虽节省Token但可能影响写作能力。
- Grok 4.6:马斯克发布的新旗舰,主打低成本高性能。在GPVALAVR、AA Briefcase及HarveyLab等评测中超越GPT-5.6和Claude Opus 4.8。实测显示其完成特定任务成本高于DeepSeek V4 Pro(如Flappy Bird开发成本$0.03 vs $0.019),但在部分综合智能指数上领先。
- 阿里千问3.8 MAX:开放2.4万亿参数模型权重,激活95B,支持扩展至100万Token上下文。在Paperbench(93.0分)和OS World Verified(86.1分)中位居前列。具备长周期自主工作能力,曾连续自主编程16天复现论文并改进。国内API定价为输入12元/M tokens,输出36元/M tokens。
🏁 结论
DeepSeek V4 Pro、Grok 4.6与千问3.8 MAX在性能上已处于同一梯队,难分伯仲。行业趋势显示,模型正从单一任务处理转向独立承接完整项目与自主闭环的智能体应用。随着算力成本优化和架构创新(如注意力变体),AI能力天花板被不断击穿,“强大且实惠”成为现实。未来竞争将聚焦于更复杂的长周期任务及生态落地,Grok 4.7等后续版本即将加入战局。
同一博主
AI的下一个护城河不是模型 | 彼得·路德维希 | 物理AI | 具身智能 | 自动驾驶 | 工程系
AI要学会像人一样犯错 | Simile 朴俊成 | 人类行为模拟 | AI替身 | 数字双胞胎 |
AI算力不仅没过剩,还更加稀缺 | Gavin Baker | GPU | Blackwell |
FCC盯上中国光模块?| 光通信 | AI算力 | 光互连 | CPO | 1.6T光模块 | In
李飞飞的机器人新赌注 | World Labs | SceniX | 空间智能 | 机器人仿真 |
🧭 类似博主
-
《人民的珍藏》第三季 寸图倾心筑通衢:两年磨一剑!重庆东站高铁站设计画稿惊艳亮相 中铁二院建筑师的匠
-
8月12日日全食
-
腾讯阿里字节集体转向:Chat时代终结,办公Agent大战爆发 - IC实验室出品
-
唐獎得主蘇珊.索羅門,找到地球問題也找到修復地球的可能!
-
Cerebras CEO Andrew Feldman:“AI革命才刚刚开始
-
中國國產C919成功執飛國際商業航線 乘客分享首航體驗
-
【油管答疑】“如果我主动关闭广告,观众就更喜欢看,因此就会得到油管更多的推荐。” 这个说法是真的吗?
-
LTX 2.5 全流程指南:ComfyUI 原生工作流实操与三大翻车痛点攻克
-
从DeepSeek、Kimi到“黄仁勋联盟”:AI模型开源,到底“开”了什么?
-
iOS 27全新相机应用:你需要了解的一切
0 条评论
发表评论
请先 登录 后参与讨论。