这几天 Anthropic、OpenAI 分别发布了 Fable 5.1 和 GPT-6 Astra,但前者很快没了存在感,Astra 则持续刷屏、热度不减。有观点认为,Fable 5.1 不仅价格贵,而且处处设限,搞得客户不满;Astra 可能在编码性能上略逊一筹,但综合能力优秀,Token 效率更高,综合成本反而下降,在各领域的应用也更广泛,网友正积极探索用它改变现有工作方式。
梁文锋:不搞视频与世界模型,专注 LLM 才是主线
Astra 的这波爆发也引来日本 JAIST 大学客座教授今井翔太的感慨,而他切入的角度很有意思——提到了 DeepSeek 创始人梁文锋前几个月流出的内部演讲中的一个表态。
DeepSeek 此前对多模态的支持不太完善,这与梁文锋的观点有关。他认为视频生成 AI、世界模型或物理模型都不是 AGI 的主线,现在需要专注 LLM 大模型发展,之后再用大模型来解决其他问题。今井翔太认为,看到 Astra 展现出的全能力之后,梁文锋这番表态的说服力越来越强。
按梁文锋的说法,DeepSeek 真正的核心目标就是 AGI,其他的事顺手就能完成——站在更高的技术目标上再去做下一层的技术应用,很多时候就是降维打击。他同时表示,DeepSeek 不会把主要精力投入上述 AI 方向,这不是说这些领域没有价值,而是它们并非限制 AGI 的关键瓶颈。
OpenAI 战略调整见效,国产大模型需看下一代
OpenAI 此前因为 Anthropic 及中国开源大模型的竞争调整过战略,放弃视频生成模型、专注 AI 核心能力,包括编码等方向。这番改革现在看来相当成功,GPT-5.5 及如今的 GPT-6 发布后,OpenAI 已回归巅峰。此次 Astra 发布,OpenAI 自信表态要开启 AGI 时代,英伟达 CEO 黄仁勋也表示赞同,还不忘提到自家 GPU 在训练 Astra 中的作用,称现在只用了 10 万张显卡,下一次将是 40 万张。
文章也指出,虽然美国公司动辄用“实现了 AGI”来营销很无聊,但 Astra 展示出的能力确实更上一层楼;同时也要承认国产 AI 大模型被拉开了距离,尤其在算力资源本就存在鸿沟的情况下。美国公司的旗舰大模型已出了一轮,国产大模型后续要看 Kimi 3.1、GLM-5.5、MiniMax M3 Pro、Qwen4 以及 DeepSeek V4.1 了。