快科技 9 月 7 日消息,这几天 Anthropic、OpenAI 分别发布了 Fable 5.1 及 GPT-6 Astra 大模型,但前者很快没了存在感,Astra 则持续刷屏,热度不减。
A 家发布 Fable 5.1 不仅价格贵,而且处处搞限制,搞得客户都不满了,Astra 可能在编码性能上略逊一筹,但综合能力优秀,而且 Token 效率更高,综合成本反而下降了,在各个领域的使用更广泛,网友都在积极探索用 Astra 改变目前的工作方式。
Astra 的这波爆发也让日本 JAIST 大学的客座教授金晶翔太发了感慨,但他谈的一个角度很有意思,提到了 DeepSeek 创始人梁文锋前几个月流出来的内部演讲中的一个表态。
DeepSeek 之前对多模态的支持不太完善,这跟梁文锋的观点也有关,他认为视频生成 AI、世界模型或者物理模型都不是 AGI 的主线,现在需要专注 LLM 大模型发展,之后会用大模型来解决其他问题。
今井翔太认为,现在看到 Astra 大模型的全能力之后,梁文锋此番表态的说服力越来越强了。

梁文锋对 AGI 的态度也是如此,他表示 DeepSeek 不会把主要精力投入前面提到的 AI 方向上,这也不是说这些领域没有价值,而是认为这些不是限制 AGI 的关键瓶颈。
梁文锋的意思是,DeepSeek 真正的核心目标就是 AGI,其他的事顺手就能完成,站在更高的技术目标上再去做下一层的技术应用,很多时候就是降维打击。
OpenAI 之前因为 Anthropic 及中国开源大模型的竞争也调整过战略,放弃了视频生成模型,专注 AI 核心能力,包括编码之类的,他们这番改革现在来看是很成功的,在 GPT-5.5 及现在的 GPT-6 大模型发布之后回归巅峰了。
这次 Astra 大模型的发布,OpenAI 也自信表态要开启 AGI 时代了,NVIDIA CEO 黄仁勋也表示了赞同,顺带着夸了自家的 GPU 显卡在训练 Astra 上的作用,还表示现在只用了 10 万张显卡,下一次就是 40 万张显卡训练大模型了。
虽然美国公司张嘴闭嘴就用实现了 AGI 来营销很无聊,但 Astra 这波展示出来的能力确实更上一层楼了,也要承认国产 AI 大模型又被拉开了距离,特别是算力资源上两边本身就存在鸿沟的情况下。
美国公司的旗舰大模型已经出了一轮了,国产大模型后续要看 Kimi 3.1、GLM-5.5、MimiMax M3 Pro、Qwen4 以及 DeepSeek V4.1 了,希望能有惊喜等着大家吧。



登录后才可以发布评论哦
打开小程序可以发布评论哦