云头条 12小时前
国内大模型来了新玩家:清华系 Naive AI
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

2026 年 9 月 18 日,《The Information》报道,清华大学副教授代季峰今年 2 月创办的 Naive AI,已经连续完成三轮融资,累计融资 4 亿美元,最新一轮融资后的估值达到 14.2 亿美元。

腾讯、IDG Capital、MPCi 和 HSG(原红杉中国)均已入股。

Naive AI 的三轮融资分别为 1 亿美元、1.8 亿美元和 1.2 亿美元。

目前,Naive AI 团队不足 100 人,但首款大语言模型已经接近发布。

这款同样名为 Naive 的模型最早可能在 9 月推出,并采用开放权重方式发布,用户可以免费下载权重并进行二次开发。

过去半年,Naive AI 一直保持低调。

其官网至今只有一句 "100x Intelligence for the pioneers",没有产品、团队或技术路线介绍。

与从头训练一个基础模型不同,Naive AI 没有重新进行成本高昂的大规模预训练,而是选择一款已经存在的中国开放权重大模型作为基础,在此之上继续开发。

目前尚不清楚其具体使用了哪款模型。

Naive AI 会调整预训练模型的结构,再通过强化学习等方法继续训练,以提升模型在不同任务上的表现。

Naive AI 并没有试图重新复制一遍从数据、预训练到基础模型的完整路线,而是将更多资源集中在模型已经完成预训练之后的阶段。

代季峰押注的是中期训练和后训练。

目前中国的大模型市场已经形成较为稳定的竞争格局,DeepSeek、月之暗面、智谱以及阿里等团队拥有成熟的基础模型。

Naive AI 判断,即使基础模型本身来自其他团队,后续的模型结构调整、中期训练、强化学习和后训练仍然存在很大的性能提升空间。

Naive AI 同时在研究递归式自我改进,也就是让 AI 模型参与自身能力升级。

这一方向目前也是 OpenAI、Anthropic、Google、智谱等前沿 AI 实验室重点研究的领域。

这种路线在新一批 AI 创业公司中并非孤例。

Mira Murati 创办的 Thinking Machines Lab 今年 7 月发布首款大语言模型 Inkling 时表示,其模型架构设计很大程度上沿用了 DeepSeek 2024 年底发布的 V3 开放权重模型。

《The Information》还提到,被 SpaceX 收购后的 Cursor 在开发自有编程模型时,使用了智谱的模型。

基础模型逐渐开放后,一些新成立的 AI 实验室开始选择另一条路线,不再投入巨额资金重复进行底层预训练,而是在成熟的开放权重模型之上继续训练和改造,集中资源解决推理、Agent、强化学习以及特定任务能力。

Naive AI 的核心筹码则是代季峰本人。

代季峰,清华大学电子工程系副教授。2009 年和 2014 年于清华大学自动化系分别获得工学学士和博士学位,博士导师周杰教授。

2014 年至 2019 年在微软亚洲研究院视觉组工作,担任首席研究员、研究经理。

2019 年至 2022 年在商汤科技研究院工作,担任执行研究总监。

2022 年 7 月全职加入清华大学电子工程系。他的研究聚焦于智能体(Agentic AI)与持续学习(Continual Learning),以通用人工智能为目标探索前沿技术。

代季峰此前主导开发过 InternVL。该开放权重多模态模型曾在学术研究和开源社区获得广泛使用。

2025 年,代季峰加入盛大旗下 AI 创业团队 MiroMind,并参与 MiroThinker 的研发。

MiroThinker 是一款面向复杂任务的开源 AI Agent,可以执行多步骤网络研究、金融分析等任务,在开发者和开源社区中获得过较多关注。

今年 1 月,代季峰离开 MiroMind。离职原因涉及团队发展方向分歧,MiroMind 的其他联合创始人希望将团队迁往中国以外地区。

一个月后,代季峰创办 Naive AI。

对于 Naive AI 来说,真正的第一次检验很快就会到来。

云头条声明:如以上内容有误或侵犯到你公司、机构、单位或个人权益,请联系我们说明理由,我们会配合,无条件删除处理。

智客推

智客推

ZAKER 智客推 GEO | AI 时代的品牌认知解决方案

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

腾讯 红杉 融资 the 元和
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论