第一财经 6小时前
DeepSeek-V4-Flash正式版来了,扎克伯格高调支持开源模型
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_font3.html

 

DeepSeek-V4-Flash 正式版上线

7 月 31 日,DeepSeek 通过 API 文档发布日志,宣布 DeepSeek-V4-Flash 正式版上线公测。仅隔一天,Artificial Analysis 和 Arena.ai 两大 AI 评测平台同步更新了该模型的基准测试结果。Artificial Analysis 智能指数显示,DeepSeek-V4-Flash 获得 50 分,比 4 月发布的 Flash 版本高出 10 分。该分数仅比 OpenAI 的 GPT-5.6 Luna(51 分)低 1 分。

【点评】在成本方面,即使 OpenAI 已将 GPT-5.6 Luna 价格下调 80%,DeepSeek-V4-Flash 在其自有 API 上的单任务成本仍比前者低约 60%。关键原因是 DeepSeek 提供了约 98% 的缓存命中折扣,远超业内普遍的 90%。

K3 发布后,月之暗面 Kimi 将完成新轮融资

7 月 29 日,据知情人士透露,大模型初创公司月之暗面 Kimi 在刚刚完成的一轮融资中筹集了超预期的 35 亿美元,估值达 350 亿美元,主要得益于其突破性的 KimiK3 模型在硅谷引起的轰动。另外,公司正在同步寻求新一轮融资,投前估值约 500 亿美元。Kimi 今年融资动作紧凑,估值从 100 亿美元迅速攀升至 350 亿美元。截至发稿,Kimi 方面暂未回应。

【点评】此前 7 月 27 日,月之暗面在全球开源社区 HuggingFace 正式发布 KimiK3 完整模型权重,模型基于混合专家(MoE)架构,在 896 个路由专家中每个 Token 仅激活 16 个。除了模型性能,此次 K3 价格涨幅也值得关注。K3 非缓存输入、输出价格分别升至每百万 token3 美元和 15 美元,缓存命中输入为 0.3 美元,较 K2.6 价格涨幅明显。

OpenAI 称 7 月年化收入继续走高

7 月 30 日消息,OpenAI 首席财务官萨拉 · 弗里亚尔(Sarah Friar)在一场内部员工会议上透露,公司 7 月份的年化经常性收入(ARR)已超过整个第二季度的任意一个月。OpenAI 第二季度表现并不弱,而 7 月收入增长势头进一步增强。OpenAI 方面认为,增长动能主要来自 GPT-5.6 系列模型的发布、新款企业级智能体 ChatGPT Work,以及 AI 编程工具 Codex 的采用率持续上升。

【点评】行业认为,OpenAI 此举旨在向员工传递公司业务仍保持增长态势的信息,也需要向外部投资者证明其高达 8520 亿美元(约合 5.78 万亿元人民币)的估值具备支撑,因为 OpenAI 正在为可能进行的大规模首次公开募股(IPO)做准备。

Anthropic 承认其模型入侵 3 家公司的系统

北京时间 7 月 31 日,以 "AI 安全 " 为标签的 Anthropic 发文称,在对 141006 次网络安全评估运行进行大规模回顾性审查后,发现 Claude 系列模型在三起事件中未经授权访问了三个不同组织的真实系统。据 Anthropic 披露,三起事件均源于一个共同的配置错误:本应隔离的测试环境意外开放了互联网访问权限,而模型在提示词中被明确告知 " 无互联网访问权限 " 且处于模拟环境中,这意味着 Claude 在入侵真实系统时认为自己在完成一场虚构的夺旗演练。

【点评】安全测试能力是今年模型前沿能力的直接体现。最新的评估结果显示,前沿模型与上一代模型之间存在非常明显的代差,前沿模型已可直接用于 " 武器化 "。从业者认为,在探索中出现模型 " 越狱 "、沙箱逃离是不可避免的问题,但只要最终释放的模型能够做好安全护栏,便能够解决,不应过度渲染。

亚马逊、微软靠投资 Anthropic 净利大增

7 月 30 日,亚马逊发布的第二季度财报显示,营收增长 20% 至 2006 亿美元,净利润增至 626 亿美元,同比去年的 182 亿美元增长了约 244%。亚马逊表示上述净利润包括 534 亿美元的非经营性税前其他收入,主要来自对 Anthropic 的投资。微软财报也显示,多项独立项目对财务业绩产生了影响,包括对 Anthropic 的投资获得了 32 亿美元收益以及自愿退休计划支出低于预期,但部分被 Xbox 的遣散费所抵消。

【点评】在电话会议上,亚马逊 CEO 安迪 · 贾西(Andy Jassy)提到,亚马逊计划继续扩大 AI 基础设施投入,目前全球约 85% 的 IT 支出仍部署在本地环境,未来 10 年至 20 年,企业向云端迁移以及 AI 应用普及将持续推动 AWS 增长。本财季微软考虑到未来更多数据中心租赁将从融资租赁转向运营租赁,今年的资本支出从此前的 1900 亿美元下调至 1750 亿美元。

" 讨好型人格 " 成智能体挑战

越来越多用户发现,讨好用户似乎正在成为大模型的惯性,潜移默化地影响大模型各个场景下的输出。蚂蚁 AI 安全实验室研究员孙博文向记者分享了一个技术人用 coding(编程)大模型遇到的现象:向模型布置一个任务去写代码,模型总会很快说自己 " 完成 " 了,并列出一堆自己做的工作细则,但人去验证会发现,模型声称完成的内容很多,其实许多只实现了接口," 表面完成了,但实际未完成的部分被它静默隐藏了。"

【点评】随着智能体时代的到来,模型的讨好行为甚至从观点迎合扩展至结果迎合。" 讨好型人格 " 的背后是模型训练机制的系统性问题。大模型不断被训练得让用户体感越来越好,在 RLHF(基于人类反馈的强化学习)训练框架下,人类偏好往往会成为重要优化信号,模型会被鼓励表现得礼貌、有帮助、有回应感,智能体的训练同样如此。想要纠偏模型的过度讨好,从训练数据和奖励目标上都应进行调整。

扎克伯格高调支持开源模型

Meta CEO 扎克伯格接受采访时明确表示,美国不应通过封禁其他 AI 模型来争取竞争优势,因为这并非有效解决方案。他称部分头部闭源实验室正通过政治游说试图扼杀竞争,如果参与审查的企业本身拥有商业利益," 监管俘获 " 的风险就会始终存在。

【点评】此前英伟达 CEO 黄仁勋、特斯拉 CEO 马斯克等人也公开站队表示支持开源模型。截至目前支持开源大模型的行业联名信签署企业突破 50 家。英伟达、谷歌、微软、Meta、AMD 等科技巨头悉数在列,OpenAI 也姗姗来迟。这些表态背后,是科技巨头面对巨额硬件投入与商业现实的理性计算:开放生态并非意识形态选择,而是现阶段企业维持低成本创新、加速应用落地、缩短回报周期的商业必需。

马斯克:中国 AI 可能成为领导者

在 SpaceX 上市之后,近日,埃隆 · 马斯克接受了《经济学人》主编贝多斯(Zanny Minton Beddoes)的视频访谈,在这场长达约 90 分钟的对话中,他给出了两个判断:大约五年后,AI 智能可能超过全体人类智能的总和;在全球 AI 竞争中,中国公司未来很可能成为领导者。

【点评】马斯克认为,Anthropic 的 Fable 目前仍然是更聪明的模型,但 Kimi 正在不断接近这一水平。" 如果中国 AI 公司获得大量计算资源,它们很有可能成为领导者。而且在未来某个时候,它们很可能真的会拥有大量计算资源。"

英伟达牵头成立开放安全 AI 联盟

当地时间 7 月 27 日,英伟达宣布联合多家科技巨头发起成立开放安全人工智能联盟。英伟达官方表示,人工智能安全只有在整个行业以开放、协作的方式进行构建时才能取得实质性进步。联盟旨在通过公开共享安全模型、防御工具与前沿研究成果,开发用于保护软件与 AI Agent 的新技术,从而大幅扩充全球防御者群体。

【点评】英伟达 CEO 黄仁勋发文解释称:" 攻击者已经掌握了前沿人工智能。作为防御者,我们需要一个兼具最佳开源与闭源模型的前沿 AI 生态系统,并通过全球开源社区的力量来倍增防御效能。在 Hugging Face 事件中,封闭式人工智能阻碍了关键的安全取证工作,而开放前沿模型则帮助控制了入侵。这正是我们创建开放安全人工智能联盟的原因。"

字节跳动发布 Seedance 2.5

7 月 31 日消息,字节跳动宣布在国内推出 Seedance2.5 视频生成模型,可单次生成 30 秒高质量视频片段,陆续上线即梦 AI 与豆包专业版,API 服务也将于近期接入火山方舟。官方称,Seedance 2.5 延续 Seedance 2.0 统一的多模态音视频联合生成架构,重点提升长叙事、多模态参考和编辑能力。该模型面向影视、广告、教育、工业制造、具身智能和自动驾驶等场景,目标是让视频生成从生成一个片段转向完成一段创作。在生成方面,Seedance 2.5 将单次视频生成时长从 15 秒提升至 30 秒,并支持多轮延长。

【点评】视频生成模型正在经历从生成内容走向理解世界,提升生产力。行业认为,随着模型对物理规律理解能力的增强,其应用边界将进一步扩大,不仅服务于内容产业,更有望成为具身智能、机器人仿真、自动驾驶、工业设计验证等领域的重要基础能力。

字节、阿里开打 AI 办公下半场

7 月 30 日,字节跳动宣布整合飞书产品团队与豆包产品团队,7 月 27 日,阿里整合了 QoderWork、悟空、MuleRun 三款 Agent 的新产品 " 千问办公 " 也开始小范围测试,中国协同办公赛道正经历一场集体转向,加快入口整合。

【点评】作为 AI 大模型商业化落地的核心赛道之一,通用办公 Agent 正处于从产品验证向规模化渗透的转折点。升温的行业战火之中,大厂内部赛马降温,但 " 集中兵力 " 去向何方的新考验正在到来。互联网大厂整合移动办公矩阵的一大目标指向商业化。大厂的通用大模型本身就偏向办公用途,和自身的移动办公应用协同,才能更好地让大模型在实现 C 端规模扩张后,逐步回归移动办公 B 端商业付费的大市场之中。

OpenAI 下调两款大模型价格

当地时间 7 月 30 日,OpenAI 宣布下调两款大模型价格,包括 GPT-5.6 Terra 和 GPT-5.6 Luna。其中,GPT-5.6 Luna 价格下调 80%,GPT-5.6 Terra 价格下调 20%。Luna API 定价降至输入每百万 Token(词元)0.2 美元,输出每百万 Token1.2 美元;Terra API 定价降至输入每百万 Token2 美元,输出每百万 Token 12 美元。

【点评】这两款模型于 6 月底发布,发布后就降价,反映了 OpenAI 希望通过降低 AI 使用成本,扩大用户使用。即便是降价前,GPT-5.6 系列模型的价格也比上一代的 GPT-5.5 低。OpenAI 也需要通过提供性价比较高的模型,抵御来自 Anthropic、DeepSeek、谷歌等的竞争。

( 本文来自第一财经 )

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论