邬话不说 4小时前
降价75%追平Opus-4.8,DeepSeek开源掀桌:AI效率战谁主沉浮
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

# 谈谈 # 开篇:当免费模型追上了收费旗舰

一个305B 参数的大模型,每次推理只激活13B,还能在 ZeroBench 上以35.0 分反超闭源旗舰 Opus-4.8 的34.0 分——关键是,它免费。

9 月 1 日,DeepSeek 在 Hugging Face 开放 V4 家族首款多模态模型 Vision-Exp 的权重,MIT 协议,商用不要钱,连推理代码都打包给你。同一天,谷歌被曝最早周三发布 Gemini 3.8 Flash,节奏快到自家工程师都喘不过气—— Gemini 3.7 Flash 8 月 13 日才发布,距今不过三周。

一边是中国团队开源掀桌,一边是硅谷巨头加速追赶。你会发现,2026 年 AI 行业的主线已经从 " 谁的参数更大 " 变成了 " 谁的成本更低 "。说句大白话:大模型不比谁肌肉大了,比谁能用更少的力气打出同样的拳。

这篇文章不聊虚的,就聊一件事——当 AI 推理成本跌破地板,你我普通人、职场打工人、创业者,到底该怎么接住这波红利。

事件拆解:这一周,AI 行业到底发生了什么

先把时间线理清楚。

8 月 21 日,DeepSeek 通过 API 上线 V4-Flash-Vision-Exp,当时更像一次能力预告。8 月 31 日,权重和推理代码直接开放到 Hugging Face,开发者可以下载、部署、魔改,商用零门槛。模型总参数305B,每 token 激活13B,MoE 架构,支持 JPEG、PNG、GIF、WebP 四种图片格式输入。开源内容覆盖视觉编码器、Aligner、DFlash Attention、MoE、Hyper-Connections 与 DSpark 全套核心模块,相当于不只给你一条鱼,连渔网和钓鱼方法一起打包了。

跑分方面确实能打。ZeroBench 35.0 分反超 Opus-4.8 的34.0 分;Terminal Bench 2.1 拿到83.9 分;DeepSWE 从 54.4 涨到59.3 分;Chartography 图表理解64.3 分。翻译成人话:它能看图、能写代码、能跑 Agent,一个模型干仨活儿,还不收钱。

但 DeepSeek 不是一个人在战斗。8 月 26 日到 9 月 1 日这一周,至少五款重量级 Flash 模型集中落地,价格战直接打穿地板。有意思的是,海外独立评测社区 Artificial Analysis 画了一张性能 - 价格对比图,DeepSeek V4 Flash 成了一道醒目的 "斩杀线" ——在它的价格之下,性能比它差、价格还比它贵的模型,都不用看了。

然后智谱用更低的价格拿到更高分,把 DeepSeek 的斩杀线给斩了。这场面,说白了就是国产大模型在自己跟自己卷。

具体看四家定价:DeepSeek V4 Flash 峰谷定价,高峰输入3.0 元/ 百万 tokens、输出9.0 元,闲时半价;智谱 GLM-5.3-Flash 输入0.8 元/ 输出2.7 元,Artificial Analysis 智能指数57 分,限时 5 折后低至输入 0.4 元;阿里 Qwen3.8-Flash 缓存命中价低至0.1 元/ 百万 tokens;腾讯 Hy4 preview 总参数770B、激活 49B、100 万 token 上下文,Apache-2.0 协议开源。

与此同时谷歌也坐不住了。财联社 9 月 2 日报道,谷歌最早将于周三发布Gemini 3.8 Flash,内部代号 "skimaki",已在 Jetski 编码平台完成测试。谷歌 CEO Sundar Pichai 甚至放话,目标是每月一个新模型。这节奏,坦白讲,有点疯。

我的判断:这一周不是偶然,是行业拐点信号。当开源 MIT 遇上峰谷定价遇上 Flash 架构,大模型的商业模式正在被重构——不是修修补补,是推倒重来。

行业趋势:从 " 卷参数 " 到 " 卷效率 ",Flash 凭什么突然成了主角

上半年还比谁更大,下半年全在比谁更省

上半年,大模型行业的叙事还停留在比拼更多数据、更多参数、更多算力。到了下半年,DeepSeek、智谱、阿里、腾讯集体转身,把赌注压在 " 效率 " 两个字上。

变化来得很快。7 月 21 日,Google 一口气端出三款 Flash 模型,但旗舰 Gemini 3.5 Pro 缺席。十天后,DeepSeek V4 Flash 正式版上线并开源。8 月 26 日到 28 日三天,Flash 成了主战场——智谱认领匿名刷屏的 GLM-5.3-Flash,阿里连夜放出 Qwen3.8-Flash,9 月 1 日腾讯发布 Hy4 preview 的轻量版。

为什么 Flash 突然火了?两个原因撑着。

第一,Agent 规模化需要 Flash。AI Agent 不是聊一次天就完事,一个完整的业务闭环往往需要数十次模型循环调用。全部交给旗舰模型处理,成本随调用轮次成倍膨胀。Agent 的大量工作集中在意图路由、信息抽取、工具调用,并不需要旗舰模型顶尖的深度推理能力,但对推理延迟、并发承载力、调用成本高度敏感。Flash 就是为这类高频次、大批量场景量身定制的。阿里 Qwen3.8-Flash 发布的同时,千问办公 Agent 产品同步上线,模型与智能体业务的绑定趋势非常直观。

第二,算力瓶颈逼出了效率路线。智谱动用10 万张国产芯片集群支撑 GLM-5.3-Flash 的线上推理,腾讯罕见地公开承认 " 整体算力严重不足 " 拖慢了混元迭代。与其说厂商选择了效率路线,不如说是算力瓶颈让各家不得不去走效率路线。320B 的 GLM-5.3-Flash 每次推理只唤醒 18B,770B 的 Hy4 只激活 49B,同样的卡能服务更多用户、摊薄更多成本。

这就像开车——以前比谁的发动机排量大,现在比谁的油耗低、续航长。赛道变了,玩法也变了。

MoE 架构拆解:" 大总参、小激活 " 的秘密

Flash 能又便宜又强,核心在于 MoE(Mixture of Experts,混合专家)架构。

打个比方,传统大模型像一个 " 全科医生 ",不管你问什么,整个大脑都参与运算。MoE 更像一家 " 专科医院 ",模型保留庞大的总参规模作为完整知识底座,但每一轮推理只激活一小部分 " 专家 " 参与运算。

看看各家数据:DeepSeek V4 Flash 284B总参,每次只唤醒13B;GLM-5.3-Flash 320B,激活18B;Qwen3.8-Flash 125B,每个 token 只唤醒6B;腾讯 Hy4 770B,激活49B

你会发现一个规律:激活比例都在 5%-6% 左右。这不是巧合,是 MoE 稀疏路由机制的工程极限。保留大参数量保证知识广度,同时用极低的激活率控制推理成本,这就是 " 大总参、小激活 " 的精髓。

值得注意的是,DeepSeek 这次开源的不只是模型权重,还有视觉编码器、Aligner、DFlash Attention、Hyper-Connections 和 DSpark 等核心模块的参考实现。社区已经有 SGLang 在跟进,DGX Spark 版本也在路上。对于小团队和开发者来说,MIT 协议意味着零门槛商用——电商自动识别商品图生成详情页、教育 App 拍题讲解、医疗影像辅助等场景,之前被 API 成本劝退的,现在可以真正落地了。

我的判断:MoE" 大总参、小激活 " 已经成为行业共识的基础架构。当各家 Flash 的权重几乎全部开源,架构不再是秘密,真正难复制的只剩两样——算力规模数据管线

中美路线分叉:开源 MIT vs 闭源 API

把中国和美国的大模型路线放一起看,分化越来越明显。

中国这边,DeepSeek 用 MIT 协议开源,最宽松的许可证之一,允许商用、修改、再分发,无需支付版权费。智谱用 10 万张国产芯片训练,阿里在多模态语料配比上押注,腾讯 770B 模型 Apache-2.0 开源。路线清晰:开源、低价、端侧部署、Agent 绑定。

美国这边,谷歌 Gemini 3.8 Flash 即将发布但仍是闭源 API 模式,定价 0.75/ 百万输入 tokens、0.75/ 百万输入 tokens、3.75/ 百万输出 tokens。OpenAI 的 Opus-4.8 同样闭源。路线也清晰:闭源、API 计费、云端调用、生态锁定。

坦白讲,两条路各有各的道理。中国走开源,有政策东风在推,也有 " 农村包围城市 " 的产业策略——先用低价和开源抢占开发者生态,再用 Agent 和端侧场景赚钱。美国走闭源,有先发优势和资本壁垒,顶级模型训练成本动辄数亿美元,不靠 API 收费回不了本。

但有一个数据值得玩味:DeepSeek V4 Flash Vision 在 ZeroBench 上35.0 分反超 Opus-4.8 的34.0 分。一个开源免费模型,在特定维度上打平甚至超过闭源旗舰。这件事放在两年前,几乎不可想象。

趋势很清楚:开源和闭源的能力差距在快速缩小,但商业模式却越拉越大。开源派靠规模和场景赚钱,闭源派靠技术和生态收租。终局谁赢,不取决于谁的模型更强,取决于谁先跑通 Agent 的规模化闭环——每一次 Agent 调用都是真实使用数据回流,回流进训练,模型更强,便有更多 Agent 接入。谁先转起来这个飞轮,谁就拿到最深的护城河。

政策加持:75% 国产芯片强制令和 1.3 万亿投入

技术变革背后,政策这股风刮得比技术还猛。

七部委(工信部、发改委、科技部、财政部、央行、国资委、市场监管总局)联合印发的《2026-2028 硬科技协同发展方案》,自 2026 年 9 月起,新建智算中心国产算力硬件采购占比强制不低于75%。其中财政 / 国债全额出资项目,AI 加速卡国产占比不低于80%,不达标不予立项、不发放补贴、不审批算力国债额度。央企自建算力集群,国产芯片底线不低于70%

全国一体化算力网三年投入超1.3 万亿元,直接锁定上游硬件厂商未来三年稳定订单。企业采购国产 AI 服务器、光交换、DRAM 存储芯片等,最高可申领30% 比例的财政补贴。研发费用 200% 加计扣除延长至 2028 年底,特色工艺和车规芯片企业享受 15% 优惠所得税率。

简单算笔账:一个企业花 1 亿采购国产 AI 服务器,最高拿回 3000 万补贴,再叠加 200% 研发费用加计扣除的税收优惠,实际成本可能砍到五六千万。这力度,不亚于当年新能源车补贴。

与此配套,工信部印发人工智能应用服务商培育专项行动通知,目标到 2026 年底全国服务商资源池内服务商数量突破2000 家,支持服务商与国家算力网络枢纽节点对接,用好 " 算力券 " 降低算力成本。科技日报 8 月 28 日报道,腾讯混元 Hy4 preview 发布并开源时也提到,模型在尺寸、上下文长度、数据规模上均有大幅提升,直接对准软件工程、办公、游戏开发、科研等真实生产力场景。

我的判断是:政策这把火不是在帮某一家公司,是在帮整条国产 AI 产业链烧穿 " 用不起 " 的瓶颈。当算力成本被打下来,当 2000 家服务商铺到每个地级市,AI 落地最后一公里的问题才真正有解。

AI 3D 产业化:从 " 造物 " 到 " 造世界 " 的分水岭

聊完语言大模型,再看一个正在爆发的赛道—— AI 3D。

9 月 1 日,影眸科技发布世界生成模型Hyper3D WorldGen,用户上传一张场景图片,系统自动识别主要物体并生成独立 3D 资产,同时重构物体间的物理关系——谁支撑谁、谁悬挂于谁。同日,3D 大模型公司 VAST 宣布完成约30 亿元B 轮和 B+ 轮融资,不到半年累计融资约50 亿元,创 AI 3D 领域融资纪录。VAST 同步发布旗舰模型 Tripo P2.0,首次实现原生四边面拓扑网格的端到端生成,三角面上限从 2 万提升至5 万

数据更有冲击力。据机构统计,2025 年全球 3D 生成式 AI 模型市场规模约18 亿美元,预计 2032 年达75.9 亿美元。2026 年以来,谷歌开放 Genie 3 体验、World Labs 发布 Marble 1.1、腾讯开源混元 3D 世界模型 2.0、阿里发布世界模型 HappyOyster 1.0、字节跳动推出 Seed3D 2.0,巨头集体入局的信号非常清晰。

商业化落地方面,网易《蛋仔派对》蛋仔工坊已上线由 Tripo 提供技术支持的 3D 模型拆分功能。由苹果、皮克斯成员创立的海外创意平台 Intangible AI 已接入 Tripo。VAST 与黑格科技达成战略合作,实现拓竹、黑格、纵维立方、创想三维、爱乐酷等头部硬件厂商全覆盖。

这事的逻辑跟语言大模型如出一辙:技术从 " 实验室可行 " 走到 " 产线可用 ",竞争点从 " 能否生成一个看起来不错的模型 " 转向 " 能否控制、编辑、拆分、进入工作流并稳定交付 "。影眸 CEO 吴迪说了一句话很到位:"3D 生成的赛道正在收敛,而收敛意味着,最终只有少数真正解决了产业问题的团队能留在牌桌上。"

我的判断:AI 3D 的产业化分水岭已经到了。从更宏观的视角看,3D 生成正在成为 " 空间智能 " 时代的基础设施层。当 AI 竞争从语言智能走向空间智能,3D 生成不再只是提升建模效率的工具,而是连接数字内容、智能系统与物理空间的重要底座。2026 年下半年到 2027 年,游戏、影视、XR、机器人仿真都会被重写一遍。

机会与风险:算力军备、数据飞轮和价格战终局

效率路线表面上是把成本打下来了,背后却有一场更烧钱的军备竞赛。

算力侧,效率模型不是省了算力,是把同样的算力用在更多用户身上。智谱 10 万张国产芯片,腾讯公开说 " 算力严重不足 ",MiniMax 称自己是国内最早建成规模化基础设施的独立大模型公司之一。Flash 是算力紧张时代的最优解,但不是算力自由时代的终点。

数据侧才是真正的护城河。DeepSeek 靠强化学习与蒸馏,把推理能力压进 13B 激活的模型;Qwen 在多模态语料配比上押注;智谱在数据与对齐工程上积累。预训练语料、后训练数据管线、对齐工程,才是各家真正拉开身位的地方。算力用钱能买到,数据不能。

各家都在押注 Agent,每一次 Agent 调用都是真实使用数据回流,回流进训练,模型更强,便有更多 Agent 接入。谁先跑通 Agent 的规模化闭环,谁就同时拿到了算力之外最深的护城河。这也是千问的 Flash 发布就和千问办公 Agent 同步上线、模型与业务绑定如此紧密的原因。

风险也明摆着。价格战把模型压到成本线附近,模型层利润变薄,落到 Agent、端侧与云服务身上的压力变得更重。" 斩杀线 " 每隔几周往下挪一次,每挪一次,能活下来的模型就少一批。我的判断是:按这个节奏,2027 年大模型行业会有一轮残酷洗牌——不是 " 谁更好 " 的洗牌,是 " 谁还能活 " 的洗牌。一时的便宜不是终局,谁能在成本、效率与数据之间跑通飞轮,谁才能划出下一道斩杀线。

影响启示:四个群体,该怎么接住这波红利

讲了这么多趋势,落到每个具体的人身上,该怎么接招?分四类人群说。

普通人:开源模型已经够你用了,别花冤枉钱。 DeepSeek V4 Flash Vision MIT 协议免费商用,支持图片输入、图表理解、Agent 任务。你做电商需要自动识别商品图生成详情页?拍题讲解的教育应用?甚至只想搞个能看图的 AI 助手?以前被 API 成本劝退的场景,现在可以真正落地了。社区已有 SGLang 在跟进,量化版本也会很快出来。不过提醒一句,这是实验版本,正式生产环境用之前先测,别拿它直接上战场。

职场人:学用 Flash 级模型,比追逐旗舰更实际。 你会发现,很多日常工作——写邮件、做表格、分析文档、跑流程——根本不需要旗舰模型。Flash 模型便宜十倍,能力覆盖 80% 的日常场景。真正的职场竞争力不是 " 会用最强的 AI",而是 " 知道什么任务用什么模型、怎么编排 Agent"。这个技能现在学不算早,明年学就晚了。坦白讲,我自己已经在把一些重复性高的任务切给 Flash 模型跑了,一个月省下来的 API 费用够买好几杯咖啡。

创业者:MIT 协议是金矿,但别只盯着模型层。 模型层正在变成基础设施,利润越来越薄。真正的机会在应用层——基于开源模型做垂直场景的 Agent。电商自动识别商品图、教育拍题讲解、医疗影像辅助、法律文书审阅,每一个都是百亿级市场。MIT 协议意味着你可以自由商用、修改、再分发,小团队也能用顶级模型能力做产品。但要清醒:多模态模型最容易踩坑的是图文匹配出错,很多隐藏短板不会写在官宣里,必须放到真实业务场景实测。别看了跑分就上头,先跑通最小 MVP 再说。阿里 Qwen3.8-Flash 发布和千问办公 Agent 同步上线,已经验证了 " 模型 + 场景 " 绑定的打法,这个思路创业者可以直接抄。

企业:降本增效的窗口期已经打开,但别盲目 All-in。 七部委方案给了 30% 补贴和 200% 加计扣除,工信部推 2000 家服务商。如果你们公司有 AI 落地需求,现在是成本最低的入场时机。但也别一口气上所有项目。建议先找一两个高频、低风险的场景试点——比如客服、文档处理、数据分析——跑通闭环再铺开。Flash 模型的 MoE 架构天然适合 Agent 高频调用,同预算下能服务更多用户。DeepSeek V4 Pro 更是直接把价格永久砍了75%,据 The Hindu 报道,这一降价可能迫使全球 AI 厂商跟随压低成本。不过要记住,模型能力是工具,不是战略。工具再好,业务逻辑跑不通也白搭。

结尾:说到底,你准备好换挡了吗

2026 年 9 月第一周,DeepSeek 用305B参数、13B激活、MIT 协议、免费商用这组数字,给 AI 行业划了一道新的起跑线。谷歌加速到每月一发的节奏,智谱用 10 万张国产芯片把价格压到地板,七部委用1.3 万亿和 **75%** 国产化率给产业兜底,AI 3D 用 30 亿融资宣告产业化分水岭。

说白了,AI 效率战争不是某个公司的战斗,是整条产业链在同时换挡。开源和闭源的差距在缩小,但赚钱的路径在分叉。大模型行业正从 " 造出更聪明的大脑 " 走向 " 让大脑用得起、用得广、用得深 "。

说到底,留个问题给大家:当开源模型的能力追平闭源旗舰,当推理成本跌破地板,当政策把国产算力推进到每个机房——你准备好用 AI 重写自己的工作流了吗?还是打算等别人先用明白再跟?

如果觉得有用,点个赞、转给需要的朋友、收藏备用,咱们评论区聊。

#AI # 人工智能 # 大模型 #AIGC # 科技前沿 #DeepSeek 开源 #Flash 大战 # 国产芯片 75% #AI3D # 斩杀线之争

财联社(2026-09-02 05:10):谷歌最早将于周三发布 Gemini 3.8 Flash AI 模型

Tech 星球 / 任雪芸(2026-09-01):DeepSeek、智谱、阿里、腾讯,谁是大模型真正的斩杀线?

观察者网(2026-09-01):DeepSeek-V4 首款多模态模型权重开放," 睁眼 " 后追上 Opus-4.8

新浪财经 / 看点资讯(2026-09-01 06:53):DeepSeek V4 多模态开源 305B 参数 MIT 协议,比 Opus-4.8 强在哪

每日经济新闻 / 赵雯琪(2026-09-01):影眸发布世界生成模型、VAST 完成 30 亿元融资:AI 3D 开启场景竞赛

新华网(2026-09-01 09:05):人工智能应用服务商培育专项行动启动

企数智(2026-07):七部委发布 2026-2028 硬科技协同发展方案:新建智算中心国产芯片采购占比强制不低于 75%

Crypto Briefing(2026-09-02):Google to unveil Gemini 3.8 Flash on Wednesday(内部代号 skimaki,Jetski 平台测试)

The Hindu/TechShots(2026-09-01):DeepSeek Slashes AI Prices by 75% in China's Latest AI Price War

科技日报 / 罗云鹏(2026-08-28):腾讯混元 Hy4 preview 发布并开源(770B 参数 /49B 激活 /100 万上下文)

凤凰网(2026-08-28):腾讯混元 Hy4 preview 开源(7700 亿参数、100 万上下文)

IT 之家(2026-08-28):1.5TB 压到 214GB:腾讯混元 Hy4 preview 轻量版发布开源

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

ai 谷歌 开源 职场 比图
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论