8 月 17 日 / 大湾区经济网 / 国产大模型在 8 月中旬迎来密集迭代期。DeepSeek 发布新一代旗舰模型 DeepSeek-V4-Pro,进一步强化复杂推理、编程及智能体能力;智谱紧随其后发布开源旗舰 GLM-5.3,在代码与长程任务执行上大幅提升。中信建投 8 月 17 日研报指出,国产模型在推理、Coding、Agent 等能力上正加速追赶海外领先水平,模型生态与商业化进程不断提速,国产模型与国产算力有望形成协同发展的正向循环。
双雄同周发新模型
DeepSeek 此次推出的 V4-Pro 定位与此前主打低成本、高效率的 V4-Flash 形成差异化。V4-Pro 更侧重高难度任务与智能体场景,在 Artificial Analysis Intelligence Index 测评中得分 53 分,高于 V4-Flash 的 40 分。这一策略调整意味着 DeepSeek 正在从 " 以价换量 " 向能力纵深拓展,试图在高端推理市场与海外巨头正面竞争。
智谱 8 月 14 日发布的 GLM-5.3 则继续强化开源路线。据智谱披露,GLM-5.3 在内部 Z.ai Code Bench 上的表现较 GLM-5.2 提升约 50%,支持 100 万 Token 上下文和最高 128K Token 输出,在复杂软件工程和长时间自主执行任务方面进一步增强。开源策略使 GLM 系列在开发者社区中保持较高活跃度,也为国产算力适配提供了丰富的应用场景。
Agent 能力成竞逐焦点
两家厂商的新版本不约而同将 Agent 能力作为核心卖点。DeepSeek-V4-Pro 明确针对智能体场景优化,智谱 GLM-5.3 则强调 " 长程任务执行 "。这一趋势反映出 AI 产业正在从单轮对话向多步骤自主执行演进,对模型的推理深度、上下文保持和工具调用能力提出更高要求。
国产模型快速迭代的背后,是国产算力产业链的同步成熟。模型能力提升直接拉动训练和推理算力需求,而国产算力的性价比优势又降低了模型训练和部署成本,二者形成飞轮效应。中信建投建议持续关注国产大模型及算力产业链发展。从近期市场表现看,算力硬件、CPO、光通信等上游板块持续活跃,AI Agent 规模化落地驱动的推理算力需求被视为中长期基本面支撑。不过,业内也提醒,模型迭代速度加快意味着技术路线和竞争格局仍存在不确定性,商业化落地进度将是检验模型真实价值的关键。
来源:大湾区经济网


登录后才可以发布评论哦
打开小程序可以发布评论哦