信通院 MCP 专项测试:StartLux-27B 综合第二,超越 284B DeepSeek V4 Flash
2026.08.31 09:30
2
1
钛媒体 App 8 月 31 日,中国信通院人工智能研究所公布的可信 AI 大模型基准测试 MCP 专项测试显示,上海原点星辉研发的 StartLux-V1.0-27B-Preview 以 27B 参数量取得综合性能排名第二,得分 39.25%,高于第三名 284B 的 DeepSeek-V4-Flash-0731(38.24%),并以 1 个百分点之差紧追 1.6T 的 DeepSeek-V4-Pro。测试于 8 月 3 日启动,经三轮完整测试取均值,覆盖位置导航、网页搜索、浏览器自动化、金融分析、代码仓库管理及 3D 设计 6 类专项共 7 项检验。同等参数规模下,StartLux-27B 较 Qwen-3.6-27B 高出 5.34 个百分点;位置导航任务排名第一,浏览器自动化、金融分析与 DeepSeek-V4-Pro 并列第一。该模型以 Qwen3.6-27B 为基座,采用 "AI 训练 AI" 方法后训练,是国内首个以此方法进行后训练的本地 Agent 模型,可在消费级个人电脑运行,团队计划年内推出第一代本地智能解决方案。
本文内容仅供参考,不构成投资建议,请谨慎对待。


登录后才可以发布评论哦
打开小程序可以发布评论哦