2026 年被业界普遍视为端侧 AI 规模化落地元年。大模型正加速从云端 " 下凡 ",走向手机、汽车、机器人等各类终端设备,AI 的价值标尺也从 " 参数规模 " 转向 " 落地实效 "。在这一结构性跃迁中,算力如何下沉、如何在有限功耗预算内释放最大智能价值,成为全行业共同的命题。
在近日上海举行的 2026 世界人工智能大会(WAIC 2026)上,智算与具身智能成为关注焦点,AI 从数字世界走向物理世界的趋势愈发清晰。
作为全球领先的 AI 推理系统芯片(SoC)供应商,爱芯元智携完整 AI 生态重磅亮相 WAIC2026,不仅集中展示了从端侧到边缘侧的全系列算力产品,更首度揭秘 " 元曦 " 系列大算力 AI 推理新品,引发行业高度关注。
展会期间,爱芯元智联合创始人、副总裁刘建伟与边缘 & 终端计算业务总经理刘瑞聚接受了集微网等媒体采访,围绕大算力产品布局、具身智能赛道机会、端侧 AI 落地策略等核心议题,进行了深入的交流和分享。
边缘 AI:早有实力,顺势而为
伴随大模型产业全面普及,云端 Token 成本高、算力不足、数据合规受限等痛点持续制约 AI 规模化落地。
本届 WAIC 上,爱芯元智重磅揭秘全新 " 元曦 " 系列大算力产品,其中 A 系列 AI 推理卡搭载超 1000TOPS 推理算力、超大显存与超高显存带宽硬核配置,补齐高端边缘大算力市场空白,与已规模化落地的 M.2 算力卡、标准化核心模组形成分层全覆盖的边缘算力矩阵,从底层重构边缘 AI Token 经济体系,为企业 AI 规模化落地实现降本、提效、合规多重价值。
据了解," 元曦 " 系列大算力产品主要针对机房集群、多路视频分析、私有化知识库等高并发、高负载场景。依托自研技术优势,其超大显存可稳定承载大模型权重和海量数据,超高带宽突破了传统边缘设备的性能限制,能高效处理长文本推理、高清图像解析等复杂任务,减少对云端调用的依赖,从源头降低成本,同时保障数据安全。
" 爱芯元智切入 AI 推理卡物理 AI 领域,并非临时决策,技术储备早已就绪。" 刘建伟强调。他认为,爱芯元智在端侧长期打磨,能在满足场景成本功耗的前提下,将 Token 质量提升至高于友商。
" 过往产品算力在十几 T,可流畅运行 1B 参数模型,结合 Transformer 和 CNN 完成基础任务。当前云侧大模型迭代加快,已大量转向轻量化,3B、4B 模型及 MoE 在特定场景可用,端侧无需超大规模编码,小脑控制模型参数量本就不大,时机成熟之下我们顺势推出上百 P 算力的推理卡和服务器。" 刘建伟告诉集微网。
机器人:构建自主智能大脑
随着年初机器人登上春晚舞台,国家出出台相关扶持政策,今年被称为 " 具身智能元年 ",行业出货量有望实现规模提高。
此次 WAIC 上,爱芯元智也展示了具身智能相关技术产品。本次展出的机器人,其大脑和小脑控制芯片已实现完整技术闭环,属于首次公开亮相,仅开放基础功能体验。
以抓取水杯为例,多数机器人在无预设标签时难以精准判断空间位置,容易推倒杯子。爱芯元智多年在自研芯片领域的视觉感知与计算技术方面积累深厚,提供的方案能感知深度距离,即使水杯透明,也能通过模组芯片实现智能分析,使机器人更聪明。
刘瑞聚介绍,当前机器人节目多依赖预设程序,并未具备真正的自主智能大脑。这正是爱芯元智的核心布局方向,也是下游机器人厂商的共性痛点。
" 具身智能机器人需要采集有效数据并高效处理,无效数据无法产生高精度推理。同时,这类芯片不追求云端极致算力,过高功耗会导致续航缩短、发热严重,限制落地场景。爱芯元智走高能效路线,针对具身智能场景定制芯片架构和优化软件,推出专用高能效芯片,更好适配功耗、续航和成本要求,对具身智能和机器人行业是重要提升。" 刘瑞聚强调。
当前,机器人领域尚处于行业发展的早期,尚存很多痛点。在刘瑞聚看来,在机器人领域有不少需求未被满足,如更高算力和极致功耗。而从技术层面,爱芯元智的 NPU 能力可补齐智能算力。感知层面,爱芯元智在中高端视觉 AI 感知芯片出货量最大,积累了大量 NPU 架构优化技术,能高效采集数据,降低内存占用,提升计算效率。
据刘瑞聚介绍,爱芯元智长期聚焦端侧和边缘侧,与 " 物理 AI" 理念契合,感知和计算基础扎实。针对机器人领域的需求,爱芯元智正布局大算力低功耗芯片产品,后续将推出。
对于今年行业发展的趋势,刘建伟表示,先进的机器人公司出货节奏明显加快,而且对国产芯片的接受度也较高。当前主要的诉求在于 " 算力达一定程度,且功耗控制住。" 爱芯元智在机器人领域,瞄准已过 POC、进入量产阶段的客户。着重在两个方面:一是能耗成本敏感市场;二是与物理世界大量交互、需驱动实体设备作业的场景。
端侧 AI 落地:深入千行百业
自 2019 年成立以来,爱芯元智专注边缘与端侧 AI 推理芯片研发。针对端侧市场高度碎片化的特点,爱芯元智通过多代芯片迭代积累了丰富的 " 最后一公里 " 落地经验,将 CV 时代积累的视觉处理与工程化经验复用到大模型时代,结合架构创新,大幅提升复杂场景下的落地效率。
本次大会上,爱芯元智展示了众多细分行业的端侧 AI 产品,赋能端侧 AI 真正在千行百业实现落地。
比如本地 AI 会议机。目前会议纪要生成依赖云端算力,存在数据合规和安全风险。爱芯元智自研芯片支持本地部署,会议内容、纪要、转录和翻译全部在本地完成,数据不出企业,属行业首创。尤其适合国企、公检法和金融部门,此前因合规问题只能人工处理,效率低。政府领导到访时特别关注这款产品,确认芯片为国产自研,数据全程本地处理,不改变原有存储逻辑。
类似产品还有本地 " 龙虾盒子 ",传统云端算力同样带来安全隐患。工程师用 AI 辅助写代码,若依托云端,数据风险极高。爱芯元智推出纯本地运行方案,代码生成全流程本地闭环,降低合规风险,无需调用云端 Token,节省持续费用。本地盒子仅需一次性硬件投入,7 × 24 小时运行,运维成本极低。
展台还展示了端侧视频 AI 产品,如太阳能相机,可在无网无电环境下工作,夜间也能采集与白天同质量的视频数据,实现 " 黑夜如白昼 "。在智慧农业中,无需补光即可获取作物清晰生长数据;在动物园,可在不打扰动物的情况下监测夜间健康数据。这是行业首创,引领 AI-ISP 方向,已有新兴厂商跟进。
上述展示,正体现出爱芯元智端侧算力方向:聚焦细分场景和垂直行业定制,而非云端通用算力。大量中小企业无力承担云端集群成本,但可部署端侧本地服务器,搭建自有 Agent,提升效率,避免未来高额 Token 费用。
从十几 TOPS 的端侧芯片,到上千 TOPS 的边缘推理卡,爱芯元智正在构建一条覆盖 " 端 - 边 " 全场景算力产品线,而贯穿其中的核心逻辑,始终是 " 能效比 " ——在给定的功耗与成本约束下,提供最高效的 AI 计算能力。
随着 AI 从 " 能对话 " 走向 " 会干活 ",从数字世界深入物理世界,边缘侧与端侧的算力需求将持续爆发。对于爱芯元智而言,WAIC2026 既是技术成果的展示台,也是下一轮规模化落地的起点。背靠多年端侧 AI 能力积累,锚定物理世界的真实场景,这家以 " 普惠 AI" 为使命的公司,正在算力的蓝海中,划出属于自己的航线。


