入口从不偏爱声势最大者,而常留给在暗处把链路磨透的团队。
来源丨小饭桌
过去两年,具身智能的故事大多发生在 " 大脑 " 上—— VLA、世界模型、端到端控制轮番刷新能力边界。但当机器人真正被放进工厂和家庭,最先 " 露怯 " 的往往是 " 眼睛 "。
今天的视觉大模型,大多数还停留在 " 问一句答一句 " 的阶段。而真实的物理世界由光线的明暗、物体的运动、遮挡与深度的变化和时间的流逝构成,连续发生,不会暂停。视觉智能这件事,难在它不是一个单点技术,而是从镜头到模型,哪一环都不能少。
也因此,视觉链路却不是资本可以速成的生意——成像、压缩、芯片、理解,每一环都要以年计地打磨。拐点不会只由一个更大的模型触发,它需要成像、编码、芯片和模型同时成熟。
而谁提供了这层感知,谁就握住了智能进入物理世界的入口。
双深科技提出的方向叫 Always-on VLM——不是让大模型 24 小时满负荷运转,而是学人的视觉那套分层处理:底层感知一直开着,快速捕捉光照、运动、深度和目标变化;只有环境里真正发生了什么,更耗算力的推理才会被叫醒。
本期小饭局,小饭桌邀请到双深科技 CEO 曹磊、CTO 武祥吉,与联想控股投资总监高琛一起,聊聊 AI 与物理世界交汇处的下一个入口。
各位关注 AI 与物理世界交汇的桌友,无论您是躬身入局的机器人从业者、关注 AI 落地的投资人,还是对视觉智能底层链路好奇的技术人,我们都诚挚邀请您线上围坐。
入口从不偏爱声势最大者,而常留给在暗处把链路磨透的团队。 9 月 8 日(下周二)晚,让我们一同推开那扇门,看谁先踏进物理世界的 AI 新大陆。
席位有限,审核制参与, 欢迎在 " 阅读原文 " 处获得报名信息,期待与您线上相见!


登录后才可以发布评论哦
打开小程序可以发布评论哦