MiniMax 要去纽约了。这家公司的美国业务发展负责人 Morgan Suo 将在 AI Engineer NYC 发表演讲,主题是 "The Hidden Costs of a Faster Model" ——更快模型的隐藏成本。
这个题目本身就值得琢磨。模型跑得越快,账单上省下的钱,会不会在别的地方悄悄还回去?

三个变量:量化、投机解码、推理控制
根据公开的演讲信息,Morgan Suo 要聊的是量化、投机解码和推理控制这三件事,如何同时改变模型的成本、速度和质量。
这三项技术各自都指向同一个目标:让推理更快、更便宜。但演讲的落点不在 " 怎么快 ",而在 " 切换之前需要检查什么 "。
换句话说,加速不是免费的午餐,代价可能藏在质量、稳定性或者别的维度里。
时间地点已经确定
这场演讲安排在2026 年 10 月 14 日,美东时间上午10:40 到 10:58,只有 18 分钟。
地点是纽约时代广场喜来登酒店的 McCarthy Room。
18 分钟要讲清楚量化、投机解码、推理控制三条线,还要给出切换前的检查清单,节奏不会慢。
对于正在做模型选型和推理优化的团队来说,这场分享的实用价值可能比标题看起来更高——它讨论的不是要不要更快,而是快之前该确认什么。


登录后才可以发布评论哦
打开小程序可以发布评论哦