MiniMax要去纽约了。这家公司的美国业务发展负责人Morgan Suo将在AI Engineer NYC发表演讲,主题是“The Hidden Costs of a Faster Model”——更快模型的隐藏成本。

这个题目本身就值得琢磨。模型跑得越快,账单上省下的钱,会不会在别的地方悄悄还回去?

打开网易新闻 查看精彩图片

三个变量:量化、投机解码、推理控制

根据公开的演讲信息,Morgan Suo要聊的是量化、投机解码和推理控制这三件事,如何同时改变模型的成本、速度和质量。

这三项技术各自都指向同一个目标:让推理更快、更便宜。但演讲的落点不在“怎么快”,而在“切换之前需要检查什么”。

换句话说,加速不是免费的午餐,代价可能藏在质量、稳定性或者别的维度里。

时间地点已经确定

这场演讲安排在2026年10月14日,美东时间上午10:40到10:58,只有18分钟。

地点是纽约时代广场喜来登酒店的McCarthy Room。

18分钟要讲清楚量化、投机解码、推理控制三条线,还要给出切换前的检查清单,节奏不会慢。

对于正在做模型选型和推理优化的团队来说,这场分享的实用价值可能比标题看起来更高——它讨论的不是要不要更快,而是快之前该确认什么。