对话更流畅,控车更懂你——超级小爱背后技术解读
小米技术 2026-09-10 18:05 北京

日常用车时,你也许遇到过这些场景:出门自驾,行李塞了满满一车;周末郊游,朋友们想在车上打牌;露营的夜晚,想在车上找到最佳的观景休息模式;导航规划到一半,想顺路买点其他东西……
这些关于车内空间的智能编排需求,背后却涉及座椅、空调、灯光、导航、娱乐等多个系统的联动。在小米澎程上,这些复杂的跨系统协作被交给了超级小爱专家模式——你用一句话描述想要的场景,会客厅、休息舱、极致储物间,编排、规划、执行全部由小爱完成。
而让超级小爱真正做到“说一句就搞定”的背后,是两项核心技术的升级:快慢系统和全双工对话。

01
快慢系统:更智能的分流算法
一次自然流畅的车载对话,要做到两件事:响应要快,结果要对。
很多时候,这两件事却像天平的两端——想让助手“想得更清楚”,就得让它多思考一会,用户会觉得慢;想让助手“回得更快",跳过深度思考,结果就可能没那么准。
因此我们需要组合两个不同的系统,来解决这个问题。快系统负责快速、直觉和自动化反应,慢系统负责理性、分析和深度思考。
▍把对的请求,送到对的链路
快慢系统的核心思路很朴素:不同复杂度的请求,不该走同一条处理链路。
快系统执行速度快、成本低,承接“打开空调”“音量调大”“导航到公司”这类高频简单请求。慢系统能力强,承接多途经点导航、条件筛选搜索、长程任务编排这类需要深度推理的复杂请求。
快慢系统的目标,就是把每一个请求分发到效率最高的链路上,在满足度、延时、成本之间找到平衡。
同样以“导航”开头,两句话走的却是完全不同的两条路:“导航到公司”语义明确、操作单一,你刚说完指令,路线规划就开始;而“找一个能看见长江的露营地,最好停车免费且附近两公里有商场可以吃饭”,则被智能分流到慢系统,理解模糊语义、筛选多个条件、规划完整行程。
▍更快更准的回复
我们来举个例子,“找一个能看见长江的露营地,最好停车免费,附近两公里有商场可以吃饭” ,这个指令包含了地点周边信息的筛选需求,它需要理解模糊语义、筛选多个条件、调用多个工具才能规划完整的行程。
这种复杂请求,得交给深度思考。为了让复杂请求“想得清楚、又回得快”,这次我们基于 Xiaomi MiMo 模型做了两项关键升级:
第一步,我们做了一个关键调整:把模型从“边想边答”(think模式)切换到了“直接作答”(no-think模式)。这一切换带来了非常显著的响应提速——模型耗时平均下降了约35%。大家的直观的感受是:小爱“利索多了”。但跳过思考,复杂任务的准确度会下降。面对多途经点、条件筛选的导航需求,模型更容易“想岔”或“漏工具”。
第二步,也是关键一步:Xiaomi MiMo 模型引入 RAG-Planning 。就像人在考试时,如果手边有几道类似的例题,就能快速照着做出正确判断。RAG-Planning 在小爱开始处理你的问题之前,先从知识库里检索出几个“类似问题的完整解题思路”,作为示例喂给模型。这样模型不需要从头推理,而是参考类似解法快速做出准确判断——相当于开卷考试,速度和准确率同时提升。
加入 RAG-Planning 之后,小爱的任务完成度和可用率得到了大幅度提升,更重要的是,它守住了速度这条底线:相比之前的 think 版本,端到端耗时依旧保持 no-think 的低时延,最快能快出3到6秒,这在车载场景里,是你能实实在在感知到的差距。
对 Xiaomi MiMo 的这一轮优化,让小爱用 no-think 的速度,做到了 think 模式的准确度。
02
全双工对话:边听边说的自然交流
你正让小爱“导航去东湖落雁景区”,话没说完又插一句“空调调到24度”。小爱先立刻执行空调,等这句播完,它记着导航还没完成,接着补上路线规划。
这一次超级小爱全双工升级,我们把拒识、判停和打断放进同一个控制模块里统一决策,让小爱持续感知车内对话状态,同步判断三件事:你是不是想和它说话、你有没有说完、此刻要不要中断播报。
小爱的对话能力从“听完再说”变成“边听边说”——小爱在回复你的同时也在持续倾听,你随时可以插话打断。说完它接着干,对话节奏更接近人与人之间的自然交流。
▍多轮对话
一次长途出行,你可能和小爱聊了几十轮:先规划去露营地的路线,中途改目的地,又问了沿途天气,调了空调,最后让它推荐附近餐厅。每一轮对话都会把车内状态、工具调用、任务进度堆进上下文,Token 轻松突破十万级。
上下文越长,对模型的挑战越大——容易被无关信息带偏,响应速度也会变慢。我们基于 Xiaomi MiMo 进一步优化,设计了三级 Session 压缩体系,给上下文进行“瘦身”:
第一级,清掉过时状态。空调温度、车窗开关这些信息每秒都在变,默认清空这些历史轮的快照。
第二级,只留当前任务相关的。正在规划导航,之前聊音乐的就精简掉;太长就从最旧的删,最近几轮一定保住。
第三级,超长对话做摘要。聊到上百轮时,把历史归纳成摘要,只留你的偏好这类长期有用的信息。
三级整理下来,上下文的 Token 量下降 60%—86% ,而业务表现和合规率不降反升——就像一个记性好的副驾,不会因为聊了一路就忘了你最初要去哪,反而因为只记重点,回答得更专注、更准确。
▍打断接续能力
打断,本来就是自然对话的一部分。人和人聊天时一句话被打断、稍后再补,大家都能自然接上。但过去的人机对话里,打断往往意味着上一件事就这么没了。
为了让打断后的交互更自然顺畅,小爱优化了打断接续的判断逻辑,区分不同场景精准处理,让判停更准确:
播报被打断:如果只是播报类内容说了一半(如新闻、天气),信息已经完整,就不用接着往下念。
任务被打断:如果正在执行的任务被打断(如导航还在规划),事情没做完,就会接着完成。
误打断:如果是环境噪音导致的误触发,其实你没说话,它会自动回到刚才的任务上。
快抢慢重发:如果新指令已经被快速响应,而旧的后台任务还在处理,会根据实际情况判断要不要继续。
判断的核心标准很简单:看最终交付的是「动作」还是「信息」。如果打断让你 “少做了一件事”,就继续做完;如果只是 “少听了一段话”,就到此为止。
你在表述时,它会结合语义完整性、说话节奏和对话上下文一起判断你是否说完,支持边想边说、中途自然停顿,小爱不会贸然抢话。播报过程中持续监听并识别有效人机请求,确认你是在对它说话后,就立刻停下播报、把话语权交还给你。而当你和同行人聊天、车内有噪音或咳嗽声时,它会安静地不打扰 —— 听得懂你什么时候在叫它,也分得清什么时候该安静。

链路分工,多端协同
回到最开始的问题:小米澎程的“智能可变大空间”到底意味着什么?

它不只是空间可以变化,还能理解模糊语义,你说一句话,小爱就能懂你的场景、编排你的空间、执行你的需求。
超级小爱的升级,让简单指令能即刻响应,复杂需求也能又快又准地完成规划;对话也更加自然,你可以停顿、可以插话、可以想到哪说到哪,小爱像真人副驾一样接得住你的每一句话。
小米澎程 SkyNomad 已搭载专家版的超级小爱,未来其他车型及其他设备上的超级小爱也将迎来重磅升级,欢迎大家一起感受更聪明的小爱。
END

