端侧 AI · 运行时
LiteRT-LM 多轮对话状态怎么管理
明确会话状态分别属于 App、prompt builder 和 native runtime 的哪些部分。
主查询:LiteRT-LM 多轮对话 · 核验:2026-09-16 · 事实卡:LITERTLM-01, BENCHMARK-01
先给结论
这不是一篇替你猜性能或设备兼容的文章。它把「LiteRT-LM 多轮对话」拆成可执行步骤,并告诉你什么证据足以支持结论。没有真机记录时,只给方法和待验证项。
需要先收集的证据
至少把下面三项与同一个 artifact、运行时和任务绑定:
- 会话状态 schema
- 渲染 prompt fixture
- 重置与进程重建测试
若缺一项,就把它写成未知,不要用模型参数、芯片宣传或网上截图代替。
实施流程
- 选择运行时生态
- 确认支持的模型格式
- 封装应用接口
- 验证实际执行后端
- 测试取消与释放
- 保留回滚路径
每一步都要能失败并恢复。错误记录保留阶段、artifact、运行时与脱敏上下文,不记录用户原始照片、音频、文档或 prompt。
最容易写错的地方
- 把 native 状态当永久历史
- 取消后混入旧会话
另外要防止静默回退、未固定 revision、只留成功结果、把一次运行推广为所有设备支持。
最小复现记录
| 层 | 必须记录 |
|---|---|
| 设备 | 型号、芯片、系统、RAM 档位 |
| 软件 | App 版本与 git commit |
| 模型 | 家族、变种、revision、格式、长度、hash、量化 |
| 运行时 | 版本、请求后端、实际后端证据 |
| 任务 | fixture、输入 hash、prompt hash、输出规则 |
| 结果 | 完成、失败、取消、回退与恢复 |
发布检查单
- 目标查询已在开头直接回答。
- 所有数字都能回到事实卡或原始记录。
- artifact、runtime、设备与任务没有混淆。
- 失败、取消、清理与回退都被测试。
- 隐私和网络边界单独说明。
- 结论只适用于记录中的配置。