Chrome 决策 API:决策模型(DecisionModel)背后的提示词、限制、引擎与代码评审
Chrome 正在开发一个名为 DecisionModel 的 Web API,在访客设备本地对一段文本回答网站提出的封闭式问题(是/否、从列表中选择、 打分),并为每个答案返回概率。 该 API 的首批代码于 2026 年 10 月 6 日至 8 日间合入 Chromium,目前仅限桌面端,由 chrome://flags#decisions-api 开关控制,计划随 Chrome 第 160 版到期移除。 API 目前有两个引擎在代码评审中:Gemma 4 与 EmbeddingGemma。Gemma 4 引擎将问题逐条送入模型,让模型对每个选项字母输出概率; EmbeddingGemma 引擎则把问题和每个选项都编码为向量,通过余弦相似度再经温度 0.05 的 softmax 得到概率。 每个问题最多 2 到 26 个选项,每个选项对应一个单字母键;评分等级最多 2 到 9 级,每级对应一个数字键。输入仅限纯文本,EmbeddingGemma 段落上限为 8192 字符。 代码评审(6 个开放评审、143 条审阅意见)揭示了若干尚未写入代码的行为细节:Gemma 4 在 CPU 上约 9.6 秒处理 8 个、每选项约 3000 token 的问题,16 个问题、每个 26 选项时约 46 秒;选项字母的固定位置会产生位置偏差,TinyGemma 在 480 次测试中有 440 次选择 A;早期版本把已评分答案追加到会话导致后续选项得分错误,现改为在独立会话副本上评分。 Gemma 4 引擎仅跑在 CPU 上,因为 GPU 路径连续评分会返回错误分数或崩溃模型服务。API 的 create 调用在 2026 年 10 月 8 日之后要求访客先与页面交互,防止任意页面启动多 GB 的模型下载。 Android 被明确排除以避免二进制体积增长。










