Ollama 现在在 0.35 版本中支持完全本地运行的 Jev 类决策模型
Ollama 0.35 起支持本地运行 9B 级“决策模型”Nimble(基于 Qwen3.5-9B 微调,Apache 2.0),通过 /v1/systemone 端点接受文本和最多 64 个结构化问题,返回 choice/true-false/rubric 三类答案及其概率,无推理步骤、响应 <100ms。 核心卖点:一次调用批量判断路由、条件、政策或评分;支持 cURL 与 TypeSafe SDK 直接接入 Ollama;训练数据用对比对(一条事实翻转改变答案),13 个人工标注公开数据集平均准确率 75.7%,略低于 Jev 1.13(76%),但在 Score 类任务上高于 Jev。 限制:仅文本,8K token 上下文,概率不等同于真实准确率,不能生成解释或嵌套 JSON。适合需要轻量本地分类/审核/路由的工程场景,值得关注。 

