Hacker News | 📄 原文链接 | 2026-09-30 收录

让决策模型先推理再下判断:Jeeves 的思路 — Hacker News 中文摘要

来源:github.com — 171 分 · by nicowaltz

📋 概述

Jev 这类模型能给出校准良好的决策概率,但准确率偏低,于是很多流水线不得不再挂一个推理模型兜底。PostHog 开源的 Jeeves 把这一步内化:以 Qwen3.5-9B 为基座,加 LoRA 与指针头,用 CISPO 训练模型先推理再决定,并配一个 block-4 扩散草稿器加速。同一个请求里支持 yes/no、多选与打分三种题型,在未训练过的测试数据上准确率 0.889,高于 Kev-9B 的 0.822 与 Jev 的 0.857。

🔑 核心要点

💡 金句

Jev-like models give calibrated decision probabilities, but at low accuracy.
← 返回 Hacker News 首页