作者把 Hugging Face 上一个约 2.1 亿参数的小模型转成 ONNX,用 WebGPU 跑在浏览器里,做成网页正文提取工具 Pulpie。模型只回答一个很简单的问题——这一块是不是正文,剩下的交给确定性工具把 HTML 转成 Markdown,因此标题、代码块、表格与图片都能保留,而且无需 API 调用与云端推理。
🔑 核心要点
210M 参数的小模型只做分类:这块是正文,还是导航、侧栏与样板。
把判断交给模型、把转换交给确定性工具,是这次组合最漂亮的地方。
浏览器版模型约 800 MB,下载一次进入缓存后,提取几乎瞬时完成。
没有 API 调用、没有云端推理,也不必为了清洗网页动用大模型。
💡 金句
It isn't generating Markdown or rewriting anything. It just answers a much simpler question: Is this block part of the page I actually care about?