dev.to | 📄 原文链接 | 2026-09-24 收录

4 GB 笔记本 GPU 对 6 核 CPU 跑 Gemma 4,按 ABBA 顺序重测:4.1 倍

来源:dev.to — 2026-09-23

📋 概述

这是上一次对比的重测版。同一台笔记本、同一份 3.35 GB 的量化感知 GGUF(google/gemma-4-E2B-it-qat-q4_0-gguf),由 llama-server 分别跑在 CPU 和 GPU 上,两次构建来自同一个 llama.cpp 提交,命令行只差一个 flag。GTX 1650 Ti 的解码速度是共享同一机身的 i7-10750H 的 4.14 倍,预填充快 3.42 倍,端到端完成请求快 3.62 倍。由于 CPU 与 Max-Q 显卡共用一套散热,作者这次用 ABBA 顺序(CPU、GPU、GPU、CPU)来抵消热漂移。

🔑 核心要点

💡 金句

这台笔记本上,只跑一种顺序的基准测试,结果大约会偏离 2%。
← 返回 dev.to 首页