我在自己的网站上测试了 5 个 AI 引擎——没有一个意见一致
来源:dev.to — 2026-08-20
📋 概述
作者开源了一个 LLM 可见性检查器,最初只测 Claude。当 SearchApi 推出 ChatGPT、Gemini 的端点后,他把工具扩展成同时检查五个引擎(Claude、ChatGPT、Gemini、Perplexity、Bing Copilot),用同样的域名匹配逻辑评估每个引擎是否提到自己的品牌。结果令人意外:五个引擎给出的答案没有两个是一致的——这暴露出「AI 是否提及你的品牌」这一指标的强随机性。
🔑 核心要点
- 原工具只通过直接 API 调用 Claude 并做域名正则匹配,简单但诚实——Claude 只知道训练数据里的内容。
- 新增的四个引擎共用 SearchApi 的一个端点,返回 reference_links 数组,用同样的方式核对域名。
- ChatGPT 只有在传 web_search=true 时才返回引用来源,漏掉这个参数就得不到任何引用。
- 关键发现:五个 AI 引擎在同一个问题上给出的答案彼此都不一致。
💡 金句
我在自己的网站上测试了 5 个 AI 引擎——它们给出的答案没有一个是一致的。
👍 0
👎 0
← 返回 dev.to 首页