Hacker News | 📄 原文链接 | 2026-09-11 收录

还能信任 OpenAI 吗:数学家追问未发表成果是否进了训练数据

来源:mathstodon.xyz — mathstodon.xyz · 124 分 · by pred_

📋 概述

数学家 Andreas Thom 在 Mastodon 上复盘围绕 OpenAI「非 sofic 群」成果的争议。他与合作者 Gabor Kun 近几个月一直在 ChatGPT 里讨论 expander matching 问题及这项工作的各种延伸,因此自然想知道:这些对话有没有进入训练数据,或者对解题过程是否可见。他当时写信向 Mark Sellke 与 Sebastien Bubeck 询问,Sellke 的完整答复是「Regarding your conversations with ChatGPT: that did not happen.」——但事后看,这句话只回应了「过程可见」这一层,对训练数据只字未提。OpenAI 在 Buckmaster–Alpöge 事件中表示没有访问特定用户数据,却补充「无法排除由用户使用衍生的去标识化数据帮助改进了模型」。作者认为这至少算不诚实,并担心它比 AI 生成的新结果更伤害数学共同体的信任基础。

🔑 核心要点

💡 金句

要问的是两件事——有没有进训练数据,解题过程能不能看到。只回答其中一件,我称之为不诚实。
← 返回 Hacker News 首页