新闻
PhantomFill:当表单需要答案时,语言模型会发明一个答案
1 分钟阅读
来源:arXiv ML
arXiv:2607.20492v1 公告类型:新 摘要:生产中的语言模型不写散文。它们填写表单:JSON 字段、函数参数、提取模板。我们证明这种形式本身会引起幻觉。我们向十三个模型询问关于相同输入的相同问题,并且仅更改答案格式。输入的构建是为了让问题无法得到回答:一篇病毒式帖子显示 12,400 个赞,但没有可见的回复,一张支持票,其电话从未被转录。在自由文本中,GPT-5.5 诚实地回答。 98%的情况下都说没有回复数据。给定情感所需的 JSON 字段,同一模型有 40 次会发明一个答案。它会捏造人群的情绪