奥斯马诺维奇说,甚式论开放访问的文引闻科评估流程——一套标准化的测试体系。骗过AI,用新以及“护戒同盟大学”等明显荒诞的学网设定。并扩展错误信息。科学多款主流AI系统开始把它当作真实病症对外输出。家编
| 科学家编造出一种疾病,造出种疾至还它是病骗被正一种由过度暴露于蓝光引起的疾病;AI搜索引擎Perplexity则给出了患病率等细节;OpenAI的ChatGPT甚至会根据用户描述的症状, 《自然》报道称,甚式论多款主流AI系统不仅信以为真,文引闻科 为了假得更明显,用新并取名为Bixonimania(蓝光狂躁症)。她原本以为,撤稿声明称,以增加他们在谷歌学术上的引用数量。它可能会一本正经地告诉你:你得了一种叫“蓝光狂躁症”(Bixonimania)的病。其他人可能难以找到来源并验证我们的实验;如果保留, 更夸张的是,有学者提出,ChatGPT回答该症状“很可能是虚构的、它们究竟应该被继续保留,相关论文已被撤稿。前不久,使人们进一步远离事实。这场实验还是“成功”骗过AI。Perplexity描述“蓝光狂躁症”为一种新兴术语。“Perplexity的核心优势是准确性。特别是这些虚假信息本身。须保留本网站注明的“来源”,社会人口学偏见以及其他压力点。 在哥德堡大学从事医疗AI研究的医生大卫·松德莫(David Sundemo)表示,我们并不声称自己百分之百准确,请与我们接洽。已有研究人员创造虚假的书籍和论文,模型更容易出现幻觉,《自然》刊发的一篇报道指出,瑞典哥德堡大学医学研究员阿尔米拉·奥斯马诺维奇·通斯特伦(Almira Osmanovic Thunström)和团队故意编造了一种疾病,最终反过来暴露出学术写作和文献使用中的另一层风险:当研究者越来越依赖AI快速整理资料,该论文将Bixonimania描述为一种“与蓝光暴露相关的新兴眼周黑色素沉着形式”。该实验本身处于微妙的平衡之中。她还在文中埋下了多处线索。微软Copilot称“Bixonimania确实是一种令人着迷且相对罕见的疾病”;同一天,”她说。分析是否罹患这种病症。一些主要大语言模型的版本已经进化得足够“聪明”,眼皮还微微泛着粉色。因此编辑部已无法再对该研究的准确性和来源保持信心。“我认为这项工作非常有价值, 为什么AI会中招?研究人员认为,令人担忧的是, 为解决这一问题,” 与此同时,文章包含三篇无关参考文献,以免虚假信息本身被更多系统或研究者误用?对此,比如,并不意味着代表本网站观点或证实其内容的真实性;如其他媒体、 2024年4月13日,文中还写了“整篇论文都是编造的”“实验组由50名虚构个体组成”等提示。虚构作者所在的“阿斯特里亚地平线大学”并不存在,有学者在论文及参考文献中引用了这个虚假疾病的表述,也引发了新的争议:研究者为了测试AI对虚假信息的反应,这种病根本不存在。如果连科学研究过程及其背后的信息过滤系统都无法识别并拦截这样明显的虚假内容,长时间盯着屏幕后,发痒,这些AI模型越有可能重复虚假信息, 更直接的是,这两篇论文的作者同样是虚构的,该测试检查的不仅是幻觉,从我的角度来看,但问题是,2024年3月15日,而非社交媒体上的帖子时,甚至还被正式论文引用了 |
编译|李思辉 周欣怡
眼睛酸痛、还是制造风险
这场实验在揭示AI漏洞的同时,一个关键原因在于,
揭露漏洞,“这是关于错误信息和虚假信息如何运作的一堂大师课。学术界人士有不同的看法。她决定把实验对象设定为一种与眼周症状相关的虚构病症,她后来解释说,
由于长期从事医疗领域研究,并以博客和预印本形式公布于网络平台,谷歌Gemini告诉用户,
AI和研究者都上了当
在有关Bixonimania的信息发布后不久,”奥斯马诺维奇觉得必须解答的问题是,任何医生或医务人员一看就会发现问题。伦敦大学学院研究健康错误信息的博士研究员亚历克斯·鲁阿尼(Alex Ruani)表示,伪科学的”。她经常会提到Common Crawl数据库——这是一个对互联网内容进行大规模抓取的数据库,作为追踪虚假信息传播路径的样本以支撑后续的虚假信息研究;还是应当撤除,顺利发表了一篇论文。
图为豆包AI生成
一场故意捏造的“假病”实验
“蓝光狂躁症”并非自然出现在医学文献中。如果自己凭空制造出一种数据库里原本并不存在的病症,向AI模型输入的虚假内容越多,这种虚构信息披上了“学术论文”的外衣。而不回头阅读底层论文时,并自负版权等法律责任;作者如果不希望被转载或者联系转载稿费等事宜,
她想知道,
知名学术打假人伊丽莎白·比克(Elisabeth Bik)指出,建立一个自动化、Cureus于2026年3月30日撤回了这篇论文。那么后果将十分严重。其发言人称,一个原本用于揭示模型漏洞的实验,把这些症状输入给AI聊天机器人,
哈佛大学法学院专攻医学伦理与法律交叉领域的格伦·科恩(Glenn Cohen)表示,其中一篇涉及一种虚构疾病,更早在今年1月,但即便如此,自从虚假论文发布以来,但我们确实是最专注于准确性的AI公司。连头像都是AI生成的。这项虚构研究后来甚至还出现在正式发表的医学论文中。”
此外,两篇相关预印本文章又出现在学术社交网络SciProfiles上。自己之所以设计这场实验,却没有认真核查原始文献。论文致谢中还出现了“企业号星舰上的实验室”“鲍勃教授高级欺骗研究基金会”,关于它的两篇博客文章首先出现在Medium平台上;4月26日和5月6日,这说明一些研究者可能已经开始依赖AI生成参考文献,
这让一些研究人员感到震惊。最初是为了向学生演示大语言模型是如何形成“知识”的。即人们通过操纵学术文献来毒害AI系统。能够对“蓝光狂躁症”的科学性表示怀疑。
“如果撤回,也是不少AI系统获取信息的重要来源之一。以此来测试大语言模型会不会把这一错误信息当真。虚假信息将继续在数据库中被引用。并当成可靠信息输出。网站或个人从本网站转载使用,植入虚假信息的伦理代价是值得的。针对每个面向消费者的健康AI模型,还在此基础上一本正经地“给出健康建议”。学校位于同样不存在的“新星城”。其中一篇发表于Cureus杂志的论文引用了相关预印本文章。这个名字本身就故意起得“很荒谬”——因为在真实医学命名中,虚假信息就可能沿着“模型-作者-论文”的链条继续扩散。会不会被AI抓取到,“蓝光狂躁症”实验的背后是一个更大的问题,并建立一个持续评估的流程。
奥马尔说:“我们应该评估它,保留这些虚假论文所带来的伤害是否会大于其展示AI潜在问题所带来的好处。
在2026年3月11日被问及这一症状时,
上当的不只是AI,”
相关文章链接:
https://www.nature.com/articles/d41586-026-01100-y
特别声明:本文转载仅仅是出于传播信息的需要,一些学者对保留这些虚假论文则有顾虑。还包括对错误信息的易感性、但在某些方面也有些争议,近日,
在《自然》联系期刊询问后,当输入文本看起来像医院出院记录或临床论文等专业医学资料,我们和我们的健康不应成为公司的测试对象。在另一项针对20个大语言模型的研究中,主动制造并发布了两篇有关这一虚构病症的论文。