TGViewer
Lss233's.Bookmarks(); Lss233's.Bookmarks(); @lss233_k · 87 subscribers
Post #1092 119

Forwarded from Solidot

大模型没有幻觉,它只是喜欢胡说八道

2024-06-11 00:00 by 3001太空漫游

大模型如 OpenAI 的 Chatgpt 彻底改变了 AI 与人类互动的方式,它能生成类似人类写作的流畅文本。尽管其能力令人影响深刻,但大模型也以其不准确性著称,它犯下的错误被称为 AI 幻觉。根据发表在《Ethics and Information Technology》上的一篇论文《ChatGPT is bullshit》,格拉斯哥大学 Michael Townsen Hicks 等人认为,这种不准确性应该被称为胡说八道。大模型是旨在生成类似人类文本的复杂程序,其实现方法是通过分析大量语料使用统计技术按顺序预测下一个特定单词的可能性。它们能对提示生成连贯且上下文恰当的响应。人类大脑有着丰富的目标和行为,大模型与之不同,它只有单一的目标,即生成与人类语言极为相似的文本。这也意味着它们的主要功能是复制人类语言和写作的模式和结构,不是理解或传递事实信息。AI 幻觉这一形容词暗示大模型有理解和传达真实的意图,但实际上它并没有。AI 不在乎正确性,只在乎内容是否能说服人或符合特定叙述。它们只是在胡说八道。如果生成的信息是正确的,那只是巧合罢了。

https://www.psypost.org/scholars-ai-isnt-hallucinating-its-bullshitting/
https://link.springer.com/article/10.1007/s10676-024-09775-5

#人工智能
More from @lss233_k
  1. Apr 12, 2026Margin Lab - 监测 Opus4.6 每日降智 偶然发现的网站,每日更新在 SWE-Bench-Pro 子集上的测试结果,检测默认设置下 SOTA 模型的能力退化情况。目…
  2. Apr 7, 2026Telegram 允许机器人相互通信 此前,Telegram 中的机器人无法互相查看消息——平台过去禁止此功能,以避免消息无限循环。如今,这一限制已被解除。 • 在群组中 新功能将…
  3. Jun 7, 2025https://dddd.moe/article/20a7d549-6f33-8059-bd3e-ef30e7bbbcb5
  4. Apr 24, 2025地衣或能在火星上生存 2025-04-21 21:57 by 跃入虚空 火星上是否存在过生命我们暂时还不得而知,但今天的火星显然不太适合生命生存。然而根据发表在《IMA Fungu…
  5. Feb 2, 2025Lss233's.Mirror(); 的 CDN 费用续费到 5 年后了😋
  6. Dec 12, 2024CSDN被挂马:CDN疑似成为攻击入口 奇安信威胁情报中心披露,CSDN网站被恶意组织挂马,攻击者利用潜伏期伪装流量,诱导用户下载恶意程序。攻击行为涉及分析受害设备IP并针对特定行…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →