论文:法学硕士在文档问答场景中产生多少幻觉?涉及温度、上下文长度和硬件平台的 1720 亿代币研究 (2603.08274) 发布时间:2026 年 3 月 9 日。了解有关 Emergent Mind 的更多信息:https://www.emergentmind.com/papers/2603.08274 arXiv:https://arxiv.org/abs/2603.08274 免费注册热门论文电子邮件摘要:https://www.emergentmind.com/subscribe 在 X 上关注我们:https://x.com/EmergentMind 加入我们的 Discord:https://discord.gg/BhfTC4mTXq 本演示文稿探讨了执行文档问答任务的语言模型中的幻觉的大规模研究。研究人员使用 RIKER 框架(一种以事实为先的评估方法)测试了 1720 亿个代币、不同上下文长度(最多 20 万个代币)、温度和硬件平台的 35 个开放权重模型。该研究表明,当前的模型都没有摆脱幻觉,随着上下文的增长,制造率不断攀升,并且模型检索正确事实的能力与发明虚假事实的倾向之间存在令人惊讶的脱节。
免责声明:info@kdj.com
所提供的信息并非交易建议。根据本文提供的信息进行的任何投资,kdj.com不承担任何责任。加密货币具有高波动性,强烈建议您深入研究后,谨慎投资!
如您认为本网站上使用的内容侵犯了您的版权,请立即联系我们(info@kdj.com),我们将及时删除。