首页
学习
活动
专区
圈层
工具
发布
技术百科首页 >AI 幻觉 >AI 幻觉与模型规模之间存在什么关系?

AI 幻觉与模型规模之间存在什么关系?

词条归属:AI 幻觉

1. 大规模模型的总体趋势

一般来说,较大规模的模型在事实回忆任务上的幻觉率低于较小模型,尽管随着训练技术的改进这一差距正在收窄。更大模型拥有更多参数来编码训练数据中的事实信息,对罕见知识的记忆也更稳定。然而这种优势并非线性——模型规模翻倍并不等同于幻觉率减半。

2. 推理模型的悖论

反直觉的发现是,更强的推理模型在某些任务上反而幻觉更多。Vectara 排行榜数据显示,Claude Sonnet 4 幻觉率为 10.3%,GPT-5.2 为 10.8%,而 o3-pro 高达 23.3%,相比之下简单的 Gemini 2.5 Flash Lite 仅 3.3%,Qwen 3-8B 为 4.8%。任务是在给定源文档的情况下做摘要——更聪明的模型容易"想太多",从而引入原文中不存在的信息。

3. 小模型的特定风险

小于 7B 参数的模型在面对复杂推理任务时幻觉风险更高,尤其是在缺乏充分微调的情况下。这些小模型在训练数据中只出现过一次的罕见事实上特别脆弱——如果某个人的生日或冷门事件时间在训练数据中仅出现极少次数,模型很难稳定记住。

4. 规模之外的影响因素

模型架构、训练数据质量、对齐方法等因素对幻觉的影响往往比单纯的参数量更重要。经过良好 RAG 增强的中等规模模型,其事实准确性可以超过未增强的超大模型。腾讯混元 Hy3 通过重建数据清洗与定向约束对齐,将整体幻觉率从 12.5% 降至 5.4%,这证明数据质量和训练策略的改进可以带来比单纯扩大规模更显著的收益。

相关文章
开源AI与大规模模型训练的技术挑战与未来展望
Open Source, LLMs & Ethik: Ines Montani über nachhaltige KI-Entwicklung
用户11764306
2026-01-11
1660
一文读懂大规模AI模型:原理、应用与实战
大规模AI模型(常称为“大模型”)正迅速成为人工智能领域的核心驱动力。这类模型拥有数十亿甚至上百亿的参数,能够胜任诸如自然语言生成、图像识别和智能推荐等高复杂度任务。本文将深入探讨大模型的定义、技术特征、典型应用及训练挑战,并辅以实用代码示例,为开发者、研究者和AI爱好者提供实战指南。
用户11658894
2025-05-20
2K0
大模型与AI底层技术揭秘 (2) 人妖之间的国度
“……应该说,美国是一个美丽的国家。可是它不应该像现在这样,动不动就要欺负你……”
用户8289326
2023-09-25
5910
AI大模型,与传统文化到底有什么关系?| 探元计划2023
6月21日,在联合国教科文组织驻华代表处、中国文物信息咨询中心(国家文物局数据中心)、中国文化遗产研究院的指导下,腾讯SSV数字文化实验室与腾讯研究院联合发起“探元计划2023”。
腾讯研究院
2023-11-16
1.4K0
大语言模型也会“幻觉”?揭秘AI胡说八道的背后原因与破解之道
你是否曾经遇到过这样的情况:向AI提问时,它回答得信誓旦旦,引经据典,但仔细一查却发现全是编造的?这就是大语言模型著名的"幻觉"问题。
智谷星瀚
2025-10-28
1.1K0
点击加载更多
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档
领券