首页
学习
活动
专区
圈层
工具
发布
技术百科首页 >AI 幻觉 >提示词工程对抑制 AI 幻觉有什么作用?

提示词工程对抑制 AI 幻觉有什么作用?

词条归属:AI 幻觉

1. 思维链推理(Chain-of-Thought)

思维链提示强制模型分步推理,减少逻辑漏洞。MIT 研究发现最优性能出现在模型生成 3 至 7 个 distinct 推理步骤时。微软研究院报告显示,7B 参数模型使用 Logic-RL 变体在 AIME 数学竞赛题上准确率提升 125%。但较小模型(低于 7B 参数)往往难以有效运用 CoT。

2. 自我一致性校验(Self-Consistency)

通过多次独立采样生成不同推理路径,选取出现频率最高的答案。这种方法在数学问题上带来 18% 的提升,在文字应用题上提升 11%。代价是延迟增加——使用 5 条推理路径会使 API 调用耗时增加约 3.2 倍。

3. 验证循环(Chain-of-Verification, CoVe)

CoVe 是一种系统化方法:模型先起草初始回答,再规划验证问题来核查草稿,然后独立回答问题以避免偏见,最终生成经过验证的回答。实验表明 CoVe 将 F1 分数提升了 23%(从 0.39 到 0.48),优于 Zero-Shot、Few-Shot 和 Chain-of-Thought 方法。

4. 引用约束与结构化输出

要求模型为每个事实性声明提供来源引用,并将输出限制为预定义的 JSON Schema 或枚举选项。引用约束的优势不仅在于提高准确性,更在于让用户可以逐条审计答案。结构化输出则将模型的生成空间限制在有效选项范围内,从根本上缩小幻觉的空间。

5. 温度参数调优

对于事实性任务,将 temperature 设为 0 或接近 0 可显著降低幻觉风险。生产环境的推荐配置是:抽取/分类任务用 temperature=0,带引用的 RAG 回答用 temperature=0.2,头脑风暴类创意任务才使用 temperature=0.9 等高值。

相关文章
【AI 大模型】提示工程 ③ ( 提示词用法 | 提示词 Prompt 构成 | 提示词位置对权重的影响 | 提示词 Prompt 调优 | OpenAI 的 API 类型 | 提示词重要参数说明 )
大模型 对 提示词 Prompt 开头和结尾的文本更加敏感 , 最重要的内容要放在开头和结尾 , 开头 > 结尾 ;
韩曙亮
2024-07-14
2.6K0
什么是Prompt工程?为什么提示词的质量决定AI输出的好坏?
🚀 本文收录于Github:AI-From-Zero 项目 —— 一个从零开始系统学习 AI 的知识库。如果觉得有帮助,欢迎 ⭐ Star 支持!
ETL 小当家
2026-03-17
1.7K0
别再手搓提示词了!万能提示词工程编写框架让AI从“听得懂”到“做得对”
做提示词工程这么久,我见过太多人把大模型当成“许愿池”——扔一句模糊的话进去,期待AI能完美猜中心思。结果要么是泛泛而谈的废话,要么是逻辑跑偏的“幻觉”内容。
抖知书
2026-08-11
1900
上下文工程是什么?从提示词工程到上下文,一文讲透 AI 不跑偏
假设重构一个模块,聊到第 20 轮,它突然开始无视你最开始的约束——"数据库表结构不能动"。翻回去看,最初那轮对话早被挤到十万八千里外,它"看得见",但已经"记不住"了。
晚安code
2026-08-16
2250
大模型应用:医疗AI智能体幻觉防控:幻觉抑制的四层防护体系应用实践.128
大模型幻觉,是指生成式人工智能在输出内容时,产生与事实不符、无来源依据、逻辑矛盾或虚假编造信息的现象,本质是大模型的概率生成机制与真实世界知识的错位。
未闻花名
2026-06-05
5952
点击加载更多
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档
领券