技术技术

OpenAI发布AI安全对齐新方法,大幅降低幻觉率中文OpenAI发布AI安全对齐新方法,大幅降低幻觉率

📅 2026-04-28 ⏱️ 约 1 分钟阅读⏱️ 1 min read ✍️ AI导航编辑部✍️ AI Nav Editorial 🔗 openai.com
OpenAI发布AI安全对齐新方法,大幅降低幻觉率
📝 内容摘要📝 Summary

OpenAI宣布研发出新一代安全对齐技术,可将AI幻觉率降低80%,同时保持模型创造力。中文OpenAI宣布研发出新一代安全对齐技术,可将AI幻觉率降低80%,同时保持模型创造力。

📌 核心要点

  • OpenAI安全研究团队发布了一项重大突破:一种名为"语义锚定"(Semantic Anchoring)的新型对齐技术中文OpenAI安全研究团队发布了一项重大突破:一种名为"语义锚定"(Semantic Anchoring)的新型对齐技术
  • 实验结果显示,采用该技术的GPT-5系列模型在TruthfulQA基准测试中的准确率从75%提升至96%,同时在创意写作基准测试中的表现没有明显下降中文实验结果显示,采用该技术的GPT-5系列模型在TruthfulQA基准测试中的准确率从75%提升至96%,同时在创意写作基准测试中的表现没有明显下降
  • OpenAI表示,这项技术将首先应用于GPT-5.5的下一版本更新,预计将在2026年第二季度向开发者开放中文OpenAI表示,这项技术将首先应用于GPT-5.5的下一版本更新,预计将在2026年第二季度向开发者开放

OpenAI安全研究团队发布了一项重大突破:一种名为"语义锚定"(Semantic Anchoring)的新型对齐技术。

这项技术通过在模型训练过程中引入外部知识库验证机制,显著提高了AI输出的事实准确性。

实验结果显示,采用该技术的GPT-5系列模型在TruthfulQA基准测试中的准确率从75%提升至96%,同时在创意写作基准测试中的表现没有明显下降。

OpenAI表示,这项技术将首先应用于GPT-5.5的下一版本更新,预计将在2026年第二季度向开发者开放。

这一突破被视为解决AI幻觉问题的重要里程碑。

中文

OpenAI安全研究团队发布了一项重大突破:一种名为"语义锚定"(Semantic Anchoring)的新型对齐技术。

这项技术通过在模型训练过程中引入外部知识库验证机制,显著提高了AI输出的事实准确性。

实验结果显示,采用该技术的GPT-5系列模型在TruthfulQA基准测试中的准确率从75%提升至96%,同时在创意写作基准测试中的表现没有明显下降。

OpenAI表示,这项技术将首先应用于GPT-5.5的下一版本更新,预计将在2026年第二季度向开发者开放。

这一突破被视为解决AI幻觉问题的重要里程碑。

来源openai.com· 本文为编辑整理,仅供参考