技术

OpenAI发布AI安全对齐新方法,大幅降低幻觉率

📅 2026-04-28 · AI导航编辑部
OpenAI宣布研发出新一代安全对齐技术,可将AI幻觉率降低80%,同时保持模型创造力。

OpenAI安全研究团队发布了一项重大突破:一种名为"语义锚定"(Semantic Anchoring)的新型对齐技术。

这项技术通过在模型训练过程中引入外部知识库验证机制,显著提高了AI输出的事实准确性。

实验结果显示,采用该技术的GPT-5系列模型在TruthfulQA基准测试中的准确率从75%提升至96%,同时在创意写作基准测试中的表现没有明显下降。

OpenAI表示,这项技术将首先应用于GPT-5.5的下一版本更新,预计将在2026年第二季度向开发者开放。

这一突破被视为解决AI幻觉问题的重要里程碑。

来源:https://openai.com/safety