技术

OpenAI发布GPT-5.5o,实现实时多模态交互

📅 2026-05-05 🏷️ 技术 ⏱️ 约 1 分钟阅读 ✍️ AI导航编辑部
OpenAI在春季发布会上展示GPT-5.5o,语音延迟降至80ms,支持实时视频、音频和文本的多模态交互。

📌 核心要点

OpenAI在2026年春季发布会上正式发布GPT-5.5o,这是继GPT-5之后的又一款重大迭代模型。

GPT-5.5o最大的突破在于实现了真正的实时多模态交互:语音延迟降至仅80ms(接近人类对话水平),支持实时视频流分析、音频理解和文本生成的无缝融合。

现场演示中,GPT-5.5o通过摄像头实时分析复杂的卡牌游戏场景,即时给出策略建议;

还能通过语音与用户进行40分钟的连续深度对话。

性能方面,GPT-5.5o在推理、代码生成和创意写作上与GPT-5.5持平,但多模态交互速度和效率提升了3倍。

OpenAI表示,GPT-5.5o将首先向ChatGPT Plus用户开放,API访问将在6月推出。

来源:https://openai.com · 本文为编辑整理,仅供参考。
查看原文来源 → 返回 AI导航 首页
分享: 微博 X QQ 微信 复制链接
微信扫码分享

打开微信「扫一扫」,分享给好友或朋友圈

关闭