OpenAI发布GPT-4o,这是一个多模态AI模型,能够处理文本、音频、图像和视频输入。 新模型在响应速度上有显著提升,音频响应时间从5.4秒降低到320毫秒。 GPT-4o在非英语语言处理上有明显改进,同时API成本降低了50%。