OpenAI实时语音对话闭源 多模态模型

GPT-4o Audio 4o-audio

GPT-4o Audio系列 · OpenAI · 2024-05发布

闭源多模态

模型介绍

GPT-4o 的原生音频能力,实现接近实时的语音对话,理解语气与情感,是 Agent 与语音助手的新范式。

模型基础信息

模型系列GPT-4o Audio系列
开发机构OpenAI
发布时间2024-05
参数规模闭源(未公开)
上下文窗口未公开
模型类型实时语音对话
中文能力良好
使用方式网页体验 / API调用

免费额度与收费政策

按量付费 订阅

模型能力介绍

✅ 核心优势

  • 实时语音交互
  • 情感理解
  • 低延迟

⚠️ 短板与局限

  • 价格较高
  • 国内需代理

🎯 适用场景

  • 语音助手
  • 客服机器人
  • 实时翻译

模型使用教程

本章节整理 GPT-4o Audio 的在线体验、API调用、本地部署全套入门教程,快速上手使用该模型。

暂无内容,可前往官方文档查看。

暂无内容,可前往官方文档查看。

暂无内容,可前往官方文档查看。