DataLearner 标志
GP

GPT-4o Mini TTS - 2025-12-15

语音大模型Audio / RealtimeGPT-4o

OpenAI GPT-4o Mini TTS - 2025-12-15

发布时间: 2025-12-15更新于: 2026-06-14浏览量: 470
在线体验GitHubHugging Face对比
模型参数
暂无数据
上下文长度
暂无数据
多语言支持
暂无数据
推理能力
3/5

OpenAI GPT-4o Mini TTS - 2025-12-15 是由 OpenAI 发布的 AI 模型,发布时间为 2025-12-15,定位为 语音大模型,采用 不开源 许可。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

GPT-4o Mini TTS - 2025-12-15

模型基本信息

推理过程
暂无数据
思考模式
常规模式 (默认)思考模式
上下文长度
暂无数据
最大输出长度
暂无数据
模型类型
语音大模型
输入/输出模态
文本 → 音频
发布时间
2025-12-15
模型文件大小
暂无数据
MoE架构
未公布
总参数 / 激活参数
未公布 / 未公布
知识截止
暂无数据
GPT-4o Mini TTS - 2025-12-15

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
在线体验
暂无
GPT-4o Mini TTS - 2025-12-15

官方介绍与博客

DataLearnerAI博客
暂无
GPT-4o Mini TTS - 2025-12-15

API接口信息

接口速度
3/5
暂无公开的 API 定价信息。
GPT-4o Mini TTS - 2025-12-15

发布机构

OpenAI GPT-4o Mini TTS - 2025-12-15

模型解读

模型简介

GPT-4o Mini TTS - 2025-12-15 是 OpenAI 于 2025 年 12 月 15 日在平台 API 中推出的文本转语音(Text-to-Speech)模型快照版本,隶属于 GPT-4o 音频模型体系中的 Mini 分支。该型号主要面向需要稳定、高质量语音合成能力的开发场景。

技术背景与定位

该模型为 GPT-4o Mini TTS 系列的日期快照版本。OpenAI 目前未公开其参数规模、上下文窗口或训练数据细节,该快照主要用于线上版本管理与能力迭代,而非独立架构发布。

核心能力与模态支持

模型支持文本输入并生成语音输出,覆盖多语言语音合成能力。根据开发者社区披露信息,该版本在多语种场景下的稳定性和词错误率方面相较此前版本有所改进。

性能与评测信息

公开信息主要来自 OpenAI 开发者社区的更新说明,其中提及在 Common Voice 等语音评测场景中的词错误率下降。目前尚未发布完整的标准化基准测试报告或论文级评测数据。

访问方式与许可

该模型通过 OpenAI 官方 API 提供服务,未开源,使用与商用需遵循 OpenAI 平台的统一服务条款。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码