GPT-Transcribe
OpenAI 面向完整音频与批量任务的语音转录模型
GPT-Transcribe 是 OpenAI 推出的语音转文字模型,面向已完成音频文件、流式文件转录以及 Realtime 会话中通过 WebSocket 提交的对话轮次。它支持非结构化上下文、关键词提示和多语言提示,以提升对专业术语、多语言音频和语言切换场景的转录准确度,可通过 API 调用集成到异步和批量转录工作负载中
1
2026-07-29
未收录
—
工具功能
这个工具能做什么、适合谁用,以及目前已识别的核心能力。
工具简介
GPT-Transcribe 是 OpenAI 推出的语音转文字模型,面向已完成音频文件、流式文件转录以及 Realtime 会话中通过 WebSocket 提交的对话轮次。它支持非结构化上下文、关键词提示和多语言提示,以提升对专业术语、多语言音频和语言切换场景的转录准确度,可通过 API 调用集成到异步和批量转录工作负载中
核心功能
价格信息
暂无可验证价格信息暂无足够准确的价格信息。
基础信息
- 更新频率
- 近 7 天 1 条收录动态
- 最近更新
- 2026-07-29
- 覆盖行业
更新日志
按时间记录功能更新、版本发布、新工具入库等重要变化。
- 2026-07-29新工具首发
OpenAI 于 2026 年 7 月 29 日推出 GPT-Transcribe 语音转录模型,支持 API 调用,优化已完成音频文件与批量工作负载的异步转录,转录费用每分钟 0.0045 美元。官方称在 Common Voice 的 22 种语言上转录错误率为 19.27%,低于 Whisper (whisper-1) 的 40.37%。
GPT-Transcribe 常见问题
关于 GPT-Transcribe 的定位、核心功能、价格与最近更新。
GPT-Transcribe 是什么?
GPT-Transcribe 是 OpenAI 推出的语音转文字模型,面向已完成音频文件、流式文件转录以及 Realtime 会话中通过 WebSocket 提交的对话轮次。它支持非结构化上下文、关键词提示和多语言提示,以提升对专业术语、多语言音频和语言切换场景的转录准确度,可通过 API 调用集成到异步和批量转录工作负载中。
GPT-Transcribe 有哪些核心功能?
GPT-Transcribe 当前已核验的核心功能包括:语音转录。
GPT-Transcribe 如何收费?
AI Equal 当前没有收录 GPT-Transcribe 的可验证价格信息。
GPT-Transcribe 最近有什么更新?
2026-07-29:OpenAI 于 2026 年 7 月 29 日推出 GPT-Transcribe 语音转录模型,支持 API 调用,优化已完成音频文件与批量工作负载的异步转录,转录费用每分钟 0.0045 美元。官方称在 Common Voice 的 22 种语言上转录错误率为 19.27%,低于 Whisper (whisper-1) 的 40.37%。