GPT-Transcribe

OpenAI 面向完整音频与批量任务的语音转录模型

GPT-Transcribe 是 OpenAI 推出的语音转文字模型,面向已完成音频文件、流式文件转录以及 Realtime 会话中通过 WebSocket 提交的对话轮次。它支持非结构化上下文、关键词提示和多语言提示,以提升对专业术语、多语言音频和语言切换场景的转录准确度,可通过 API 调用集成到异步和批量转录工作负载中

语音转录
访问官网
收录动态

2

最近更新

2026-07-29

评价样本

未收录

社区规模

工具功能

这个工具能做什么、适合谁用,以及目前已识别的核心能力。

工具简介

GPT-Transcribe 是 OpenAI 推出的语音转文字模型,面向已完成音频文件、流式文件转录以及 Realtime 会话中通过 WebSocket 提交的对话轮次。它支持非结构化上下文、关键词提示和多语言提示,以提升对专业术语、多语言音频和语言切换场景的转录准确度,可通过 API 调用集成到异步和批量转录工作负载中

核心功能

1 项已整理
语音转录

价格信息

付费

当前仅展示已核验的定价模式。

基础信息

更新频率
近 7 天 2 条收录动态
最近更新
2026-07-29
覆盖行业

更新日志

按时间记录功能更新、版本发布、新工具入库等重要变化。

  1. 2026-07-29新工具首发

    OpenAI 通过 API 推出 GPT Transcribe 与 GPT Live Transcribe 两款语音识别模型:前者处理预录音频约为实时的34倍,词错误率 3.31%,较前代降 0.7 个百分点,定价降 25% 至每分钟 $0.0045;后者面向低延迟实时流式转录。两模型均可接受文本上下文、关键词与多种输入语言。

  2. 2026-07-29新工具首发

    OpenAI 于 2026 年 7 月 29 日推出 GPT-Transcribe 语音转录模型,支持 API 调用,优化已完成音频文件与批量工作负载的异步转录,转录费用每分钟 0.0045 美元。官方称在 Common Voice 的 22 种语言上转录错误率为 19.27%,低于 Whisper (whisper-1) 的 40.37%。

GPT-Transcribe 常见问题

关于 GPT-Transcribe 的定位、核心功能、价格与最近更新。

GPT-Transcribe 是什么?

GPT-Transcribe 是 OpenAI 推出的语音转文字模型,面向已完成音频文件、流式文件转录以及 Realtime 会话中通过 WebSocket 提交的对话轮次。它支持非结构化上下文、关键词提示和多语言提示,以提升对专业术语、多语言音频和语言切换场景的转录准确度,可通过 API 调用集成到异步和批量转录工作负载中。

GPT-Transcribe 有哪些核心功能?

GPT-Transcribe 当前已核验的核心功能包括:语音转录。

GPT-Transcribe 如何收费?

GPT-Transcribe 当前已核验的价格模式为付费。

GPT-Transcribe 最近有什么更新?

2026-07-29:OpenAI 通过 API 推出 GPT Transcribe 与 GPT Live Transcribe 两款语音识别模型:前者处理预录音频约为实时的34倍,词错误率 3.31%,较前代降 0.7 个百分点,定价降 25% 至每分钟 $0.0045;后者面向低延迟实时流式转录。两模型均可接受文本上下文、关键词与多种输入语言。