Gemini 3.5 Transcribe
Google 推出的语音转录模型,支持85+语言与最多三人说话人识别
Gemini 3.5 Transcribe 是 Google Gemini Audio 家族新增的语音转录模型,用于将预录音频转录为文字,覆盖 85 种以上语言,具备高准确率并为最多三位说话人提供时间戳与说话人归属。它支持实时语种切换与无缝流式转录,用户可通过自定义词汇表适配行业术语与专有拼写,并自动去除口头填充词。对比上一代 Chirp 3 表现显著提升;面向开发者以公共预览通过 Gemini API 与 AI Studio 开放,macOS 应用英文用户即日起可用
1
2026-08-26
未收录
—
工具功能
这个工具能做什么、适合谁用,以及目前已识别的核心能力。
工具简介
Gemini 3.5 Transcribe 是 Google Gemini Audio 家族新增的语音转录模型,用于将预录音频转录为文字,覆盖 85 种以上语言,具备高准确率并为最多三位说话人提供时间戳与说话人归属。它支持实时语种切换与无缝流式转录,用户可通过自定义词汇表适配行业术语与专有拼写,并自动去除口头填充词。对比上一代 Chirp 3 表现显著提升;面向开发者以公共预览通过 Gemini API 与 AI Studio 开放,macOS 应用英文用户即日起可用
核心功能
价格信息
暂无可验证价格信息暂无足够准确的价格信息。
基础信息
- 更新频率
- 近 7 天 1 条收录动态
- 最近更新
- 2026-08-26
- 覆盖行业
更新日志
按时间记录功能更新、版本发布、新工具入库等重要变化。
- 2026-08-26新工具首发
Google 发布 Gemini 3.5 Transcribe 语音转录模型:覆盖 85+ 语言,支持三人说话人归属与时间戳、自定义词汇表适配术语、去除 um/uh 填充词与语音自然编辑,对比 Chirp 3 多语言与字错误率显著提升;即日起在 macOS Gemini 应用(英文)与开发者公共预览开放。
Gemini 3.5 Transcribe 常见问题
关于 Gemini 3.5 Transcribe 的定位、核心功能、价格与最近更新。
Gemini 3.5 Transcribe 是什么?
Gemini 3.5 Transcribe 是 Google Gemini Audio 家族新增的语音转录模型,用于将预录音频转录为文字,覆盖 85 种以上语言,具备高准确率并为最多三位说话人提供时间戳与说话人归属。它支持实时语种切换与无缝流式转录,用户可通过自定义词汇表适配行业术语与专有拼写,并自动去除口头填充词。对比上一代 Chirp 3 表现显著提升;面向开发者以公共预览通过 Gemini API 与 AI Studio 开放,macOS 应用英文用户即日起可用。
Gemini 3.5 Transcribe 有哪些核心功能?
Gemini 3.5 Transcribe 当前已核验的核心功能包括:语音转录。
Gemini 3.5 Transcribe 如何收费?
AI Equal 当前没有收录 Gemini 3.5 Transcribe 的可验证价格信息。
Gemini 3.5 Transcribe 最近有什么更新?
2026-08-26:Google 发布 Gemini 3.5 Transcribe 语音转录模型:覆盖 85+ 语言,支持三人说话人归属与时间戳、自定义词汇表适配术语、去除 um/uh 填充词与语音自然编辑,对比 Chirp 3 多语言与字错误率显著提升;即日起在 macOS Gemini 应用(英文)与开发者公共预览开放。