Gemini
更新于 2026-10-09
Gemini 3.5 Transcribe Live
Gemini 3.5 Transcribe Live 是一款专为实时音频转录设计的语言模型,支持超长上下文窗口处理,适用于会议记录、直播字幕、语音交互等实时音频转写场景。
价格信息
输入价格
$3.50 / 1M tokens
输出价格
$21.00 / 1M tokens
上下文窗口
131072 tokens
能力概览
多模态
不支持
擅长领域
支持实时音频流式转录
131072 tokens 超长上下文窗口
低延迟的专业级语音识别
适合长时间音频内容的连续处理
相关模型
Gemini 3.5 Transcribe
Gemini
Gemini 3.5 Transcribe 是 Gemini 公司推出的音频转录模型,专注于准确快速地将语音内容转换为文本,适用于会议记录、语音助手等领域。
$2.00 / 1M tokens
GPT Audio
OpenAI
OpenAI 推出的音频生成模型,擅长从文本生成高质量音频,适用于音频创作和编辑。
$2.50 / 1M tokens
GPT Audio Mini
OpenAI
OpenAI推出的音频处理模型,专注于语音理解与音频内容分析,适用于语音转文本、音频分类等任务,支持长上下文处理。
$0.6000 / 1M tokens
GPT Live Transcribe
Azure
微软Azure推出的实时音频转录模型,支持将语音内容快速准确转为文字,适用于会议记录、语音转写等实时音频处理场景。