AILabox
校对于
2026-08-25
EN
◐
☰
模型价格
▾
LLM Token
视频生成
图片生成
套餐订阅
数据源
AI 工具
▾
AI 工具
AI 资源
▾
模型百科
AI 术语
AI 资讯
AI 术语库
/
语音识别(STT)
多模态
图像、视频、语音等跨模态能力
语音识别(STT)
将语音转换为文本的技术,用于转写、字幕与语音输入。
语音识别用于会议转写、字幕与语音输入,主流方案已支持实时流式识别与多说话人区分,按音频时长计费。
相关术语
语音合成(TTS)
多模态模型