选模型,从你要做的事开始
← 场景指南

语音转文字,如何选模型?

语音识别将录音转为文字。文件转写、实时识别、说话人分离和时间戳有不同接口要求。

接入前需要确认

  • 01确认音频格式、采样率与时长限制。
  • 02区分文件上传和实时流式连接。
  • 03核对语言、时间戳和说话人分离支持。
  • 04为人名、术语和低质量音频保留校对步骤。

本站尚未完成该场景的正式接入契约,基础目录只用于发现。

需求示例:“把会议录音转换成中文文字
按这个场景选型 →

已整理的相关方案

查看基础目录 →
此场景尚无完整接入方案。可继续浏览厂商与基础目录,具体接口以官方文档为准。

了解资料来源与核验方法 →