语音识别
发布时间
2017年1月1日
定价
免费增值
分类
AI 音视频转写与字幕平台,支持 50 余种语言,提供自动摘要与主题分析。
Whisper
OpenAI 开源的语音识别模型,支持多语言转写与翻译,可本地部署,是事实上的开源 ASR 基准。
Deepgram
企业级语音识别 API,以自研端到端模型提供高精度、低延迟的转写与分析服务。
AssemblyAI
企业级语音转写与语音智能 API,提供转写、摘要、情感分析等能力,服务数千家开发者。
Trint
面向媒体与记者的 AI 转写平台,可将音视频快速转为可编辑文本并支持多人协作标注。