AssemblyAI 发布 Dictation API:专为语音输入优化的智能纠错与格式重构引擎
AssemblyAI 正式推出 Dictation API,这是其首款专为语音输入场景设计的 API。该工具基于 Universal-3.5 Pro 模型,能够自动处理口语中的自我修正、填充词去除及专有名词拼写校正,并将文本重构为符合应用需求的特定格式。相比传统转录,Dictation API 实现了从“逐字记录”到“可直接发送”的跨越,支持 19 种语言,短音频响应时间低于 0.36 秒,显著提升了用户体验与开发效率。