跳到正文
转写 API

转写 API 总览

把音频提交给 iKho 转写引擎,异步拿回带说话人与逐句时间戳的结构化逐字稿。

开发者平台处于内测阶段,接口契约以联调时提供的正式文档为准;账号由对接工程师开通,见联系我们

能力

  • 说话人分离:自动区分并标注不同发言人,可选返回声纹向量。
  • 逐句时间戳:每个片段带毫秒级起止时间,便于回放定位。
  • 中英混说:同一句话中英文夹杂也能正确识别。
  • 自动语种识别:不指定语言时自动判定,支持按片段或章节回报语种。

转写模型

模型取向适用场景
ikho-asr-pro精度优先会议纪要、医疗随访、销售拜访、访谈等对准确度要求高的长音频
ikho-asr-fast时延优先需要尽快拿到结果的场景,如门店巡检速记

异步轮询

转写是异步任务:提交音频后立即拿到 transcription_id 与初始状态,随后按此标识轮询任务,直到进入终态。

1
提交音频
调用 POST /open/partner/ai/transcriptions/,传入 file_url 与参数,返回 transcription_id
2
轮询任务
调用 GET /open/partner/ai/transcriptions/{transcription_id} 查询状态。PENDINGRECEIVEDSTARTEDPROGRESS 表示进行中,继续轮询;SUCCESS 表示结果就绪;FAILUREREVOKED 为终态失败。