豆包语音识别模型 2.0 上线:不仅“听懂字”还能“看懂图”,支持日韩德法等 13 种外语 模型推理能力提升,通过深度理解上下文完成精准识别,上下文整体关键词召回率提升 20%;支持多模态视觉识别,不仅“听懂字”还能“看懂图”,通过单图和多图等视觉信息输入让文字识别更精准;支持日语、韩语、德... AI 新资讯行业资讯# 语音识别模型# 豆包 8个月前5,755207
阶跃星辰发布 StepAudio 2.5 ASR 自动语音识别模型:推理速度提升 400%,定价骤减 90% 阶跃星辰 StepAudio 2.5 ASR 将大语言模型推理加速技术引入语音识别,实现 400% 速度提升与 60% 时延降低,并支持 30 分钟长音频端到端转写,无需分段。新模型定价仅 0.15 ... AI 新资讯行业资讯# StepAudio 2.5 ASR# 语音识别模型# 阶跃星辰 3个月前3,586498
单模型支持 30 种语言 + 16 种方言,阿里千问升级 Fun-ASR-Realtime 语音识别模型 在覆盖八大方言区的 16 种方言识别测试中,Fun-ASR-Realtime 字符准确率平均为 88.62%,在 12 类方言上领先。 AI 新资讯行业资讯# FunASRRealtime# 千问大模型# 语音识别模型 4周前1,968659