星知

logo
logo
登录

科大讯飞发布 Spark-Audio-1.0-Preview:全国产算力训练,覆盖 99 种语言、202 种方言

科大讯飞发布全国产算力训练的语音基座大模型 Spark-Audio-1.0-Preview,支持语音转写、多语言与多方言识别、环境音识别、说话人识别和情感分析等,推动智能语音从“听清”走向“听懂”。
发布时间:2026/09/17 03:45|分类:人工智能
9月16日,科大讯飞发布语音基座大模型 Spark-Audio-1.0-Preview。该模型基于全国产化算力训练而成,支持文本和语音两个模态输入、以文本模态输出,能力覆盖语音转写、多语言翻译、多方言识别、环境音识别、说话人识别、情感分析以及复杂音频问答。其可识别99种语言和202种方言。科大讯飞表示,智能语音正从“听清”向“听懂”跃升,模型能分辨说话人、语调情绪和背景声音。目前 Spark-Audio-1.0-Preview 已开放体验,API 后续将上线讯飞开放平台。
人工智能星知