星知
体验星知
核心优势
产品特点
适用场景
星知大模型
新闻资讯
星知智能体
登录
返回列表
科大讯飞发布 Spark-Audio-1.0-Preview:全国产算力训练,覆盖 99 种语言、202 种方言
科大讯飞发布全国产算力训练的语音基座大模型 Spark-Audio-1.0-Preview,支持语音转写、多语言与多方言识别、环境音识别、说话人识别和情感分析等,推动智能语音从“听清”走向“听懂”。
发布时间:
2026/09/17 03:45
|
分类:
人工智能
9月16日,科大讯飞发布语音基座大模型 Spark-Audio-1.0-Preview。该模型基于全国产化算力训练而成,支持文本和语音两个模态输入、以文本模态输出,能力覆盖语音转写、多语言翻译、多方言识别、环境音识别、说话人识别、情感分析以及复杂音频问答。其可识别99种语言和202种方言。科大讯飞表示,智能语音正从“听清”向“听懂”跃升,模型能分辨说话人、语调情绪和背景声音。目前 Spark-Audio-1.0-Preview 已开放体验,API 后续将上线讯飞开放平台。
人工智能
星知
最近发布
英国 AI 初创 Emulate 启动融资,目标最高募资7亿美元、估值37亿美元
2026/09/18
千问APP升级未成年人保护模式,让青少年安全地用好AI
2026/09/18
讯飞星火语音基座大模型上线:0.65B 编码器配 30B MoE,纯国产算力训练
2026/09/17
加拿大研究员呼吁无限期暂停前沿 AI 研发:否则人类灭绝"只是时间问题"
2026/09/16