科大讯飞发布Spark-Audio-1.0-Preview,音频大模型为智能汽车人机交互注入新动能

2026-09-17 17:44:17
作者:共谋发展的
分享
AIME

问财摘要

1、科大讯飞发布国内首个面向全场景音频智能的预览版大模型Spark-Audio-1.0-Preview,标志着其在多模态大模型领域迈出重要一步。该模型具备强大的语音识别、合成、音频内容理解及多语言交互能力,支持高保真语音合成、复杂场景下的语音转写、情感化语音表达以及跨语言语音翻译等功能。 2、其在高精度与低延迟方面实现突破,并开放API接口与灵活部署方案,有望在车载语音助手、多语言出行服务、车内音频内容理解等场景中加速落地,推动人机交互向更自然、更智能的方向演进。
免责声明 内容由AI生成
文章提及标的
智能座舱--
科大讯飞--
查看股票机会下载客户端

9月16日,安徽省汽车行业协会副会长单位——科大讯飞(002230)正式发布Spark-Audio-1.0-Preview。作为国内首个面向全场景音频智能的预览版大模型,该产品的发布标志着科大讯飞(002230)在多模态大模型领域迈出重要一步,也为安徽汽车产业在智能座舱(886059)、车载语音交互等关键环节的技术升级提供了新的支撑。

从技术层面看,Spark-Audio-1.0-Preview聚焦音频理解与生成,具备强大的语音识别、语音合成、音频内容理解及多语言交互能力,支持高保真语音合成、复杂场景下的语音转写、情感化语音表达以及跨语言语音翻译等功能。其在高精度与低延迟方面实现突破,并开放API接口与灵活部署方案,可面向开发者和企业提供高效、易用的音频智能解决方案。

Spark-Audio-1.0-Preview所具备的复杂场景语音转写、高保真合成与跨语言翻译等能力,与智能座舱(886059)对自然交互、多模融合的需求高度契合,有望在车载语音助手、多语言出行服务、车内音频内容理解等场景中加速落地,推动人机交互向更自然、更智能的方向演进。

免责声明:风险提示:本文内容仅供参考,不代表同花顺观点。同花顺各类信息服务基于人工智能算法,如有出入请以证监会指定上市公司信息披露平台为准。如有投资者据此操作,风险自担,同花顺对此不承担任何责任。
homeBack返回首页
不良信息举报与个人信息保护咨询专线:10100571违法和不良信息涉企侵权举报涉算法推荐举报专区涉青少年不良信息举报专区

浙江同花顺互联信息技术有限公司版权所有

网站备案号:浙ICP备18032105号
证券投资咨询服务提供:浙江同花顺云软件有限公司 (中国证监会核发证书编号:ZX0050)
AIME