9月16日,安徽省汽车行业协会副会长单位——科大讯飞(002230)正式发布Spark-Audio-1.0-Preview。作为国内首个面向全场景音频智能的预览版大模型,该产品的发布标志着科大讯飞(002230)在多模态大模型领域迈出重要一步,也为安徽汽车产业在智能座舱(886059)、车载语音交互等关键环节的技术升级提供了新的支撑。
从技术层面看,Spark-Audio-1.0-Preview聚焦音频理解与生成,具备强大的语音识别、语音合成、音频内容理解及多语言交互能力,支持高保真语音合成、复杂场景下的语音转写、情感化语音表达以及跨语言语音翻译等功能。其在高精度与低延迟方面实现突破,并开放API接口与灵活部署方案,可面向开发者和企业提供高效、易用的音频智能解决方案。
Spark-Audio-1.0-Preview所具备的复杂场景语音转写、高保真合成与跨语言翻译等能力,与智能座舱(886059)对自然交互、多模融合的需求高度契合,有望在车载语音助手、多语言出行服务、车内音频内容理解等场景中加速落地,推动人机交互向更自然、更智能的方向演进。
