国外最新AI技术在有声书上已具备不同语种切换功能

  近期,人工智能技术在有声书领域的应用呈现加速落地趋势,推动行业进入技术革新与模式重构的关键阶段。以亚马逊旗下Audible为代表的平台,于5月13日宣布推出人工智能驱动的旁白服务及翻译功能测试版,标志着AI技术在内容生产与全球化分发环节的深度渗透。

  技术突破与行业标准化进程此次技术升级的核心在于语音合成与翻译能力的双重突破。Audible采用基于人工智能驱动,实现了超过100种英语、西班牙语、法语、意大利语的AI语音合成,覆盖多口音与方言体系。

  翻译服务方面,Audible计划于2025年推出的测试版将支持英语与西、法、意、德四种语言的“语音到语音”实时翻译,同时提供专业语言学家审核通道,确保文化细微差别的精准传递。这种“技术+人工”的混合模式,既满足规模化生产需求,又保留内容质量把控的柔性空间,为行业树立了技术应用的新范式。

  市场生态演变的同时,行业竞争呈现多元化态势。今年4月,Spotify与ElevenLabs合作,为自助出版的有声书作者提供自动化的人工智能转换服务。与此同时,瑞典的Storytel公司已经实施了“语音切换器”技术,使读者能够在一本书的收听过程中更换旁白者,并且已经尝试开发完全由人工智能制作的有声书籍。

  这种技术竞争背后,反映出行业生态的结构性变革。据市场研究机构预测,2029年全球有声书市场规模将突破304亿美元,其中AI驱动的内容生产将成为核心增长极。传统出版商与平台正面临双重挑战:一方面需应对技术颠覆带来的生产流程重构,另一方面要平衡AI效率与内容质量的关系。

  随着AI技术的广泛应用,行业开始深入探讨技术伦理与艺术价值的平衡。Audible允许专业叙述者通过提交录音训练AI克隆自己的声音,既提升制作效率,又保留人类创作者的艺术控制权,这种“AI+人工”的协作模式被视为行业的可行路径。然而,完全依赖AI生成内容可能导致叙事艺术的扁平化,如语调同质化、情感表达程式化等问题,部分用户调研显示,60%的重度用户仍将“朗读者个人风格”视为选择有声书的关键因素。

  展望未来,Audible公司相关负责人表示,关键在于为用户提供卓越的收听体验,所以了解用户喜欢哪些内容也很重要。教育内容具有特别的潜力,这些内容完全可以用有声书的方式呈现。假设平台有100万部有声书的规模,那么随着向更多语言的拓展,有机会把有声书这个品类发展成一个更庞大的产品,这是一个巨大的机遇。

  当前,有声书行业正站在技术与艺术的十字路口。AI技术的高效性与规模化生产能力,为行业突破内容供给瓶颈提供了可能;而创作者的文化积淀与情感表达,仍是构建叙事深度的核心要素。未来的行业领导者或将在这两者间找到平衡点——既利用AI实现长尾内容的低成本开发,又通过人类艺术家的参与确保头部作品的品质标杆,最终推动有声书从碎片化娱乐向深度文化体验转型。

  文章来源:央广广告