AI语音合成技术新突破:克隆语音逼真度媲美真人
AI导读:
英国伦敦玛丽女王大学研究团队指出,AI语音合成技术已进入新阶段,克隆语音逼真度与真人录音无异,部分AI生成声音可信度超越真人,AI语音技术发展带来机遇与挑战。
许多人仍认为人工智能(AI)生成的语音听起来“机械感”明显,但英国伦敦玛丽女王大学研究团队在新出版的《公共科学图书馆·综合》杂志上发表论文指出,AI语音合成技术已进入新阶段,其生成的“克隆语音”或深度伪造声音,逼真度与真人录音无异。这项AI语音技术标志着人工智能领域的重大突破。
研究团队采用当前最先进的AI语音合成工具,生成两类合成语音:一类是基于真人录音的“克隆”声音,旨在模仿特定说话者;另一类则由大型语音模型生成,不针对具体个人。参与者被要求辨别声音的真实性与可信度。
尽管研究未发现AI声音存在“超真实效应”(即比真人更像真人),但结果显示,“克隆语音”的逼真度已与真人声音不相上下,令人难以分辨。且部分AI生成的声音在可信度评价中甚至超越了真人录音。这种AI语音逼真度提升在科技领域引发了广泛关注。
研究团队表示,AI语音已渗透日常生活,如Alexa、Siri及各类客服系统。虽然当前系统音色仍具机械特征,但自然度接近人声的AI语音技术已然成熟。利用商用软件仅需几分钟真人录音,即可快速、低成本地生成高质量声音克隆,且几乎无需专业知识。这体现了AI语音技术的强大实用性。
最新研究显示,公众对高仿真语音认知机制的研究迫在眉睫。AI语音技术的飞速发展有望给教育、人机交互等领域带来创新机遇——在这些领域,定制的高质量合成语音可增强用户体验。但是,合成语音也对伦理、版权和安全构成挑战,尤其在虚假信息、诈骗与身份冒用等方面需加强防范。
(文章来源:科技日报)
郑重声明:以上内容与本站立场无关。本站发布此内容的目的在于传播更多信息,本站对其观点、判断保持中立,不保证该内容(包括但不限于文字、数据及图表)全部或者部分内容的准确性、真实性、完整性、有效性、及时性、原创性等。相关内容不对各位读者构成任何投资建议,据此操作,风险自担。股市有风险,投资需谨慎。如对该内容存在异议,或发现违法及不良信息,请发送邮件至yxiu_cn@foxmail.com,我们将安排核实处理。

