微软Azure Neural TTS(神经网络版文本转语音)新增五种声音模型,让我们再次体会到了“风格迁移”技术对AI语音模型多情感多风格的强大支持。
此次更新的五个美式英语声音模型,包括青春甜美的Jane、低沉温和的Nancy、随性且精力充沛的Davis、响亮激昂的Jason和沙哑粗犷的Tony。在“风格迁移”技术的支持下,不仅拥有开心(cheerful)、伤心(sad)、生气(angry)、兴奋(excited)、期待(hopeful)、友好(friendly)、不友好(unfriendly)和恐惧(terrified)等丰富的情感表现,还拥有首次运用的呼喊(shouting)和耳语(whispering)两种表达方式。至此,用户拥有可选择的美式英语声音模型已达到20个,丰富的情感和风格让应用场景更加多元。
现在就来听听这5个新声音吧
点击声音模型,感受AI声音的两种新表达方式
点击声音模型示例,感受合成语音蕴含的情感
情感或表达方式 |
示例(男性) |
示例(女性) |
开心(cheerful) |
||
期待(hopeful) |
||
友好(friendly) |
||
不友好(unfriendly) |
||
恐惧(terrified) |
“风格迁移”技术的原理是把一个声音模型的韵律和语调复制到另一个声音模型上,从而让后者在本身音色不变的前提下,也可以拥有前者说话的韵律和语调。过去,声音风格的搭建主要依靠录音演员录制各种风格的声音数据,再使用录音数据来生成多风格的智能语音模型,但是一名录音演员难以演绎所有风格的声音。风格迁移技术创新地解决了这一问题,可以高效地赋予多AI声音情感和风格。
声音风格和声音情感模型的持续更新,让Azure Neural TTS的合成语音在多种业务场景中得到了广泛应用,让用户感受到了更逼真的语音体验。例如,游戏平台可以快速为角色生成多种情感声音,为游戏增添更多符合情节的个性化表达,让虚拟游戏世界栩栩如生。“State of Decay”(腐烂国度)的创作者——微软亡灵工作室 (Undead Labs) 的使命是为游戏开创崭新的方向,他们在游戏开发中就应用了Azure Neural TTS。推出过包括“Psychonauts 2”(精神病患者2)在内的多款游戏的Double Fine工作室,也正在利用Azure Neural TTS制作未来游戏项目的原型。音频解决方案提供商Remixd在其平台中集成了Azure Neural TTS的声音模型Jenny和Davis,让其客户在创建音频内容时有了更多选择。
关于Azure Neural TTS
微软Azure Neural TTS是Azure认知服务中强大的语音合成功能,能够让开发人员使用AI技术将文本转换为逼真的声音。截止目前,微软Azure Neural TTS支持全球140个国家和地区的语言,提供400个声音模型,可加速声音的自动化生产,帮助各种企业更快地训练出满足业务场景的声音,打造出专属的声音品牌——无论是呼叫中心、语音助手、有声书制作、聊天机器人、语音导购,还是影视剧/动漫配音、自媒体短视频、情感电台、教育培训等场景。
持续的技术迭代和版本更新,让Azure Neural TTS 可以为更多企业、更多场景提供逼真、自然、接地气的声音体验。同时,微软的所有技术进步都接受微软负责任的 AI流程的指导,遵循公平、包容、可靠性与安全性、透明、隐私与保障、负责的原则,并通过微软内部的负责任人工智能办公室 (ORA),人工智能、伦理与工程研究委员会 (Aether),以及负责任AI战略管理团队 (RAISE) 来监督、实施这些道德标准。
好文章,需要你的鼓励
Hugging Face推出开源工具Yourbench,允许企业创建自定义基准来评估AI模型在其内部数据上的表现。这一工具通过复制大规模多任务语言理解基准的子集,以极低成本实现了对模型性能的精确评估。Yourbench的出现为企业提供了更贴合实际需求的AI模型评估方法,有望改善模型评估的方式。
Cognition AI 推出 Devin 2.0,这是其 AI 驱动的软件开发平台的更新版本。新版本引入了多项功能,旨在提升开发者与自主代理之间的协作效率。最引人注目的是,Devin 2.0 的起价从每月 500 美元大幅下调至 20 美元,使其更易于普及。新功能包括并行 Devin、交互式规划、代码库搜索等,有望提升开发效率并增强用户控制。
安迪·卡拉布蒂斯是一位杰出的CIO,她的职业生涯横跨多个行业和地区,经历了多次变革时刻。她在福特和通用汽车锻炼了领导力和技术专长,后来在戴尔、拜奥根和国家电网等公司担任高管,推动战略创新。本文总结了她对IT领导者核心技能的见解,包括战略沟通、情商、协作、远见卓识、变革管理和敏捷性等,对当今IT领导者具有重要参考价值。
边缘 AI 计算将使人形机器人、智能设备和自动驾驶等应用从数据中心和云端服务器解放出来,转移到制造车间、手术室和城市中心等场景。它能实现低延迟和自主决策,使 AI 无处不在,推动工业设施全面自动化,彻底改变商业和生活方式。边缘 AI 正在快速发展,各大科技公司纷纷推出相关硬件和软件平台,未来将为各行各业带来巨大变革。