
在1月23日的一次官方宣布中,文本到语音的转换平台ElevenLabs宣布他们已经成功完成了一轮僧高达8000万美元的B轮融资。该轮融资由Andreessen Horowitz和Nat Friedman作为领头投资者,同时得到了像红杉资本和SV Angel等知名投资机构的支持。
ElevenLabs平台为用户提供了一个能够将文本和语音转换为多达29种不同语言和逾千种声音选项的强大工具。用户不仅能够生成各类语音,还能够根据自己的需求调整语音的清晰度、风格和稳定性等多项参数。
随着融资的宣布,ElevenLabs也对外公布了几项新产品的预览版,包括配音工作室、语音库和一款移动应用。这些新动作进一步巩固了ElevenLabs在AI生成语音技术领域的领先地位。

根据最新提供的资讯,ElevenLabs于2022年4月成立,初定总部于美国纽约。起初仅有不到十名成员的小型创业团队,现如今已发展到拥有逾40位员工的成熟能力。
自成立以来,ElevenLabs不断获得资金支持,2023年1月,公司成功完成了200万美元种子轮投资,随后在同年6月21日锁定了额外的1900万美元A轮融资。
ElevenLabs在2023年初推出自家的测试产品,凭借着用户界面的简洁、易用性以及无需支付费用的特点,迅速获得了广泛的关注,用户数量激增至超过100万。目前,有41%的财富500强企业已在日常运营中采用此平台的服务。
ElevenLabs这一创新的平台得到了多家业界佼佼者的认可与采纳,其中包括全球有声读物巨头Storytel、领先的内容创造集团TheSoul Publishing,以及著名游戏开发商Paradox Interactive。它们利用ElevenLabs提供的技术来制作有声读物、电影配音、以及为游戏中的非玩家角色(NPC)创建声音等内容。

Eleven Labs核心团队
ElevenLabs引以为傲的产品线,采用了公司自主研发的技术,如Eleven Multilingual v2和Turbo v2等先进的大型语言模型。这些技术使得平台能够提供一系列创新功能,包括文本到语音转换、语音到语音生成、语音复制和语音识别等。
对于文本到语音的功能,该平台允许用户轻松将书面文本转换为多种不同语言的语音,支持的语言高达29种,包括中文、英文、韩文和日文等。此外,还支持跨语言的文本到语音生成——例如,用户可以上传一段英文文本,然后直接生成对应的意大利语配音。
使用流程设计得非常直观简单:用户首先选择希望生成的语音类型,随后选择所需应用的模型、设定语音参数并选取特定的模仿语音,最终只需要输入文本内容,平台通常能在几秒钟内完成语音生成。
在语音转语音服务方面,ElevenLabs提供了一项创新功能,可无缝地将已有语音改变为另一种语音效果。举例而言,用户可上传一段男性声音的录音,并轻松将其转换成老年人的音质。与传统语音转换方法相比,该过程大为简化。据悉,传统流程一般需要从原始音频中采集样本,接着分析提取基频、共振峰以及时域和频域特性等多项音频指标,并进行如去噪、规范化等多步骤处理,整个过程既复杂又耗时。
然而,通过ElevenLabs的技术,用户可以轻松实现一键式的语音变换。更为人性化的是,平台还支持可视化的语音控制功能,用户可以根据个人喜好或需求调整语音的多种参数,如强度、音调以及情感表达等,以达到最佳的定制效果。

