语音人工智能初创公司ElevenLabs扩展了其现有的D轮融资,吸引了大型机构投资者和娱乐界人士作为新投资者。继今年年初获得110亿美元(约合15.9984万亿韩元)的企业估值后,其经常性收入也迅速增长,正在巩固其作为"音频AI"市场领军者的地位。
ElevenLabs于6日(当地时间)宣布,数十名新投资者参与了最新一轮融资。该公司曾在今年2月完成D轮融资,募集了5亿美元(约合7272亿韩元)。当时的估值为110亿美元。
本轮扩展融资的规模尚未公开。但公司表示,英伟达($NVDA)旗下初创投资机构NVentures,以及贝莱德、惠灵顿管理等大型金融机构均已参与。此外,包括杰米·福克斯、伊娃·朗格利亚在内的30多名娱乐界人士也名列其中。
在进行本轮融资的同时,ElevenLabs还进行了一笔价值1亿美元(约合1454亿韩元)的收购要约交易。此举旨在允许现有投资者将其部分持股变现。这是公司在过去一年中第二次进行此类交易。这被解读为市场对非上市AI企业的投资需求依然高涨的信号。
主力模型 "Eleven v3" 推动语音合成高级化
ElevenLabs于2月推出了其代表模型"Eleven v3"。该模型可根据用户输入的脚本,在70多种语言中生成语音。与之前的版本相比,其特点在于能更精确地处理较长数字或化学式等发音复杂的表达,并且能够模拟多位说话者对话的场景。
除通用模型外,公司还提供针对特定用途的专用模型。公司解释说,"Eleven v2.5 Turbo"平均延迟时间仅为约75毫秒,适用于需要近乎实时响应用户请求的服务。此外,公司还拥有针对音乐生成、语音转录等细分用途的模型系列。
客户可通过API和云服务"ElevenAgents"使用这些模型。ElevenAgents旨在让企业应用更轻松地集成语音AI。例如,它减少了诸如客户服务聊天机器人如何在对话中应对打断话语等细节配置工作。
经常性收入增至5亿美元…预告将扩展视频功能
面向创作者的"ElevenCreative"服务也是业务扩展的一个支柱。该服务针对广告旁白等制作任务,提供超过一万种AI语音库。其核心功能"Studio 3.0"可以生成合成语音、音乐和音效,还可以对现有多媒体文件中的语音进行精加工。例如,可分离出包含噪音的特定片段,然后用同音色的AI语音自然地进行替换。
业绩增长势头也十分强劲。ElevenLabs当天透露,其年化经常性收入(ARR)已从今年年初的3.5亿美元增至5亿美元(约合7272亿韩元)。短短几个月内增长了约43%。
公司计划将新筹集的资金用于扩充海外客户支持组织,并为ElevenCreative增加视频生成功能。随着生成式AI的竞争从文本和图像迅速扩展到语音和视频,ElevenLabs此次成功融资被视为一个信号,表明"音频AI"正超越单一市场,向综合多媒体AI领域演进。
TP AI 注意事项 本文使用基于 TokenPost.ai 的语言模型进行摘要。正文中的重要内容可能被遗漏或与事实不符。

