据官方公告,AI 语音公司 Fish Audio 在种子轮融资中筹集了 5200 万美元,并于 7 月 29 日上线其下一代语音模型 S2.1 Pro。该模型仅需基于 5 秒音频样本即可克隆人声,生成速度约比 Cartesia 快 2 倍,制作成本约为 ElevenLabs 的六分之一。
S2.1 Pro 支持逐词级的情感、语调和速度控制,并被描述为可用的最具表现力的语音模型之一。包括 HeyGen、LiveKit、Retell、Sanas 和 OpenArt 在内的多家公司已在生产环境中采用 Fish Audio 的模型。为庆祝成立一周年,Fish Audio 正在提供对 S2.1 Pro 的免费为期一个月的访问权限。