AI 语音公司 Fish Audio 于 7 月 29 日宣布完成 5200 万美元种子轮融资,具体投资方暂未披露,并正式推出新一代语音生成模型 S2.1 Pro。该模型只需 5 秒音频样本即可完成声音克隆,生成速度约为 Cartesia 的两倍,成本仅为 ElevenLabs 的六分之一。
正文解读
S2.1 Pro 支持词级别的情绪、语调、语速等精细控制,被公司称为目前表达能力最强的语音模型之一。目前包括 HeyGen、LiveKit、Retell、Sanas 和 OpenArt 在内的多家 AI 企业已在生产环境中使用 Fish Audio 模型。公司还承诺,若企业采用其语音 AI 服务后无法降低至少 50% 的成本,将免费提供一年的 Fish Audio 服务。
原创文章,作者:admin,如若转载,请注明出处:https://www.23btc.com/205625/



