元峰AI笔记 · AI数字人

声音克隆变现

<titleAI 赚钱 声音克隆</title

AI 赚钱 | 声音克隆

随着视频游戏、动画电影、虚拟助手和有声读物等领域对独特、高质量语音内容的需求不断增长,都需要一系列真实的声音来赋予内容生命。

为了响应这一不断增长的需求,AI 声音克隆平台 ElevenLabs 开发了一项名为 Voice Actors 的功能。这一新功能不仅让人们能够分享自己的声音,而且还能在声音被用于项目时获得版税收入。

操作起来也很简单:只需上传 30 分钟的音频,你就可以创建一个可以在各种项目中使用的声音库。不论你拥有怎样独特的口音、舒缓的语调,还是天生就能塑造角色的声音,你的独特声音特征都可以通过 ElevenLabs 平台在全球市场中找到属于它的舞台。

使用过程如下:

登录 ElevenLabs

首先,在 ElevenLabs 平台上注册一个免费帐户。接下来,通过单击左侧菜单中的“声音”然后单击“创建”导航到 VoiceLab 部分。

这里是你可以上传 30 分钟音频内容并创建你独特的声音档案的地方。

图片展示了ElevenLabs平台的界面。上方显示“ElevenLabs”标题,下方有“Speech”和“Voices”两个选项卡,其中“Speech”被选中。在“Voices”选项下,有“Create”和“Explore”两个子选项。该图片与文档中“登录ElevenLabs”部分内容相关,对应“通过单击左侧菜单中的‘声音’然后单击‘创建’导航到VoiceLab部分”这一操作步骤,直观呈现了操作前的界面状态。

声音命名与描述

上传音频后,贡献者有机会为自己的声音命名并描述自己的声音。这将帮助潜在用户了解声音的品质和特征,让他们更容易为自己的特定项目找到完美的声音。

图片展示的是ElevenLabs平台的VoiceLab界面。界面上方显示“VoiceLab”及“Your creative AI toolkit. Design entirely new synthetic voices from scratch. Only you have access to the voices you create.”字样。下方提示“No voices created yet. Please click on 'Add Voice' to create your first one.”。中间有一个带有“+”的圆圈图标,下方文字为“Add Generative or Cloned Voice”,并标注“0 / 30”。该图片与上下文关系紧密,直观呈现了上传音频后在VoiceLab部分进行操作的界面情况。

设置价格和使用参数

ElevenLabs Voice Actors 最吸引人的一点是,你可以自定价格并为你的声音设定使用条款。这种自主权让你能够控制使用你的声音可以获得多少收入,以及在什么条件下使用。

添加付款信息,开始赚钱

设置声音配置文件后,贡献者可以添加自己的付款详细信息。一旦在项目中使用了声音,贡献者将获得使用其声音的报酬,从而从其最初的贡献中获得持续的收入流。

图片展示了ElevenLabs平台中一个名为John Smith的声音角色界面。界面显示其为年轻美国男性,声音特点为欢快且可调节,适合短视频和社交媒体。下方有“Use”(使用)、“Edit”(编辑)和“Remove”(移除)按钮,右侧有一个黄色箭头指向的分享图标。该图片与文档中介绍ElevenLabs Voice Actors平台的内容相关,直观呈现了平台中声音角色的展示及操作选项。

ElevenLabs Voice Actors 不仅为个人提供了一个分享其独特声音的平台,还培养了一个支持性社区,贡献者可以在其中与来自世界各地的用户互动。这种协作方式不仅丰富了库中可用的声音范围,还为业内人士创造了建立人脉和曝光的机会。

图片展示的是ElevenLabs Voice Actors平台的Voice Library Sharing Options设置界面。界面中可开启财务奖励,设置通知周期为180天,选择默认或自定义费率,当前为默认费率。还设有是否启用实时审核的选项。下方提示基于所选通知周期,预计每1,000个使用模型生成的字符可获$6.02版税,实际金额取决于用户类型。界面底部显示已设置180天通知周期,且告知一旦分享模型将无法减少通知周期,但可增加。

图片展示的是ElevenLabs平台的“声音分享统计”界面。界面上方显示“Voice sharing stats”,下方有“View”和“Past”选项,分别对应“Financial rewards”和“Month”。图表呈现了11月30日至12月19日期间的财务奖励情况,12月18日的USD earned为129.37美元。该图片与文档中介绍ElevenLabs平台为个人提供声音变现机会的内容相关,直观呈现了平台的收益情况。

此外,ElevenLabs 简化了流程,适用于所有拥有各种声音才华的人士。无论你是职业配音演员、有抱负的新手,还是仅仅拥有一个不同寻常或独特的声音,ElevenLabs Voice Actors 都为你提供了一个机会,让你的声音特质变现。

最终,ElevenLabs Voice Actors 为个人提供了将自己的声音才华转化为持续收入来源的突破性机会。通过这个平台分享你的声音,你不仅能满足全球市场对真实多样声音的需求,还能通过你的声音贡献获得版税,为个人才华的展示、与全球受众建立联系以及从独特声音能力中获得经济收益开辟了新路径。

声音克隆变现

还有一种方式就是帮别人克隆声音。这部分用户群体比如以下几种:

  1. 自媒体内容制作者:在视频平台上,优质的内容和吸引人的声音是吸引观众的关键。自媒体内容制作者,如电影解说员、小说配音师,他们追求的是一种能够触动人心的声音。对于这部分群体而言,使用自己真实的声音不仅可以减少机械感,还能增加内容的个性化和情感共鸣,使得每一个故事都生动起来,仿佛置身其中。

  2. 企业宣传:对于许多公司而言,企业文化和形象的传达非常重要。在制作公司宣传片或者介绍视频时,运用公司高管或者关键员工的真实声音,可以增加信息的真实性和可信度,使外界对公司有更深刻的认识。然而,忙碌的日程往往使得实际录音变得不可能,这时,声音克隆技术就显得尤为重要,它能够在不影响这些关键人物日常工作的前提下,完美复刻他们的声音。

  3. 偶像及声优声音克隆:对于狂热的粉丝而言,偶像的一言一行都有着无法替代的意义,更不用说拥有一个能够随时聆听的偶像声音了。无论是韩国明星、流行歌手还是著名声优,粉丝们愿意为了克隆偶像的声音不惜一切代价,这不仅仅是对偶像的热爱,更是一种情感的寄托和追求。这种服务为粉丝们提供了一种全新的互动方式,让他们感觉更加接近心爱的偶像。

  4. 亲人声音的克隆:最为感人的,或许是为了保留亲人声音的克隆服务。在我们的一生中,亲人的声音是陪伴我们成长的重要记忆。随着时间的流逝,这些声音可能会逐渐远去。通过声音克隆技术,人们可以永久保存亲人的声音,无论是已故的爷爷奶奶,还是远方的父母,都可以通过这种方式在特定的时刻,再次听到他们熟悉的声音,感受到他们的爱和温暖。

图片展示的是手机应用商店中“声音克隆”相关应用的搜索结果页面。页面上方有搜索框,显示“声音克隆”。下方列出多个应用,如“AI时代”“GPT-SoVITS”等,部分应用标注了价格,如“AI声音软件】AI声音克隆ai唱歌歌声软件”售价9.90元,“包邮ai声音克隆唱歌声音软件人声仿真训练合成翻唱”售价3.80元等。部分应用还标注了“包邮”“芝麻信用极好”等信息。该图片与上下文介绍声音克隆应用的内容相契合,直观呈现了相关应用的搜索结果。

图片展示的是一个关于“声音克隆”的商品列表界面。上方有搜索栏,显示“声音克隆”。下方有多个商品推荐,如“AI声音克隆代训练”售价24.90元,“最新声音克隆技术,可自用,可变现,日入1.80元”等,部分商品有“发货极快”“芝麻信用优秀”等标识。图片与上下文紧密相关,上下文在介绍声音克隆变现,此图直观呈现了相关商品及价格等信息,为读者提供参考。

声音克隆工具

目前 AI 声音克隆工具已经非常多了,这里就先简单列举 3 个。

GPT-SoVITS

GPT-SoVITS,是一个由RVC变声器创始人“花儿不哭”推出的免费开源项目。

通过模型训练,该工具能够学习并复制特定说话人的声音特征,包括情感、音色和语速,从而生成与原声音极为相似的合成语音。

同时这个工具支持多种语言的语音合成,目前包括英语、日语和中文。

项目地址:https://github.com/RVC-Project/Retrieval-based-Voice-Conversion-WebUI

图片展示的是LAI平台关于GPT - SovITS的介绍页面。页面上方有平台标志及搜索栏,右侧有用户头像等信息。中间部分介绍GPT - SovITS是耗时两个月自主研发的低成本AI音色克隆软件,可免费使用。下方有“10分钟素材训练出音色”等关键信息,还提到10分钟语音素材仍不能覆盖所有人物,因此设定目标。页面右侧有用户评论区,显示多条评论及点赞数。该图片与上下文介绍的OpenVoice等语音克隆工具相关,展示了其中一个工具的平台介绍情况。

Elevenlabs

官方链接:https://elevenlabs.io/

这个工具前面我们已经讲过了,进入到 VoiceLab 标签,选择克隆声音即可。

图片展示了ElevenLabs网站的VoiceLab页面。页面上方有导航栏,包括Speech Synthesis、Projects、Dubbing、VoiceLab等选项。页面中间有“Your creative AI toolkit”等文字介绍,下方有一个红色框突出显示的“Add Generator or Cloned Voice”按钮,提示点击以添加生成器或克隆声音。该图片与上文介绍OpenVoice项目的内容相关,用于说明在ElevenLabs网站上进行声音克隆操作的入口位置。

Openvoice

OpenVoice 是由 MyShell 推出的一个免费开源的AI即时语音克隆项目,相较于其他的语音克隆技术,OpenVoice 的优势在于仅需一段简短的音频,便能以惊人的准确度复刻说话者的音色,创造出让人信以为真的自然语音。除开复制和参考说话者的音色之外,OpenVoice 还可以对语音风格进行精细控制,包括情感的微妙变化,口音和节奏的细微差别、语速的快慢和语调的抑扬顿挫。

OpenVoice 的官网地址

GitHub项目地址:https://github.com/myshell-ai/OpenVoice

官方项目介绍:https://research.myshell.ai/open-voice

图片展示了MyShell OpenVoice的官网页面。页面上方有MyShell的标志及“OpenVoice Versatile Instant Voice Cloning”字样。下方介绍OpenVoice是一种即时语音克隆方法,仅需参考人的一段音频即可复制其声音并生成多种语言的语音。还提到OpenVoice可对语音风格进行精细控制,如情感、语速、语调等。页面底部有“Join the Community”加入社区的按钮,以及对多语言和跨语言示例的说明。该图片与文档中介绍OpenVoice的上下文紧密相关,直观呈现了其官网界面。