元峰AI笔记 · AI数字人

数十年前,技术专家就开始预测数字永生的可能性

<title数字永生</title

数字永生

最近浙江父亲用 AI “复活”儿子的案例破圈了,这个制作团队已服务 600 个家庭,每次收费最高 10000 元。这个背后的技术就是 AI 数字人,数字永生。

在浙江的一个普通家庭里,一位父亲通过 AI 技术做到了似乎只存在于科幻小说中的事情——“复活”了他的儿子。这不是魔法,也不是幻想,而是当下 AI 技术发展的一个真实写照。这项技术,正是 AI 数字人,正逐渐成为连接现实与数字永恒的桥梁,为悲痛的心灵带来慰藉,为科技与文化传承开辟新径。

图片展示了一则新闻报道画面,上方文字显示浙江父亲用AI“复活”儿子,制作团队已服务600个家庭,每次收费最高10000元,报道时间为1月30日,地点在浙江金华。画面中人物戴着帽子,下方文字提到AI模拟生成吴先生儿子的声音,还称超过半数是中老年人“复活”逝去子女,让孩子以“数字生命”方式回到身边。该图片与文档中浙江父亲用AI“复活”儿子的案例内容相呼应,直观呈现新闻信息。

在这个信息化迅速发展的时代,数字永生的概念——通过技术手段将人的意识、记忆甚至整个身份转移到数字世界中,实现某种形式的“永久存在”——已经不再是遥不可及的梦想。从浙江父亲的故事到全球范围内对 AI 数字人技术的探索,我们见证了一种全新的记忆保存与情感表达方式的诞生。

这篇文章将带您深入了解 AI 数字人技术的现状、应用及其背后的深远意义,探讨这项技术如何在纪念逝去的亲人、教育培训、心理咨询以及娱乐等多个领域发挥作用。同时,我们也将思考这一技术发展所面临的伦理、法律和技术挑战,以及它对人类社会和文化传承可能带来的影响。

数字永生是指将人类的意识或记忆转移到数字世界,从而实现永久存在。目前,数字人永生还处于概念阶段,但已经有一些公司开始进行相关研究。

钱学森数字人

今年 5 月 27 日,钱学森数字人坐在一排书架前再度分享自己的观点:“1990 年,我曾将 VR 翻译成‘灵境’。今天元宇宙概念兴起,我觉得‘灵境’较元宇宙表达的意愿更为广阔深远,也更有中国味。‘灵境’是一个和谐的人机环境,一个崭新的信息空间,即将推动思维科学与大成智慧的发展,将引发一系列震撼世界的变革。”

使用 AI 数字人技术,能够让已逝的、只有少量低质量影音资料留存的国家功勋“活化”,让老科学家精神、红色文化宣传也能踏上人工智能的浪潮,让文化传承与时代同步,适应新时代青少年的认知和接受习惯。此外,该项技术还有望帮助唐氏综合症患儿打开心扉。患有这种疾病的孩子,与他人交流会存在障碍,但他们很愿意和镜子里的自己交流。用“合成现实”技术进行数字复原,能够为患儿再造一个‘自己’,再结合人工智能语言模型,就能让患儿和‘自己’对话,开展心理治疗。此前,由中国科学技术大学与北京灵境赛博公司联合,利用“合成现实”技术打造的数字人“皓皓”,已在 2023 年 3 月 21 日联合国举办的第 12 届世界唐氏综合征会议上亮相。

当前生成式人工智能快速发展,在很多方面超越了人类。大家都在思考人类还有哪些优势。挖掘到这种优势的人机协作技术才更能体现底层价值。合成现实技术就是源于这样的思考,在两个方面区别于其他数字人技术。一是适用“目标人无法配合”的场景,其他技术通常需要目标人配合采集数据,但是已故去的人、文学作品中的人物或患者都难以满足这个要求;二是适用“严肃题材”场景,比如老科学家、革命先烈,需要高真实感。

数十年前,技术专家就开始预测数字永生的可能性

2000 年,微软的研究员戈登·贝尔(Gordon Bell)和吉姆·格雷(Jim Gray)发表了题为《Digital immortality 数字不朽》的论文,他们认为数字永生在本世纪内将成为现实。同年,美国发明家及计算机科学家雷蒙德·库兹韦尔(Raymond Kurzweil) 预言,到 2030 年我们将有能力扫描并上传人脑,甚至能够通过电子方式重新构建它的结构。

知名心理学家提摩西·利里 (Timothy Leary) ,因倡导迷幻药物而出名,在他的《Design for Dying 为死亡设计》一书中写道:“如果你想让你的意识永远留存,那就去记录和数字化它吧。” 数字永生的未来版指的是一种假想的技术概念,即通过技术最终能够将个人的意识、思想乃至整个身份上传到一个数字化大脑中,让它能够无限期地存续下去。

目前,数字永生已经以其他形式存在。Maggie Savin-Baden 和 David Burden 把数字不朽定义为人死后的主动或被动数字遗留,并将其分为两种类型:单向和双向。

  • 单向永生指的是人死后留下的被动式“只读”数字形式,比如静态的网页纪念页面。
  • 双向永生的概念涵盖了像聊天机器人这样的交互式数字角色,这些角色基于真人或是通过分析真人的数据来训练。

数字永生可以应用于以下场景

  • 心理咨询:数字永生可以帮助人们重温过去,从而更好地理解自己的心理状态。
  • 教育培训:数字永生可以帮助人们学习新知识和技能,从而提升自己的能力。
  • 娱乐:数字永生可以帮助人们与已故亲人或朋友保持联系,从而获得情感上的慰藉。

数字永生可以帮助人们与已故亲人保持联系

当代人对于“数字永生”的渴望由来已久。

在《流浪地球2》中,图恒宇(刘德华饰)的女儿图丫丫遭遇车祸后,记忆被采集到数字生命卡里,在经过迭代后拥有了自我意识,获得了“数字永生”,而图恒宇本人最后也得以进入数字世界,与女儿重逢。

图片展示了电影《流浪地球2》中的画面,屏幕上呈现出图恒宇(刘德华饰)和其女儿图丫丫。图恒宇身着白色外套,图丫丫穿着红白色衣物,屏幕左下角有时间等信息显示。该图片与上下文紧密相关,上下文提及在《流浪地球2》中,图丫丫遭遇车祸后记忆被采集到数字生命卡,经过迭代拥有自我意识,获得“数字永生”,图恒宇最后也进入数字世界与女儿重逢,此图正是这一情节相关画面。

《流浪地球2》“数字生命计划”中的图恒宇和图丫丫

数字永生最常见的应用场景之一是亲人纪念。人们可以通过收集逝者遗留下来的照片、视频、音频等数据,制作一个与逝者相似的数字人。这个数字人可以用来与逝者进行交流、互动,以此来表达对逝者的缅怀。

2017 年,詹姆斯·维拉豪斯( James Vlahos)的父亲因为肺癌癌症去世,在父亲生命最后的几个月,儿子开始拿着录音设备让 80 岁的父亲讲述他的一生:从童年时在街上看到喜欢的姑娘,到他小时候养的一只宠物兔,从唱歌剧的课外活动到成为律师的经历,从事件到细节的9万余字的父亲的一生,被记录到了互动性人工智能程序 “Dadbot”中。

图片展示了约翰·弗拉霍斯与儿子詹姆斯的合影。约翰·弗拉霍斯头发灰白,戴着眼镜,身着深色毛衣;儿子詹姆斯穿着粉色衬衫,面带微笑。二人紧挨在一起,背景是带有绿植和遮阳棚的户外场景。这张照片拍摄于2015年约翰被诊断出晚期肺癌的前一年,在父亲去世后,儿子基于对父亲的怀念参与研发了回忆型聊天机器人Dadbot,之后还成立公司让人们制作数字人“化身”,此照片与数字永生应用场景的讲述相呼应。

2015 年大约在约翰·弗拉霍斯 (John Vlahos) 被诊断出患有晚期肺癌的前一年,他与儿子詹姆斯 (James) 合影留念

在父亲去世后,儿子詹姆斯和这个人工智能机器人聊天,就好像父亲还在身边。“Dadbot不能替代父亲,但却让我用丰富的方式缅怀父亲,给到我极大安慰。”

之后 Dadbot 被研发成回忆型聊天机器人,詹姆斯还专门成立了公司 HereafterAI,让任何人都可以制作自己的数字人“化身”。

图片展示了HereafterAI网站的照片上传界面相关内容。上方聊天框中,机器人向詹姆斯提议记录更多人生故事,并询问接下来想做什么,下方紫色框提示“上传一张照片并讲述关于它的故事”。下方是一张黑白老照片,呈现了三位身着夏装的女性站在沙滩上的场景。这张图片与上下文紧密相关,直观呈现了HereafterAI网站可上传照片并分享故事来制作数字人“化身”的功能。

HereafterAI 的照片上传界面,https://www.hereafter.ai/

在网站注册后,会有一个自动聊天机器人收集你的人生故事,比如你最早的记忆是什么,你人生最自豪的一个场景等等,还可以插入配图丰富细节。“化身”做好后可以分享给亲朋好友,他们可以跟你的“化身”对话。

“化身”的制作是免费的,但分享的费用从每年 49 美元起,根据分享故事的数量不同价格也不同。

数字人永生可以用于教育。例如,未来可以创建虚拟的老师或导师,为学生提供个性化的教学。

数字人永生是一个具有巨大潜力的技术,但也存在一些挑战。例如,如何确保数字人的意识或记忆是真实的?如何防止数字人被滥用?这些问题需要在未来的研究中得到解决。

AI 数字人技术不只是用于纪念逝去的人

随着“数字永生”技术的发展,越来越多的公司和名人开始探索在他们健在时使用 AI 替身的可能性。比如,威廉·夏特纳(William Shatner)则与 StoryFile 合作,创造了一个能够回答问题的自己的互动 AI 形象。

威廉·沙特纳,一位传奇的演员,曾出演《星际迷航》系列剧,并以其饰演的詹姆斯·T·柯克船长角色而闻名。2022 年,90 岁的沙特纳成为 StoryFile 的品牌大使,他们正在为他进行一项实验,这项实验将有可能改变他的生活,甚至是整个世界。

威廉·夏特纳介绍了 StoryFile Life —— 一种全新的家族历史保存方式

这项实验名为 StoryFile Life,它利用人工智能技术,将人的视频录像和语音转化为一个互动式、可对话的 AI 视频。沙特纳将成为这项技术的首批使用者,他希望通过这项技术,将自己的故事和记忆保存下来,并与后代分享。

实验开始了。沙特纳坐在镜头前,开始讲述自己的故事。他讲述了自己的童年、青年、成年,以及他作为演员、制片人、歌手和作家的经历。他讲述了他的成功、失败、喜悦和悲伤。他讲述了他的梦想和希望。

实验人员记录下了沙特纳的每一个表情、每一个动作、每一个声音。他们将这些数据进行分析和处理,并将其转化为一个 AI 视频。

几个月后,实验完成了。沙特纳看到了自己的 AI 视频,他感到非常惊讶。视频中的他看起来非常真实,他能够与观众进行对话,回答他们的问题。

沙特纳认为,StoryFile Life 是一项具有革命意义的技术。它有可能让人们永远地保存自己的记忆和故事。沙特纳说:“我希望,通过这项技术,我能够与我的后代进行对话,告诉他们我的人生故事。”

StoryFile Life 演示,https://life.storyfile.com/

沙特纳的 AI 视频很快就发布了。它引起了全世界的轰动。人们惊叹于这项技术的逼真性和实用性。

StoryFile Life 的成功,为数字永生技术的开发开辟了新的道路。这项技术有可能让人们永远地活在人们的记忆中,永远地与他们交流。

在未来,人们可能能够通过 StoryFile Life 与历史上的伟人进行对话,与过去的亲人重逢,甚至与自己未来的自己进行交流。这项技术将有可能彻底改变我们对死亡的看法,并为我们提供了一种永生的新方式。

StoryFile 的技术,不仅可以应用于名人,也可以让普通民众留下自己的数字遗产。这项技术的出现,代表了科技在保存个人记忆和遗产方面的潜力。

未来,随着数字永生技术的不断发展,人们可能会有更多的机会将自己的记忆和遗产保存下来。这将为人们提供了一种超越死亡,继续与世人交流的方式。

数字家谱

图片展示的是北京太子峪九礼数字墓园的入口。入口上方有“太子峪九礼数字墓园”的字样,两侧墙上分别有宣传海报,左侧写着“科技殡葬”等内容,右侧有“数字科技殡葬”等字样。墓园入口处有树木,树叶呈现出金黄色。该图片与上下文的关系是,作为北京数字墓园的实景呈现,直观展现了文中所提及的中国殡葬行业数字化革命中数字墓园的场景,为介绍北京数字墓位等相关内容提供了视觉参照。

图片展示了一个充满科技感的室内场景。房间内摆放着多排透明椅子,前方有一位男士站立,似乎正在进行讲解。四周的墙壁上投影出绚丽的画面,包括粉色的繁花树、山水景色等,营造出梦幻的氛围。此图位于介绍殡葬行业数字化革命及数字家谱的文档中,可能是展示与数字纪念相关的应用场景,体现了数字化在纪念亲人等方面的应用,与文档中提到的数字墓位、数字家谱等数字化纪念方式相呼应。

北京数字墓园,图源:央视新闻

在中国,殡葬行业正悄悄经历一场数字化革命。想象一下,传统的墓地正在被数字化的“墓位”所取代。就拿北京来说,今年已经有五家陵园推出了 7000+ 个这样的数字墓位。这些墓位上,不是一堆土,而是一个电子屏幕,价格大概在3万到10万之间,租期通常是 20 年。

过去三个月,已经有近 300+ 户家庭选择了这种方式来纪念他们的亲人。有的家庭为了生前不喜欢风吹日晒的妻子选择了这种方式,有的则是为了将来打算选择海葬或生态葬的父亲,暂时将骨灰存放在这里。

目前,这些数字墓位主要是用来播放亲人的照片和视频。但想想看,将来我们或许能够和已故的家人进行对话、互动,这一天似乎已经不远了。

对于一些人来说,“数字永生”不只是重建与逝去亲人的联系那么简单,它还意味着财富的机会,以及人类智慧更长久、生动的延续。

这里有个具体的应用案例:破局合伙人陈司令的公司推出的数字家谱。你知道,传统家谱大多都是文字和少量照片。我们不知道我们的祖先长什么样,他们说什么口音,有怎样的性格和脾气,更不知道他们想传达给后代的人生智慧和真理。如果我们能和千年前的祖先对话,也许就能解答我们现在的迷茫。

图片由三张图像组成。左侧是一位白发长须、身着黑衣的老者;中间是一尊被灯光照亮的古代人物塑像,周围有身着盔甲的人物;右侧是一幅古代家族人物画像,画面中有几位穿着传统服饰的人物。图片位于介绍数字家谱的上下文中,通过展示不同形式的先人形象,直观呈现出传统家谱中对祖先的呈现方式,与后文提到的可通过数字家谱和家族已故长辈对话形成对比,突显数字家谱丰富先人的档案、实现互动的特点。

想象一下,现在我们可以通过大量的文本、音频和视频资料来丰富我们先人的档案。登陆这个数字家谱,我们就可以和家族中许多已故长辈对话。在现实生活中,我们几乎不可能有机会了解家族里的所有长辈,但数字家谱让这一切变得可能。

图片展示了数智家谱平台的运作流程。用户通过自动训练平台上传训练素材至DIG入口,分别进行声音模型训练和形象模型训练,生成训练文件。平台算力加持下,一方面进行实时对话构建,另一方面生成数字人克隆,最终通过前端页面展示,供用户使用数智家谱。此图与文档中介绍的数字家谱应用案例相呼应,直观呈现了数字家谱背后的技术运作过程。

图片是关于破局合伙人陈司令公司推出的数字家谱案例讲解。左侧展示客户提供的训练素材,是一位穿着黑白花纹上衣女士的画面,要求五官无遮挡、录音环境干净。中间是训练后的数字人,呈现克隆成功的实时对话界面,背景为绿色,可设置不同背景提升沉浸感。右侧提示可关注“DIGchen数智家谱”视频号了解实时对话产品,还指出此为网页后端拍照,能复刻真人形象与声音实现实时对话,畅想100年后后代可与今天的人对话。

在生成式人工智能大爆发时代,以成都数字家谱为代表的新数字家谱技术应运而生,既顺应了科技发展的潮流,又满足了当代社会的需要,是传承和增益家族智慧财富的重要平台。接下来将展示我们的技术产品、技术运用场景。这个视频由陈司令的母亲出镜,提供训练素材,生成他的数字人形象,复刻了他的声音,均为实时对话,价值巨大。

图片展示了一个名为“家谱树”的系统界面。界面背景为深蓝色,带有科技感的线条和地球图案。左侧有文字说明,进入家谱树系统可查看家族关系,200年后后代还能与今天的自己对话。右侧是家谱树图示,以卡通人物头像呈现家族成员,头像下方有姓名标识,人物间以线条连接,展示家族成员间的关系脉络。该图片与上下文紧密相关,直观呈现了新数字家谱技术中家谱树系统的概念与功能。

利用数字人类技术我们可以为子孙后代保存真人遗产的先驱。创建数字家谱,让我们的后代即使在一百年后也能与祖先进行实时对话。我们致力于传承智慧、家庭传统和宝贵的知识,以确保您的遗产得以延续。

如何实现数字永生

Heygen 图片说话

在应对已经去世亲人的记忆保存与纪念时,技术提供了一种温馨且创新的方式来帮助我们保存他们的形象和声音。其中,Heygen的照片说话功能成为了实现这一目的的重要工具,它允许我们通过现有的照片来“复活”亲人的形象,让他们在数字世界中“说话”,从而创造出感人的数字永生短视频。

这种技术的运用不需要实时录制视频或复杂的授权流程,只需一张静态的照片,就可以通过AI技术赋予它生命。Heygen平台通过深度学习算法分析照片中人物的面部特征,并模拟出相应的面部动作和表情,配合事先录制或合成的语音,就能够生成看似亲人在视频中自然说话的效果。这不仅可以用来纪念已故的亲人,也为留给后代一个生动的记忆提供了可能。

使用Heygen的照片说话功能创建数字永生短视频,可以在特定纪念日、家庭聚会或是个人需要慰藉的时刻,播放这些视频,让亲人的形象和声音再次出现在我们的生活中,提供情感上的支持和回忆的温暖。这种方式不仅是对亲人生前形象的一种尊重和怀念,也是科技进步给予我们的一种特殊礼物——能够跨越生死,让爱永存。

此外,创建这样的数字永生短视频还可以激发我们对于生命意义的思考,鼓励我们珍视与亲人共度的每一刻,并在未来以更加积极的态度面对生活和挑战。在技术的帮助下,我们能够以全新的方式保存和纪念那些重要的人和事,使得记忆不再是简单的回忆,而是可以触摸和感受到的现实。

小冰实时互动数字人

在数字时代,小冰互动数字人开启了一种全新的记忆保存与情感表达方式,让数字永生的概念从理论走向实践。通过AI技术的驱动,小冰平台允许用户创建具有个性化交互能力的数字化形象,这些形象不仅能够在视觉上复制人的外貌特征,更能通过深度学习,吸收并表达个人的记忆、情感和智慧。

小冰互动数字人通过微信小程序的形式,使得数字化存在能够广泛分发并与人们进行实时的智能对话,实现了一种前所未有的交流方式。用户可以根据自己的需要,定制和配置数字人的外观、背景、对话内容等,使其成为一个真正代表自己或亲人的数字化存在。

小冰互动数字人的核心价值在于其能够为用户提供一个情感交流的平台,让已逝亲人的记忆得以保存和传承,或者让个人的思想和声音能够跨越时间的限制,永久存在。此外,它也为企业和品牌提供了一种创新的客户互动和服务方式,通过精准配置和高级对话设置,可以实现高度定制化的服务体验,提升用户满意度和品牌忠诚度。

随着 AI 技术的不断进步,小冰互动数字人在继续优化和完善,能够更加精准地理解和响应用户的需求,为人们提供更加丰富、真实的互动体验。它不仅是技术创新的产物,更是情感连接和文化传承的桥梁,为人类社会开辟了一种新的交流和记忆保存方式。

Digital Agents

D-ID,数字人类生成领域的领先平台,发布了其 D-ID Agents(D-ID 智能体) 的新产品。这是一个在人机交互领域的重大突破,其交互体验类似于人与人之间面对面的对话。D-ID 智能体提供了一种无需编程的方法,能够在网站、演示文稿和应用程序中创建交互式数字人,用于销售、客户支持和教育,从而为客户带来更自然、更吸引人的体验。

图片展示了D-ID平台中D-ID Agents的页面。页面上方有D-ID的品牌标识,下方是导航栏,包含Products、Solutions等选项。页面主体部分有一位红发女性数字人的形象,旁边配有文字,大标题为“D-ID Agents”,副标题是“A New Era of Face - to - Face Digital Interaction”和“Experience Connection Beyond Code”,下方还有“JOIN WAITLIST”按钮。此图直观呈现了D-ID Agents产品,与上下文对该产品的介绍相呼应。

利用大语言模型 (LLMs) 的强大推动,D-ID 智能体能够让企业在自己的网站上集成一位 AI 驱动的虚拟助手。这些数字智能体可以根据不同的年龄、性别和种族定制,并能支持多种语言。企业还可以通过 D-ID 的 API 和 Creative Reality Studio 获得更多高级开发工具。

此外,D-ID 还推出了自然用户界面 (NUI)。这个界面可以让用户可以通过面对面的对话来与技术进行互动。NUI 的功能为数字客户支持代表、电子商务平台的数字销售人员以及培训演示中的数字讲师等应用带来了多模态体验,包含了面部、身体和声音的交互。

“尽管数字人技术日益强大,但我们从中获得价值的能力通常受限于我们与它的交互方式,” D-ID 的首席执行官兼联合创始人吉尔·佩里(Gil Perry)在一份声明中表示。“NUI 平台正在改变这一局面,它让公司能够开发出促进与客户进行自然面对面交流的界面。这些界面能够理解用户并赢得其信任,无需通过打字或点击操作。它们会随着业务和数字环境的演变而适应和发展。这一技术进步推动了 D-ID 智能体,使他们能够智能地回应客户问题,并提供个性化建议,满足客户对迅速有效互动的需求。”

平台的特性和功能包括:

智能体创建和编辑:用户可以根据组织的客户体验(CX)目标,自定义智能体的外观和声音属性(如音高、音调),并根据需要进行编辑或删除。

知识库查询:基于公司实际知识,智能体可以进行双向的、由大语言模型 (LLMs) 驱动的对话,这些对话基于业务数据、知识库和客户服务手册。用户可以简单地上传文本或 PDF 文件、PPT,或者链接到网址。

托管灵活性:智能体平台既提供给企业和独立软件供应商 (ISV) 开发者的 API,也提供给中小企业 (SMB) 在 Creative Reality Studio 网站上使用的预打包 API。智能体所有者可以在这两个平台上创建和托管他们的智能体,并将他们的数字人类嵌入到外部网站和移动平台上,以适应不同的价格点和消费者互动的规模。

图片展示了D - ID Agents的工作流程。画面以橙色和黑色为主色调,左侧起始处是一位手持扩音器的女性头像,标注“User question”代表用户提问;接着箭头指向“Retrieval query”,表示问题转化为检索查询;之后与“Knowledge base (Content and context)”即知识库交互获取“Relevant knowledge”;再生成“Prompt”供“LLM”(大语言模型)处理,最终大语言模型给出“Response”,由右侧的数字人讲出。此图直观呈现了文档中介绍的D - ID Agents工作步骤。

上面这张图片解释了 D-ID Agents 的工作流程。

  1. 用户提问:流程以用户提出的问题开始;
  2. 检索查询:用户的问题被转化为检索查询,可能涉及数据库搜索;
  3. 知识库:这个查询与一个知识库相互作用,知识库中含有相关的内容和上下文信息;
  4. Prompt:根据检索到的知识,生成一个提示词(Prompt)供大语言模型(LLM)处理;
  5. LLM:大语言模型处理这个提示词;
  6. 回应:最终,大语言模型提供一个回应,让数字人将内容讲出来。

打造一个专属于的交互式 AI Agents!

D-ID 智能体技术结合了面对面沟通和个性化 AI 形象,融合了大语言模型和自然语言处理技术。可以上传文本(包括 TXT、PDF 或 PPT 格式)来丰富这个智能体的知识库,从而实现与高品质虚拟形象的生动互动,带来前所未有的对话体验。

开始之前,我们需要先加入白名单进行申请

图片展示的是D-ID Agents的网页界面,背景为室内场景,右侧有一位女性虚拟形象。页面上方有“Products”“Solutions”等导航栏。中间显著位置显示“D-ID Agents”及相关介绍“A New Era of Face - to - Face Digital Interaction”等。下方有一个橙色的“JOIN WAITLIST”按钮,被红色箭头指向。该图片与上下文关系为:上下文提到开始创建交互式AI Agents前需先加入白名单申请,图片直观展示了申请入口所在界面。

填写姓名,D-ID 帐户的电子邮箱,行业,公司,D-ID 账号的邮箱,选择希望通过 D-ID Agent 实现什么目标,选择受众目标即可完成。

图片展示的是D-ID Agents的白名单申请界面。界面顶部有D-ID的标志,下方标题为“Request Early Access to D-ID Agents”。需填写的内容包括姓、名、D-ID帐户的电子邮箱、行业、公司名称;还需选择希望通过D-ID Agent实现的目标,如模拟现实生活和商业场景等;以及选择受众目标。界面底部是有限发布用户的使用条款,并有“我愿意分享使用D-ID的反馈”的勾选框,最下方是橙色的“Request Access”申请按钮。此图对应文档中加入白名单进行申请的内容。

第一步:创建新的智能体

图片展示的是D-ID平台创建新智能体的操作界面。左侧导航栏中“Agents”选项处于选中状态,并有红色箭头标注序号“1.”指向它。右侧界面上方显示“Agents gallery”,下方有一个白色的“Create agent”方块区域,带有红色箭头标注序号“2.”指向此处,点击该区域可创建新的智能体。此外,右上方还有一个橙色的“+ Create agent”按钮。此图对应文档中“第一步:创建新的智能体”的内容,直观呈现了创建新智能体的起始操作位置。

第二步:上传一个自己的头像

图片展示的是打造交互式AI Agents过程中“第二步:上传一个自己的头像”的操作界面。界面上方显示“New agent”,下方有“Appearance”等选项卡。中间大圆形区域展示了已上传的头像,下方有多个人物头像供选择,最左侧有一个带红色箭头指向的“Upload”按钮,提示用户可以选择智能体头像或上传自己的头像。该图片与上下文紧密相关,直观呈现了上传头像这一步骤的操作页面。

第三步:设置智能体的名字,选择声音,添加智能体描述。

图片展示的是创建交互式AI Agents的第三步操作界面。界面上方显示“New agent”,中间有一个已上传的圆形头像。下方有三个设置区域,“Agent name”处名字为“Metafeng” ,提示设置Agents名字;“Agent voice”处声音选择为“Andrew”,提示选择声音;“Agent instructions”文本框中有一段英文描述,提示进行Agents描述。此图与文档中创建交互式AI Agents的步骤说明相对应,直观呈现了设置名字、选择声音和添加描述的操作环节。

第四步:上传知识库

支持 TXT、PDF 或 PPT 三种格式的文件,总的可以上传 5 份文件,单个文件不能超过 20 M。

图片展示的是创建交互式AI Agents第四步上传知识库的界面。界面中“Information sources”区域提示可上传文本、PDF或PPTX文件来训练智能体,自然流畅的句子效果最佳。中间有红框高亮的上传区域,显示“Click to upload file or drag it here”,说明可点击或拖拽文件上传,最多5个文件,共100MB。下方已显示上传的两个PDF文件,分别是“487条帖子,15颗AI之心背后,我做了什么?.pdf”和“元峰的讲师介绍.pdf” ,与上下文提到的上传内容对应。

图片展示的是创建交互式AI Agents第四步上传知识库的界面,标题为“Information sources”。界面提示可上传文本、PDF或PPTX文件来训练智能体,自然流畅的句子效果最佳。中间有上传区域,显示可点击或拖拽上传,最多5个文件,共100MB。下方已上传两个PDF文件,分别是“487条帖子,15颗AI之心背后,我做了什么?.pdf”和“元峰的讲师介绍.pdf”。右下角有红色箭头指向的“Create agent (2 credits)”按钮,用于创建智能体。该图与上下文第四步上传知识库的内容对应。

这里我上传了这篇精华文 的 PDF 版本,还有一份我的个人介绍。

第五步:创建完成,等待几分钟即可完成。

图片展示的是D-ID平台中“Agents gallery”(智能体画廊)界面。左侧黑色导航栏有Video library、Agents(标注Beta)、Developer Hub、Pricing等选项。右侧显示了一个名为“Metafeng”的智能体,配有一张人物头像照片,下方标注日期为2023年12月28日。右上角有一个橙色的“Create agent”按钮。该图片与上文创建D-ID交互式AI Agents的内容相关,展示了创建完成后智能体在画廊中的呈现样式。

第六步:体验测评

D-ID Agents 局限性还是比较大,只能通过照片来来讲话,在英语方面表现不错,但在中文支持方面还有待提升,有的问题根本不会回答。但是,它展现了数字永生技术的巨大潜力,尤其是在个人遗产保存和文化传承方面。未来,随着技术的不断进步和普及,它可能会成为重要的社会和文化工具,使得人们能够以新的方式与历史、家族和知识进行互动。

常见问题

数字人永生是一项具有重大意义的技术,但也存在一些潜在的风险,例如数据安全、伦理问题等。随着技术的不断发展,数字人永生可能会成为现实,并对人类社会产生深远的影响。

  • 人类与 AI 的互动将如何影响我们的情感?一个人活着时拥有数字角色有哪些潜在用途?
  • AI 数字人的创建和使用是否会像社交媒体资料一样被社会接受并融入日常生活?
  • 人们是否会意识到他们正在与 AI 数字人互动或查看 AI 数字人?
  • 使用自己的人工智能角色有哪些道德限制?未经他人同意而使用他人的人工智能角色会怎样?
  • 谁将拥有和管理这些 AI 数字人、相关数据以及其活动带来的利益?它们是否会成为个人数字遗产的一部分?
  • 数据的安全和隐私将如何保障?如何避免 AI 数字人被未经授权使用,包括制作深度伪造视频?
  • 留下个人的数字版本会不会影响他人的哀悼过程?AI 的存在是否有助于保留个人遗产?AI 数字人将如何改变哀悼过程,并适应现有的文化习俗?