本文为精选翻译,原文标题为:AI can now create a replica of your personality,2024.11.20, MIT Technology Review
想象一下,你和一个人工智能模型坐下来进行一场长达两小时的口头采访。一个友好的声音引导你进行一场谈话,内容涉及你的童年、成长记忆、你的职业以及你对移民政策的看法。不久之后,你的虚拟复制品就能以惊人的准确度体现你的价值观和偏好。
根据斯坦福大学和谷歌 DeepMind 研究人员团队发表的一篇新论文,这已经成为可能,该论文已在arXiv上发表,尚未经过同行评审。
该团队由斯坦福大学计算机科学博士生 Joon Sung Park 领导,招募了 1,000 名年龄、性别、种族、地区、教育程度和政治意识形态各异的人。他们因参与而获得高达 100 美元的报酬。
通过对他们的采访,该团队创建了这些人的代理复制品。为了测试代理模仿人类对手的水平,参与者进行了一系列性格测试、社交调查和逻辑游戏,每项测试两次,间隔两周;然后代理完成相同的练习。结果相似度高达 85%。
帕克说:“如果你能让一群小小的‘你’四处奔波,并真正做出你本应做出的决定——我认为这最终就是未来。”
在论文中,这些复制品被称为模拟代理,创建它们的动机是让社会科学和其他领域的研究人员更容易进行那些用真人受试者进行昂贵、不切实际或不道德的研究。如果你能创造出像真人一样行为的人工智能模型,那么你就可以用它们来测试一切,从社交媒体干预措施对抗虚假信息的效果到哪些行为会导致交通堵塞。

此类模拟代理与当今主导领先 AI 公司工作的代理略有不同。这些代理被称为基于工具的代理,是为你做事而不是与你交谈而构建的模型。
例如,它们可能会输入数据、检索你存储在某处的信息,或者——有朝一日——为你预订旅行和安排约会。据彭博社报道,Salesforce 于 9 月宣布了自己的基于工具的代理,随后Anthropic 于 10 月宣布,OpenAI 计划在 1 月发布一些基于工具的代理。
这两种类型的代理各有不同,但有共同点。麻省理工学院斯隆管理学院信息技术副教授约翰·霍顿 (John Horton) 表示,对本文中提到的模拟代理的研究可能会带来更强大的人工智能代理。霍顿创立了一家使用人工智能模拟参与者进行研究的 公司。
他在一封电子邮件中 告诉《麻省理工技术评论》:“这篇论文展示了如何实现一种混合:使用真实的人来生成角色,然后可以通过编程/模拟的方式使用角色,而这是真实人类无法做到的。”
这项研究也有一些警告,其中最重要的就是它指出的危险。就像图像生成技术使得在未经他人同意的情况下制作有害的深度伪造作品变得容易一样,任何代理生成技术都引发了人们对人们可以轻易构建工具来在网上拟人化他人、说出或授权他们不想说的话的质疑。
该团队用来测试人工智能代理如何复制其对应的人类的评估方法也相当基础。这些方法包括综合社会调查(收集有关个人人口统计、幸福感、行为等信息)以及对五大人格特质的评估:经验开放性、尽责性、外向性、亲和性和神经质。此类测试通常用于社会科学研究,但并不假装捕捉到构成我们自己的所有独特细节。
人工智能代理在“独裁者游戏”等行为测试中复制人类的能力也较差,该游戏旨在阐明参与者如何考虑公平等价值观。
为了构建一个能够很好地复制人类的人工智能代理,研究人员需要找到方法将我们的独特之处提炼成人工智能模型可以理解的语言。
帕克说,他们选择定性访谈就是为了做到这一点。他说,在2023 年他写了一篇关于生成代理的论文后,他出现在无数播客中,这引起了人们对该领域的极大兴趣,他确信访谈是了解一个人最有效的方式。“我可能会参加一个两小时的播客采访,采访结束后,我觉得,哇,人们现在对我了解很多了,”他说。“两个小时可以非常有力。”
这些访谈还可以揭示调查中不太可能出现的特质。“想象一下,某人刚刚得了癌症,但去年终于治愈了。这是关于你的非常独特的信息,可以说明你的行为和思维方式。”他说。设计调查问题来引出这类记忆和反应会很困难。
不过,面试并不是唯一的选择。像Tavus这样的提供用户“数字孪生”服务的公司可以让他们的人工智能模型吸收客户的电子邮件或其他数据。Tavus 首席执行官哈萨尼亚·拉扎(Hassaan Raza)表示,这种方式往往需要相当大的数据集才能复制某人的个性,但这篇新论文提出了一种更有效的途径。

“真正酷的是,他们告诉你可能不需要那么多信息,”拉扎说,并补充说他的公司将尝试这种方法。“你今天和人工智能面试官聊 30 分钟,明天聊 30 分钟怎么样?然后我们用它来构建你的数字孪生。”