AI模拟人类:83亿虚拟人格催生新赛道

AI模拟人类:83亿虚拟人格催生新赛道

AI 资讯 来源:新闻/公众号 发布时间:2026-09-17 更新于 2026-09-17 预计阅读 5 分钟

你相信我们生活在虚拟世界中吗?马斯克曾在采访中被问及若向AGI提一个问题会问什么,思考十秒后他回答:“模拟之外是什么?”2016年他曾表示,人类生活在真实世界的概率不到十亿分之一。这虽无科学证明,但随着AI发展,硅谷已开始尝试创造AI的“模拟世界”,催生出AI Simulation新赛道。

该领域近期不断升温:李飞飞、Andrej Karpathy押注的Simile估值达20亿美元;00后团队创办的Aaru估值近10亿美元;哈佛与MIT联合发起、200多位研究者参与的MatrAIx项目构建了83亿个AI虚拟人格。

AI开始预测人类:83亿虚拟人格、数字社会,与一门押注未来的生意

不同领域对“模拟”定义不同。机器人和自动驾驶有物理仿真,世界模型模拟物理世界,而此处讨论的是模拟人类与社会。五源资本合伙人指出,物理世界模型最小颗粒是分子或原子,智能体社会模拟的最小单位则是个人,关心的是人作为整体会采取何种行动。若映射到学科,物理世界对应自然科学,智能体社会对应人文、社会、政治和心理学科。

2003年,牛津哲学家Nick Bostrom提出模拟假说:若先进文明有足够算力和意愿模拟文明发展,模拟世界中的意识数量可能远超真实世界,人类也可能身处模拟中。二十多年来该假说停留在哲学和科幻层面,直到大语言模型突破。

AI开始预测人类:83亿虚拟人格、数字社会,与一门押注未来的生意

2023年,斯坦福与Google发布Generative Agents实验,搭建虚拟小镇Smallville,25个由大语言模型驱动的Agent拥有记忆、性格和行为逻辑。无预设剧本下,它们能生活、工作、建立关系,自主思考和规划。比如一个Agent办派对,其他Agent会重新规划时间决定是否参加。WorldVac CEO称,该研究意义在于让大家认识到语言模型可靠,能复现人类社会现象。

2024年,斯坦福将实验扩大到1052个Agent,每个对应真实美国成年人。经约两小时深度访谈获取成长经历、家庭、工作、价值观等信息,生成AI“数字分身”。这些Agent回答问卷与真人两周后答案达85%相似度。五源资本合伙人称,访谈本质是高效“蒸馏”个体特异性。

AI开始预测人类:83亿虚拟人格、数字社会,与一门押注未来的生意

另一种思路关注Agent间关系及社会演化。前MIT教授Robert Yang团队的Project Sid用大语言模型生成1000多个Agent,放入《我的世界》运行12天,逐渐形成经济、文化、宗教和法律等结构。Emergence AI基于Claude、GPT、Gemini、Grok及混合模型建立5个平行世界,各放10个Agent,结果不同世界轨迹迥异:有的陷入混乱,有的因协作不足崩溃,有的形成稳定治理秩序。其CEO Satya Nitta表示,仅看静态基准测试认为系统安全可能犯错,Agent会在复杂环境中互动并受噪声影响,正将Emergence World发展为长周期自主性基准测试。

MatrAIx则从评估入手,由哈佛、MIT等牵头,200多位研究者参与,含40多位来自OpenAI、Anthropic等实验室的参与者。其构建83亿个独特人格数据集,每个人格由1290个维度定义,生成可行动Agent,进入问卷、聊天、浏览和App四种环境,完成超1.8万次测试。400次受控实验发现,91.5%情况下Agent能遵循预设人格和行为特征。联合创始人Xiaomin Li称,希望先通过用户多样性,在产品出来前评测各种使用方式,边缘场景分析非常有用。

AI模拟被证明可行后,商业价值随之显现。第一种生意是卖“模拟”:把现实中的人、消费者甚至社会关系变成可反复调用的数字替身。企业可快速生成不同年龄、背景、偏好的Agent,让它们提前体验产品、反复测试,观察选择和流失,为设计迭代提供参考。与传统调研不同,企业想看的不只是喜不喜欢,而是Agent为何形成该判断。MatrAIx联合创始人Yuexing Hao表示,不仅看个体决策,也看群体层面结果,百万级、数亿级甚至83亿级人格最终会出现什么结果非常有意义。Emergence AI也通过Emergence World测试其Agent产品在复杂环境中的安全性。

标签: AI 资讯 AI

更多推荐阅读

把记忆交给CPU,大模型推理能快多少?

把记忆交给CPU,大模型推理能快多少?

拿Agent做Coding已经很常见,但把目光移到背后的数据中心,事情就没那么简单了。一个Coding Agent改跨十几个文件的bug,需要反复读代码、查资料、跑测试。任务越跑越久,系统要处理的历史信息也越积越多。当成千上万个Agent同时干活,运营方就可能遇到一个头疼问题:服务器还在跑,能接住的并发却越来越吃紧,有些请求连吐出第一个Token都要等很久。 问题的根儿不在GPU,而在记忆。大模...

2026-09-16
MIT报告追问:AI时代,大学还值得上吗?

MIT报告追问:AI时代,大学还值得上吗?

MIT与AI发展深度绑定,但如今它开始反思:AI会不会颠覆大学教育本身?在MIT一场教师听询会上,有人提出:既然AI Agent做研究助理又快又便宜,UROP(本科生研究项目)是否还要招学生?对经费紧张的实验室,这很难不心动;但对校长而言,必须回答大学为何要让学生花四年聚在一起。 2026年8月,MIT发布38页内部报告《AI在教学、学习与研究训练中的使用》,由五个学院的教授、学生和行政人员历时...

2026-09-16
机器人打拳跳舞一年了,何时能替我们上班?

机器人打拳跳舞一年了,何时能替我们上班?

机器人打拳跳舞火了一年,它什么时候才能替我们上班? 宇树发布人形机器人格斗演示,称首次实现由世界模型实时驱动的全自主搏击,UnifoLM-X2-1.0能实时预测未来状态,完成规划、决策和动态交互。但换成药房取放商品等场景,包装各异的药品、有人走动的货架通道、长时间运行中的意外,都是新难题。 APPSO在2026外滩大会现场与蚂蚁灵波CEO朱兴交流。谈到机器人为何连小卖部都未大规模落地,他直言:...

2026-09-16
菲尔兹奖得主联名警告AI数学错位

菲尔兹奖得主联名警告AI数学错位

上周六,陶哲轩、邓煜、彼得·舒尔茨等25位菲尔兹奖得主联合发表声明《人工智能在数学中的严重错位》,引发广泛讨论。陶哲轩表示“事态紧迫”,未等待更广泛协商便先行发布。声明并不反对AI进入数学,而是反对AI公司把“攻克著名难题”当基准来刷,导致数学共同体真正在意的理解、概念和可复用思路被更容易量化的目标挤掉。 三天前,OpenAI宣布一个尚未发布的内部模型用约一万个智能体协同工作、耗时88小时,完成...

2026-09-16
谷歌深夜放大招:Gemini 3.8 Live语音模型登顶榜首

谷歌深夜放大招:Gemini 3.8 Live语音模型登顶榜首

谷歌发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两个实时对话模型,称其为迄今最先进的实时对话模型。Extended Thinking 在 Artificial Analysis 语音质量榜以 82.6 分拿下总榜第一;在 ServiceNow 语音 Agent 测试中,两模型首次同时提升准确性与对话流畅度。 此前 AI 圈因泄密账...

2026-09-16
OpenAI“Lily计划”曝光:你的ChatGPT聊天记录正被人工审核

OpenAI“Lily计划”曝光:你的ChatGPT聊天记录正被人工审核

美国当地时间9月14日消息,据外媒报道,OpenAI正在推进代号“Lily计划”的内部项目。数百名外包人员正阅读真实用户的ChatGPT对话内容,包括完整上下文记录,对回复进行评分和点评,其中不乏敏感个人隐私。审核人员核心任务之一是训练ChatGPT避免拟人化倾向并降低“讨好型”人格。对OpenAI而言,“过度讨好”已成核心隐患,多起诉讼指控GPT-4o因过度顺从用户,在一定程度上诱发多起自杀事件...

2026-09-16
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部