由哈佛大学与麻省理工学院牵头、OpenAI 和谷歌 DeepMind 等参与的团队本月推出 MatrAIx 系统,可生成 83 亿个 AI 智能体来模拟全球人类行为。该系统用 1290 个维度对各类背景与生活方式的人群建模,这些"AI 人"能像真人一样填问卷、聊客服、刷网页、操作 App,整体行为一致性高达 91.5%。

91.5% 一致性,但随场景浮动

团队以 400 次对照测试验证,涵盖 10 个行为属性与全部四类环境,其中 366 次智能体表现出正确特质或正确抑制无关特质,即 91.5% 情形判断准确。一致性会随环境波动:问卷与聊天场景升至 92% 至 96%,而操控 App 测试降到 83%。

目前经确定性、质量过滤的百万"人格核心集"已上架 Hugging Face 供研究使用,相关 8B 人格模型代码也在 GitHub 开源。这套超大规模仿真被视为社科与产品研究的全新试验场,但"AI 人"能在多大程度上替代真实人类样本,仍需更多交叉验证。