[AI]《MatrAIx: Simulating the World with 8.3 Billion Persona Agents》X Li, Y Hao, J Hou, J Huang… [MatrAIx] (2026)
在 AI 系统评测领域,兼顾规模化与用户真实多样性是一个悬而未决的难题。过去的方法受困于真人测试的高昂成本与漫长周期,或离线基准测试的同质化,本质原因是缺乏一个能模拟海量异构用户与产品进行动态交互的标准化设施。
本文的核心洞见是:把模糊的用户多样性,重塑为可计算、可采样的结构化档案库。由此,让大模型扮演从 83 亿档案中抽取的特定角色,在模拟环境中与产品互动,这一“实例化虚拟评测员”的关键操作使问题得以解开。
这项工作真正留下的遗产是一个可重复、可扩展的数字产品“社会风洞”。它为后来者打开的新门是,在产品上线前即可进行预测性的、细粒度的多群体用户体验分析,但尚未跨过的门槛是,如何确保仿真行为与真实人类行为之间的高保真对齐。
arxiv.org/abs/2608.04205 机器学习 人工智能 论文 AI创造营








