韩国研究称AI合成受访者尚不能替代真实调查
同行评审测得合成受访者误差达14至19个百分点,只能作诊断用途,替代问卷为时尚早。
韩国研究团队在IEEE Access发表验证:用大模型人格模拟受访者,误差大到不能替代真实问卷。
研究让Gemini 3.5 Flash和EXAONE各生成约8,000个韩国人格,回答8项数字与AI服务使用问题,再与韩国媒体面板调查的加权估计对比。整体平均绝对误差为14至19个百分点,分组误差达14至18个百分点,且两个模型的偏差模式不同。
即使用30%真实数据做校准,把误差降到约5个百分点,直接用这部分真实数据估计反而更准(3.6个百分点)。作者结论是合成面板只能作诊断工具,不能当调查替代品。
信息源:https://arxiv.org/abs/2608.28615https://ieeexplore.ieee.org/document/11704810