{
  "api_version": "v1",
  "generated_at": "2026-09-29T13:00:45",
  "criteria": [
    {
      "key": "A1",
      "label": "把 LLM 当作人类被试的替代品，复现或预测人类的调查回答、实验行为、态度分布、决策模式",
      "n": 491
    },
    {
      "key": "A2",
      "label": "评估这类仿真的可靠性、偏差、外部效度",
      "n": 334
    },
    {
      "key": "A3",
      "label": "用 LLM agent 群体模拟社会、经济、政治过程，并与真实人类数据对照",
      "n": 218
    },
    {
      "key": "A4",
      "label": "给 LLM 仿真提出方法论规范、报告标准、验证框架",
      "n": 37
    },
    {
      "key": "A5",
      "label": "用 LLM 生成合成样本，用于社会科学研究的数据增强或预调研",
      "n": 37
    },
    {
      "key": "B1",
      "label": "有真实人类数据作为对照基准",
      "n": 555
    },
    {
      "key": "B2",
      "label": "涉及经济学实验、行为博弈、政策评估场景",
      "n": 317
    },
    {
      "key": "B3",
      "label": "讨论识别策略、因果推断、统计推断的有效性",
      "n": 57
    },
    {
      "key": "B4",
      "label": "批判性视角，指出仿真失效的条件",
      "n": 434
    },
    {
      "key": "C1",
      "label": "纯多智能体系统研究，agent 之间协作解题，不涉及人类行为对照",
      "n": 615
    },
    {
      "key": "C2",
      "label": "机器人、自动驾驶、游戏中的仿真环境",
      "n": 135
    },
    {
      "key": "C3",
      "label": "角色扮演对话、人格化聊天机器人，无实验或测量目的",
      "n": 274
    },
    {
      "key": "C4",
      "label": "纯 NLP 能力评测，不以人类为参照系",
      "n": 532
    },
    {
      "key": "C5",
      "label": "用人类数据训练或对齐模型",
      "n": 39
    },
    {
      "key": "D1",
      "label": "LLM 做标注员替代人工标注，是替代人类劳动但不是仿真被试",
      "n": 191
    },
    {
      "key": "D2",
      "label": "人格测量，测的是模型不是人群",
      "n": 171
    },
    {
      "key": "D3",
      "label": "社会模拟但无人类数据对照，纯理论演示",
      "n": 203
    }
  ]
}