方法与质量

我们拦什么,不拦什么,都写在这里。

质量声明如果说不清,就等于没有。以下每一条都对应平台里真正在跑的代码;尚未启用的也一并列出。

参与者是谁

注册即实名底卡:性别、出生年(自动换算年龄段)、学历、地区、职业。 手机号哈希入库、脱敏展示,不采集身份证号。

账号有信用分字段(默认 100)。信用分目前尚未接入任何自动扣减或准入逻辑, 只是留好的位置——不拿它做质量宣传。

配额定向

发布时可设目标样本量、单份里程、预计用时,并按性别年龄段(18–25 / 26–35 / 36–45 / 46+)设配额。 未设的维度不限。某格满额后,该格被试就看不到这份任务。

配额扣减走数据库咨询锁 + 条件更新,5 并发抢 1 个名额实测无超发。

地区、学历、职业维度目前只用于分析交叉,尚未开放为投放配额条件。

质检:当前实际生效的两项

  • 注意力检测——问卷可插入注意力题并指定正确项,答错即判无效。被逻辑跳转隐藏的注意力题不计入。
  • 重复作答拦截——同一份问卷下,同设备指纹或同 IP 已有提交记录的,再次提交判重复。 设备与 IP 均以哈希形式存储。

命中任一项即置为未通过,不入有效样本、不发里程,理由写进作答记录,研究者在过程记录页可逐份查看。

速度筛查当前为放行状态。投放页仍保留该开关,但判定函数目前一律放行,实际不拦截作答过快。 未恢复前,本平台不应对外宣称具备速度质检能力。

效度设计

  • 题序与选项随机——可打乱题序与选项顺序以抑制顺序效应;作答值仍存规范序号,不会串。情境材料与分节引导语永不被洗到测量题之后。
  • 匿名流防刷情境——匿名作答用设备 id 与问卷 id 生成确定性种子,同一浏览器刷新不会重抽实验组或情境组合。
  • 构念复用三铁律——只在同构念、同量表之间复用;研究者建题时确认;不跨量表静默换算。
  • 组间比较用 Welch t 检验——不假定两组方差齐性。

留痕与可追溯

每份作答都有事件时间线:领取、开始、提交、质检结果(含拦截原因)与时间戳,在过程记录页可查。 构念档案里每个值带来源标记:新答 / 确认沿用 / 校对刷新。 Research Agent 的每次运行记录输入版本、输出版本、模型标识、起止时间与失败摘要,研究者的批准与退回单独留痕。

我们不做的事

  • 不接入任何支付或转账,报酬只做记账。
  • 不把硅基分身的模拟作答当作真人研究证据。
  • 不让 Agent 自动发布研究、自动改配额预算、自动排除参与者或自动拒付。
  • 不把个人直接标识发给模型服务商。
  • 不宣称「保证发表」「结果一定准确」或「AI 自动完成研究」。