CrowdOracle人群数据预测实验
HOW THE EXPERIMENT WORKS

不是读心术,是统计关系。

CrowdOracle 探索一个简单的问题:人们已经作出的选择,能否帮助预测另一个尚未回答的问题?我们不输出人格标签,也不随机生成玄学结论。

01 · 从选择开始

先回答 8 个基础问题,再回答至少 20 个跨领域随机问题。之后你可以立即预测,也可以继续贡献更多答案。20 题是最低门槛,不是终点。

02 · 把未知留给统计

你只能选择尚未回答的题目作为目标。预测时不会使用目标本身,以及同一泄漏分组中的答案。例如“是否独生子女”和“兄弟姐妹数量”不会互相提供直接答案。

03 · 先用简单方法,诚实展示局限

没有样本时不生成预测。少于 30 份样本时,使用选项频率与拉普拉斯平滑;达到 30 份时,使用经过降权的朴素贝叶斯条件概率。概率分布不是准确率,也不是因果关系。

训练只使用其他访客描述自己的、质量评分至少 40 的记录,同一访客对当前目标最多贡献最近一份可用提交。预测排除当前访客的全部提交。数据仍可能存在选择偏差、重复自然人、缺失值偏差及自报误差。

04 · 保留不确定性

样本少时,分布可能不稳定;更多答案不保证更准确。结果页展示真实可用样本数和模型版本。反馈完全自愿,目前独立保存,不自动混入训练数据。

← 开始自己的实验