知识库/区块链

预测校准闭环

属性

预测校准闭环

任何做预测性判断的系统都要回答一个问题:怎么证明自己比抛硬币强? 这套机制正是答案。它源自一个量化研究系统的设计(三方评审一致认定校准闭环是原方案的最大缺口),但不限于加密研究——任何预测性判断(含个人决策)都可复用。

四个组件

  1. Predictions ledger:每个预测发出即登记(唯一 ID、时间戳、可证伪条件、到期日、事前置信度桶),无论是否据此行动都钉死——防事后美化。
  2. Base rate 构造(反自欺三原则):显式定义参考类(基准是哪一群对象);只用预测日可得数据(anti-lookahead / walk-forward);分母含死亡样本(rug/废弃计入,防 survivorship bias);n<20 标“低置信”不强行下结论。
  3. 强制回看:到期由独立 audit 记录 hit/miss/inconclusive,滚动算命中率 vs base rate 与校准曲线(Brier score)。诚实性 audit(过程是否诚实)与有效性 audit(方法是否真有效)分开
  4. Kill criteria:某假设家族累计 ≥20 个已决预测后,命中率不显著高于 base rate 且 Brier 不优于“直接报 base rate”→ 该家族暂停回炉——方法论不允许无限自我延续

配套防线

  • 三概率只评 High/Med/Low 桶,不给伪精确小数;>80% 默认可疑
  • Owner 决策协议:人行动前也要写理由/假设 ID/止损,事后回填 ledger——堵住“系统越精密、人越过度自信”的放大效应

跨主题关联(本库解释)

这套闭环与 知识复利页所述的“外部化+按需读回”同构——ledger 就是预测的持久层;而“独立 audit 强制回看”与本知识库的红队审计、编译式 wiki 的错误放大风险防御是同一思想:生成方不能给自己打分

本页由 AI 从原始资料编译生成、经人工确认后发布;原始资料保留在私有工作区。

人负责策展与提问,AI 负责编译与记账· 源自 Karpathy 的 LLM Wiki 构想