{
  "schema_version": "veriharness_v04_preview_public_status_v0.1",
  "status": "preview_incomplete",
  "claude": {
    "scheduled": 150,
    "eligible": 150,
    "scored": 150
  },
  "gpt": {
    "scheduled": 150,
    "eligible": 66,
    "failed_canonical": 25,
    "unstarted": 59,
    "scored": 66,
    "primary_scored": 51
  },
  "snapshot_sha256": "f5d62628c4143ad5053d05b53a3c98de17f8d095eaa12d369b27773482b9e0d6",
  "viewer_experiment": "veriharness-v0-4-xseries-preview",
  "claude_primary_8case_effects_vs_c0v0": {
    "X1V0": {
      "case_count": 8,
      "case_mean_delta": 0.19208333333333355,
      "case_bootstrap_95_ci": [
        0.08041666666666691,
        0.3120833333333332
      ],
      "case_win_tie_loss": {
        "win": 7,
        "tie": 0,
        "loss": 1
      }
    },
    "X2V0": {
      "case_count": 8,
      "case_mean_delta": 0.1975000000000005,
      "case_bootstrap_95_ci": [
        0.06083333333333429,
        0.3362604166666664
      ],
      "case_win_tie_loss": {
        "win": 6,
        "tie": 0,
        "loss": 2
      }
    },
    "X3": {
      "case_count": 8,
      "case_mean_delta": 0.2308333333333335,
      "case_bootstrap_95_ci": [
        0.09250000000000058,
        0.3775000000000002
      ],
      "case_win_tie_loss": {
        "win": 7,
        "tie": 0,
        "loss": 1
      }
    },
    "X4": {
      "case_count": 8,
      "case_mean_delta": 0.14750000000000046,
      "case_bootstrap_95_ci": [
        0.027083333333333903,
        0.28583333333333355
      ],
      "case_win_tie_loss": {
        "win": 6,
        "tie": 1,
        "loss": 1
      }
    }
  },
  "forbidden_inferences": [
    "condition effects",
    "bootstrap confidence intervals",
    "Claude-versus-GPT superiority"
  ]
}
