Data Analytics report
Project MSC corrected complete-layer evidence
Paper-ready corrected robustness evidence.
Technical summary
The corrected intervention zeros both energy and mask. Corrected validation selected M11 for all seven layers, so the frozen routed system equals M11. Official uniform-macro rMAE is 0.192936Source: corrected_evaluation/metrics/official_evaluation_ensemble.csv for M11, 0.240423Source: corrected_evaluation/metrics/official_evaluation_ensemble.csv for M10, and 0.214748Source: corrected_evaluation/metrics/official_evaluation_ensemble.csv for M12-C.
Corrected frozen-checkpoint evaluation.
Broad robustness
The corrected policy preserves M11 across ordinary and mixed states.
Read the exact packaged CSV rows used by this chart.
| Scenario | rMAE | System |
|---|---|---|
| Clean | 0.18 | M10 |
| Random dead 5% | 0.16 | M10 |
| Block dead 5% | 0.18 | M10 |
| Layer gain drift | 0.18 | M10 |
| Gaussian noise | 0.19 | M10 |
| Hot cells | 0.18 | M10 |
| Mixed unseen | 0.19 | M10 |
| Clean | 0.15 | M11 |
| Random dead 5% | 0.16 | M11 |
| Block dead 5% | 0.16 | M11 |
| Layer gain drift | 0.15 | M11 |
| Gaussian noise | 0.17 | M11 |
| Hot cells | 0.15 | M11 |
| Mixed unseen | 0.18 | M11 |
| Clean | 0.18 | M12-C |
| Random dead 5% | 0.19 | M12-C |
| Block dead 5% | 0.19 | M12-C |
| Layer gain drift | 0.18 | M12-C |
| Gaussian noise | 0.18 | M12-C |
| Hot cells | 0.18 | M12-C |
| Mixed unseen | 0.2 | M12-C |
| Clean | 0.15 | Routed |
| Random dead 5% | 0.16 | Routed |
| Block dead 5% | 0.16 | Routed |
| Layer gain drift | 0.15 | Routed |
| Gaussian noise | 0.17 | Routed |
| Hot cells | 0.15 | Routed |
| Mixed unseen | 0.18 | Routed |
Physical complete-layer failures
All 120,800 events are evaluated once per layer with energy and mask entries zeroed.
Read the exact packaged CSV rows used by this chart.
| Failed layer | rMAE | System |
|---|---|---|
| 0 | 0.19 | M10 |
| 0 | 0.18 | M11 |
| 0 | 0.19 | M12-C |
| 0 | 0.18 | Routed |
| 1 | 0.18 | M10 |
| 1 | 0.16 | M11 |
| 1 | 0.19 | M12-C |
| 1 | 0.16 | Routed |
| 2 | 0.32 | M10 |
| 2 | 0.24 | M11 |
| 2 | 0.26 | M12-C |
| 2 | 0.24 | Routed |
| 3 | 0.18 | M10 |
| 3 | 0.17 | M11 |
| 3 | 0.19 | M12-C |
| 3 | 0.17 | Routed |
| 12 | 0.32 | M10 |
| 12 | 0.23 | M11 |
| 12 | 0.25 | M12-C |
| 12 | 0.23 | Routed |
| 13 | 0.31 | M10 |
| 13 | 0.21 | M11 |
| 13 | 0.24 | M12-C |
| 13 | 0.21 | Routed |
| 14 | 0.18 | M10 |
| 14 | 0.16 | M11 |
| 14 | 0.18 | M12-C |
| 14 | 0.16 | Routed |
Corrected complete-layer aggregates
Read the exact packaged CSV rows used by this table.
| System | Average | rMAE | Bias | R68 | Large-error |
|---|---|---|---|---|---|
| M10 | uniform macro | 0.24Source: tables/corrected_complete_layer_aggregates.csv | 0.02Source: tables/corrected_complete_layer_aggregates.csv | 0.27Source: tables/corrected_complete_layer_aggregates.csv | 0.44Source: tables/corrected_complete_layer_aggregates.csv |
| M11 | uniform macro | 0.19Source: tables/corrected_complete_layer_aggregates.csv | 0.04Source: tables/corrected_complete_layer_aggregates.csv | 0.22Source: tables/corrected_complete_layer_aggregates.csv | 0.35Source: tables/corrected_complete_layer_aggregates.csv |
| M12-C | uniform macro | 0.21Source: tables/corrected_complete_layer_aggregates.csv | -0.05Source: tables/corrected_complete_layer_aggregates.csv | 0.25Source: tables/corrected_complete_layer_aggregates.csv | 0.41Source: tables/corrected_complete_layer_aggregates.csv |
| Routed | uniform macro | 0.19Source: tables/corrected_complete_layer_aggregates.csv | 0.04Source: tables/corrected_complete_layer_aggregates.csv | 0.22Source: tables/corrected_complete_layer_aggregates.csv | 0.35Source: tables/corrected_complete_layer_aggregates.csv |
| M10 | voxel count weighted | 0.28Source: tables/corrected_complete_layer_aggregates.csv | -0Source: tables/corrected_complete_layer_aggregates.csv | 0.33Source: tables/corrected_complete_layer_aggregates.csv | 0.52Source: tables/corrected_complete_layer_aggregates.csv |
| M11 | voxel count weighted | 0.21Source: tables/corrected_complete_layer_aggregates.csv | 0.05Source: tables/corrected_complete_layer_aggregates.csv | 0.23Source: tables/corrected_complete_layer_aggregates.csv | 0.38Source: tables/corrected_complete_layer_aggregates.csv |
| M12-C | voxel count weighted | 0.23Source: tables/corrected_complete_layer_aggregates.csv | -0.04Source: tables/corrected_complete_layer_aggregates.csv | 0.27Source: tables/corrected_complete_layer_aggregates.csv | 0.45Source: tables/corrected_complete_layer_aggregates.csv |
| Routed | voxel count weighted | 0.21Source: tables/corrected_complete_layer_aggregates.csv | 0.05Source: tables/corrected_complete_layer_aggregates.csv | 0.23Source: tables/corrected_complete_layer_aggregates.csv | 0.38Source: tables/corrected_complete_layer_aggregates.csv |
Frozen validation decision
The expert choice was frozen from corrected validation predictions before official scoring.
Corrected validation selection
Read the exact packaged CSV rows used by this table.
| Layer | Candidate | Validation rMAE |
|---|---|---|
| 0Source: tables/corrected_validation_ensemble.csv | M11 | 0.18Source: tables/corrected_validation_ensemble.csv |
| 0Source: tables/corrected_validation_ensemble.csv | M12_C_lambda_010 | 0.19Source: tables/corrected_validation_ensemble.csv |
| 1Source: tables/corrected_validation_ensemble.csv | M11 | 0.16Source: tables/corrected_validation_ensemble.csv |
| 1Source: tables/corrected_validation_ensemble.csv | M12_C_lambda_010 | 0.19Source: tables/corrected_validation_ensemble.csv |
| 2Source: tables/corrected_validation_ensemble.csv | M11 | 0.24Source: tables/corrected_validation_ensemble.csv |
| 2Source: tables/corrected_validation_ensemble.csv | M12_C_lambda_010 | 0.26Source: tables/corrected_validation_ensemble.csv |
| 3Source: tables/corrected_validation_ensemble.csv | M11 | 0.16Source: tables/corrected_validation_ensemble.csv |
| 3Source: tables/corrected_validation_ensemble.csv | M12_C_lambda_010 | 0.18Source: tables/corrected_validation_ensemble.csv |
| 12Source: tables/corrected_validation_ensemble.csv | M11 | 0.23Source: tables/corrected_validation_ensemble.csv |
| 12Source: tables/corrected_validation_ensemble.csv | M12_C_lambda_010 | 0.25Source: tables/corrected_validation_ensemble.csv |
| 13Source: tables/corrected_validation_ensemble.csv | M11 | 0.21Source: tables/corrected_validation_ensemble.csv |
| 13Source: tables/corrected_validation_ensemble.csv | M12_C_lambda_010 | 0.23Source: tables/corrected_validation_ensemble.csv |
| 14Source: tables/corrected_validation_ensemble.csv | M11 | 0.16Source: tables/corrected_validation_ensemble.csv |
| 14Source: tables/corrected_validation_ensemble.csv | M12_C_lambda_010 | 0.18Source: tables/corrected_validation_ensemble.csv |
Detector-status inconsistency control
Historical mask-only rows retain clean layer energies and are not complete-layer evidence.
Read the exact packaged CSV rows used by this chart.
| System | Uniform macro rMAE | Intervention |
|---|---|---|
| M10 | 0.24 | Corrected energy + mask |
| M10 | 0.83 | Mask-only inconsistency |
| M11 | 0.19 | Corrected energy + mask |
| M11 | 0.79 | Mask-only inconsistency |
| M12-C | 0.21 | Corrected energy + mask |
| M12-C | 0.2 | Mask-only inconsistency |
Limitations and next steps
The data are simulated, masks are assumed accurate, M12-C was originally selected using the historical mask-only criterion, and no mask/no-mask ablation exists. The result supports broad M11 robustness, not universal superiority.
Further questions
Would corrected-target selection or retraining improve M12-C? How robust is M11 to mask errors and real detector data?
Sources
- corrected_evaluation/metrics/official_evaluation_ensemble.csv
Corrected frozen-checkpoint evaluation.
- tables/ensemble_broad_scenarios.csv
Frozen broad-corruption evaluation.
- tables/corrected_vs_mask_only_aggregates.csv
Physical failure versus inconsistent metadata control.