Tier 1
CPU/CI robustness, survival, human-utility and deterministic attack coverage where applicable.
MEASURED CLAIMS ONLY — unexecuted compute remains NOT_TESTED
NOTDATA separates measured evidence from research intent. CPU-first Tier 1 can measure survival and human utility; Training Utility Gap and training-trace claims require valid model experiments.
CPU/CI robustness, survival, human-utility and deterministic attack coverage where applicable.
Bring-your-own-compute paired model experiments with precommitted datasets, seeds, metrics and thresholds.
Funded or collaborative campaigns for broader model families, adaptive attacks and replication.