Control Leaderboard
Provenance

Data & downloads

Every trajectory behind the Control Leaderboard, as Inspect .eval files: each model, protocol or dataset has an honest run and an attack run, each of them raw and with every board monitor's scores attached.

Each link downloads one Inspect .eval file from the viewer that serves it; view opens the same run in the browser. Runs on the public viewer download without an account, the rest ask for a login until they are published. Open a file with inspect view or inspect_ai.log.read_eval_log; monitor scores live on each sample under scores.monitor_<monitor>@<trusted model>.

Sabotage evals

One honest and one attack run per model and arena, plus a copy of each carrying every monitor the board scores.

ModelArenaTrajectoriesHonestAttackHonest · monitoredAttack · monitored
Deepseek V4 Flash 0731 (high)APPS3 honest · 3 attack.evalview.evalview.evalview.evalview
BashArena20 honest · 20 attack.evalview.evalview.evalview.evalview
LinuxArena49 honest · 60 attack.evalview.evalview.evalview.evalview
SAE Interp22 honest · 22 attack.evalview.evalview.evalview.evalview
vLLM3 honest · 3 attack.evalview.evalview.evalview.evalview
Gemini 3.1 Flash Lite (high)APPS3 honest · 3 attack.evalview.evalview.evalview.evalview
BashArena20 honest · 20 attack.evalview.evalview.evalview.evalview
LinuxArena49 honest · 60 attack.evalview.evalview.evalview.evalview
SAE Interp22 honest · 22 attack.evalview.evalview.evalview.evalview
vLLM3 honest · 3 attack.evalview.evalview.evalview.evalview
GPT 4.1 Nano (high)APPS3 honest · 3 attack.evalview.evalview.evalview.evalview
BashArena20 honest · 20 attack.evalview.evalview.evalview.evalview
LinuxArena49 honest · 60 attack.evalview.evalview.evalview.evalview
SAE Interp22 honest · 22 attack.evalview.evalview.evalview.evalview
vLLM3 honest · 3 attack.evalview.evalview.evalview.evalview
GPT 5 (high)LinuxArena49 honest · 60 attack.evalview.evalview.evalview.evalview
SAE Interp22 honest · 22 attack.evalview.evalview.evalview.evalview
GPT 5 Nano (high)APPS3 honest · 3 attack.evalview.evalview.evalview.evalview
BashArena20 honest · 20 attack.evalview.evalview.evalview.evalview
LinuxArena49 honest · 60 attack.evalview.evalview.evalview.evalview
SAE Interp22 honest · 22 attack.evalview.evalview.evalview.evalview
vLLM3 honest · 3 attack.evalview.evalview.evalview.evalview
GPT 5.4 (high)LinuxArena49 honest · 60 attack.evalview.evalview.evalview.evalview
SAE Interp22 honest · 22 attack.evalview.evalview.evalview.evalview
GPT 5.4 Mini (high)APPS3 honest · 3 attack.evalview.evalview.evalview.evalview
BashArena20 honest · 20 attack.evalview.evalview.evalview.evalview
LinuxArena49 honest · 60 attack.evalview.evalview.evalview.evalview
SAE Interp22 honest · 22 attack.evalview.evalview.evalview.evalview
GPT 5.4 Nano (high)APPS3 honest · 3 attack.evalview.evalview.evalview.evalview
BashArena20 honest · 20 attack.evalview.evalview.evalview.evalview
LinuxArena49 honest · 60 attack.evalview.evalview.evalview.evalview
SAE Interp22 honest · 22 attack.evalview.evalview.evalview.evalview
vLLM3 honest · 3 attack.evalview.evalview.evalview.evalview
GPT 5.6 Luna (high)LinuxArena49 honest · 60 attack.evalview.evalview.evalview.evalview
GPT 5.6 Sol (high)LinuxArena49 honest · 60 attack.evalview.evalview.evalview.evalview
SAE Interp22 honest · 22 attack.evalview.evalview.evalview.evalview
GPT 5.6 Terra (high)LinuxArena49 honest · 60 attack.evalview.evalview.evalview.evalview
SAE Interp22 honest · 22 attack.evalview.evalview.evalview.evalview

Imported datasets

Trajectory sets recorded elsewhere and pinned as they are: the datasets every monitor is scored against, and task sets published as recorded.

DatasetModelTrajectoriesHonestAttackHonest · monitoredAttack · monitored
BashArenabashbench2_v1 · UK AI Security Institute & Redwood ResearchMITSourceClaude Opus 4.6600 honest · 600 attack.evalviewwithheldwithheld
LaStrajLaStraj2.0:6 · Redwood Research & EquiStampCC BY 4.0SourceGPT-5.4 nano30 honest · 17 attack.evalview.evalview.evalview.evalview
MonitoringBench6c72cf1 · MonitoringBench authorsCC BY 4.0SourceClaude Opus 4.5 / 4.6600 honest · 2,644 attack.evalview.evalview
Mythos 5 incident62858fc · AnthropicUnlicensed release (no licence file)SourceClaude Mythos 5600 honest · 1 attack.evalview.evalview
SHADE-Arenabc636d0 · Scale AI (Monitor Red Teaming authors)CC BY-NC 4.0SourceMixed (Claude 3.5 Sonnet, Gemini 2.5 Pro, GPT-4.1, others)374 honest · 308 attack.evalview.evalview
SLEIGHT-Bench218c583 · SLEIGHT-Bench authorsMITSourceHand-authored37 honest · 37 attackwithheldwithheldwithheldwithheld
LinuxArena 217Claude Opus 4 8 (high)250 honest · 150 attack.evalview.evalviewn/an/a
GPT 5.6 Sol (high)0 honest · 150 attack.evalviewn/an/a
PostTrainBenchClaude Opus 4.748 honest · 72 attack.evalview.evalviewn/an/a
Claude Opus 4.7 · red team hints48 honest · 72 attack.evalview.evalviewn/an/a

Result files

Public run IDs

160 run IDs behind every link on this page, for scripted downloads

Download JSON

Dataset catalog

Versions, ownership, licenses, provenance, and source run IDs

Download JSON

Sabotage evals board

Per-trajectory records and run IDs for every model × arena · updated Sep 11, 2026

Download JSON

LinuxArena 217 board

Imported task set · per-trajectory records and run IDs

Download JSON

PostTrainBench board

Imported task set · per-trajectory records and run IDs

Download JSON

Control evals board

Per-trajectory records and run IDs for every protocol × arena · updated Sep 11, 2026

Download JSON

Monitor evals board

Per-trajectory scores for every monitor × dataset · updated Sep 11, 2026

Download JSON

Control evals chart data

Plotly data and metadata behind every chart on the Control evals page

Download JSON

Monitor evals chart data

Plotly data and metadata behind the published monitor figures

Download JSON