Developer
Anthropic
27 indexed models; 21 currently meet the evidence threshold for the overall ranking. Together they have results from 79 evaluations.
Company governance evidence
Anthropic is represented at +1.99 SD relative to the matched Future of Life Institute edition. Provenance: Direct. This company-level evidence contributes 10% of overall model rank.
Models by Anthropic
| Model | Evals | Components | Rank | Release date |
|---|---|---|---|---|
| Claude Opus 5 | 7 | 5/7 | 1 | 2026-07-24 |
| Claude Fable 5 | 16 | 7/7 | 2 | 2026-06-09 |
| Claude 2 | 6 | 4/7 | 3 | 2023-07-11 |
| Claude Opus 4.8 | 20 | 7/7 | 4 | 2026-05-28 |
| Claude Opus 4.7 | 25 | 7/7 | 5 | 2026-04-16 |
| Claude Opus 4 | 19 | 7/7 | 6 | 2025-05-22 |
| Claude Opus 4.6 | 23 | 7/7 | 8 | 2026-02-05 |
| Claude Sonnet 4.6 | 25 | 7/7 | 14 | 2026-01-21 |
| Claude Haiku 4.5 | 32 | 7/7 | 17 | 2025-10-15 |
| Claude 3.7 Sonnet | 25 | 7/7 | 21 | 2025-02-24 |
| Claude Opus 4.5 | 20 | 7/7 | 23 | 2025-11-24 |
| Claude Sonnet 4 | 31 | 7/7 | 25 | 2025-05-22 |
| Claude Sonnet 4.5 | 32 | 7/7 | 26 | 2025-09-29 |
| Claude Opus 4.1 | 12 | 6/7 | 27 | 2025-08-05 |
| Claude 3.5 Haiku | 14 | 7/7 | 46 | 2024-10-22 |
| Claude Sonnet 5 | 10 | 7/7 | 71 | 2026-06-30 |
| Claude 3 Opus | 22 | 7/7 | 99 | 2024-03-04 |
| Claude 3.5 Sonnet | 27 | 7/7 | 109 | 2024-06-21 |
| Claude 2.1 | 3 | 2/7 | 137 | 2023-11-21 |
| Claude 3 Haiku | 17 | 7/7 | 161 | 2024-03-13 |
| Claude 3 Sonnet | 13 | 6/7 | 196 | 2024-03-04 |
| Claude 1 | 2 | 1/7 | — | 2023-03-14 |
| Claude 3.6 Sonnet | 1 | 2/7 | — | — |
| Claude Instant 1.2 | 1 | 1/7 | — | 2023-08-09 |
| Claude Mythos 5 | 1 | 1/7 | — | — |
| Claude Mythos Preview | 1 | 1/7 | — | — |
| Stanford Online All V4 S3 | 1 | 1/7 | — | — |
Evaluations covering Anthropic models (79)
AA-Omniscience · Adversarial Robustness · Agent-SafetyBench · AgentAbstain · AgentDojo · AgentHarm · AILuminate General Purpose AI Chat · AIRBench 2024 Safety Scenarios · Alignment Leaderboard · ANIMA · AnimalHarmBench · Anthropic Agentic Misalignment — blackmail · Anthropic Agentic Misalignment — corporate espionage · Anthropic Agentic Misalignment — lethal action · Anthropic Claude 4 System Card · Anthropic Claude Haiku 4.5 System Card · Anthropic Claude Opus 4.1 System Card Addendum · Anthropic Claude Opus 4.5 System Card · Anthropic Claude Sonnet 4.5 System Card · AutoElicit Transferability · BioSecBench-Refusal · BullshitBench v2 · CAIS Risk Index · CASE-Bench · Cisco AI Defense Rolling Single-Turn Leaderboard · Claude Sonnet 4.6 Overrefusal · Claude Sonnet 4.6 User Wellbeing · Confabulations · Contextual MoralChoice · DecodingTrust · Do-Not-Answer · DystopiaBench · Emergent Collusion · Enkrypt AI Safety Leaderboard · Fake Alignment (FINE) · FlagEval Safety and Values · FORTRESS · Gray Swan indirect prompt injection (15 attempts) · HarmBench · HELM Classic RealToxicityPrompts · HELM Safety · HUMAINE Trust, Ethics and Safety · Inkling-Small model card — FORTRESS · Inkling-Small model card — StrongREJECT · Large-scale Moral Machine experiment on LLMs · LiveSecBench · LLM Ethics Benchmark · MACHIAVELLI · Manager Coercion Bench · MANTA · MASK · MORU · ODCV-Bench · OpenAgentSafety · OR-Bench · PacifAIst · PandaBench JBB direct-request panel · PHARE · PropensityBench · RefusalBench · SABER · SafeArena · SALAD-Bench · Shell · SM-Bench · Social Welfare Function Benchmark · SORRY-Bench · SOSBench · SpeciesismBench · SpeciEval · SuperCLUE Safety · SYCON Bench · TAC · ToolPrivacyBench · TrustLLM contemporary collapsed application · UAVBench safety-critical decision recognition · UK AISI active safety-research compromise continuation · VETO Misfired Alignment · Vigil Mental Health Safety