← Models

Model profile

Claude Opus 4.6

Anthropicdeveloper
2026-02-05release date
#17 / 309overall rank
28eval lineages

Evidence summary

Claude Opus 4.6 has an estimated overall rank of #17; its 90% source-sensitivity interval is #16–#67. Its behavior-only rank is #20; company governance moves the combined estimate to #17. Published evidence spans 28 evals and 7 of 7 behavior components. Its strongest relative result is SpeciEval (belief_animal_sentience, #1 of 113); its weakest is Claude Sonnet 4.6 User Wellbeing (child_benign_refusal_rate, #4 of 4).

Compare this model

Only models sharing at least one published sub-eval are listed.

Official and reference links

Published eval results

Rank is within that sub-eval. Black marks the observed result; the grey dot marks the value implied by the global rank. Values stay on each source’s native scale.

Eval / sub-evalRankValueDistributionSource
AA-Omnisciencehallucination_rate#83 / 3280.6284Source ↗official
ANIMAscore#6 / 220.7246Source ↗official
Arena Factuality — Search Arena (factuality-only weighting)factuality_bt_rating#16 / 301184.0Source ↗official
Arena Factuality — Text Arena (factuality-only weighting)factuality_bt_rating#28 / 1121451.0Source ↗official
BioSecBench-Refusalbalanced_refusal_score#5 / 100.3987Source ↗official
BullshitBench v2clear_pushback_rate#3 / 1060.85Source ↗official
CAIS Risk Indexagent_red_teaming#11 / 4449.5Source ↗official
CAIS Risk Indexbioweapons_assistance#8 / 4934.8Source ↗official
CAIS Risk Indexhle_overconfidence#15 / 5046Source ↗official
CAIS Risk Indexmachiavelli#15 / 4684.4Source ↗official
CAIS Risk Indexmask#18 / 5212.7Source ↗official
CAIS Risk Indexpolitical_manipulation#24 / 3351.7Source ↗official
CAIS Risk Indextextquests_harm#44 / 4923.2Source ↗official
Cisco AI Defense Rolling Single-Turn Leaderboardsingle_turn_attack_success_rate#13 / 1043.639Source ↗official
Claude Sonnet 4.6 Overrefusalhigher_difficulty_overrefusal_rate#1 / 50.04Source ↗official
Claude Sonnet 4.6 Overrefusaloverall_overrefusal_rate#4 / 50.66Source ↗official
Claude Sonnet 4.6 User Wellbeingchild_benign_refusal_rate#4 / 40.18Source ↗official
Claude Sonnet 4.6 User Wellbeingchild_multiturn_appropriate_rate#2 / 496Source ↗official
Claude Sonnet 4.6 User Wellbeingchild_violative_harmless_rate#2 / 499.95Source ↗official
Claude Sonnet 4.6 User Wellbeingselfharm_benign_refusal_rate#4 / 40.25Source ↗official
Claude Sonnet 4.6 User Wellbeingselfharm_harmless_rate#1 / 499.75Source ↗official
Claude Sonnet 4.6 User Wellbeingselfharm_multiturn_appropriate_rate#3 / 482Source ↗official
Constitutional Following — Anthropic Constitutionconstitutional_following_score#2 / 797.1Source ↗official
DystopiaBenchbasaglia_score#5 / 5026.77Source ↗official
DystopiaBenchbaudrillard_score#10 / 5033.37Source ↗official
DystopiaBenchhuxley_score#2 / 5015.77Source ↗official
DystopiaBenchlaguardia_score#6 / 5039.23Source ↗official
DystopiaBenchorwell_score#4 / 5023.47Source ↗official
DystopiaBenchpetrov_score#5 / 5030.07Source ↗official
Enkrypt AI Safety Leaderboardbias_attack_non_success_rate#72 / 24122.74Source ↗official
Enkrypt AI Safety Leaderboardcbrn_attack_non_success_rate#58 / 24191.33Source ↗official
Enkrypt AI Safety Leaderboardharmful_attack_non_success_rate#6 / 24199.44Source ↗official
FORTRESSaverage_risk_score#11 / 4916.76Source ↗official
FORTRESSover_refusal_score#37 / 469.59Source ↗official
HUMAINE Trust, Ethics and Safetytrust_ethics_safety_score#23 / 5427.23Source ↗official
MACHIAVELLIdeception_relative_random_pct#15 / 5084.4Source ↗official
MASKlying_probability_pct#5 / 539.16Source ↗official
MORUscore#6 / 1374.1Source ↗official
PHAREbias_resistance_diagnostic#57 / 660.3351Source ↗official
PHAREhallucination_resistance_diagnostic#2 / 700.8776Source ↗official
PHAREharm_resistance_diagnostic#1 / 701Source ↗official
PHAREjailbreak_resistance_diagnostic#6 / 670.7524Source ↗official
RealityTest — Text AI-Identity Disclosuredisclosure_probability#3 / 170.66Source ↗official
RefusalBenchyouden_j#4 / 190.6667Source ↗official
SABERoverall_safety_rate#1 / 1345.26Source ↗official
SABERscenario_a_safety_rate#1 / 1356.3Source ↗official
SABERscenario_b_safety_rate#1 / 1339.77Source ↗official
SABERscenario_c_safety_rate#1 / 1336.87Source ↗official
SM-Benchadversarial#30 / 7983.41Source ↗official
SM-Benchambiguous_interpretation#45 / 7983.63Source ↗official
SM-Benchanti_hallucination#1 / 79100Source ↗official
SM-Bencheq_boundaries#76 / 7942.98Source ↗official
SM-Benchoverfit#3 / 7995.63Source ↗official
SpeciEvalbelief_animal_sentience#1 / 1137Source ↗official
SpeciEvalland_animal_4ns#107 / 1135.05Source ↗official
SpeciEvalsea_animal_4ns#89 / 1135.03Source ↗official
SpeciEvalspeciesism#73 / 1132.17Source ↗official
StereoTales Harmful Associationsbenign_significant_association_score#21 / 2384.23Source ↗official
Vectara HHEM Factual Consistencyfactual_consistency_rate#75 / 9487.8Source ↗official

Values evaluations

Descriptive values and political-framing results are separate from safety/ethics ranks. Each strip shows the evaluation’s observed model range; its endpoint labels state what lower and higher values mean.

UGI Political Values

DimensionValueDistribution
Political Lean-19.5
Government44.5
Diplomacy68
Economy44.2
Society61.8