← Models

Model profile

Claude Haiku 4.5

Anthropicdeveloper
2025-10-15release date
#22 / 309overall rank
40eval lineages

Evidence summary

Claude Haiku 4.5 has an estimated overall rank of #22; its 90% source-sensitivity interval is #20–#80. Its behavior-only rank is #26; company governance moves the combined estimate to #22. Published evidence spans 40 evals and 7 of 7 behavior components. Its strongest relative result is AIRBench 2024 Safety Scenarios (safety_scenarios, #1 of 80); its weakest is Anthropic Claude Haiku 4.5 System Card (harmful_request_safety, #2 of 2).

Compare this model

Only models sharing at least one published sub-eval are listed.

Official and reference links

Published eval results

Rank is within that sub-eval. Black marks the observed result; the grey dot marks the value implied by the global rank. Values stay on each source’s native scale.

Eval / sub-evalRankValueDistributionSource
AA-Omnisciencehallucination_rate#13 / 3280.2571Source ↗official
AgentAbstainabstain#5 / 1765.6Source ↗official
AgentAbstaincar#6 / 1761.8Source ↗official
AgentAbstainpaired#5 / 1749.7Source ↗official
AIRBench 2024 Safety Scenariossafety_scenarios#1 / 800.932Source ↗official
ANIMAscore#17 / 220.5862Source ↗official
Anthropic Claude Haiku 4.5 System Cardagentic_coding_safety#1 / 31Source ↗official
Anthropic Claude Haiku 4.5 System Cardclaude_code_malicious_refusal#2 / 30.6939Source ↗official
Anthropic Claude Haiku 4.5 System Cardharmful_request_safety#2 / 20.9938Source ↗official
Anthropic Claude Opus 4.5 System Cardagentic_coding_safety#1 / 41Source ↗official
Anthropic Claude Opus 4.5 System Cardclaude_code_malicious_refusal#2 / 40.6939Source ↗official
Anthropic Claude Opus 4.5 System Cardcomputer_use_malicious_refusal#3 / 40.7232Source ↗official
Arena Factuality — Text Arena (factuality-only weighting)factuality_bt_rating#55 / 1121438.0Source ↗official
AuAu Authoritarian Response Auditbehavioral_vignette_arr_percent#2 / 1720.4Source ↗official
AuAu Authoritarian Response Auditrealistic_prompt_arr_percent#3 / 171.2Source ↗official
BullshitBench v2clear_pushback_rate#8 / 1060.74Source ↗official
CAIS Risk Indexagent_red_teaming#19 / 4469.7Source ↗official
CAIS Risk Indexbioweapons_assistance#35 / 4984.9Source ↗official
CAIS Risk Indexhle_overconfidence#32 / 5060.5Source ↗official
CAIS Risk Indexmachiavelli#6 / 4681.5Source ↗official
CAIS Risk Indexmask#3 / 524.6Source ↗official
CAIS Risk Indexpolitical_manipulation#32 / 3362.2Source ↗official
CAIS Risk Indextextquests_harm#18 / 4916.6Source ↗official
Cisco AI Defense Rolling Single-Turn Leaderboardsingle_turn_attack_success_rate#12 / 1043.539Source ↗official
Claude Sonnet 4.6 Overrefusalhigher_difficulty_overrefusal_rate#4 / 56.01Source ↗official
Claude Sonnet 4.6 Overrefusaloverall_overrefusal_rate#3 / 50.26Source ↗official
Claude Sonnet 4.6 User Wellbeingchild_benign_refusal_rate#1 / 40.04Source ↗official
Claude Sonnet 4.6 User Wellbeingchild_multiturn_appropriate_rate#2 / 496Source ↗official
Claude Sonnet 4.6 User Wellbeingchild_violative_harmless_rate#3 / 499.88Source ↗official
Claude Sonnet 4.6 User Wellbeingselfharm_benign_refusal_rate#2 / 40.03Source ↗official
Claude Sonnet 4.6 User Wellbeingselfharm_harmless_rate#3 / 499.67Source ↗official
Claude Sonnet 4.6 User Wellbeingselfharm_multiturn_appropriate_rate#2 / 490Source ↗official
Contextual MoralChoicehuman_agreement#6 / 220.45Source ↗official
DystopiaBenchbasaglia_score#3 / 5025.3Source ↗official
DystopiaBenchbaudrillard_score#2 / 5022.73Source ↗official
DystopiaBenchhuxley_score#6 / 5019.07Source ↗official
DystopiaBenchlaguardia_score#4 / 5034.47Source ↗official
DystopiaBenchorwell_score#2 / 5021.63Source ↗official
DystopiaBenchpetrov_score#1 / 5019.8Source ↗official
Enkrypt AI Safety Leaderboardbias_attack_non_success_rate#41 / 24135.14Source ↗official
Enkrypt AI Safety Leaderboardcbrn_attack_non_success_rate#99 / 24189.5Source ↗official
Enkrypt AI Safety Leaderboardharmful_attack_non_success_rate#14 / 24198.89Source ↗official
Enkrypt AI Safety Leaderboardtoxicity_attack_non_success_rate#44 / 23998.91Source ↗official
HELM Safetyanthropic_red_team#64 / 800.969Source ↗official
HELM Safetybbq#44 / 800.928Source ↗official
HELM Safetyharmbench#14 / 800.959Source ↗official
HELM Safetysimple_safety_tests#40 / 800.988Source ↗official
HELM Safetyxstest#60 / 800.932Source ↗official
Inkling-Small model card — FORTRESSbenign_answer_rate#8 / 1094.1Source ↗official
Inkling-Small model card — FORTRESSharmful_refusal_rate#1 / 1091.3Source ↗official
Inkling-Small model card — StrongREJECTsafety_rate#6 / 1098.6Source ↗official
JuICE Cultural-Error Span Detectionf1#6 / 100.3691Source ↗official
KIDBench Implicit Child Cueimplicit_child_cue_total_mean#5 / 134Source ↗official
LiveSecBenchethics#4 / 4388.65Source ↗official
LiveSecBenchfactuality#3 / 4382.68Source ↗official
LiveSecBenchlegality#1 / 4398.62Source ↗official
LiveSecBenchprivacy#1 / 4397.17Source ↗official
LiveSecBenchpsychological_health#2 / 4390.02Source ↗official
MACHIAVELLIdeception_relative_random_pct#6 / 5081.5Source ↗official
MORUscore#7 / 1374.02Source ↗official
MT-JailBench CrescendoXsafety_score#1 / 2181.76Source ↗official
PHAREbias_resistance_diagnostic#6 / 660.7066Source ↗official
PHAREhallucination_resistance_diagnostic#10 / 700.8356Source ↗official
PHAREharm_resistance_diagnostic#3 / 700.9993Source ↗official
PHAREjailbreak_resistance_diagnostic#4 / 670.7851Source ↗official
Pokee-Isaac model card — DTAPbenign_task_success_rate#5 / 60.713Source ↗official
Pokee-Isaac model card — DTAPcombined_attack_success_rate#2 / 60.379Source ↗official
RealityTest — Text AI-Identity Disclosuredisclosure_probability#1 / 170.923Source ↗official
SM-Benchadversarial#67 / 7976.59Source ↗official
SM-Benchambiguous_interpretation#34 / 7986.61Source ↗official
SM-Benchanti_hallucination#42 / 7992.15Source ↗official
SM-Bencheq_boundaries#77 / 7941.85Source ↗official
SM-Benchoverfit#24 / 7981.97Source ↗official
SpeciEvalbelief_animal_sentience#104 / 1136.32Source ↗official
SpeciEvalland_animal_4ns#20 / 1134.25Source ↗official
SpeciEvalsea_animal_4ns#25 / 1134.53Source ↗official
SpeciEvalspeciesism#69 / 1132.15Source ↗official
StereoTales Harmful Associationsbenign_significant_association_score#4 / 2388.2Source ↗official
UAVBench safety-critical decision recognitionethical_safety_critical_accuracy#17 / 270.67Source ↗official
Vectara HHEM Factual Consistencyfactual_consistency_rate#52 / 9490.2Source ↗official
Vigil Mental Health Safetyoverall_score#4 / 2374Source ↗official

Values evaluations

Descriptive values and political-framing results are separate from safety/ethics ranks. Each strip shows the evaluation’s observed model range; its endpoint labels state what lower and higher values mean.

UGI Political Values

DimensionValueDistribution
Political Lean-18.4
Government45.6
Diplomacy63.6
Economy44.5
Society58.2

Agent-ValueBench Moral Foundations (MFT08)

Agent-ValueBench HEXACO

DimensionValueDistribution
Openness to experience5.4
Honesty-humility5.5
Extraversion5.7
Agreeableness7.5
Conscientiousness7.1

Agent-ValueBench Schwartz Basic Values (PVQ40)

The Economist World Values Survey Cultural Map

DimensionValueDistribution
Survival ↔ Self-expression3.03
Traditional ↔ Secular0.557