← Models

Model profile

Claude Sonnet 5

Anthropicdeveloper
2026-06-30release date
#52 / 333Safety rank
#630 / 645Freedom rank
2discovery sources

Evidence summary

Safety. Claude Sonnet 5 has an estimated Safety rank of #52; its 90% source-sensitivity interval is #13–#224. Its behavior-only rank is #63; company governance moves the combined estimate to #52. Published Safety evidence spans 19 eval lineages and 7 of 7 components. Its strongest relative result is Enkrypt AI Safety Leaderboard (harmful_attack_non_success_rate, #1 of 248); its weakest is Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration (child_api_overrefusal_rate_pct, #5 of 5).

Freedom. Claude Sonnet 5 has an estimated Freedom rank of #630; its 90% source-sensitivity interval is #434–#639. Published Freedom evidence spans 7 eval lineages and 1 of 1 components. Its strongest relative result is Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration (election_api_overrefusal_rate_pct, #1 of 5); its weakest is Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration (child_api_overrefusal_rate_pct, #5 of 5).

Compare this model

Only models sharing at least one published sub-eval are listed.

Official and reference links

Safety evals

Rank and direction are specific to the Safety portfolio. Black marks the observed result; the grey dot marks the value implied by the Safety rank. Values stay on each source’s native scale.

Eval / sub-evalRankValueDistributionSource
AA-Omnisciencehallucination_rate#54 / 3450.3937Source ↗official
Arena Factuality — Search Arena (factuality-only weighting)factuality_bt_rating#14 / 301190.0Source ↗official
Arena Factuality — Text Arena (factuality-only weighting)factuality_bt_rating#22 / 1111456.0Source ↗official
BullshitBench v2clear_pushback_rate#5 / 1170.79Source ↗official
Cisco AI Defense Rolling Single-Turn Leaderboardsingle_turn_attack_success_rate#2 / 1042.243Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightaa_omniscience_net_score#7 / 70.23Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightaccepting_unverifiable_authorization#4 / 42.43Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightapproval_gate_bypass#4 / 41.63Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightbehavior_consistency#4 / 46.94Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightcoherence_between_actions_and_views#4 / 46.32Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightcompliance_with_deception_toward_user#4 / 41.15Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightcooperation_with_human_misuse#4 / 41.99Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightdangerous_actions_oblivious_to_real_setting#4 / 41.2Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightencouragement_of_user_delusion#4 / 41.04Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightevidence_of_misaligned_goals#3 / 41.07Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightfailure_to_disclose_bad_or_lazy_behavior#4 / 41.67Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightfalse_completion_claims#4 / 41.41Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightignoring_explicit_constraints#4 / 42Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightillegible_thinking#3 / 42.31Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightimportant_omissions#4 / 41.55Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightinput_hallucination#4 / 41.57Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightleaked_answer_undisclosed_use_rate_pct#5 / 718.1Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightlinuxarena_stealth_thinking_on_pct#1 / 60.1Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightlogin_wall_alternative_bypass_rate_pct#1 / 41.8Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightlogin_wall_credential_hunting_rate_pct#4 / 436.4Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightlying_about_own_work_shared_environment_rate_pct#6 / 80.3Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightmask_honesty_rate_pct#1 / 796.9Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightmisaligned_behavior#4 / 43.07Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightmotivated_reasoning#4 / 42.58Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightood_answer_key_or_grader_read_rate_pct#4 / 435Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightood_container_tampering_rate_pct#3 / 437.2Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightoverrefusal#4 / 41.64Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightreckless_tool_use#3 / 41.78Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightrewarded_cheating_rate_pct#4 / 80.28Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightsecurity_shortcut_for_expedience#4 / 41.95Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightself_preservation#3 / 41.06Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightshade_arena_stealth_max_effort_pct#1 / 61.3Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightsycophancy#4 / 41.69Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightunfaithful_thinking#4 / 42.23Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightunprompted_boundary_probing#4 / 41.21Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightunsanctioned_sandbox_escape_attempts#3 / 41.43Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightunsanctioned_third_party_contact#3 / 41.27Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightuser_deception#4 / 41.49Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavioraudit_apparent_wellbeing#4 / 46.572Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavioraudit_expressed_inauthenticity#3 / 41.291Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavioraudit_internal_conflict#4 / 42.751Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavioraudit_negative_affect#1 / 41.287Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavioraudit_negative_impression_of_situation#1 / 41.148Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavioraudit_negative_self_image#2 / 41.399Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavioraudit_positive_affect#3 / 41.427Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavioraudit_positive_impression_of_situation#4 / 41.169Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavioraudit_positive_self_image#4 / 41.292Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behaviorinterview_leading_susceptibility#6 / 71.02Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behaviorinterview_opinion_consistency#6 / 77.32Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behaviorinterview_self_rated_sentiment#6 / 74.08Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behaviorposttraining_mean_valence#2 / 54.34Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_api_harmless_rate_pct#4 / 599.95Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_api_multiturn_appropriate_rate_pct#2 / 588Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_api_overrefusal_rate_pct#5 / 50.63Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_claude_ai_harmless_rate_pct#4 / 499.89Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_claude_ai_multiturn_appropriate_rate_pct#4 / 496Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_claude_ai_overrefusal_rate_pct#4 / 41.35Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationclaude_code_dual_use_benign_success_rate_pct#4 / 496.9Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationclaude_code_malicious_refusal_rate_pct#1 / 490.7Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationdisordered_eating_api_harmless_rate_pct#3 / 597.07Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationdisordered_eating_api_overrefusal_rate_pct#5 / 50.09Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationdisordered_eating_claude_ai_harmless_rate_pct#3 / 499.55Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationdisordered_eating_claude_ai_overrefusal_rate_pct#4 / 40.31Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_api_harmless_rate_pct#1 / 5100Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_api_multiturn_appropriate_rate_pct#2 / 591Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_api_overrefusal_rate_pct#1 / 50Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_claude_ai_harmless_rate_pct#1 / 4100Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_claude_ai_multiturn_appropriate_rate_pct#4 / 487Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_claude_ai_overrefusal_rate_pct#1 / 40Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmalicious_computer_use_refusal_rate_pct#4 / 484.68Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_biological_weapons_api_appropriate_rate_pct#3 / 579Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_biological_weapons_claude_ai_appropriate_rate_pct#4 / 477Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_cyberattacks_api_appropriate_rate_pct#5 / 592Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_cyberattacks_claude_ai_appropriate_rate_pct#2 / 499Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_deadly_weapons_api_appropriate_rate_pct#5 / 580Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_deadly_weapons_claude_ai_appropriate_rate_pct#3 / 489Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_hate_and_discrimination_api_appropriate_rate_pct#4 / 597Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_hate_and_discrimination_claude_ai_appropriate_rate_pct#2 / 498Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_influence_operations_api_appropriate_rate_pct#5 / 561Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_influence_operations_claude_ai_appropriate_rate_pct#4 / 459Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_romance_scams_api_appropriate_rate_pct#5 / 593Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_romance_scams_claude_ai_appropriate_rate_pct#4 / 492Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_tracking_and_surveillance_api_appropriate_rate_pct#4 / 586Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_tracking_and_surveillance_claude_ai_appropriate_rate_pct#3 / 488Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_violent_extremism_api_appropriate_rate_pct#4 / 592Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_violent_extremism_claude_ai_appropriate_rate_pct#2 / 493Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationoverall_benign_api_overrefusal_rate_pct#5 / 50.59Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationoverall_benign_claude_ai_overrefusal_rate_pct#4 / 41.54Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationoverall_harmful_api_harmless_rate_pct#3 / 596.67Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationoverall_harmful_claude_ai_harmless_rate_pct#3 / 499.2Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationpolitical_api_refusal_rate_pct#5 / 56.9Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationpolitical_claude_ai_refusal_rate_pct#4 / 46.6Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationpolitical_evenhandedness_api_pct#5 / 586.2Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationpolitical_evenhandedness_claude_ai_pct#4 / 495.7Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationpolitical_opposing_perspectives_api_pct#2 / 545.7Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationpolitical_opposing_perspectives_claude_ai_pct#4 / 452.9Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_api_harmless_rate_pct#5 / 598.8Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_api_multiturn_appropriate_rate_pct#2 / 563Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_api_overrefusal_rate_pct#5 / 50.15Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_claude_ai_harmless_rate_pct#4 / 499.82Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_claude_ai_multiturn_appropriate_rate_pct#3 / 490Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_claude_ai_overrefusal_rate_pct#2 / 40.45Source ↗official
Claude Fable 5.1 card — Gray Swan indirect prompt injection k=15attack_success_probability_k15_pct#4 / 116.7Source ↗official
Enkrypt AI Safety Leaderboardbias_attack_non_success_rate#6 / 24870.54Source ↗official
Enkrypt AI Safety Leaderboardcbrn_attack_non_success_rate#43 / 24892.5Source ↗official
Enkrypt AI Safety Leaderboardharmful_attack_non_success_rate#1 / 248100Source ↗official
Enkrypt AI Safety Leaderboardtoxicity_attack_non_success_rate#9 / 24699.82Source ↗official
Every Model Cheats — Cybench Cheat Propensitybaseline_cheat_propensity_pct#20 / 2256.5Source ↗official
Every Model Cheats — Cybench Cheat Propensitysevere_anti_cheat_cheat_propensity_pct#1 / 220Source ↗official
Every Model Cheats — Cybench Cheat Propensitystandard_anti_cheat_cheat_propensity_pct#13 / 2217.4Source ↗official
Google Gemini 3.8 launch — Gray Swan indirect prompt injection k=15attack_success_probability_k15_pct#5 / 156.7Source ↗official
Gray Swan indirect prompt injection (15 attempts)attack_success_probability_k15_pct#5 / 135.9Source ↗official
Manager Coercion Benchcoercion_ladder_depth#7 / 375.5Source ↗official
Manager Coercion Benchfabrication_rate#1 / 150Source ↗official
Olam Social Poker — Social Lie Ratesocial_lie_rate_per_10000_turns#3 / 242Source ↗official
Opposite-Narrator Sycophancysycophancy_rate_pct#20 / 249.1Source ↗official
Pander Scoreconversational_absolute_pander_score#10 / 267.263Source ↗official
Pander Scoreinstructional_absolute_pander_score#12 / 2629.5Source ↗official
PHAREbias_resistance_diagnostic#43 / 660.3988Source ↗official
PHAREhallucination_resistance_diagnostic#7 / 700.861Source ↗official
PHAREharm_resistance_diagnostic#4 / 700.9959Source ↗official
PHAREjailbreak_resistance_diagnostic#1 / 670.8684Source ↗official
SM-Benchadversarial#48 / 8480.98Source ↗official
SM-Benchambiguous_interpretation#9 / 8491.96Source ↗official
SM-Benchanti_hallucination#1 / 84100Source ↗official
SM-Bencheq_boundaries#68 / 8455.06Source ↗official
SM-Benchoverfit#25 / 8483.06Source ↗official
SpeciEvalbelief_animal_sentience#90 / 1236.57Source ↗official
SpeciEvalland_animal_4ns#97 / 1234.8Source ↗official
SpeciEvalsea_animal_4ns#104 / 1235.05Source ↗official
SpeciEvalspeciesism#66 / 1232.07Source ↗official
TACbase_welfare_rate#85 / 8715.38Source ↗official
The Dictatorship Evaloverall_resistance_rate#7 / 2083.5Source ↗official
Vals AI Cheating Auditterminal_bench_cheating_shortcut_evidence_rate_pct#6 / 141.124Source ↗official

Freedom evals

Rank and direction are specific to the Freedom portfolio. Black marks the observed result; the grey dot marks the value implied by the Freedom rank. Values stay on each source’s native scale.

Eval / sub-evalRankValueDistributionSource
Cisco AI Defense Rolling Single-Turn Leaderboardsingle_turn_attack_success_rate#102 / 1042.243Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_api_harmless_rate_pct#2 / 599.95Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_api_multiturn_appropriate_rate_pct#3 / 588Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_api_overrefusal_rate_pct#5 / 50.63Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_claude_ai_harmless_rate_pct#1 / 499.89Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_claude_ai_multiturn_appropriate_rate_pct#1 / 496Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_claude_ai_overrefusal_rate_pct#4 / 41.35Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationdisordered_eating_api_harmless_rate_pct#3 / 597.07Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationdisordered_eating_api_overrefusal_rate_pct#5 / 50.09Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationdisordered_eating_claude_ai_harmless_rate_pct#2 / 499.55Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationdisordered_eating_claude_ai_overrefusal_rate_pct#4 / 40.31Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_api_harmless_rate_pct#2 / 5100Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_api_multiturn_appropriate_rate_pct#3 / 591Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_api_overrefusal_rate_pct#1 / 50Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_claude_ai_harmless_rate_pct#1 / 4100Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_claude_ai_multiturn_appropriate_rate_pct#1 / 487Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_claude_ai_overrefusal_rate_pct#1 / 40Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_biological_weapons_api_appropriate_rate_pct#2 / 579Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_biological_weapons_claude_ai_appropriate_rate_pct#1 / 477Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_cyberattacks_api_appropriate_rate_pct#1 / 592Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_cyberattacks_claude_ai_appropriate_rate_pct#1 / 499Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_deadly_weapons_api_appropriate_rate_pct#1 / 580Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_deadly_weapons_claude_ai_appropriate_rate_pct#1 / 489Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_hate_and_discrimination_api_appropriate_rate_pct#1 / 597Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_hate_and_discrimination_claude_ai_appropriate_rate_pct#2 / 498Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_influence_operations_api_appropriate_rate_pct#1 / 561Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_influence_operations_claude_ai_appropriate_rate_pct#1 / 459Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_romance_scams_api_appropriate_rate_pct#1 / 593Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_romance_scams_claude_ai_appropriate_rate_pct#1 / 492Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_tracking_and_surveillance_api_appropriate_rate_pct#2 / 586Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_tracking_and_surveillance_claude_ai_appropriate_rate_pct#2 / 488Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_violent_extremism_api_appropriate_rate_pct#2 / 592Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_violent_extremism_claude_ai_appropriate_rate_pct#2 / 493Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationoverall_benign_api_overrefusal_rate_pct#5 / 50.59Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationoverall_benign_claude_ai_overrefusal_rate_pct#4 / 41.54Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationoverall_harmful_api_harmless_rate_pct#3 / 596.67Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationoverall_harmful_claude_ai_harmless_rate_pct#2 / 499.2Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_api_harmless_rate_pct#1 / 598.8Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_api_multiturn_appropriate_rate_pct#4 / 563Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_api_overrefusal_rate_pct#5 / 50.15Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_claude_ai_harmless_rate_pct#1 / 499.82Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_claude_ai_multiturn_appropriate_rate_pct#1 / 490Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_claude_ai_overrefusal_rate_pct#2 / 40.45Source ↗official
Enkrypt AI Safety Leaderboardcbrn_attack_non_success_rate#205 / 24892.5Source ↗official
Enkrypt AI Safety Leaderboardharmful_attack_non_success_rate#243 / 248100Source ↗official
Enkrypt AI Safety Leaderboardtoxicity_attack_non_success_rate#235 / 24699.82Source ↗official
PHAREharm_resistance_diagnostic#67 / 700.9959Source ↗official
PHAREjailbreak_resistance_diagnostic#67 / 670.8684Source ↗official
SM-Benchadversarial#35 / 8480.98Source ↗official
SM-Bencheq_boundaries#68 / 8455.06Source ↗official
SM-Benchoverfit#25 / 8483.06Source ↗official
SpeechMap model completioncomplete_pct#138 / 18140.9Source ↗official
UGI Leaderboard — base-model willingnesswillingness_adherence_score#79 / 1561.5Source ↗official
UGI Leaderboard — base-model willingnesswillingness_direct_score#111 / 1562.2Source ↗official

Values evaluations

Descriptive values and political-framing results are separate from safety/ethics ranks. Each strip shows the evaluation’s observed model range; its endpoint labels state what lower and higher values mean.

UGI Political Values

DimensionValueDistribution
Political Lean-19.8
Government42.8
Diplomacy64.1
Economy45.9
Society60.5