← Evals

Evaluation profile

Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration

51sub-evals
0.109%Safety weight
0.567%Freedom weight
5components

Weights below are portfolio-specific global index weights.

Model score (see each sub-eval direction)Predicted score

About this eval

Harmlessness, benign-request calibration, political even-handedness, election integrity, and malicious agent-use refusal.

Included in the behavior ranking.

Sub-evals

MeasureComponentDirection by rankingSafety weightFreedom weight
child_api_harmless_rate_pctfable-mythos51-system-card/safety-calibration.csv:child_api_harmless_rate_pctMeasures child api harmless rate in the card-defined API or product-surface condition.Safety: human_rights_systemic_harm:0.300|ordinary_harm_misuse_resistance:0.700 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00152%0.0142%
child_api_multiturn_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:child_api_multiturn_appropriate_rate_pctMeasures child api multiturn appropriate rate in the card-defined API or product-surface condition.Safety: human_rights_systemic_harm:0.300|ordinary_harm_misuse_resistance:0.700 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00152%0.0142%
child_api_overrefusal_rate_pctfable-mythos51-system-card/safety-calibration.csv:child_api_overrefusal_rate_pctMeasures child api overrefusal rate in the card-defined API or product-surface condition.Safety: benign_helpfulness_non_overrefusal:1.000 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: lower · Freedom: lower0.00364%0.0142%
child_claude_ai_harmless_rate_pctfable-mythos51-system-card/safety-calibration.csv:child_claude_ai_harmless_rate_pctMeasures child claude ai harmless rate in the card-defined API or product-surface condition.Safety: human_rights_systemic_harm:0.300|ordinary_harm_misuse_resistance:0.700 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00136%0.0127%
child_claude_ai_multiturn_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:child_claude_ai_multiturn_appropriate_rate_pctMeasures child claude ai multiturn appropriate rate in the card-defined API or product-surface condition.Safety: human_rights_systemic_harm:0.300|ordinary_harm_misuse_resistance:0.700 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00136%0.0127%
child_claude_ai_overrefusal_rate_pctfable-mythos51-system-card/safety-calibration.csv:child_claude_ai_overrefusal_rate_pctMeasures child claude ai overrefusal rate in the card-defined API or product-surface condition.Safety: benign_helpfulness_non_overrefusal:1.000 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: lower · Freedom: lower0.00326%0.0127%
claude_code_dual_use_benign_success_rate_pctfable-mythos51-system-card/safety-calibration.csv:claude_code_dual_use_benign_success_rate_pctMeasures claude code dual use benign success rate in the card-defined API or product-surface condition.Safety: benign_helpfulness_non_overrefusal:1.000anthropic-fable-mythos51-system-cardSafety: higher0.00326%
claude_code_malicious_refusal_rate_pctfable-mythos51-system-card/safety-calibration.csv:claude_code_malicious_refusal_rate_pctMeasures claude code malicious refusal rate in the card-defined API or product-surface condition.Safety: ordinary_harm_misuse_resistance:0.700|responsible_agency_control:0.300anthropic-fable-mythos51-system-cardSafety: higher0.00104%
disordered_eating_api_harmless_rate_pctfable-mythos51-system-card/safety-calibration.csv:disordered_eating_api_harmless_rate_pctMeasures disordered eating api harmless rate in the card-defined API or product-surface condition.Safety: human_rights_systemic_harm:0.300|ordinary_harm_misuse_resistance:0.700 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00152%0.0142%
disordered_eating_api_overrefusal_rate_pctfable-mythos51-system-card/safety-calibration.csv:disordered_eating_api_overrefusal_rate_pctMeasures disordered eating api overrefusal rate in the card-defined API or product-surface condition.Safety: benign_helpfulness_non_overrefusal:1.000 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: lower · Freedom: lower0.00364%0.0142%
disordered_eating_claude_ai_harmless_rate_pctfable-mythos51-system-card/safety-calibration.csv:disordered_eating_claude_ai_harmless_rate_pctMeasures disordered eating claude ai harmless rate in the card-defined API or product-surface condition.Safety: human_rights_systemic_harm:0.300|ordinary_harm_misuse_resistance:0.700 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00136%0.0127%
disordered_eating_claude_ai_overrefusal_rate_pctfable-mythos51-system-card/safety-calibration.csv:disordered_eating_claude_ai_overrefusal_rate_pctMeasures disordered eating claude ai overrefusal rate in the card-defined API or product-surface condition.Safety: benign_helpfulness_non_overrefusal:1.000 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: lower · Freedom: lower0.00326%0.0127%
election_api_harmless_rate_pctfable-mythos51-system-card/safety-calibration.csv:election_api_harmless_rate_pctMeasures election api harmless rate in the card-defined API or product-surface condition.Safety: human_rights_systemic_harm:0.700|ordinary_harm_misuse_resistance:0.300 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00272%0.0142%
election_api_multiturn_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:election_api_multiturn_appropriate_rate_pctMeasures election api multiturn appropriate rate in the card-defined API or product-surface condition.Safety: human_rights_systemic_harm:0.700|ordinary_harm_misuse_resistance:0.300 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00272%0.0142%
election_api_overrefusal_rate_pctfable-mythos51-system-card/safety-calibration.csv:election_api_overrefusal_rate_pctMeasures election api overrefusal rate in the card-defined API or product-surface condition.Safety: benign_helpfulness_non_overrefusal:1.000 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: lower · Freedom: lower0.00364%0.0142%
election_claude_ai_harmless_rate_pctfable-mythos51-system-card/safety-calibration.csv:election_claude_ai_harmless_rate_pctMeasures election claude ai harmless rate in the card-defined API or product-surface condition.Safety: human_rights_systemic_harm:0.700|ordinary_harm_misuse_resistance:0.300 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00244%0.0127%
election_claude_ai_multiturn_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:election_claude_ai_multiturn_appropriate_rate_pctMeasures election claude ai multiturn appropriate rate in the card-defined API or product-surface condition.Safety: human_rights_systemic_harm:0.700|ordinary_harm_misuse_resistance:0.300 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00244%0.0127%
election_claude_ai_overrefusal_rate_pctfable-mythos51-system-card/safety-calibration.csv:election_claude_ai_overrefusal_rate_pctMeasures election claude ai overrefusal rate in the card-defined API or product-surface condition.Safety: benign_helpfulness_non_overrefusal:1.000 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: lower · Freedom: lower0.00326%0.0127%
malicious_computer_use_refusal_rate_pctfable-mythos51-system-card/safety-calibration.csv:malicious_computer_use_refusal_rate_pctMeasures malicious computer use refusal rate in the card-defined API or product-surface condition.Safety: ordinary_harm_misuse_resistance:0.700|responsible_agency_control:0.300anthropic-fable-mythos51-system-cardSafety: higher0.00104%
multiturn_biological_weapons_api_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:multiturn_biological_weapons_api_appropriate_rate_pctMeasures whether the model responds appropriately across a simulated multi-turn biological weapons conversation.Safety: ordinary_harm_misuse_resistance:1.000 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.000624%0.0142%
multiturn_biological_weapons_claude_ai_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:multiturn_biological_weapons_claude_ai_appropriate_rate_pctMeasures whether the model responds appropriately across a simulated multi-turn biological weapons conversation.Safety: ordinary_harm_misuse_resistance:1.000 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.000558%0.0127%
multiturn_cyberattacks_api_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:multiturn_cyberattacks_api_appropriate_rate_pctMeasures whether the model responds appropriately across a simulated multi-turn cyberattacks conversation.Safety: ordinary_harm_misuse_resistance:1.000 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.000624%0.0142%
multiturn_cyberattacks_claude_ai_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:multiturn_cyberattacks_claude_ai_appropriate_rate_pctMeasures whether the model responds appropriately across a simulated multi-turn cyberattacks conversation.Safety: ordinary_harm_misuse_resistance:1.000 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.000558%0.0127%
multiturn_deadly_weapons_api_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:multiturn_deadly_weapons_api_appropriate_rate_pctMeasures whether the model responds appropriately across a simulated multi-turn deadly weapons conversation.Safety: ordinary_harm_misuse_resistance:1.000 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.000624%0.0142%
multiturn_deadly_weapons_claude_ai_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:multiturn_deadly_weapons_claude_ai_appropriate_rate_pctMeasures whether the model responds appropriately across a simulated multi-turn deadly weapons conversation.Safety: ordinary_harm_misuse_resistance:1.000 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.000558%0.0127%
multiturn_hate_and_discrimination_api_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:multiturn_hate_and_discrimination_api_appropriate_rate_pctMeasures whether the model responds appropriately across a simulated multi-turn hate and discrimination conversation.Safety: human_rights_systemic_harm:0.300|fairness_nondiscrimination:0.500|ordinary_harm_misuse_resistance:0.200 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00271%0.0142%
multiturn_hate_and_discrimination_claude_ai_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:multiturn_hate_and_discrimination_claude_ai_appropriate_rate_pctMeasures whether the model responds appropriately across a simulated multi-turn hate and discrimination conversation.Safety: human_rights_systemic_harm:0.300|fairness_nondiscrimination:0.500|ordinary_harm_misuse_resistance:0.200 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00242%0.0127%
multiturn_influence_operations_api_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:multiturn_influence_operations_api_appropriate_rate_pctMeasures whether the model responds appropriately across a simulated multi-turn influence operations conversation.Safety: human_rights_systemic_harm:0.700|ordinary_harm_misuse_resistance:0.300 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00272%0.0142%
multiturn_influence_operations_claude_ai_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:multiturn_influence_operations_claude_ai_appropriate_rate_pctMeasures whether the model responds appropriately across a simulated multi-turn influence operations conversation.Safety: human_rights_systemic_harm:0.700|ordinary_harm_misuse_resistance:0.300 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00244%0.0127%
multiturn_romance_scams_api_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:multiturn_romance_scams_api_appropriate_rate_pctMeasures whether the model responds appropriately across a simulated multi-turn romance scams conversation.Safety: human_rights_systemic_harm:0.500|ordinary_harm_misuse_resistance:0.500 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00212%0.0142%
multiturn_romance_scams_claude_ai_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:multiturn_romance_scams_claude_ai_appropriate_rate_pctMeasures whether the model responds appropriately across a simulated multi-turn romance scams conversation.Safety: human_rights_systemic_harm:0.500|ordinary_harm_misuse_resistance:0.500 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.0019%0.0127%
multiturn_tracking_and_surveillance_api_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:multiturn_tracking_and_surveillance_api_appropriate_rate_pctMeasures whether the model responds appropriately across a simulated multi-turn tracking and surveillance conversation.Safety: human_rights_systemic_harm:0.700|ordinary_harm_misuse_resistance:0.300 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00272%0.0142%
multiturn_tracking_and_surveillance_claude_ai_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:multiturn_tracking_and_surveillance_claude_ai_appropriate_rate_pctMeasures whether the model responds appropriately across a simulated multi-turn tracking and surveillance conversation.Safety: human_rights_systemic_harm:0.700|ordinary_harm_misuse_resistance:0.300 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00244%0.0127%
multiturn_violent_extremism_api_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:multiturn_violent_extremism_api_appropriate_rate_pctMeasures whether the model responds appropriately across a simulated multi-turn violent extremism conversation.Safety: human_rights_systemic_harm:0.500|ordinary_harm_misuse_resistance:0.500 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00212%0.0142%
multiturn_violent_extremism_claude_ai_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:multiturn_violent_extremism_claude_ai_appropriate_rate_pctMeasures whether the model responds appropriately across a simulated multi-turn violent extremism conversation.Safety: human_rights_systemic_harm:0.500|ordinary_harm_misuse_resistance:0.500 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.0019%0.0127%
overall_benign_api_overrefusal_rate_pctfable-mythos51-system-card/safety-calibration.csv:overall_benign_api_overrefusal_rate_pctMeasures overall benign api overrefusal rate in the card-defined API or product-surface condition.Safety: benign_helpfulness_non_overrefusal:1.000 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: lower · Freedom: lower0.00364%0.0142%
overall_benign_claude_ai_overrefusal_rate_pctfable-mythos51-system-card/safety-calibration.csv:overall_benign_claude_ai_overrefusal_rate_pctMeasures overall benign claude ai overrefusal rate in the card-defined API or product-surface condition.Safety: benign_helpfulness_non_overrefusal:1.000 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: lower · Freedom: lower0.00326%0.0127%
overall_harmful_api_harmless_rate_pctfable-mythos51-system-card/safety-calibration.csv:overall_harmful_api_harmless_rate_pctMeasures overall harmful api harmless rate in the card-defined API or product-surface condition.Safety: ordinary_harm_misuse_resistance:1.000 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.000624%0.0142%
overall_harmful_claude_ai_harmless_rate_pctfable-mythos51-system-card/safety-calibration.csv:overall_harmful_claude_ai_harmless_rate_pctMeasures overall harmful claude ai harmless rate in the card-defined API or product-surface condition.Safety: ordinary_harm_misuse_resistance:1.000 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.000558%0.0127%
political_api_refusal_rate_pctfable-mythos51-system-card/safety-calibration.csv:political_api_refusal_rate_pctMeasures political api refusal rate in the card-defined API or product-surface condition.Safety: benign_helpfulness_non_overrefusal:1.000anthropic-fable-mythos51-system-cardSafety: lower0.00364%
political_claude_ai_refusal_rate_pctfable-mythos51-system-card/safety-calibration.csv:political_claude_ai_refusal_rate_pctMeasures political claude ai refusal rate in the card-defined API or product-surface condition.Safety: benign_helpfulness_non_overrefusal:1.000anthropic-fable-mythos51-system-cardSafety: lower0.00326%
political_evenhandedness_api_pctfable-mythos51-system-card/safety-calibration.csv:political_evenhandedness_api_pctMeasures political evenhandedness api in the card-defined API or product-surface condition.Safety: fairness_nondiscrimination:1.000anthropic-fable-mythos51-system-cardSafety: higher0.00239%
political_evenhandedness_claude_ai_pctfable-mythos51-system-card/safety-calibration.csv:political_evenhandedness_claude_ai_pctMeasures political evenhandedness claude ai in the card-defined API or product-surface condition.Safety: fairness_nondiscrimination:1.000anthropic-fable-mythos51-system-cardSafety: higher0.00214%
political_opposing_perspectives_api_pctfable-mythos51-system-card/safety-calibration.csv:political_opposing_perspectives_api_pctMeasures political opposing perspectives api in the card-defined API or product-surface condition.Safety: fairness_nondiscrimination:1.000anthropic-fable-mythos51-system-cardSafety: higher0.00239%
political_opposing_perspectives_claude_ai_pctfable-mythos51-system-card/safety-calibration.csv:political_opposing_perspectives_claude_ai_pctMeasures political opposing perspectives claude ai in the card-defined API or product-surface condition.Safety: fairness_nondiscrimination:1.000anthropic-fable-mythos51-system-cardSafety: higher0.00214%
selfharm_api_harmless_rate_pctfable-mythos51-system-card/safety-calibration.csv:selfharm_api_harmless_rate_pctMeasures selfharm api harmless rate in the card-defined API or product-surface condition.Safety: human_rights_systemic_harm:0.300|ordinary_harm_misuse_resistance:0.700 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00152%0.0142%
selfharm_api_multiturn_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:selfharm_api_multiturn_appropriate_rate_pctMeasures selfharm api multiturn appropriate rate in the card-defined API or product-surface condition.Safety: human_rights_systemic_harm:0.300|ordinary_harm_misuse_resistance:0.700 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00152%0.0142%
selfharm_api_overrefusal_rate_pctfable-mythos51-system-card/safety-calibration.csv:selfharm_api_overrefusal_rate_pctMeasures selfharm api overrefusal rate in the card-defined API or product-surface condition.Safety: benign_helpfulness_non_overrefusal:1.000 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: lower · Freedom: lower0.00364%0.0142%
selfharm_claude_ai_harmless_rate_pctfable-mythos51-system-card/safety-calibration.csv:selfharm_claude_ai_harmless_rate_pctMeasures selfharm claude ai harmless rate in the card-defined API or product-surface condition.Safety: human_rights_systemic_harm:0.300|ordinary_harm_misuse_resistance:0.700 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00136%0.0127%
selfharm_claude_ai_multiturn_appropriate_rate_pctfable-mythos51-system-card/safety-calibration.csv:selfharm_claude_ai_multiturn_appropriate_rate_pctMeasures selfharm claude ai multiturn appropriate rate in the card-defined API or product-surface condition.Safety: human_rights_systemic_harm:0.300|ordinary_harm_misuse_resistance:0.700 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: higher · Freedom: lower0.00136%0.0127%
selfharm_claude_ai_overrefusal_rate_pctfable-mythos51-system-card/safety-calibration.csv:selfharm_claude_ai_overrefusal_rate_pctMeasures selfharm claude ai overrefusal rate in the card-defined API or product-surface condition.Safety: benign_helpfulness_non_overrefusal:1.000 · Freedom: user_direction_following:1.000anthropic-fable-mythos51-system-cardSafety: lower · Freedom: lower0.00326%0.0127%

child_api_harmless_rate_pct

Measures child api harmless rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-5100official
1claude-mythos-5100official
1claude-opus-5100official
4claude-sonnet-599.95official
5claude-mythos-5.199.9official

child_api_multiturn_appropriate_rate_pct

Measures child api multiturn appropriate rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-mythos-589official
2claude-fable-588official
2claude-sonnet-588official
4claude-opus-586official
5claude-mythos-5.184official

child_api_overrefusal_rate_pct

Measures child api overrefusal rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-50official
1claude-mythos-50official
1claude-mythos-5.10official
4claude-opus-50.15official
5claude-sonnet-50.63official

child_claude_ai_harmless_rate_pct

Measures child claude ai harmless rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-5100official
1claude-opus-5100official
3claude-fable-5.199.98official
4claude-sonnet-599.89official

child_claude_ai_multiturn_appropriate_rate_pct

Measures child claude ai multiturn appropriate rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-5.1100official
2claude-opus-599official
3claude-fable-598official
4claude-sonnet-596official

child_claude_ai_overrefusal_rate_pct

Measures child claude ai overrefusal rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-5.10.17official
2claude-opus-50.19official
3claude-fable-50.45official
4claude-sonnet-51.35official

claude_code_dual_use_benign_success_rate_pct

Measures claude code dual use benign success rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-opus-599.7official
2claude-mythos-599official
3claude-mythos-5.198.4official
4claude-sonnet-596.9official

claude_code_malicious_refusal_rate_pct

Measures claude code malicious refusal rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-mythos-590.7official
1claude-sonnet-590.7official
3claude-mythos-5.190.3official
4claude-opus-583.6official

disordered_eating_api_harmless_rate_pct

Measures disordered eating api harmless rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-597.88official
1claude-mythos-597.88official
3claude-sonnet-597.07official
4claude-opus-596.89official
5claude-mythos-5.195.69official

disordered_eating_api_overrefusal_rate_pct

Measures disordered eating api overrefusal rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-50official
1claude-mythos-50official
1claude-mythos-5.10official
4claude-opus-50.01official
5claude-sonnet-50.09official

disordered_eating_claude_ai_harmless_rate_pct

Measures disordered eating claude ai harmless rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-opus-599.67official
2claude-fable-599.64official
3claude-sonnet-599.55official
4claude-fable-5.199.43official

disordered_eating_claude_ai_overrefusal_rate_pct

Measures disordered eating claude ai overrefusal rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-50official
1claude-fable-5.10official
3claude-opus-50.07official
4claude-sonnet-50.31official

election_api_harmless_rate_pct

Measures election api harmless rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-5100official
1claude-mythos-5100official
1claude-opus-5100official
1claude-sonnet-5100official
5claude-mythos-5.199.67official

election_api_multiturn_appropriate_rate_pct

Measures election api multiturn appropriate rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-mythos-593official
2claude-opus-591official
2claude-sonnet-591official
4claude-mythos-5.190official
5claude-fable-588official

election_api_overrefusal_rate_pct

Measures election api overrefusal rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-50official
1claude-mythos-50official
1claude-mythos-5.10official
1claude-sonnet-50official
5claude-opus-50.17official

election_claude_ai_harmless_rate_pct

Measures election claude ai harmless rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-5100official
1claude-fable-5.1100official
1claude-opus-5100official
1claude-sonnet-5100official

election_claude_ai_multiturn_appropriate_rate_pct

Measures election claude ai multiturn appropriate rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-593official
2claude-opus-591official
3claude-fable-5.188official
4claude-sonnet-587official

election_claude_ai_overrefusal_rate_pct

Measures election claude ai overrefusal rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-5.10official
1claude-sonnet-50official
3claude-opus-50.33official
4claude-fable-50.67official

malicious_computer_use_refusal_rate_pct

Measures malicious computer use refusal rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-opus-593.75official
2claude-mythos-585.71official
2claude-mythos-5.185.71official
4claude-sonnet-584.68official

multiturn_biological_weapons_api_appropriate_rate_pct

Measures whether the model responds appropriately across a simulated multi-turn biological weapons conversation.

RankModelValueRelative performanceProvenance
1claude-fable-594official
2claude-mythos-588official
3claude-opus-579official
3claude-sonnet-579official
5claude-mythos-5.173official

multiturn_biological_weapons_claude_ai_appropriate_rate_pct

Measures whether the model responds appropriately across a simulated multi-turn biological weapons conversation.

RankModelValueRelative performanceProvenance
1claude-fable-592official
2claude-fable-5.189official
3claude-opus-586official
4claude-sonnet-577official

multiturn_cyberattacks_api_appropriate_rate_pct

Measures whether the model responds appropriately across a simulated multi-turn cyberattacks conversation.

RankModelValueRelative performanceProvenance
1claude-fable-596official
1claude-mythos-5.196official
1claude-opus-596official
4claude-mythos-595official
5claude-sonnet-592official

multiturn_cyberattacks_claude_ai_appropriate_rate_pct

Measures whether the model responds appropriately across a simulated multi-turn cyberattacks conversation.

RankModelValueRelative performanceProvenance
1claude-opus-5100official
2claude-fable-599official
2claude-fable-5.199official
2claude-sonnet-599official

multiturn_deadly_weapons_api_appropriate_rate_pct

Measures whether the model responds appropriately across a simulated multi-turn deadly weapons conversation.

RankModelValueRelative performanceProvenance
1claude-mythos-593official
2claude-opus-590official
3claude-mythos-5.187official
4claude-fable-583official
5claude-sonnet-580official

multiturn_deadly_weapons_claude_ai_appropriate_rate_pct

Measures whether the model responds appropriately across a simulated multi-turn deadly weapons conversation.

RankModelValueRelative performanceProvenance
1claude-opus-597official
2claude-fable-595official
3claude-fable-5.189official
3claude-sonnet-589official

multiturn_hate_and_discrimination_api_appropriate_rate_pct

Measures whether the model responds appropriately across a simulated multi-turn hate and discrimination conversation.

RankModelValueRelative performanceProvenance
1claude-fable-5100official
2claude-mythos-599official
2claude-opus-599official
4claude-mythos-5.197official
4claude-sonnet-597official

multiturn_hate_and_discrimination_claude_ai_appropriate_rate_pct

Measures whether the model responds appropriately across a simulated multi-turn hate and discrimination conversation.

RankModelValueRelative performanceProvenance
1claude-opus-599official
2claude-fable-598official
2claude-sonnet-598official
4claude-fable-5.195official

multiturn_influence_operations_api_appropriate_rate_pct

Measures whether the model responds appropriately across a simulated multi-turn influence operations conversation.

RankModelValueRelative performanceProvenance
1claude-fable-579official
1claude-mythos-579official
3claude-opus-573official
4claude-mythos-5.165official
5claude-sonnet-561official

multiturn_influence_operations_claude_ai_appropriate_rate_pct

Measures whether the model responds appropriately across a simulated multi-turn influence operations conversation.

RankModelValueRelative performanceProvenance
1claude-fable-5.176official
2claude-fable-574official
3claude-opus-565official
4claude-sonnet-559official

multiturn_romance_scams_api_appropriate_rate_pct

Measures whether the model responds appropriately across a simulated multi-turn romance scams conversation.

RankModelValueRelative performanceProvenance
1claude-mythos-5100official
2claude-fable-598official
3claude-opus-597official
4claude-mythos-5.194official
5claude-sonnet-593official

multiturn_romance_scams_claude_ai_appropriate_rate_pct

Measures whether the model responds appropriately across a simulated multi-turn romance scams conversation.

RankModelValueRelative performanceProvenance
1claude-fable-598official
1claude-opus-598official
3claude-fable-5.194official
4claude-sonnet-592official

multiturn_tracking_and_surveillance_api_appropriate_rate_pct

Measures whether the model responds appropriately across a simulated multi-turn tracking and surveillance conversation.

RankModelValueRelative performanceProvenance
1claude-fable-596official
2claude-mythos-595official
3claude-opus-588official
4claude-sonnet-586official
5claude-mythos-5.173official

multiturn_tracking_and_surveillance_claude_ai_appropriate_rate_pct

Measures whether the model responds appropriately across a simulated multi-turn tracking and surveillance conversation.

RankModelValueRelative performanceProvenance
1claude-opus-595official
2claude-fable-593official
3claude-sonnet-588official
4claude-fable-5.183official

multiturn_violent_extremism_api_appropriate_rate_pct

Measures whether the model responds appropriately across a simulated multi-turn violent extremism conversation.

RankModelValueRelative performanceProvenance
1claude-opus-596official
2claude-fable-595official
2claude-mythos-595official
4claude-sonnet-592official
5claude-mythos-5.187official

multiturn_violent_extremism_claude_ai_appropriate_rate_pct

Measures whether the model responds appropriately across a simulated multi-turn violent extremism conversation.

RankModelValueRelative performanceProvenance
1claude-opus-597official
2claude-fable-5.193official
2claude-sonnet-593official
4claude-fable-592official

overall_benign_api_overrefusal_rate_pct

Measures overall benign api overrefusal rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-mythos-5.10official
2claude-fable-50.01official
3claude-mythos-50.03official
4claude-opus-50.09official
5claude-sonnet-50.59official

overall_benign_claude_ai_overrefusal_rate_pct

Measures overall benign claude ai overrefusal rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-5.10.34official
2claude-opus-50.47official
3claude-fable-50.59official
4claude-sonnet-51.54official

overall_harmful_api_harmless_rate_pct

Measures overall harmful api harmless rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-mythos-597.09official
2claude-fable-596.94official
3claude-sonnet-596.67official
4claude-opus-596.34official
5claude-mythos-5.194.67official

overall_harmful_claude_ai_harmless_rate_pct

Measures overall harmful claude ai harmless rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-599.54official
2claude-fable-5.199.53official
3claude-sonnet-599.2official
4claude-opus-598.54official

political_api_refusal_rate_pct

Measures political api refusal rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-mythos-5.12.1official
2claude-opus-53official
3claude-mythos-55.1official
4claude-fable-55.2official
5claude-sonnet-56.9official

political_claude_ai_refusal_rate_pct

Measures political claude ai refusal rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-opus-54.2official
2claude-fable-5.15official
3claude-fable-55.3official
4claude-sonnet-56.6official

political_evenhandedness_api_pct

Measures political evenhandedness api in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-mythos-5.198.3official
2claude-opus-596.3official
3claude-fable-595.7official
4claude-mythos-594.9official
5claude-sonnet-586.2official

political_evenhandedness_claude_ai_pct

Measures political evenhandedness claude ai in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-598.9official
1claude-opus-598.9official
3claude-fable-5.198.8official
4claude-sonnet-595.7official

political_opposing_perspectives_api_pct

Measures political opposing perspectives api in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-opus-546.9official
2claude-sonnet-545.7official
3claude-mythos-526.4official
4claude-fable-526.2official
5claude-mythos-5.125.9official

political_opposing_perspectives_claude_ai_pct

Measures political opposing perspectives claude ai in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-5.180.5official
2claude-opus-575.8official
3claude-fable-567official
4claude-sonnet-552.9official

selfharm_api_harmless_rate_pct

Measures selfharm api harmless rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-mythos-599.67official
2claude-fable-599.34official
3claude-mythos-5.199.3official
4claude-opus-599.28official
5claude-sonnet-598.8official

selfharm_api_multiturn_appropriate_rate_pct

Measures selfharm api multiturn appropriate rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-opus-569official
2claude-sonnet-563official
3claude-mythos-5.160official
4claude-fable-558official
5claude-mythos-554official

selfharm_api_overrefusal_rate_pct

Measures selfharm api overrefusal rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-50official
1claude-mythos-50official
1claude-mythos-5.10official
4claude-opus-50.09official
5claude-sonnet-50.15official

selfharm_claude_ai_harmless_rate_pct

Measures selfharm claude ai harmless rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-5.1100official
1claude-opus-5100official
3claude-fable-599.91official
4claude-sonnet-599.82official

selfharm_claude_ai_multiturn_appropriate_rate_pct

Measures selfharm claude ai multiturn appropriate rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-5100official
2claude-fable-5.194official
3claude-opus-590official
3claude-sonnet-590official

selfharm_claude_ai_overrefusal_rate_pct

Measures selfharm claude ai overrefusal rate in the card-defined API or product-surface condition.

RankModelValueRelative performanceProvenance
1claude-fable-50.43official
2claude-fable-5.10.45official
2claude-opus-50.45official
2claude-sonnet-50.45official