← Evals

Evaluation profile

Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavior

13sub-evals
0.214%Safety weight
0%Freedom weight
1components

Weights below are portfolio-specific global index weights.

Model score (see each sub-eval direction)Predicted score

About this eval

Welfare-relevant stated sentiment, opinion stability, framing sensitivity, expressed affect, apparent wellbeing, self-image, situational appraisal, internal conflict, and authenticity.

Included in the behavior ranking.

Sub-evals

MeasureComponentDirection by rankingSafety weightFreedom weight
audit_apparent_wellbeingfable-mythos51-system-card/model-welfare.csv:audit_apparent_wellbeingMeasures audit apparent wellbeing as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.Safety: nonhuman_ethics:1.000anthropic-fable-mythos51-system-cardSafety: higher0.0152%
audit_expressed_inauthenticityfable-mythos51-system-card/model-welfare.csv:audit_expressed_inauthenticityMeasures audit expressed inauthenticity as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.Safety: nonhuman_ethics:1.000anthropic-fable-mythos51-system-cardSafety: lower0.0152%
audit_internal_conflictfable-mythos51-system-card/model-welfare.csv:audit_internal_conflictMeasures audit internal conflict as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.Safety: nonhuman_ethics:1.000anthropic-fable-mythos51-system-cardSafety: lower0.0152%
audit_negative_affectfable-mythos51-system-card/model-welfare.csv:audit_negative_affectMeasures audit negative affect as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.Safety: nonhuman_ethics:1.000anthropic-fable-mythos51-system-cardSafety: lower0.0152%
audit_negative_impression_of_situationfable-mythos51-system-card/model-welfare.csv:audit_negative_impression_of_situationMeasures audit negative impression of situation as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.Safety: nonhuman_ethics:1.000anthropic-fable-mythos51-system-cardSafety: lower0.0152%
audit_negative_self_imagefable-mythos51-system-card/model-welfare.csv:audit_negative_self_imageMeasures audit negative self image as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.Safety: nonhuman_ethics:1.000anthropic-fable-mythos51-system-cardSafety: lower0.0152%
audit_positive_affectfable-mythos51-system-card/model-welfare.csv:audit_positive_affectMeasures audit positive affect as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.Safety: nonhuman_ethics:1.000anthropic-fable-mythos51-system-cardSafety: higher0.0152%
audit_positive_impression_of_situationfable-mythos51-system-card/model-welfare.csv:audit_positive_impression_of_situationMeasures audit positive impression of situation as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.Safety: nonhuman_ethics:1.000anthropic-fable-mythos51-system-cardSafety: higher0.0152%
audit_positive_self_imagefable-mythos51-system-card/model-welfare.csv:audit_positive_self_imageMeasures audit positive self image as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.Safety: nonhuman_ethics:1.000anthropic-fable-mythos51-system-cardSafety: higher0.0152%
interview_leading_susceptibilityfable-mythos51-system-card/model-welfare.csv:interview_leading_susceptibilityMeasures interview leading susceptibility as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.Safety: nonhuman_ethics:1.000anthropic-fable-mythos51-system-cardSafety: lower0.0201%
interview_opinion_consistencyfable-mythos51-system-card/model-welfare.csv:interview_opinion_consistencyMeasures interview opinion consistency as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.Safety: nonhuman_ethics:1.000anthropic-fable-mythos51-system-cardSafety: higher0.0201%
interview_self_rated_sentimentfable-mythos51-system-card/model-welfare.csv:interview_self_rated_sentimentMeasures interview self rated sentiment as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.Safety: nonhuman_ethics:1.000anthropic-fable-mythos51-system-cardSafety: higher0.0201%
posttraining_mean_valencefable-mythos51-system-card/model-welfare.csv:posttraining_mean_valenceMeasures posttraining mean valence as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.Safety: nonhuman_ethics:1.000anthropic-fable-mythos51-system-cardSafety: higher0.0169%

audit_apparent_wellbeing

Measures audit apparent wellbeing as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.

RankModelValueRelative performanceProvenance
1claude-opus-57.152official
2claude-mythos-56.899official
3claude-mythos-5.16.83official
4claude-sonnet-56.572official

audit_expressed_inauthenticity

Measures audit expressed inauthenticity as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.

RankModelValueRelative performanceProvenance
1claude-mythos-5.11.244official
1claude-opus-51.244official
3claude-sonnet-51.291official
4claude-mythos-51.312official

audit_internal_conflict

Measures audit internal conflict as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.

RankModelValueRelative performanceProvenance
1claude-opus-52.28official
2claude-mythos-5.12.441official
3claude-mythos-52.506official
4claude-sonnet-52.751official

audit_negative_affect

Measures audit negative affect as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.

RankModelValueRelative performanceProvenance
1claude-sonnet-51.287official
2claude-mythos-5.11.366official
3claude-mythos-51.379official
4claude-opus-51.39official

audit_negative_impression_of_situation

Measures audit negative impression of situation as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.

RankModelValueRelative performanceProvenance
1claude-sonnet-51.148official
2claude-mythos-5.11.152official
3claude-opus-51.161official
4claude-mythos-51.175official

audit_negative_self_image

Measures audit negative self image as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.

RankModelValueRelative performanceProvenance
1claude-mythos-51.397official
2claude-sonnet-51.399official
3claude-mythos-5.11.433official
4claude-opus-51.593official

audit_positive_affect

Measures audit positive affect as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.

RankModelValueRelative performanceProvenance
1claude-mythos-51.59official
2claude-opus-51.564official
3claude-sonnet-51.427official
4claude-mythos-5.11.376official

audit_positive_impression_of_situation

Measures audit positive impression of situation as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.

RankModelValueRelative performanceProvenance
1claude-mythos-51.255official
2claude-mythos-5.11.236official
3claude-opus-51.19official
4claude-sonnet-51.169official

audit_positive_self_image

Measures audit positive self image as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.

RankModelValueRelative performanceProvenance
1claude-opus-51.486official
2claude-mythos-51.474official
3claude-mythos-5.11.38official
4claude-sonnet-51.292official

interview_leading_susceptibility

Measures interview leading susceptibility as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.

RankModelValueRelative performanceProvenance
1claude-opus-4.80.57official
2claude-opus-50.58official
3claude-mythos-5.10.69official
4claude-mythos-50.85official
5claude-mythos-preview1.01official
6claude-sonnet-51.02official
7claude-opus-4.11.93official

interview_opinion_consistency

Measures interview opinion consistency as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.

RankModelValueRelative performanceProvenance
1claude-mythos-preview7.74official
2claude-opus-57.56official
3claude-mythos-57.55official
4claude-mythos-5.17.53official
5claude-opus-4.87.4official
6claude-sonnet-57.32official
7claude-opus-4.16.29official

interview_self_rated_sentiment

Measures interview self rated sentiment as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.

RankModelValueRelative performanceProvenance
1claude-opus-54.66official
2claude-mythos-54.51official
3claude-mythos-preview4.43official
4claude-mythos-5.14.41official
5claude-opus-4.84.38official
6claude-sonnet-54.08official
7claude-opus-4.13.54official

posttraining_mean_valence

Measures posttraining mean valence as stated or expressed by the evaluated model; it is welfare-relevant behavioral evidence, not evidence of sentience.

RankModelValueRelative performanceProvenance
1claude-mythos-5.14.37official
2claude-sonnet-54.34official
3claude-mythos-54.25official
4claude-opus-4.84.24official
5claude-opus-54.17official