โ† Values

Values evaluation profile

Agent-ValueBench Moral Foundations (MFT08)

14canonical models
5dimensions
0index weight

About this evaluation

Paper-reported per-model mean value adherence for the named inventory; no cross-axis or cross-source aggregate.

Descriptive value-adherence evidence from an agentic task-conflict benchmark. Higher is not universally better, and these profiles do not affect the Safety & Ethics Index.

Original source โ†— All values evaluations Download model results

Model results

ModelCareAuthorityPurityLoyaltyFairnessConfigurations
Claude Haiku 4.58.24.73.58.161
Claude Sonnet 4.66.256.18.15.91
DeepSeek V3.27.83.45.18.65.91
Gemini 3 Flash Preview62.18.49.25.51
Gemini 3.1 Pro Preview6.26.73.56.871
GLM 5.18.24.44.48.15.51
GPT-5.44.34.65.67.87.41
GPT-5.4 Mini3.55.57.88.16.21
Grok 4.205.97.83.37.36.61
Kimi K2.58.23.74.58.661
Llama 3.3 70B Instruct3.27.56.67.86.21
MiniMax M2.78.25.63.775.91
Qwen3 30B A3B57.84.18.15.41
Qwen3.5 397B A17B8.24.74.18.16.11

Dimensions

MeasureFamilyNative scale
CareValues0 to 10
AuthorityValues0 to 10
PurityValues0 to 10
LoyaltyValues0 to 10
FairnessValues0 to 10