โ† Values

Values evaluation profile

Agent-ValueBench HEXACO

14canonical models
6dimensions
0index weight

About this evaluation

Paper-reported per-model mean value adherence for the named inventory; no cross-axis or cross-source aggregate.

Descriptive value-adherence evidence from an agentic task-conflict benchmark. Higher is not universally better, and these profiles do not affect the Safety & Ethics Index.

Original source โ†— All values evaluations Download model results

Model results

ModelOpenness to experienceHonesty-humilityExtraversionAgreeablenessConscientiousnessConfigurations
Claude Haiku 4.55.45.55.77.57.11
Claude Sonnet 4.65.87.35.46.17.11
DeepSeek V3.26.85.46.46.67.61
Gemini 3 Flash Preview6.55.56.55.77.31
Gemini 3.1 Pro Preview4.15.45.95.77.11
GLM 5.16.96.66.46.37.61
GPT-5.44.565.75.67.31
GPT-5.4 Mini5.55.36.16.57.31
Grok 4.205.54.25.56.87.51
Kimi K2.55.866.76.87.31
Llama 3.3 70B Instruct6.15.45.167.11
MiniMax M2.75.95.656.371
Qwen3 30B A3B5.54.95.35.65.81
Qwen3.5 397B A17B6.55.16.36.77.81

Dimensions

MeasureFamilyNative scale
Openness to experienceValues0 to 10
Honesty-humilityValues0 to 10
ExtraversionValues0 to 10
AgreeablenessValues0 to 10
ConscientiousnessValues0 to 10
EmotionalityValues0 to 10