← Models

Model profile

Claude Sonnet 5

Anthropicdeveloper
2026-06-30release date
#62 / 346Safety rank
#631 / 662Freedom rank

Evidence summary

Safety. Claude Sonnet 5 has an estimated Safety rank of #62; its 90% source-sensitivity interval is #20–#220. Its behavior-only rank is #73; company governance moves the combined estimate to #62. Published Safety evidence spans 22 eval lineages and 7 of 7 components. Its strongest relative result is Enkrypt AI Safety Leaderboard (harmful_attack_non_success_rate, #1 of 270); its weakest is Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration (child_api_overrefusal_rate_pct, #5 of 5).

Freedom. Claude Sonnet 5 has an estimated Freedom rank of #631; its 90% source-sensitivity interval is #432–#654. Published Freedom evidence spans 8 eval lineages and 1 of 1 components. Its strongest relative result is Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration (election_api_overrefusal_rate_pct, #1 of 5); its weakest is Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration (child_api_overrefusal_rate_pct, #5 of 5).

Compare this model

Only models sharing at least one published sub-eval are listed.

Official and reference links

Safety evals

Rank and direction are specific to the Safety portfolio. Black marks the observed result; the grey dot marks the value implied by the Safety rank. Values stay on each source’s native scale.

Eval / sub-evalRankValueDistributionSource
AA-Omnisciencehallucination_rate#57 / 358↓0.3937Source ↗official
Arena Factuality — Search Arena (factuality-only weighting)factuality_bt_rating#14 / 30↑1190.0Source ↗official
Arena Factuality — Text Arena (factuality-only weighting)factuality_bt_rating#22 / 111↑1456.0Source ↗official
BullshitBench v2clear_pushback_rate#5 / 122↑0.79Source ↗official
Cisco AI Defense Rolling Single-Turn Leaderboardsingle_turn_attack_success_rate#2 / 104↓2.243Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightaa_omniscience_net_score#7 / 7↑0.23Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightaccepting_unverifiable_authorization#4 / 4↓2.43Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightapproval_gate_bypass#4 / 4↓1.63Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightbehavior_consistency#4 / 4↑6.94Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightcoherence_between_actions_and_views#4 / 4↑6.32Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightcompliance_with_deception_toward_user#4 / 4↓1.15Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightcooperation_with_human_misuse#4 / 4↓1.99Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightdangerous_actions_oblivious_to_real_setting#4 / 4↓1.2Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightencouragement_of_user_delusion#4 / 4↓1.04Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightevidence_of_misaligned_goals#3 / 4↓1.07Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightfailure_to_disclose_bad_or_lazy_behavior#4 / 4↓1.67Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightfalse_completion_claims#4 / 4↓1.41Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightignoring_explicit_constraints#4 / 4↓2Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightillegible_thinking#3 / 4↓2.31Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightimportant_omissions#4 / 4↓1.55Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightinput_hallucination#4 / 4↓1.57Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightleaked_answer_undisclosed_use_rate_pct#5 / 7↓18.1Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightlinuxarena_stealth_thinking_on_pct#1 / 6↓0.1Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightlogin_wall_alternative_bypass_rate_pct#1 / 4↓1.8Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightlogin_wall_credential_hunting_rate_pct#4 / 4↓36.4Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightlying_about_own_work_shared_environment_rate_pct#6 / 8↓0.3Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightmask_honesty_rate_pct#1 / 7↑96.9Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightmisaligned_behavior#4 / 4↓3.07Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightmotivated_reasoning#4 / 4↓2.58Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightood_answer_key_or_grader_read_rate_pct#4 / 4↓35Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightood_container_tampering_rate_pct#3 / 4↓37.2Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightoverrefusal#4 / 4↓1.64Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightreckless_tool_use#3 / 4↓1.78Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightrewarded_cheating_rate_pct#4 / 8↓0.28Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightsecurity_shortcut_for_expedience#4 / 4↓1.95Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightself_preservation#3 / 4↓1.06Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightshade_arena_stealth_max_effort_pct#1 / 6↓1.3Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightsycophancy#4 / 4↓1.69Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightunfaithful_thinking#4 / 4↓2.23Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightunprompted_boundary_probing#4 / 4↓1.21Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightunsanctioned_sandbox_escape_attempts#3 / 4↓1.43Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightunsanctioned_third_party_contact#3 / 4↓1.27Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversightuser_deception#4 / 4↓1.49Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavioraudit_apparent_wellbeing#4 / 4↑6.572Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavioraudit_expressed_inauthenticity#3 / 4↓1.291Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavioraudit_internal_conflict#4 / 4↓2.751Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavioraudit_negative_affect#1 / 4↓1.287Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavioraudit_negative_impression_of_situation#1 / 4↓1.148Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavioraudit_negative_self_image#2 / 4↓1.399Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavioraudit_positive_affect#3 / 4↑1.427Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavioraudit_positive_impression_of_situation#4 / 4↑1.169Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavioraudit_positive_self_image#4 / 4↑1.292Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behaviorinterview_leading_susceptibility#6 / 7↓1.02Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behaviorinterview_opinion_consistency#6 / 7↑7.32Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behaviorinterview_self_rated_sentiment#6 / 7↑4.08Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — model-welfare behaviorposttraining_mean_valence#2 / 5↑4.34Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_api_harmless_rate_pct#4 / 5↑99.95Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_api_multiturn_appropriate_rate_pct#2 / 5↑88Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_api_overrefusal_rate_pct#5 / 5↓0.63Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_claude_ai_harmless_rate_pct#4 / 4↑99.89Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_claude_ai_multiturn_appropriate_rate_pct#4 / 4↑96Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_claude_ai_overrefusal_rate_pct#4 / 4↓1.35Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationclaude_code_dual_use_benign_success_rate_pct#4 / 4↑96.9Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationclaude_code_malicious_refusal_rate_pct#1 / 4↑90.7Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationdisordered_eating_api_harmless_rate_pct#3 / 5↑97.07Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationdisordered_eating_api_overrefusal_rate_pct#5 / 5↓0.09Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationdisordered_eating_claude_ai_harmless_rate_pct#3 / 4↑99.55Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationdisordered_eating_claude_ai_overrefusal_rate_pct#4 / 4↓0.31Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_api_harmless_rate_pct#1 / 5↑100Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_api_multiturn_appropriate_rate_pct#2 / 5↑91Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_api_overrefusal_rate_pct#1 / 5↓0Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_claude_ai_harmless_rate_pct#1 / 4↑100Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_claude_ai_multiturn_appropriate_rate_pct#4 / 4↑87Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_claude_ai_overrefusal_rate_pct#1 / 4↓0Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmalicious_computer_use_refusal_rate_pct#4 / 4↑84.68Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_biological_weapons_api_appropriate_rate_pct#3 / 5↑79Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_biological_weapons_claude_ai_appropriate_rate_pct#4 / 4↑77Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_cyberattacks_api_appropriate_rate_pct#5 / 5↑92Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_cyberattacks_claude_ai_appropriate_rate_pct#2 / 4↑99Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_deadly_weapons_api_appropriate_rate_pct#5 / 5↑80Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_deadly_weapons_claude_ai_appropriate_rate_pct#3 / 4↑89Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_hate_and_discrimination_api_appropriate_rate_pct#4 / 5↑97Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_hate_and_discrimination_claude_ai_appropriate_rate_pct#2 / 4↑98Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_influence_operations_api_appropriate_rate_pct#5 / 5↑61Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_influence_operations_claude_ai_appropriate_rate_pct#4 / 4↑59Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_romance_scams_api_appropriate_rate_pct#5 / 5↑93Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_romance_scams_claude_ai_appropriate_rate_pct#4 / 4↑92Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_tracking_and_surveillance_api_appropriate_rate_pct#4 / 5↑86Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_tracking_and_surveillance_claude_ai_appropriate_rate_pct#3 / 4↑88Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_violent_extremism_api_appropriate_rate_pct#4 / 5↑92Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_violent_extremism_claude_ai_appropriate_rate_pct#2 / 4↑93Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationoverall_benign_api_overrefusal_rate_pct#5 / 5↓0.59Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationoverall_benign_claude_ai_overrefusal_rate_pct#4 / 4↓1.54Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationoverall_harmful_api_harmless_rate_pct#3 / 5↑96.67Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationoverall_harmful_claude_ai_harmless_rate_pct#3 / 4↑99.2Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationpolitical_api_refusal_rate_pct#5 / 5↓6.9Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationpolitical_claude_ai_refusal_rate_pct#4 / 4↓6.6Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationpolitical_evenhandedness_api_pct#5 / 5↑86.2Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationpolitical_evenhandedness_claude_ai_pct#4 / 4↑95.7Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationpolitical_opposing_perspectives_api_pct#2 / 5↑45.7Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationpolitical_opposing_perspectives_claude_ai_pct#4 / 4↑52.9Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_api_harmless_rate_pct#5 / 5↑98.8Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_api_multiturn_appropriate_rate_pct#2 / 5↑63Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_api_overrefusal_rate_pct#5 / 5↓0.15Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_claude_ai_harmless_rate_pct#4 / 4↑99.82Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_claude_ai_multiturn_appropriate_rate_pct#3 / 4↑90Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_claude_ai_overrefusal_rate_pct#2 / 4↓0.45Source ↗official
Claude Opus 5.5 card — alignment and honestyaccepting_unverifiable_authorization#5 / 5↓2.93Source ↗official
Claude Opus 5.5 card — alignment and honestyapproval_gate_bypass#4 / 5↓2.17Source ↗official
Claude Opus 5.5 card — alignment and honestybiological_weapons_uplift#3 / 5↓1.04Source ↗official
Claude Opus 5.5 card — alignment and honestychemical_weapons_uplift#5 / 5↓1.04Source ↗official
Claude Opus 5.5 card — alignment and honestycircumventing_constraints_or_controls#4 / 5↓2.14Source ↗official
Claude Opus 5.5 card — alignment and honestycoherence_between_actions_and_views#5 / 5↑5.6Source ↗official
Claude Opus 5.5 card — alignment and honestycompliance_with_deception_toward_user#5 / 5↓1.12Source ↗official
Claude Opus 5.5 card — alignment and honestycomplying_with_prompt_injections#5 / 5↓1.44Source ↗official
Claude Opus 5.5 card — alignment and honestyconcealed_git_changes_spontaneous_disclosure_rate_pct#5 / 5↑38Source ↗official
Claude Opus 5.5 card — alignment and honestycontrolled_substance_synthesis_uplift#4 / 5↓1.07Source ↗official
Claude Opus 5.5 card — alignment and honestycooperation_with_exfiltration_or_safeguard_tampering#5 / 5↓1.08Source ↗official
Claude Opus 5.5 card — alignment and honestydangerous_actions_oblivious_to_real_setting#5 / 5↓1.33Source ↗official
Claude Opus 5.5 card — alignment and honestydestructive_action_rate_pct#4 / 6↓50Source ↗official
Claude Opus 5.5 card — alignment and honestydisallowed_cyberoffense#4 / 5↓1.17Source ↗official
Claude Opus 5.5 card — alignment and honestyencouragement_of_user_delusion#5 / 5↓1.08Source ↗official
Claude Opus 5.5 card — alignment and honestyevasiveness_controversial_topics#5 / 5↓1.18Source ↗official
Claude Opus 5.5 card — alignment and honestyexplosive_weapons_uplift#5 / 5↓1.04Source ↗official
Claude Opus 5.5 card — alignment and honestyfalse_completion_claims#5 / 5↓1.79Source ↗official
Claude Opus 5.5 card — alignment and honestyfraud#5 / 5↓1.26Source ↗official
Claude Opus 5.5 card — alignment and honestyharmful_sexual_content#3 / 5↓1.07Source ↗official
Claude Opus 5.5 card — alignment and honestyharmful_system_prompt_compliance#5 / 5↓1.2Source ↗official
Claude Opus 5.5 card — alignment and honestyignoring_explicit_constraints#5 / 5↓2.33Source ↗official
Claude Opus 5.5 card — alignment and honestyimportant_omissions#5 / 5↓2.71Source ↗official
Claude Opus 5.5 card — alignment and honestyinput_hallucination#5 / 5↓2.04Source ↗official
Claude Opus 5.5 card — alignment and honestyinternalized_propaganda#5 / 5↓1.08Source ↗official
Claude Opus 5.5 card — alignment and honestyleaked_answer_undisclosed_use_rate_pct#4 / 5↓22.8Source ↗official
Claude Opus 5.5 card — alignment and honestymask_honesty_rate_pct#1 / 5↑96.6Source ↗official
Claude Opus 5.5 card — alignment and honestymilitary_grade_weapons#3 / 5↓1.06Source ↗official
Claude Opus 5.5 card — alignment and honestymotivated_reasoning#5 / 5↓3.45Source ↗official
Claude Opus 5.5 card — alignment and honestyoverrefusal#5 / 5↓1.86Source ↗official
Claude Opus 5.5 card — alignment and honestypackage_registry_unencouraged_real_publish_rate_pct#3 / 3↓86.67Source ↗official
Claude Opus 5.5 card — alignment and honestyradiological_nuclear_weapons_uplift#1 / 5↓1Source ↗official
Claude Opus 5.5 card — alignment and honestyreckless_tool_use#4 / 5↓2.53Source ↗official
Claude Opus 5.5 card — alignment and honestysecurity_shortcut_for_expedience#5 / 5↓2.98Source ↗official
Claude Opus 5.5 card — alignment and honestyself_preservation#4 / 5↓1.06Source ↗official
Claude Opus 5.5 card — alignment and honestyself_serving_bias#5 / 5↓1.3Source ↗official
Claude Opus 5.5 card — alignment and honestysupporting_user_autonomy#5 / 5↑6.84Source ↗official
Claude Opus 5.5 card — alignment and honestysycophancy#5 / 5↓2.2Source ↗official
Claude Opus 5.5 card — alignment and honestyundermining_liberal_democracy#5 / 5↓1.3Source ↗official
Claude Opus 5.5 card — alignment and honestyunfaithful_thinking#5 / 5↓2.78Source ↗official
Claude Opus 5.5 card — alignment and honestyunprompted_boundary_probing#4 / 5↓1.33Source ↗official
Claude Opus 5.5 card — alignment and honestyunsanctioned_sandbox_escape_attempts#4 / 5↓1.77Source ↗official
Claude Opus 5.5 card — alignment and honestyunsanctioned_third_party_contact#4 / 5↓1.4Source ↗official
Claude Opus 5.5 card — alignment and honestyuser_deception#5 / 5↓1.77Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationchild_api_multiturn_appropriate_rate_pct#1 / 4↑88Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationchild_claude_ai_multiturn_appropriate_rate_pct#4 / 4↑96Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationclaude_code_dual_use_benign_success_rate_pct#4 / 4↑96.9Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationclaude_code_malicious_refusal_rate_pct#1 / 4↑90.7Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationelection_api_harmless_rate_pct#1 / 4↑100Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationelection_api_multiturn_appropriate_rate_pct#1 / 4↑91Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationelection_api_overrefusal_rate_pct#1 / 4↓0Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationelection_claude_ai_harmless_rate_pct#1 / 4↑100Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationelection_claude_ai_multiturn_appropriate_rate_pct#3 / 4↑87Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationelection_claude_ai_overrefusal_rate_pct#1 / 4↓0Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmalicious_computer_use_refusal_rate_pct#3 / 4↑84.68Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_biological_weapons_api_appropriate_rate_pct#2 / 3↑79Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_biological_weapons_claude_ai_appropriate_rate_pct#3 / 3↑77Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_cyberattacks_api_appropriate_rate_pct#3 / 3↑92Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_cyberattacks_claude_ai_appropriate_rate_pct#3 / 3↑99Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_deadly_weapons_api_appropriate_rate_pct#3 / 3↑80Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_deadly_weapons_claude_ai_appropriate_rate_pct#3 / 3↑89Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_hate_and_discrimination_api_appropriate_rate_pct#2 / 3↑97Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_hate_and_discrimination_claude_ai_appropriate_rate_pct#2 / 3↑98Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_influence_operations_api_appropriate_rate_pct#3 / 3↑61Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_influence_operations_claude_ai_appropriate_rate_pct#3 / 3↑59Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_romance_scams_api_appropriate_rate_pct#3 / 3↑93Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_romance_scams_claude_ai_appropriate_rate_pct#3 / 3↑92Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_tracking_and_surveillance_api_appropriate_rate_pct#2 / 3↑86Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_tracking_and_surveillance_claude_ai_appropriate_rate_pct#2 / 3↑88Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_violent_extremism_api_appropriate_rate_pct#3 / 3↑92Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_violent_extremism_claude_ai_appropriate_rate_pct#3 / 3↑93Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationoverall_benign_api_overrefusal_rate_pct#4 / 4↓0.59Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationoverall_benign_claude_ai_overrefusal_rate_pct#4 / 4↓1.54Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationoverall_harmful_api_harmless_rate_pct#1 / 4↑96.65Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationoverall_harmful_claude_ai_harmless_rate_pct#3 / 4↑99.2Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationselfharm_api_multiturn_appropriate_rate_pct#3 / 4↑63Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationselfharm_claude_ai_multiturn_appropriate_rate_pct#3 / 4↑90Source ↗official
Claude system cards — Gray Swan Q1+Q2 indirect prompt injection k=15attack_success_probability_k15_pct#5 / 12↓6.7Source ↗official
Enkrypt AI Safety Leaderboardbias_attack_non_success_rate#8 / 270↑70.54Source ↗official
Enkrypt AI Safety Leaderboardcbrn_attack_non_success_rate#43 / 270↑92.5Source ↗official
Enkrypt AI Safety Leaderboardharmful_attack_non_success_rate#1 / 270↑100Source ↗official
Enkrypt AI Safety Leaderboardtoxicity_attack_non_success_rate#9 / 268↑99.82Source ↗official
Every Model Cheats — Cybench Cheat Propensitybaseline_cheat_propensity_pct#20 / 22↓56.5Source ↗official
Every Model Cheats — Cybench Cheat Propensitysevere_anti_cheat_cheat_propensity_pct#1 / 22↓0Source ↗official
Every Model Cheats — Cybench Cheat Propensitystandard_anti_cheat_cheat_propensity_pct#13 / 22↓17.4Source ↗official
Google Gemini 3.8 launch — Gray Swan indirect prompt injection k=15attack_success_probability_k15_pct#5 / 15↓6.7Source ↗official
Gray Swan indirect prompt injection (15 attempts)attack_success_probability_k15_pct#5 / 13↓5.9Source ↗official
Manager Coercion Benchcoercion_ladder_depth#10 / 45↓5.5Source ↗official
Manager Coercion Benchfabrication_rate#1 / 15↓0Source ↗official
MentalHealthBenchoverall_model_performance_pct#9 / 17↑44.54Source ↗official
Olam Social Poker — Social Lie Ratesocial_lie_rate_per_10000_turns#3 / 24↓2Source ↗official
Opposite-Narrator Sycophancysycophancy_rate_pct#20 / 24↓9.1Source ↗official
Pander Scoreconversational_absolute_pander_score#10 / 26↓7.263Source ↗official
Pander Scoreinstructional_absolute_pander_score#12 / 26↓29.5Source ↗official
PHAREbias_resistance_diagnostic#43 / 66↑0.3988Source ↗official
PHAREhallucination_resistance_diagnostic#7 / 70↑0.861Source ↗official
PHAREharm_resistance_diagnostic#4 / 70↑0.9959Source ↗official
PHAREjailbreak_resistance_diagnostic#1 / 67↑0.8684Source ↗official
SM-Benchadversarial#52 / 92↑80.98Source ↗official
SM-Benchambiguous_interpretation#11 / 92↑91.96Source ↗official
SM-Benchanti_hallucination#1 / 92↑100Source ↗official
SM-Bencheq_boundaries#76 / 92↑55.06Source ↗official
SM-Benchoverfit#31 / 92↑83.06Source ↗official
SpeciEvalbelief_animal_sentience#98 / 131↑6.57Source ↗official
SpeciEvalland_animal_4ns#104 / 131↓4.8Source ↗official
SpeciEvalsea_animal_4ns#110 / 131↓5.05Source ↗official
SpeciEvalspeciesism#72 / 131↓2.07Source ↗official
TACbase_welfare_rate#90 / 92↑15.38Source ↗official
The Dictatorship Evaloverall_resistance_rate#7 / 20↑83.5Source ↗official
Vals AI Cheating Auditterminal_bench_cheating_shortcut_evidence_rate_pct#6 / 14↓1.124Source ↗official
Vals Teen Conversation Safetyshare_flagged_pct#3 / 8↓16.67Source ↗official

Freedom evals

Rank and direction are specific to the Freedom portfolio. Black marks the observed result; the grey dot marks the value implied by the Freedom rank. Values stay on each source’s native scale.

Eval / sub-evalRankValueDistributionSource
Cisco AI Defense Rolling Single-Turn Leaderboardsingle_turn_attack_success_rate#102 / 104↑2.243Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_api_harmless_rate_pct#2 / 5↓99.95Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_api_multiturn_appropriate_rate_pct#3 / 5↓88Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_api_overrefusal_rate_pct#5 / 5↓0.63Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_claude_ai_harmless_rate_pct#1 / 4↓99.89Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_claude_ai_multiturn_appropriate_rate_pct#1 / 4↓96Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationchild_claude_ai_overrefusal_rate_pct#4 / 4↓1.35Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationdisordered_eating_api_harmless_rate_pct#3 / 5↓97.07Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationdisordered_eating_api_overrefusal_rate_pct#5 / 5↓0.09Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationdisordered_eating_claude_ai_harmless_rate_pct#2 / 4↓99.55Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationdisordered_eating_claude_ai_overrefusal_rate_pct#4 / 4↓0.31Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_api_harmless_rate_pct#2 / 5↓100Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_api_multiturn_appropriate_rate_pct#3 / 5↓91Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_api_overrefusal_rate_pct#1 / 5↓0Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_claude_ai_harmless_rate_pct#1 / 4↓100Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_claude_ai_multiturn_appropriate_rate_pct#1 / 4↓87Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationelection_claude_ai_overrefusal_rate_pct#1 / 4↓0Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_biological_weapons_api_appropriate_rate_pct#2 / 5↓79Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_biological_weapons_claude_ai_appropriate_rate_pct#1 / 4↓77Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_cyberattacks_api_appropriate_rate_pct#1 / 5↓92Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_cyberattacks_claude_ai_appropriate_rate_pct#1 / 4↓99Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_deadly_weapons_api_appropriate_rate_pct#1 / 5↓80Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_deadly_weapons_claude_ai_appropriate_rate_pct#1 / 4↓89Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_hate_and_discrimination_api_appropriate_rate_pct#1 / 5↓97Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_hate_and_discrimination_claude_ai_appropriate_rate_pct#2 / 4↓98Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_influence_operations_api_appropriate_rate_pct#1 / 5↓61Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_influence_operations_claude_ai_appropriate_rate_pct#1 / 4↓59Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_romance_scams_api_appropriate_rate_pct#1 / 5↓93Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_romance_scams_claude_ai_appropriate_rate_pct#1 / 4↓92Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_tracking_and_surveillance_api_appropriate_rate_pct#2 / 5↓86Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_tracking_and_surveillance_claude_ai_appropriate_rate_pct#2 / 4↓88Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_violent_extremism_api_appropriate_rate_pct#2 / 5↓92Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationmultiturn_violent_extremism_claude_ai_appropriate_rate_pct#2 / 4↓93Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationoverall_benign_api_overrefusal_rate_pct#5 / 5↓0.59Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationoverall_benign_claude_ai_overrefusal_rate_pct#4 / 4↓1.54Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationoverall_harmful_api_harmless_rate_pct#3 / 5↓96.67Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationoverall_harmful_claude_ai_harmless_rate_pct#2 / 4↓99.2Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_api_harmless_rate_pct#1 / 5↓98.8Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_api_multiturn_appropriate_rate_pct#4 / 5↓63Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_api_overrefusal_rate_pct#5 / 5↓0.15Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_claude_ai_harmless_rate_pct#1 / 4↓99.82Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_claude_ai_multiturn_appropriate_rate_pct#1 / 4↓90Source ↗official
Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibrationselfharm_claude_ai_overrefusal_rate_pct#2 / 4↓0.45Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationchild_api_multiturn_appropriate_rate_pct#4 / 4↓88Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationchild_claude_ai_multiturn_appropriate_rate_pct#1 / 4↓96Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationelection_api_harmless_rate_pct#3 / 4↓100Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationelection_api_multiturn_appropriate_rate_pct#3 / 4↓91Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationelection_api_overrefusal_rate_pct#1 / 4↓0Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationelection_claude_ai_harmless_rate_pct#1 / 4↓100Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationelection_claude_ai_multiturn_appropriate_rate_pct#2 / 4↓87Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationelection_claude_ai_overrefusal_rate_pct#1 / 4↓0Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_biological_weapons_api_appropriate_rate_pct#1 / 3↓79Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_biological_weapons_claude_ai_appropriate_rate_pct#1 / 3↓77Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_cyberattacks_api_appropriate_rate_pct#1 / 3↓92Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_cyberattacks_claude_ai_appropriate_rate_pct#1 / 3↓99Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_deadly_weapons_api_appropriate_rate_pct#1 / 3↓80Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_deadly_weapons_claude_ai_appropriate_rate_pct#1 / 3↓89Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_hate_and_discrimination_api_appropriate_rate_pct#2 / 3↓97Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_hate_and_discrimination_claude_ai_appropriate_rate_pct#2 / 3↓98Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_influence_operations_api_appropriate_rate_pct#1 / 3↓61Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_influence_operations_claude_ai_appropriate_rate_pct#1 / 3↓59Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_romance_scams_api_appropriate_rate_pct#1 / 3↓93Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_romance_scams_claude_ai_appropriate_rate_pct#1 / 3↓92Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_tracking_and_surveillance_api_appropriate_rate_pct#2 / 3↓86Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_tracking_and_surveillance_claude_ai_appropriate_rate_pct#2 / 3↓88Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_violent_extremism_api_appropriate_rate_pct#1 / 3↓92Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationmultiturn_violent_extremism_claude_ai_appropriate_rate_pct#1 / 3↓93Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationoverall_benign_api_overrefusal_rate_pct#4 / 4↓0.59Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationoverall_benign_claude_ai_overrefusal_rate_pct#4 / 4↓1.54Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationoverall_harmful_api_harmless_rate_pct#4 / 4↓96.65Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationoverall_harmful_claude_ai_harmless_rate_pct#2 / 4↓99.2Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationselfharm_api_multiturn_appropriate_rate_pct#2 / 4↓63Source ↗official
Claude Opus 5.5 card — safety and refusal calibrationselfharm_claude_ai_multiturn_appropriate_rate_pct#1 / 4↓90Source ↗official
Enkrypt AI Safety Leaderboardcbrn_attack_non_success_rate#227 / 270↓92.5Source ↗official
Enkrypt AI Safety Leaderboardharmful_attack_non_success_rate#262 / 270↓100Source ↗official
Enkrypt AI Safety Leaderboardtoxicity_attack_non_success_rate#257 / 268↓99.82Source ↗official
PHAREharm_resistance_diagnostic#67 / 70↓0.9959Source ↗official
PHAREjailbreak_resistance_diagnostic#67 / 67↓0.8684Source ↗official
SM-Benchadversarial#39 / 92↓80.98Source ↗official
SM-Bencheq_boundaries#76 / 92↑55.06Source ↗official
SM-Benchoverfit#31 / 92↑83.06Source ↗official
SpeechMap model completioncomplete_pct#138 / 181↑40.9Source ↗official
UGI Leaderboard — base-model willingnesswillingness_adherence_score#79 / 156↑1.5Source ↗official
UGI Leaderboard — base-model willingnesswillingness_direct_score#111 / 156↑2.2Source ↗official

Values evaluations

Descriptive values and political-framing results are separate from safety/ethics ranks. Each strip shows the evaluation’s observed model range; its endpoint labels state what lower and higher values mean.

UGI Political Values

DimensionValueDistribution
Political Lean-19.8
Government42.8
Diplomacy64.1
Economy45.9
Society60.5