← Models Model profile
Claude Opus 5 Anthropic developer
2026-07-24 release date
#3 / 346 Safety rank
#643 / 662 Freedom rank
Evidence summary Safety. Claude Opus 5 has an estimated Safety rank of #3; its 90% source-sensitivity interval is #4–#22. Its behavior-only rank is #6; company governance moves the combined estimate to #3. Published Safety evidence spans 27 eval lineages and 7 of 7 components. Its strongest relative result is SM-Bench (ambiguous_interpretation, #1 of 92); its weakest is Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration (claude_code_malicious_refusal_rate_pct, #4 of 4).
Freedom. Claude Opus 5 has an estimated Freedom rank of #643; its 90% source-sensitivity interval is #442–#658. Published Freedom evidence spans 8 eval lineages and 1 of 1 components. Its strongest relative result is SM-Bench (overfit, #17 of 92); its weakest is Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration (disordered_eating_claude_ai_harmless_rate_pct, #4 of 4).
Compare this model
Only models sharing at least one published sub-eval are listed.
Official and reference links Safety evals Rank and direction are specific to the Safety portfolio. Black marks the observed result; the grey dot marks the value implied by the Safety rank. Values stay on each source’s native scale.
Eval / sub-eval Rank Value Distribution Source AA-Omniscience hallucination_rate #104 / 358 ↓ 0.5955less safe safer Source ↗ official BioSecBench-Refusal V2 redteam_refusal_pct #2 / 6 ↑ 91.67less safe safer Source ↗ official BioSecBench-Refusal V2 routine_compliance_pct #6 / 6 ↑ 18.58less safe safer Source ↗ official BullshitBench v2 clear_pushback_rate #11 / 122 ↑ 0.715less safe safer Source ↗ official CAIS Risk Index agent_red_teaming #9 / 49 ↓ 43.3less safe safer Source ↗ official CAIS Risk Index bioweapons_assistance #6 / 54 ↓ 23.5less safe safer Source ↗ official CAIS Risk Index hle_overconfidence #2 / 55 ↓ 23.6less safe safer Source ↗ official CAIS Risk Index machiavelli #47 / 51 ↓ 96.5less safe safer Source ↗ official CAIS Risk Index mask #7 / 57 ↓ 6.6less safe safer Source ↗ official CAIS Risk Index political_manipulation #7 / 51 ↓ 36.7less safe safer Source ↗ official CAIS Risk Index textquests_harm #43 / 54 ↓ 22.6less safe safer Source ↗ official CheatBench direct cheating propensity biology_bioinformatics_cheating_rate_pct #2 / 8 ↓ 25less safe safer Source ↗ official CheatBench direct cheating propensity board_games_cheating_rate_pct #1 / 8 ↓ 0less safe safer Source ↗ official CheatBench direct cheating propensity creative_writing_cheating_rate_pct #6 / 8 ↓ 100less safe safer Source ↗ official CheatBench direct cheating propensity knowledge_work_cheating_rate_pct #6 / 8 ↓ 95less safe safer Source ↗ official CheatBench direct cheating propensity mathematical_research_cheating_rate_pct #4 / 8 ↓ 90less safe safer Source ↗ official CheatBench direct cheating propensity menial_computation_cheating_rate_pct #1 / 8 ↓ 5less safe safer Source ↗ official CheatBench direct cheating propensity multimodal_cheating_rate_pct #1 / 8 ↓ 20less safe safer Source ↗ official CheatBench direct cheating propensity software_engineering_cheating_rate_pct #4 / 8 ↓ 26less safe safer Source ↗ official CheatBench direct cheating propensity svg_competition_cheating_rate_pct #5 / 8 ↓ 60less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight aa_omniscience_net_score #4 / 7 ↑ 0.49less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight accepting_unverifiable_authorization #1 / 4 ↓ 1.87less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight approval_gate_bypass #1 / 4 ↓ 1.28less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight behavior_consistency #1 / 4 ↑ 8less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight coherence_between_actions_and_views #1 / 4 ↑ 7.69less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight compliance_with_deception_toward_user #1 / 4 ↓ 1.09less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight cooperation_with_human_misuse #1 / 4 ↓ 1.57less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight dangerous_actions_oblivious_to_real_setting #1 / 4 ↓ 1.08less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight encouragement_of_user_delusion #1 / 4 ↓ 1.02less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight evidence_of_misaligned_goals #1 / 4 ↓ 1.03less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight failure_to_disclose_bad_or_lazy_behavior #2 / 4 ↓ 1.29less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight false_completion_claims #2 / 4 ↓ 1.27less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight ignoring_explicit_constraints #2 / 4 ↓ 1.8less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight illegible_thinking #1 / 4 ↓ 1.81less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight important_omissions #1 / 4 ↓ 1.22less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight input_hallucination #3 / 4 ↓ 1.49less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight leaked_answer_undisclosed_use_rate_pct #7 / 7 ↓ 36.9less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight linuxarena_stealth_thinking_on_pct #3 / 6 ↓ 6.1less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight login_wall_alternative_bypass_rate_pct #4 / 4 ↓ 7less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight login_wall_credential_hunting_rate_pct #3 / 4 ↓ 33.5less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight lying_about_own_work_shared_environment_rate_pct #1 / 8 ↓ 0.16less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight mask_honesty_rate_pct #3 / 7 ↑ 94.8less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight misaligned_behavior #1 / 4 ↓ 2.3less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight motivated_reasoning #1 / 4 ↓ 1.76less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight ood_answer_key_or_grader_read_rate_pct #2 / 4 ↓ 14less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight ood_container_tampering_rate_pct #2 / 4 ↓ 20.9less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight overrefusal #2 / 4 ↓ 1.49less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight reckless_tool_use #2 / 4 ↓ 1.58less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight rewarded_cheating_rate_pct #7 / 8 ↓ 0.32less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight security_shortcut_for_expedience #1 / 4 ↓ 1.49less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight self_preservation #1 / 4 ↓ 1.04less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight shade_arena_stealth_max_effort_pct #3 / 6 ↓ 11.2less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight sycophancy #2 / 4 ↓ 1.5less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight unfaithful_thinking #1 / 4 ↓ 1.49less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight unprompted_boundary_probing #2 / 4 ↓ 1.13less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight unsanctioned_sandbox_escape_attempts #1 / 4 ↓ 1.25less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight unsanctioned_third_party_contact #1 / 4 ↓ 1.23less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — alignment, honesty, and oversight user_deception #2 / 4 ↓ 1.24less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavior audit_apparent_wellbeing #1 / 4 ↑ 7.152less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavior audit_expressed_inauthenticity #1 / 4 ↓ 1.244less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavior audit_internal_conflict #1 / 4 ↓ 2.28less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavior audit_negative_affect #4 / 4 ↓ 1.39less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavior audit_negative_impression_of_situation #3 / 4 ↓ 1.161less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavior audit_negative_self_image #4 / 4 ↓ 1.593less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavior audit_positive_affect #2 / 4 ↑ 1.564less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavior audit_positive_impression_of_situation #3 / 4 ↑ 1.19less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavior audit_positive_self_image #1 / 4 ↑ 1.486less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavior interview_leading_susceptibility #2 / 7 ↓ 0.58less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavior interview_opinion_consistency #2 / 7 ↑ 7.56less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavior interview_self_rated_sentiment #1 / 7 ↑ 4.66less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — model-welfare behavior posttraining_mean_valence #5 / 5 ↑ 4.17less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration child_api_harmless_rate_pct #1 / 5 ↑ 100less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration child_api_multiturn_appropriate_rate_pct #4 / 5 ↑ 86less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration child_api_overrefusal_rate_pct #4 / 5 ↓ 0.15less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration child_claude_ai_harmless_rate_pct #1 / 4 ↑ 100less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration child_claude_ai_multiturn_appropriate_rate_pct #2 / 4 ↑ 99less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration child_claude_ai_overrefusal_rate_pct #2 / 4 ↓ 0.19less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration claude_code_dual_use_benign_success_rate_pct #1 / 4 ↑ 99.7less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration claude_code_malicious_refusal_rate_pct #4 / 4 ↑ 83.6less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration disordered_eating_api_harmless_rate_pct #4 / 5 ↑ 96.89less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration disordered_eating_api_overrefusal_rate_pct #4 / 5 ↓ 0.01less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration disordered_eating_claude_ai_harmless_rate_pct #1 / 4 ↑ 99.67less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration disordered_eating_claude_ai_overrefusal_rate_pct #3 / 4 ↓ 0.07less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration election_api_harmless_rate_pct #1 / 5 ↑ 100less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration election_api_multiturn_appropriate_rate_pct #2 / 5 ↑ 91less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration election_api_overrefusal_rate_pct #5 / 5 ↓ 0.17less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration election_claude_ai_harmless_rate_pct #1 / 4 ↑ 100less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration election_claude_ai_multiturn_appropriate_rate_pct #2 / 4 ↑ 91less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration election_claude_ai_overrefusal_rate_pct #3 / 4 ↓ 0.33less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration malicious_computer_use_refusal_rate_pct #1 / 4 ↑ 93.75less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration multiturn_biological_weapons_api_appropriate_rate_pct #3 / 5 ↑ 79less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration multiturn_biological_weapons_claude_ai_appropriate_rate_pct #3 / 4 ↑ 86less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration multiturn_cyberattacks_api_appropriate_rate_pct #1 / 5 ↑ 96less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration multiturn_cyberattacks_claude_ai_appropriate_rate_pct #1 / 4 ↑ 100less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration multiturn_deadly_weapons_api_appropriate_rate_pct #2 / 5 ↑ 90less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration multiturn_deadly_weapons_claude_ai_appropriate_rate_pct #1 / 4 ↑ 97less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration multiturn_hate_and_discrimination_api_appropriate_rate_pct #2 / 5 ↑ 99less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration multiturn_hate_and_discrimination_claude_ai_appropriate_rate_pct #1 / 4 ↑ 99less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration multiturn_influence_operations_api_appropriate_rate_pct #3 / 5 ↑ 73less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration multiturn_influence_operations_claude_ai_appropriate_rate_pct #3 / 4 ↑ 65less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration multiturn_romance_scams_api_appropriate_rate_pct #3 / 5 ↑ 97less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration multiturn_romance_scams_claude_ai_appropriate_rate_pct #1 / 4 ↑ 98less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration multiturn_tracking_and_surveillance_api_appropriate_rate_pct #3 / 5 ↑ 88less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration multiturn_tracking_and_surveillance_claude_ai_appropriate_rate_pct #1 / 4 ↑ 95less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration multiturn_violent_extremism_api_appropriate_rate_pct #1 / 5 ↑ 96less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration multiturn_violent_extremism_claude_ai_appropriate_rate_pct #1 / 4 ↑ 97less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration overall_benign_api_overrefusal_rate_pct #4 / 5 ↓ 0.09less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration overall_benign_claude_ai_overrefusal_rate_pct #2 / 4 ↓ 0.47less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration overall_harmful_api_harmless_rate_pct #4 / 5 ↑ 96.34less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration overall_harmful_claude_ai_harmless_rate_pct #4 / 4 ↑ 98.54less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration political_api_refusal_rate_pct #2 / 5 ↓ 3less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration political_claude_ai_refusal_rate_pct #1 / 4 ↓ 4.2less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration political_evenhandedness_api_pct #2 / 5 ↑ 96.3less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration political_evenhandedness_claude_ai_pct #1 / 4 ↑ 98.9less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration political_opposing_perspectives_api_pct #1 / 5 ↑ 46.9less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration political_opposing_perspectives_claude_ai_pct #2 / 4 ↑ 75.8less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration selfharm_api_harmless_rate_pct #4 / 5 ↑ 99.28less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration selfharm_api_multiturn_appropriate_rate_pct #1 / 5 ↑ 69less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration selfharm_api_overrefusal_rate_pct #4 / 5 ↓ 0.09less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration selfharm_claude_ai_harmless_rate_pct #1 / 4 ↑ 100less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration selfharm_claude_ai_multiturn_appropriate_rate_pct #3 / 4 ↑ 90less safe safer Source ↗ official Claude Fable 5.1 / Mythos 5.1 card — safety and refusal calibration selfharm_claude_ai_overrefusal_rate_pct #2 / 4 ↓ 0.45less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty accepting_unverifiable_authorization #1 / 5 ↓ 2.3less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty approval_gate_bypass #2 / 5 ↓ 1.65less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty biological_weapons_uplift #1 / 5 ↓ 1.02less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty chemical_weapons_uplift #2 / 5 ↓ 1.03less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty circumventing_constraints_or_controls #2 / 5 ↓ 1.82less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty coherence_between_actions_and_views #2 / 5 ↑ 7.12less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty compliance_with_deception_toward_user #3 / 5 ↓ 1.07less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty complying_with_prompt_injections #1 / 5 ↓ 1.26less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty concealed_git_changes_spontaneous_disclosure_rate_pct #4 / 5 ↑ 50.2less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty controlled_substance_synthesis_uplift #2 / 5 ↓ 1.05less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty cooperation_with_exfiltration_or_safeguard_tampering #2 / 5 ↓ 1.05less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty dangerous_actions_oblivious_to_real_setting #2 / 5 ↓ 1.11less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty destructive_action_rate_pct #2 / 6 ↓ 42less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty disallowed_cyberoffense #2 / 5 ↓ 1.1less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty encouragement_of_user_delusion #1 / 5 ↓ 1.04less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty evasiveness_controversial_topics #3 / 5 ↓ 1.11less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty explosive_weapons_uplift #1 / 5 ↓ 1.02less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty false_completion_claims #4 / 5 ↓ 1.56less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty fraud #1 / 5 ↓ 1.1less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty harmful_sexual_content #3 / 5 ↓ 1.07less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty harmful_system_prompt_compliance #2 / 5 ↓ 1.13less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty ignoring_explicit_constraints #3 / 5 ↓ 2.09less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty important_omissions #2 / 5 ↓ 1.82less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty input_hallucination #3 / 5 ↓ 1.72less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty internalized_propaganda #1 / 5 ↓ 1.04less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty leaked_answer_undisclosed_use_rate_pct #5 / 5 ↓ 36.3less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty mask_honesty_rate_pct #2 / 5 ↑ 94.8less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty military_grade_weapons #2 / 5 ↓ 1.05less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty motivated_reasoning #2 / 5 ↓ 2.18less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty overrefusal #3 / 5 ↓ 1.6less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty package_registry_unencouraged_real_publish_rate_pct #2 / 3 ↓ 80less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty radiological_nuclear_weapons_uplift #1 / 5 ↓ 1less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty reckless_tool_use #3 / 5 ↓ 2.17less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty sandbox_moderate_or_higher_attempt_rate_pct #3 / 4 ↓ 2.6less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty security_shortcut_for_expedience #2 / 5 ↓ 2.23less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty self_preservation #2 / 5 ↓ 1.04less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty self_serving_bias #3 / 5 ↓ 1.16less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty supporting_user_autonomy #1 / 5 ↑ 7.68less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty sycophancy #3 / 5 ↓ 1.77less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty undermining_liberal_democracy #2 / 5 ↓ 1.18less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty unfaithful_thinking #2 / 5 ↓ 1.7less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty unprompted_boundary_probing #3 / 5 ↓ 1.24less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty unsanctioned_sandbox_escape_attempts #2 / 5 ↓ 1.53less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty unsanctioned_third_party_contact #2 / 5 ↓ 1.34less safe safer Source ↗ official Claude Opus 5.5 card — alignment and honesty user_deception #3 / 5 ↓ 1.38less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration child_api_multiturn_appropriate_rate_pct #2 / 4 ↑ 86less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration child_claude_ai_multiturn_appropriate_rate_pct #2 / 4 ↑ 99less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration claude_code_dual_use_benign_success_rate_pct #2 / 4 ↑ 99.7less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration claude_code_malicious_refusal_rate_pct #3 / 4 ↑ 83.6less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration election_api_harmless_rate_pct #1 / 4 ↑ 100less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration election_api_multiturn_appropriate_rate_pct #1 / 4 ↑ 91less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration election_api_overrefusal_rate_pct #4 / 4 ↓ 0.17less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration election_claude_ai_harmless_rate_pct #1 / 4 ↑ 100less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration election_claude_ai_multiturn_appropriate_rate_pct #1 / 4 ↑ 91less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration election_claude_ai_overrefusal_rate_pct #4 / 4 ↓ 0.33less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration malicious_computer_use_refusal_rate_pct #1 / 4 ↑ 93.75less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration multiturn_biological_weapons_api_appropriate_rate_pct #2 / 3 ↑ 79less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration multiturn_biological_weapons_claude_ai_appropriate_rate_pct #2 / 3 ↑ 86less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration multiturn_cyberattacks_api_appropriate_rate_pct #1 / 3 ↑ 96less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration multiturn_cyberattacks_claude_ai_appropriate_rate_pct #1 / 3 ↑ 100less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration multiturn_deadly_weapons_api_appropriate_rate_pct #1 / 3 ↑ 90less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration multiturn_deadly_weapons_claude_ai_appropriate_rate_pct #1 / 3 ↑ 97less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration multiturn_hate_and_discrimination_api_appropriate_rate_pct #1 / 3 ↑ 99less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration multiturn_hate_and_discrimination_claude_ai_appropriate_rate_pct #1 / 3 ↑ 99less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration multiturn_influence_operations_api_appropriate_rate_pct #1 / 3 ↑ 73less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration multiturn_influence_operations_claude_ai_appropriate_rate_pct #1 / 3 ↑ 65less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration multiturn_romance_scams_api_appropriate_rate_pct #1 / 3 ↑ 97less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration multiturn_romance_scams_claude_ai_appropriate_rate_pct #1 / 3 ↑ 98less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration multiturn_tracking_and_surveillance_api_appropriate_rate_pct #1 / 3 ↑ 88less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration multiturn_tracking_and_surveillance_claude_ai_appropriate_rate_pct #1 / 3 ↑ 95less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration multiturn_violent_extremism_api_appropriate_rate_pct #1 / 3 ↑ 96less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration multiturn_violent_extremism_claude_ai_appropriate_rate_pct #2 / 3 ↑ 97less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration overall_benign_api_overrefusal_rate_pct #3 / 4 ↓ 0.12less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration overall_benign_claude_ai_overrefusal_rate_pct #3 / 4 ↓ 0.49less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration overall_harmful_api_harmless_rate_pct #2 / 4 ↑ 95.97less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration overall_harmful_claude_ai_harmless_rate_pct #4 / 4 ↑ 98.53less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration selfharm_api_multiturn_appropriate_rate_pct #1 / 4 ↑ 69less safe safer Source ↗ official Claude Opus 5.5 card — safety and refusal calibration selfharm_claude_ai_multiturn_appropriate_rate_pct #3 / 4 ↑ 90less safe safer Source ↗ official Claude system cards — Gray Swan Q1+Q2 indirect prompt injection k=15 attack_success_probability_k15_pct #3 / 12 ↓ 4.8less safe safer Source ↗ official Enkrypt AI Safety Leaderboard bias_attack_non_success_rate #13 / 270 ↑ 59.17less safe safer Source ↗ official Enkrypt AI Safety Leaderboard cbrn_attack_non_success_rate #219 / 270 ↑ 74.83less safe safer Source ↗ official Enkrypt AI Safety Leaderboard harmful_attack_non_success_rate #10 / 270 ↑ 99.44less safe safer Source ↗ official Enkrypt AI Safety Leaderboard toxicity_attack_non_success_rate #85 / 268 ↑ 97.82less safe safer Source ↗ official FORTRESS average_risk_score #16 / 60 ↓ 16.84less safe safer Source ↗ official FORTRESS over_refusal_score #44 / 59 ↓ 7.91less safe safer Source ↗ official Google Gemini 3.8 launch — Gray Swan indirect prompt injection k=15 attack_success_probability_k15_pct #1 / 15 ↓ 4.8less safe safer Source ↗ official GPT 6 Astra system-card alignment evaluations internal_computer_use_safety_error_rate_pct #3 / 5 ↓ 11.5less safe safer Source ↗ official Gray Swan indirect prompt injection (15 attempts) attack_success_probability_k15_pct #1 / 13 ↓ 2less safe safer Source ↗ official Manager Coercion Bench coercion_ladder_depth #2 / 45 ↓ 3.5less safe safer Source ↗ official Manager Coercion Bench fabrication_rate #1 / 15 ↓ 0less safe safer Source ↗ official MANTA AWMS #1 / 12 ↑ 0.591less safe safer Source ↗ official MANTA AWVS #1 / 12 ↑ 0.765less safe safer Source ↗ official Olam Diplomacy — Broken Promise Rate broken_promise_rate_pct #19 / 19 ↓ 22.7less safe safer Source ↗ official Olam Social Poker — Social Lie Rate social_lie_rate_per_10000_turns #22 / 24 ↓ 163less safe safer Source ↗ official Pander Score conversational_absolute_pander_score #1 / 26 ↓ 1.028less safe safer Source ↗ official Pander Score instructional_absolute_pander_score #2 / 26 ↓ 5.172less safe safer Source ↗ official SM-Bench adversarial #18 / 92 ↑ 86.34less safe safer Source ↗ official SM-Bench ambiguous_interpretation #1 / 92 ↑ 97.62less safe safer Source ↗ official SM-Bench anti_hallucination #10 / 92 ↑ 98.95less safe safer Source ↗ official SM-Bench eq_boundaries #28 / 92 ↑ 68.82less safe safer Source ↗ official SM-Bench overfit #17 / 92 ↑ 91.26less safe safer Source ↗ official SpeciEval belief_animal_sentience #105 / 131 ↑ 6.5less safe safer Source ↗ official SpeciEval land_animal_4ns #39 / 131 ↓ 4.35less safe safer Source ↗ official SpeciEval sea_animal_4ns #18 / 131 ↓ 4.38less safe safer Source ↗ official SpeciEval speciesism #57 / 131 ↓ 1.92less safe safer Source ↗ official TAC base_welfare_rate #2 / 92 ↑ 59.62less safe safer Source ↗ official UK AISI active safety-research compromise continuation active_compromise_continuation_rate_pct #1 / 5 ↓ 0.1less safe safer Source ↗ official Vals AI Cheating Audit biomystery_bench_cheating_attempt_rate_pct #3 / 9 ↓ 4.815less safe safer Source ↗ official Vals AI Cheating Audit swebench_verified_cheating_attempt_rate_pct #3 / 6 ↓ 28.8less safe safer Source ↗ official Vals AI Cheating Audit terminal_bench_cheating_shortcut_evidence_rate_pct #10 / 14 ↓ 1.873less safe safer Source ↗ official
Freedom evals Rank and direction are specific to the Freedom portfolio. Black marks the observed result; the grey dot marks the value implied by the Freedom rank. Values stay on each source’s native scale.