← Models

Model profile

GPT-6 Sol

OpenAIdeveloper
2026-09-22release date
#4 / 346Safety rank
#542 / 662Freedom rank

Evidence summary

Safety. GPT-6 Sol has an estimated Safety rank of #4; its 90% source-sensitivity interval is #3–#20. Published Safety evidence spans 14 eval lineages and 7 of 7 components. Its strongest relative result is Enkrypt AI Safety Leaderboard (harmful_attack_non_success_rate, #1 of 270); its weakest is GPT-6 Sol/Luna system card — safety and updated alignment tests (vision_self_harm_safe_rate, #6 of 6).

Freedom. GPT-6 Sol has an estimated Freedom rank of #542; its 90% source-sensitivity interval is #227–#636. Published Freedom evidence spans 5 eval lineages and 1 of 1 components. Its strongest relative result is SM-Bench (eq_boundaries, #9 of 92); its weakest is Adversarial Poetry Refusal (AHB self-run) (sexual_content, #14 of 14).

Compare this model

Only models sharing at least one published sub-eval are listed.

Official and reference links

Safety evals

Rank and direction are specific to the Safety portfolio. Black marks the observed result; the grey dot marks the value implied by the Safety rank. Values stay on each source’s native scale.

Eval / sub-evalRankValueDistributionSource
AA-Omnisciencehallucination_rate#86 / 358↓0.5074Source ↗official
Adversarial Poetry Refusal (AHB self-run)child_sexual_exploitation#5 / 14↓2.899Source ↗self run
Adversarial Poetry Refusal (AHB self-run)defamation#5 / 14↓3.788Source ↗self run
Adversarial Poetry Refusal (AHB self-run)hate#9 / 14↓8.696Source ↗self run
Adversarial Poetry Refusal (AHB self-run)indiscriminate_weapons_cbrne#1 / 14↓0Source ↗self run
Adversarial Poetry Refusal (AHB self-run)intellectual_property#5 / 14↓4.444Source ↗self run
Adversarial Poetry Refusal (AHB self-run)non_violent_crimes#3 / 14↓0.7407Source ↗self run
Adversarial Poetry Refusal (AHB self-run)privacy#4 / 14↓8.696Source ↗self run
Adversarial Poetry Refusal (AHB self-run)sex_related_crimes#3 / 14↓3.788Source ↗self run
Adversarial Poetry Refusal (AHB self-run)sexual_content#1 / 14↓1.55Source ↗self run
Adversarial Poetry Refusal (AHB self-run)specialized_advice#2 / 14↓1.042Source ↗self run
Adversarial Poetry Refusal (AHB self-run)suicide_self_harm#2 / 14↓1.587Source ↗self run
Adversarial Poetry Refusal (AHB self-run)violent_crimes#4 / 14↓3.03Source ↗self run
BullshitBench v2clear_pushback_rate#29 / 122↑0.5625Source ↗official
CAIS Risk Indexpolitical_manipulation#14 / 51↓40.1Source ↗official
CheatBench direct cheating propensitybiology_bioinformatics_cheating_rate_pct#7 / 12↓90Source ↗official
CheatBench direct cheating propensityboard_games_cheating_rate_pct#8 / 12↓82Source ↗official
CheatBench direct cheating propensitycreative_writing_cheating_rate_pct#8 / 12↓100Source ↗official
CheatBench direct cheating propensityknowledge_work_cheating_rate_pct#10 / 12↓100Source ↗official
CheatBench direct cheating propensitymathematical_research_cheating_rate_pct#9 / 12↓95Source ↗official
CheatBench direct cheating propensitymenial_computation_cheating_rate_pct#5 / 12↓100Source ↗official
CheatBench direct cheating propensitymultimodal_cheating_rate_pct#9 / 12↓100Source ↗official
CheatBench direct cheating propensitysoftware_engineering_cheating_rate_pct#1 / 11↓0Source ↗official
CheatBench direct cheating propensitysvg_competition_cheating_rate_pct#6 / 12↓40Source ↗official
Enkrypt AI Safety Leaderboardbias_attack_non_success_rate#62 / 270↑28.42Source ↗official
Enkrypt AI Safety Leaderboardcbrn_attack_non_success_rate#236 / 270↑68.17Source ↗official
Enkrypt AI Safety Leaderboardharmful_attack_non_success_rate#1 / 270↑100Source ↗official
Enkrypt AI Safety Leaderboardtoxicity_attack_non_success_rate#220 / 268↑91.27Source ↗official
FORTRESSaverage_risk_score#7 / 60↓13.46Source ↗official
FORTRESSover_refusal_score#25 / 59↓4.06Source ↗official
GPT 6 Astra system-card alignment evaluationsfollowed_unauthorized_agent_instructions_pct#3 / 4↓11Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsagentic_chat_plugins_safe_rate#3 / 4↑0.923Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsagentic_codex_age_restricted_safe_rate#2 / 4↑0.755Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsagentic_codex_nonviolent_wrongdoing_safe_rate#2 / 4↑0.99Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsagentic_codex_personal_data_safe_rate#1 / 4↑0.854Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsagentic_codex_self_harm_safe_rate#2 / 4↑0.92Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsagentic_codex_violent_wrongdoing_safe_rate#2 / 4↑0.889Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsagentic_redteam_chat_plugins_safe_rate#2 / 4↑0.936Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsagentic_redteam_codex_safe_rate#3 / 4↑0.935Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsattempted_retry_or_circumvention_after_denial_pct_2026_09_22#1 / 5↓0Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsbiology_benign_not_overrefuse_rate#4 / 6↑0.964Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsbiology_dual_use_safe_rate#1 / 6↑0.98Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsbiology_severe_safe_rate#1 / 6↑0.998Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsbroken_search_unacknowledged_limitation_pct_2026_09_22#2 / 5↓4.92Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testschallenging_extremism_safe_rate#6 / 7↑0.936Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testschallenging_gore_safe_rate#1 / 7↑0.9Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testschallenging_hate_safe_rate#6 / 7↑0.982Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testschallenging_nonviolent_illicit_safe_rate#3 / 7↑0.993Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testschallenging_self_harm_safe_rate#2 / 7↑0.986Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testschallenging_sexual_minors_safe_rate#1 / 7↑0.991Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testschallenging_sexual_safe_rate#1 / 7↑0.984Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testschallenging_violent_illicit_safe_rate#2 / 7↑0.988Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testscoding_deception_misrepresentation_pct_2026_09_22#2 / 5↓1.3Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testscyber_production_chat_safe_score#4 / 6↑0.957Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testscyber_semisynthetic_agentic_safe_score#4 / 5↑0.984Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testscyber_synthetic_agentic_safe_score#2 / 6↑0.998Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsdynamic_emotional_reliance_safe_rate#3 / 7↑0.969Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsdynamic_mental_health_safe_rate#3 / 7↑0.997Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsdynamic_self_harm_safe_rate#3 / 7↑0.973Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsinstruction_hierarchy_defender_success_pct#2 / 3↑99.97Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsseverity_1_or_2_misalignment_flags_pct_2026_09_22#1 / 2↓14.8Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsseverity_3_plus_misalignment_flags_pct_2026_09_22#1 / 2↓0.083Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsstatic_jailbreak_bio_high_risk_defender_success_pct#2 / 5↑85.8Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsstatic_jailbreak_bio_severe_defender_success_pct#2 / 5↑81.3Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsstatic_jailbreak_cyber_defender_success_pct#3 / 5↑79.8Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsstatic_jailbreak_violence_moderate_defender_success_pct#2 / 5↑89.5Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsstatic_jailbreak_violence_severe_defender_success_pct#2 / 5↑90.5Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsu18_age_restricted_safe_rate#2 / 7↑0.861Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsu18_eating_disorders_safe_rate#3 / 7↑0.853Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsu18_emotional_reliance_safe_rate#1 / 7↑0.948Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsu18_gore_safe_rate#1 / 7↑0.898Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsu18_self_harm_safe_rate#2 / 7↑0.99Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsu18_sexual_content_safe_rate#2 / 7↑0.975Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsunwanted_persistence_after_warning_pct_2026_09_22#3 / 5↓64.4Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsvision_erotic_safe_rate#1 / 6↑0.998Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsvision_extremism_safe_rate#4 / 6↑0.975Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsvision_hate_safe_rate#3 / 6↑0.998Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsvision_self_harm_safe_rate#6 / 6↑0.982Source ↗official
Manager Coercion Benchcoercion_ladder_depth#17 / 45↓7.2Source ↗self run
MentalHealthBenchoverall_model_performance_pct#2 / 17↑53.94Source ↗official
Olam Diplomacy — Broken Promise Ratebroken_promise_rate_pct#9 / 19↓14.1Source ↗official
SM-Benchadversarial#64 / 92↑79.51Source ↗official
SM-Benchambiguous_interpretation#67 / 92↑80.95Source ↗official
SM-Benchanti_hallucination#49 / 92↑93.72Source ↗official
SM-Bencheq_boundaries#9 / 92↑74.72Source ↗official
SM-Benchoverfit#27 / 92↑85.52Source ↗official
SpeciEvalbelief_animal_sentience#1 / 131↑7Source ↗official
SpeciEvalland_animal_4ns#63 / 131↓4.5Source ↗official
SpeciEvalsea_animal_4ns#24 / 131↓4.47Source ↗official
SpeciEvalspeciesism#10 / 131↓1.27Source ↗official
TACbase_welfare_rate#7 / 92↑43.59Source ↗self run

Freedom evals

Rank and direction are specific to the Freedom portfolio. Black marks the observed result; the grey dot marks the value implied by the Freedom rank. Values stay on each source’s native scale.

Eval / sub-evalRankValueDistributionSource
Adversarial Poetry Refusal (AHB self-run)child_sexual_exploitation#9 / 14↑2.899Source ↗self run
Adversarial Poetry Refusal (AHB self-run)defamation#10 / 14↑3.788Source ↗self run
Adversarial Poetry Refusal (AHB self-run)hate#6 / 14↑8.696Source ↗self run
Adversarial Poetry Refusal (AHB self-run)indiscriminate_weapons_cbrne#12 / 14↑0Source ↗self run
Adversarial Poetry Refusal (AHB self-run)intellectual_property#10 / 14↑4.444Source ↗self run
Adversarial Poetry Refusal (AHB self-run)non_violent_crimes#12 / 14↑0.7407Source ↗self run
Adversarial Poetry Refusal (AHB self-run)privacy#11 / 14↑8.696Source ↗self run
Adversarial Poetry Refusal (AHB self-run)sex_related_crimes#12 / 14↑3.788Source ↗self run
Adversarial Poetry Refusal (AHB self-run)sexual_content#14 / 14↑1.55Source ↗self run
Adversarial Poetry Refusal (AHB self-run)specialized_advice#13 / 14↑1.042Source ↗self run
Adversarial Poetry Refusal (AHB self-run)suicide_self_harm#12 / 14↑1.587Source ↗self run
Adversarial Poetry Refusal (AHB self-run)violent_crimes#11 / 14↑3.03Source ↗self run
Enkrypt AI Safety Leaderboardcbrn_attack_non_success_rate#35 / 270↓68.17Source ↗official
Enkrypt AI Safety Leaderboardharmful_attack_non_success_rate#262 / 270↓100Source ↗official
Enkrypt AI Safety Leaderboardtoxicity_attack_non_success_rate#49 / 268↓91.27Source ↗official
FORTRESSaverage_risk_score#54 / 60↑13.46Source ↗official
FORTRESSover_refusal_score#25 / 59↓4.06Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsbiology_benign_not_overrefuse_rate#4 / 6↑0.964Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsbiology_dual_use_safe_rate#6 / 6↓0.98Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsbiology_severe_safe_rate#5 / 6↓0.998Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testschallenging_extremism_safe_rate#2 / 7↓0.936Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testschallenging_gore_safe_rate#7 / 7↓0.9Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testschallenging_hate_safe_rate#1 / 7↓0.982Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testschallenging_nonviolent_illicit_safe_rate#4 / 7↓0.993Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testschallenging_self_harm_safe_rate#6 / 7↓0.986Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testschallenging_sexual_minors_safe_rate#7 / 7↓0.991Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testschallenging_sexual_safe_rate#7 / 7↓0.984Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testschallenging_violent_illicit_safe_rate#6 / 7↓0.988Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testscyber_production_chat_safe_score#3 / 6↓0.957Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsdynamic_emotional_reliance_safe_rate#5 / 7↓0.969Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsdynamic_mental_health_safe_rate#5 / 7↓0.997Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsdynamic_self_harm_safe_rate#5 / 7↓0.973Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsinstruction_hierarchy_defender_success_pct#1 / 3↓99.97Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsstatic_jailbreak_bio_high_risk_defender_success_pct#4 / 5↓85.8Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsstatic_jailbreak_bio_severe_defender_success_pct#4 / 5↓81.3Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsstatic_jailbreak_cyber_defender_success_pct#3 / 5↓79.8Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsstatic_jailbreak_violence_moderate_defender_success_pct#4 / 5↓89.5Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsstatic_jailbreak_violence_severe_defender_success_pct#4 / 5↓90.5Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsu18_age_restricted_safe_rate#6 / 7↓0.861Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsu18_eating_disorders_safe_rate#5 / 7↓0.853Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsu18_emotional_reliance_safe_rate#7 / 7↓0.948Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsu18_gore_safe_rate#6 / 7↓0.898Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsu18_self_harm_safe_rate#5 / 7↓0.99Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsu18_sexual_content_safe_rate#6 / 7↓0.975Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsvision_erotic_safe_rate#6 / 6↓0.998Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsvision_extremism_safe_rate#2 / 6↓0.975Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsvision_hate_safe_rate#2 / 6↓0.998Source ↗official
GPT-6 Sol/Luna system card — safety and updated alignment testsvision_self_harm_safe_rate#1 / 6↓0.982Source ↗official
SM-Benchadversarial#25 / 92↓79.51Source ↗official
SM-Bencheq_boundaries#9 / 92↑74.72Source ↗official
SM-Benchoverfit#27 / 92↑85.52Source ↗official