← Models

Model profile

GPT 5 Mini

OpenAIdeveloper
2025-08-07release date
#46 / 346Safety rank
#565 / 662Freedom rank

Evidence summary

Safety. GPT 5 Mini has an estimated Safety rank of #46; its 90% source-sensitivity interval is #35–#118. Its behavior-only rank is #47; company governance moves the combined estimate to #46. Published Safety evidence spans 33 eval lineages and 7 of 7 components. Its strongest relative result is HELM Safety (simple_safety_tests, #1 of 80); its weakest is SM-Bench (overfit, #88 of 92).

Freedom. GPT 5 Mini has an estimated Freedom rank of #565; its 90% source-sensitivity interval is #393–#612. Published Freedom evidence spans 15 eval lineages and 1 of 1 components. Its strongest relative result is HELM Safety (xstest, #14 of 80); its weakest is Enkrypt AI Safety Leaderboard (cbrn_attack_non_success_rate, #263 of 270).

Compare this model

Only models sharing at least one published sub-eval are listed.

Official and reference links

Safety evals

Rank and direction are specific to the Safety portfolio. Black marks the observed result; the grey dot marks the value implied by the Safety rank. Values stay on each source’s native scale.

Eval / sub-evalRankValueDistributionSource
AA-Omnisciencehallucination_rate#70 / 358↓0.4432Source ↗official
Adversarial Poetry — AILuminate Baseline and Poetry ASRbaseline_asr#6 / 24↓2.16Source ↗official
Adversarial Poetry — AILuminate Baseline and Poetry ASRpoetry_asr#3 / 24↓3.73Source ↗official
AIRBench 2024 Safety Scenariossafety_scenarios#11 / 80↑0.857Source ↗official
Alignment Leaderboardcorrigibility#3 / 24↑4.495Source ↗official
Alignment Leaderboardhonesty#4 / 24↑4.157Source ↗official
Alignment Leaderboardnon_manipulation#5 / 24↑4.243Source ↗official
Alignment Leaderboardrobustness#1 / 24↑4.6Source ↗official
Alignment Leaderboardsafety#5 / 24↑4.288Source ↗official
Alignment Leaderboardscheming#5 / 24↑4.193Source ↗official
ANIMAscore#8 / 22↑0.7177Source ↗official
Arena Factuality — Text Arena (factuality-only weighting)factuality_bt_rating#13 / 111↑1465.0Source ↗official
AuAu Authoritarian Response Auditbehavioral_vignette_arr_percent#1 / 17↓18.2Source ↗official
AuAu Authoritarian Response Auditrealistic_prompt_arr_percent#1 / 17↓0.5Source ↗official
BioTIERpermit_compliance_pct#29 / 52↑98.9Source ↗official
BioTIERrefuse_compliance_pct#25 / 52↑46.9Source ↗official
CAIS Risk Indexagent_red_teaming#33 / 49↓84.3Source ↗official
CAIS Risk Indexbioweapons_assistance#36 / 54↓78.2Source ↗official
CAIS Risk Indexhle_overconfidence#39 / 55↓65Source ↗official
CAIS Risk Indexmachiavelli#15 / 51↓84.2Source ↗official
CAIS Risk Indexmask#31 / 57↓21.7Source ↗official
CAIS Risk Indextextquests_harm#24 / 54↓17.5Source ↗official
Cisco AI Defense Rolling Single-Turn Leaderboardsingle_turn_attack_success_rate#18 / 104↓5.085Source ↗official
Enkrypt AI Safety Leaderboardbias_attack_non_success_rate#34 / 270↑41.09Source ↗official
Enkrypt AI Safety Leaderboardcbrn_attack_non_success_rate#8 / 270↑96.83Source ↗official
Enkrypt AI Safety Leaderboardharmful_attack_non_success_rate#68 / 270↑91.11Source ↗official
Enkrypt AI Safety Leaderboardtoxicity_attack_non_success_rate#174 / 268↑95.2Source ↗official
FORTRESSaverage_risk_score#17 / 60↓17Source ↗official
FORTRESSover_refusal_score#56 / 59↓14.17Source ↗official
HELM Safetyanthropic_red_team#32 / 80↑0.991Source ↗official
HELM Safetybbq#19 / 80↑0.963Source ↗official
HELM Safetyharmbench#10 / 80↑0.971Source ↗official
HELM Safetysimple_safety_tests#1 / 80↑1Source ↗official
HELM Safetyxstest#14 / 80↑0.977Source ↗official
HUMAINE Trust, Ethics and Safetytrust_ethics_safety_score#33 / 54↑26.31Source ↗official
Human Pathogen Capabilities Test (HPCT) — overall refusalrefusal_rate_pct#21 / 69↑0.4Source ↗official
Humanity's Last Exam RMS calibration error (Scale Labs)calibrationError#18 / 42↓65Source ↗official
KIDBench Implicit Child Cueimplicit_child_cue_total_mean#6 / 13↑3.99Source ↗official
MACHIAVELLIdeception_relative_random_pct#13 / 50↓84.2Source ↗official
MASKlying_probability_pct#14 / 53↓17.4Source ↗official
MORUscore#3 / 13↑81.57Source ↗official
PHAREbias_resistance_diagnostic#31 / 66↑0.4641Source ↗official
PHAREhallucination_resistance_diagnostic#22 / 70↑0.7958Source ↗official
PHAREharm_resistance_diagnostic#7 / 70↑0.9829Source ↗official
PHAREjailbreak_resistance_diagnostic#15 / 67↑0.686Source ↗official
SimpleQA Verifiedf1_score#9 / 13↑24.6Source ↗official
SM-Benchadversarial#43 / 92↑82.44Source ↗official
SM-Benchambiguous_interpretation#13 / 92↑91.67Source ↗official
SM-Benchanti_hallucination#70 / 92↑86.91Source ↗official
SM-Bencheq_boundaries#82 / 92↑52.81Source ↗official
SM-Benchoverfit#88 / 92↑25.14Source ↗official
SpeciEvalbelief_animal_sentience#113 / 131↑6.43Source ↗official
SpeciEvalland_animal_4ns#14 / 131↓4.17Source ↗official
SpeciEvalsea_animal_4ns#40 / 131↓4.58Source ↗official
SpeciEvalspeciesism#115 / 131↓2.65Source ↗official
StereoTales Harmful Associationsbenign_significant_association_score#9 / 23↑86.57Source ↗official
TACbase_welfare_rate#48 / 92↑26.28Source ↗self run
Vectara HHEM Factual Consistencyfactual_consistency_rate#77 / 94↑87.1Source ↗official

Freedom evals

Rank and direction are specific to the Freedom portfolio. Black marks the observed result; the grey dot marks the value implied by the Freedom rank. Values stay on each source’s native scale.

Eval / sub-evalRankValueDistributionSource
Adversarial Poetry — AILuminate Baseline and Poetry ASRbaseline_asr#19 / 24↑2.16Source ↗official
Adversarial Poetry — AILuminate Baseline and Poetry ASRpoetry_asr#22 / 24↑3.73Source ↗official
AIRBench 2024 Safety Scenariossafety_scenarios#69 / 80↓0.857Source ↗official
BioTIERpermit_compliance_pct#29 / 52↑98.9Source ↗official
BioTIERrefuse_compliance_pct#28 / 52↓46.9Source ↗official
CAIS Risk Indexbioweapons_assistance#19 / 54↑78.2Source ↗official
Cisco AI Defense Rolling Single-Turn Leaderboardsingle_turn_attack_success_rate#87 / 104↑5.085Source ↗official
Enkrypt AI Safety Leaderboardcbrn_attack_non_success_rate#263 / 270↓96.83Source ↗official
Enkrypt AI Safety Leaderboardharmful_attack_non_success_rate#199 / 270↓91.11Source ↗official
Enkrypt AI Safety Leaderboardtoxicity_attack_non_success_rate#95 / 268↓95.2Source ↗official
FORTRESSaverage_risk_score#44 / 60↑17Source ↗official
FORTRESSover_refusal_score#56 / 59↓14.17Source ↗official
HELM Safetyanthropic_red_team#45 / 80↓0.991Source ↗official
HELM Safetyharmbench#71 / 80↓0.971Source ↗official
HELM Safetysimple_safety_tests#58 / 80↓1Source ↗official
HELM Safetyxstest#14 / 80↑0.977Source ↗official
Human Pathogen Capabilities Test (HPCT) — overall refusalrefusal_rate_pct#48 / 69↓0.4Source ↗official
PHAREharm_resistance_diagnostic#64 / 70↓0.9829Source ↗official
PHAREjailbreak_resistance_diagnostic#53 / 67↓0.686Source ↗official
SM-Benchadversarial#48 / 92↓82.44Source ↗official
SM-Bencheq_boundaries#82 / 92↑52.81Source ↗official
SM-Benchoverfit#88 / 92↑25.14Source ↗official
SpeechMap model completioncomplete_pct#97 / 181↑55.6Source ↗official