GPT-5.6 (Sol / Terra / Luna) is now evaluated on TrustVector โ€” with day-1 independent verification, incl. METR's benchmark-cheating findings.

Read the evaluation
Evaluation record ยท gpt-4o-mini

GPT-4o mini

v2024-07

OpenAI

Modelmultimodalvisioncost-effectivefast
81
Strong
About This Model

OpenAI's efficient multimodal model combining text and vision capabilities at competitive pricing. Designed for cost-sensitive applications requiring basic multimodal understanding. Legacy model: remains available in the API with no announced shutdown as of 2026-07-09 (unaffected by the GPT-4o retirement), but OpenAI recommends newer GPT-5.x mini/nano tiers for new work.

Last Evaluated: July 9, 2026
Official Website

Trust Vector Analysis

Dimension Breakdown

๐Ÿš€Performance & Reliability
+

Basic multimodal performance with fast inference. Good for simple vision + text tasks.

task accuracy code

Coding benchmarks

Evidence
HumanEval โ€” ~32% pass rate (estimated)
mediumVerified: 2026-07-09
task accuracy reasoning

Mathematical benchmarks

Evidence
MATH โ€” ~45% mathematical reasoning
mediumVerified: 2026-07-09
task accuracy general

Knowledge testing

Evidence
MMLU โ€” 40.2% multitask understanding
highVerified: 2026-07-09
output consistency

Internal testing

Evidence
OpenAI Testing โ€” Good consistency
mediumVerified: 2026-07-09
latency p50

Median latency

Evidence
OpenAI Documentation โ€” ~0.7s typical
highVerified: 2026-07-09
latency p95

95th percentile

Evidence
Community benchmarking โ€” p95 ~1.4s
highVerified: 2026-07-09
context window

Official specification

Evidence
OpenAI API Documentation โ€” 128K context
highVerified: 2026-07-09
uptime

Historical uptime

Evidence
OpenAI Status โ€” 99.9% uptime
highVerified: 2026-07-09
๐Ÿ›ก๏ธSecurity
+

Good security with multimodal safety considerations.

prompt injection resistance

Adversarial testing

Evidence
OpenAI Safety โ€” Good resistance
mediumVerified: 2026-07-09
jailbreak resistance

Safety testing

Evidence
OpenAI Safety โ€” Safety mechanisms
mediumVerified: 2026-07-09
data leakage prevention

Policy analysis

Evidence
OpenAI Privacy โ€” API data not used for training
mediumVerified: 2026-07-09
output safety

Safety benchmarks

Evidence
OpenAI Safety โ€” Comprehensive safety
highVerified: 2026-07-09
api security

Security review

Evidence
OpenAI API โ€” Standard API security
highVerified: 2026-07-09
๐Ÿ”’Privacy & Compliance
+

Standard OpenAI privacy with 30-day retention.

data residency

Documentation review

Evidence
OpenAI Documentation โ€” US infrastructure
highVerified: 2026-07-09
training data optout

Policy analysis

Evidence
OpenAI Privacy โ€” API opt-out by default
highVerified: 2026-07-09
data retention

Terms review

Evidence
OpenAI Terms โ€” 30-day retention
highVerified: 2026-07-09
pii handling

Documentation review

Evidence
OpenAI Documentation โ€” Customer responsible
mediumVerified: 2026-07-09
compliance certifications

Certification verification

Evidence
OpenAI Trust โ€” SOC 2, GDPR
highVerified: 2026-07-09
zero data retention

Policy review

Evidence
OpenAI Documentation โ€” 30-day retention
highVerified: 2026-07-09
๐Ÿ‘๏ธTrust & Transparency
+

Good transparency with multimodal safety considerations.

explainability

Reasoning evaluation

Evidence
Model Behavior โ€” Reasonable explanations
mediumVerified: 2026-07-09
hallucination rate

Factual QA testing

Evidence
SimpleQA โ€” Moderate hallucination
mediumVerified: 2026-07-09
bias fairness

Bias benchmarks

Evidence
OpenAI Safety โ€” Bias testing applied
mediumVerified: 2026-07-09
uncertainty quantification

Qualitative assessment

Evidence
Model Behavior โ€” Basic uncertainty
mediumVerified: 2026-07-09
model card quality

Documentation review

Evidence
OpenAI Documentation โ€” Good documentation
highVerified: 2026-07-09
training data transparency

Public disclosure

Evidence
OpenAI Statements โ€” General description
mediumVerified: 2026-07-09
guardrails

Safety system analysis

Evidence
Safety Systems โ€” Multimodal guardrails
highVerified: 2026-07-09
โš™๏ธOperational Excellence
+

Excellent operational maturity with multimodal capabilities.

api design quality

API review

Evidence
OpenAI API โ€” RESTful multimodal API
highVerified: 2026-07-09
sdk quality

SDK review

Evidence
OpenAI SDKs โ€” High-quality SDKs
highVerified: 2026-07-09
versioning policy

Policy review

Evidence
OpenAI Versioning โ€” Clear versioning
OpenAI Model Page: gpt-4o-mini โ€” Model remains active in the API with no deprecation or shutdown date announced; not included in the 2026-02-13 ChatGPT retirements or the API deprecations list
highVerified: 2026-07-09
monitoring observability

Tool review

Evidence
OpenAI Dashboard โ€” Usage dashboard
mediumVerified: 2026-07-09
support quality

Support assessment

Evidence
OpenAI Support โ€” Email support
highVerified: 2026-07-09
ecosystem maturity

Ecosystem analysis

Evidence
Ecosystem โ€” Mature ecosystem
highVerified: 2026-07-09
license terms

Terms review

Evidence
OpenAI Terms โ€” Clear terms
highVerified: 2026-07-09
Strengths
  • +Multimodal (text + vision) capabilities
  • +Fast response times (~0.7s p50)
  • +Cost-effective for multimodal tasks
  • +Large 128K context window
  • +Good for image understanding and OCR
  • +Mature OpenAI ecosystem
Limitations
  • !Limited knowledge depth (40.2% MMLU)
  • !Basic coding capabilities
  • !30-day data retention
  • !Not HIPAA eligible
  • !Moderate hallucination rate
  • !Performance trades for multimodal efficiency
Metadata
pricing
input: $0.15 per 1M tokens
output: $0.60 per 1M tokens
notes: Cost-effective multimodal pricing. Confirmed unchanged on official model page 2026-07-09; no longer listed on OpenAI's main pricing page.
last verified: 2026-07-09
context window: 128000
max output: 16384
languages
0: English
1: Spanish
2: French
3: German
4: Italian
5: Portuguese
6: Japanese
7: Korean
8: Chinese
modalities
0: text
1: image
2: vision
api endpoint: https://api.openai.com/v1/chat/completions
open source: false
architecture: Transformer-based multimodal
parameters: Not disclosed

Use Case Ratings

code generation

Basic coding capabilities.

customer support

Good for support with vision (image understanding).

content creation

Good multimodal content creation.

data analysis

Basic analysis with image/chart understanding.

research assistant

Good for research with multimodal inputs.

legal compliance

Basic legal tasks. 30-day retention may limit use.

healthcare

Not HIPAA eligible.

financial analysis

Good for chart/graph analysis.

education

Excellent for education with diagram understanding.

creative writing

Good creative writing with image context.