GPT-4o Mini est le petit modèle économique d'OpenAI issu de la génération GPT-4o, sorti le 18 juillet 2024, facturé 60 % moins cher que GPT-3.5 Turbo tout en obtenant 82 % sur MMLU. Il vise les tâches à fort volume qui exigent malgré tout une bonne compréhension et génération du langage, et prend en charge l'entrée d'images, l'appel d'outils et la mise en cache des prompts. Contexte : 128K tokens, sortie : 16K. À $0.15/M tokens en entrée et $0.60/M en sortie, il reste l'un des moyens les moins chers d'exécuter des charges simples à haut débit, même si les petits modèles plus récents raisonnent mieux. Accessible via le protocole compatible OpenAI.
Providers
/v1/chat/completions/v1/responsesExemples de code
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.ai/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="openai/gpt-4o-mini",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Benchmarks
GPT-4o Mini obtient 1318 dans la catégorie générale du classement texte LMArena (contrôle de style), se classant 226e sur 374 modèles sur la base de 68 709 votes de préférence humaine (mis à jour le 2026-07-12).
| Catégorie | Score Arena | IC à 95 % | Rang | Votes |
|---|---|---|---|---|
| Général | 1318 | 1314–1321 | 226e sur 374 | 68 709 |
| Prompts difficiles | 1311 | 1306–1316 | 241e sur 374 | 18 259 |
| Programmation | 1349 | 1342–1355 | 231e sur 369 | 10 927 |
| Mathématiques | 1276 | 1269–1283 | 238e sur 362 | 9 322 |
| Écriture créative | 1294 | 1287–1301 | 210e sur 372 | 10 484 |
| Suivi d'instructions | 1293 | 1289–1298 | 232e sur 374 | 26 705 |
| Chinois | 1315 | 1306–1324 | 220e sur 344 | 5 767 |
Source : LMArena · CC BY 4.0 · Mis à jour le 2026-07-12 · Méthodologie ↗ · Les rangs comparent les modèles au sein de chaque catégorie du classement texte LMArena (contrôle de style). Les scores proviennent d'évaluations de préférence humaine tierces, et non d'OFOX.