OpenAI

OpenAI: GPT-4o-mini (2024-07-18)

Tipo
modelo de lenguaje
Contexto
128K tokens
Salida máxima
16K
Lanzado el
18 julio 2024
Conocimientos hasta
octubre 2023
Cadena para la API
openai/gpt-4o-mini-2024-07-18

Precios por proveedor

Proveedor Entrada, $ por 1M Salida, $ por 1M En nuestros datos desde
Kilo Code $0,15 $0,6 31 jul. 2026
OpenAI $0,15 $0,6 31 jul. 2026
OpenRouter $0,15 $0,6 31 jul. 2026
Microsoft Foundry $0,165 $0,66 31 jul. 2026
Venice AI $0,188 $0,75 1 ago. 2026

Se muestra solo la tarifa base y solo precios por token. Las tarifas por lotes, reducidas o en caché, así como los precios por imagen o por segundo de vídeo, no entran en esta tabla: no se pueden poner en la misma columna que un precio por millón de tokens.

La fecha de la última columna es el día en que este precio entró por primera vez en nuestra recogida. El precio puede ser más antiguo: antes de ese día simplemente no lo registrábamos. Desde entonces no ha cambiado; si no, en su lugar habría una fila nueva con una fecha nueva.

Resultados de las mediciones

Conjunto de tareas Resultado Condiciones de ejecución Medido por
Arena Score en inglés 1.300,59 1.296–1.305
Arena Score en francés 1.295,68 1.271–1.320
Arena Score, programación 1.290,12 1.284–1.297
Arena Score, consultas largas 1.288,94 1.282–1.296
Arena Score, general 1.286,57 1.283–1.290
Arena Score, diálogo de varios turnos 1.285,04 1.278–1.292
Arena Score en español 1.278,34 1.255–1.302
Arena Score en ruso 1.274,29 1.267–1.282
Arena Score, escritura creativa 1.268,26 1.261–1.275
Arena Score, matemáticas 1.267,33 1.260–1.274
Arena Score, consultas difíciles 1.267,19 1.262–1.272
Arena Score, seguimiento de instrucciones 1.258,81 1.254–1.264
Arena Score, preguntas expertas 1.233,87 1.223–1.245
Arena Score, trabajo con imágenes 1.065,76 1.058–1.074
Escritura creativa (evaluación de Lech Mazur) 67,2 % lechmazur/writing Github repository
GeoBench — localización de un lugar a partir de una foto 64 % GeoBench leaderboard
MATH, nivel de dificultad cinco 52,63 % · con andamiaje ajustado Epoch evaluations
BALROG — entornos de juego 17,4 % Balrog Leaderboard
GPQA Diamond — preguntas de nivel de posgrado 16,96 % · con andamiaje ajustado Epoch evaluations
WeirdML — tareas inusuales de aprendizaje automático 11,76 % WeirdML Leaderboard
Mock AIME 2024–2025 — problemas de olimpiada 6,85 % · con andamiaje ajustado Epoch evaluations
Aider Polyglot — ediciones de código en seis lenguajes 3,6 % · con andamiaje ajustado Aider LLM Leaderboards
ARC-AGI-2 0 %
SimpleBench — preguntas con trampa 0 % SimpleBench Leaderboard
Problemas de ajedrez 0 % Epoch evaluations