OpenAI

o3 Mini 2025-01-31

Tipo
modelo de lenguaje
Contexto
200K tokens
Salida máxima
100K
Cadena para la API
azure/eu/o3-mini-2025-01-31

Precios por proveedor

Proveedor Entrada, $ por 1M Salida, $ por 1M En nuestros datos desde
Microsoft Foundry azure/o3-mini-2025-01-31 $1,1 $4,4 31 jul. 2026
OpenAI $1,1 $4,4 31 jul. 2026
Microsoft Foundry azure/eu/o3-mini-2025-01-31 $1,21 $4,84 31 jul. 2026

Se muestra solo la tarifa base y solo precios por token. Las tarifas por lotes, reducidas o en caché, así como los precios por imagen o por segundo de vídeo, no entran en esta tabla: no se pueden poner en la misma columna que un precio por millón de tokens.

Un mismo proveedor aparece varias veces si vende este modelo con identificadores distintos y a precios distintos, por ejemplo con distinta precisión de pesos. El identificador se indica junto al nombre. Las ofertas idénticas llegadas de dos fuentes con grafías distintas se unen en una sola fila.

La fecha de la última columna es el día en que este precio entró por primera vez en nuestra recogida. El precio puede ser más antiguo: antes de ese día simplemente no lo registrábamos. Desde entonces no ha cambiado; si no, en su lugar habría una fila nueva con una fecha nueva.

Resultados de las mediciones

Conjunto de tareas Resultado Condiciones de ejecución Medido por
MATH, nivel de dificultad cinco 96,49 % esfuerzo: high · con andamiaje ajustado Epoch evaluations
Mock AIME 2024–2025 — problemas de olimpiada 76,92 % esfuerzo: low · con andamiaje ajustado Epoch evaluations
GPQA Diamond — preguntas de nivel de posgrado 69,36 % esfuerzo: low · con andamiaje ajustado Epoch evaluations
Escritura creativa (evaluación de Lech Mazur) 61,7 % esfuerzo: high lechmazur/writing Github repository
Aider Polyglot — ediciones de código en seis lenguajes 60,4 % esfuerzo: medium · con andamiaje ajustado Aider LLM Leaderboards
CadEval — construcción de modelos CAD con código 54 % esfuerzo: medium CadEval Dashboard
Fiction.LiveBench — retención de contexto largo 50 % esfuerzo: medium Fiction.live leaderboard
WeirdML — tareas inusuales de aprendizaje automático 43,7 % esfuerzo: high WeirdML Leaderboard
ARC-AGI — generalización a patrones nuevos 34,5 % esfuerzo: high · con andamiaje ajustado ARC Prize Leaderboard
Cybench — tareas de ciberseguridad 22,5 % esfuerzo: medium · con andamiaje ajustado Cybench leaderboard
FrontierMath, niveles 1–3 18,6 % esfuerzo: high Epoch evaluations
Problemas de ajedrez 12,67 % esfuerzo: low Epoch evaluations
SimpleBench — preguntas con trampa 7,36 % esfuerzo: high SimpleBench Leaderboard
ARC-AGI-2 2,99 % esfuerzo: high
GSO-Bench — optimización de código 1,3 % esfuerzo: low GSO Leaderboard
FrontierMath, nivel 4 — problemas de investigación 0 % esfuerzo: high Epoch evaluations