OpenAI

GPT 4.5 Preview

Tipo
modelo de lenguaje
Contexto
128K tokens
Salida máxima
16K
Cadena para la API
azure/gpt-4.5-preview

Precios por proveedor

Proveedor Entrada, $ por 1M Salida, $ por 1M En nuestros datos desde
Microsoft Foundry $75 $150 31 jul. 2026

Se muestra solo la tarifa base y solo precios por token. Las tarifas por lotes, reducidas o en caché, así como los precios por imagen o por segundo de vídeo, no entran en esta tabla: no se pueden poner en la misma columna que un precio por millón de tokens.

La fecha de la última columna es el día en que este precio entró por primera vez en nuestra recogida. El precio puede ser más antiguo: antes de ese día simplemente no lo registrábamos. Desde entonces no ha cambiado; si no, en su lugar habría una fila nueva con una fecha nueva.

Resultados de las mediciones

Conjunto de tareas Resultado Condiciones de ejecución Medido por
Arena Score, diálogo de varios turnos 1.443,92 1.430–1.457
Arena Score en inglés 1.419,49 1.412–1.427
Arena Score en ruso 1.418,24 1.403–1.434
Arena Score en francés 1.418,01 1.362–1.474
Arena Score, general 1.417,47 1.412–1.423
Arena Score, matemáticas 1.411,89 1.397–1.427
Arena Score, consultas largas 1.406 1.392–1.420
Arena Score, seguimiento de instrucciones 1.404,35 1.396–1.413
Arena Score, consultas difíciles 1.403,65 1.394–1.414
Arena Score, programación 1.397,05 1.384–1.410
Arena Score, escritura creativa 1.394,29 1.382–1.406
Arena Score, preguntas expertas 1.393,91 1.371–1.417
Arena Score, trabajo con imágenes 1.195,13 1.183–1.207
MATH, nivel de dificultad cinco 78,63 % · con andamiaje ajustado Epoch evaluations
Escritura creativa (evaluación de Lech Mazur) 75,6 % lechmazur/writing Github repository
Fiction.LiveBench — retención de contexto largo 63,9 % Fiction.live leaderboard
GPQA Diamond — preguntas de nivel de posgrado 58,25 % · con andamiaje ajustado Epoch evaluations
Aider Polyglot — ediciones de código en seis lenguajes 44,9 % · con andamiaje ajustado Aider LLM Leaderboards
WeirdML — tareas inusuales de aprendizaje automático 39,37 % WeirdML Leaderboard
Mock AIME 2024–2025 — problemas de olimpiada 37,72 % · con andamiaje ajustado Epoch evaluations
SimpleBench — preguntas con trampa 21,4 % SimpleBench Leaderboard
Cybench — tareas de ciberseguridad 17,5 % · con andamiaje ajustado Cybench leaderboard
ARC-AGI — generalización a patrones nuevos 10,3 % · con andamiaje ajustado ARC Prize Leaderboard
ARC-AGI-2 0,8 %
Humanity’s Last Exam — preguntas de nivel experto 0,67 %