Google DeepMind

Gemini 3.1 Pro Preview

Tipo
modelo de lenguaje
Contexto
1.049K tokens
Salida máxima
66K
Lanzado el
19 febrero 2026
Conocimientos hasta
febrero 2026
Cadena para la API
gemini/gemini-3.1-pro-preview

Precios por proveedor

Proveedor Entrada, $ por 1M Salida, $ por 1M En nuestros datos desde
vivgrid $2 $12 31 jul. 2026
daoxe $2 $12 31 jul. 2026
frogbot $2 $12 31 jul. 2026
auriko $2 $12 31 jul. 2026
ofox $2 $12 31 jul. 2026
perplexity-agent $2 $12 31 jul. 2026
AIHubMix $2 $12 31 jul. 2026
Abacus.AI $2 $12 31 jul. 2026
CrossModel $2 $12 31 jul. 2026
FastRouter $2 $12 31 jul. 2026
GitHub Copilot $2 $12 31 jul. 2026
Google DeepMind $2 $12 31 jul. 2026
Google Vertex AI $2 $12 31 jul. 2026
Kilo Code $2 $12 31 jul. 2026
LLM Gateway $2 $12 31 jul. 2026
Merge Gateway $2 $12 31 jul. 2026
NanoGPT $2 $12 31 jul. 2026
OpenRouter $2 $12 31 jul. 2026
Vercel $2 $12 31 jul. 2026
ZenMux $2 $12 31 jul. 2026
Venice AI $2,5 $15 31 jul. 2026
OrcaRouter $4 $18 31 jul. 2026

Se muestra solo la tarifa base y solo precios por token. Las tarifas por lotes, reducidas o en caché, así como los precios por imagen o por segundo de vídeo, no entran en esta tabla: no se pueden poner en la misma columna que un precio por millón de tokens.

La fecha de la última columna es el día en que este precio entró por primera vez en nuestra recogida. El precio puede ser más antiguo: antes de ese día simplemente no lo registrábamos. Desde entonces no ha cambiado; si no, en su lugar habría una fila nueva con una fecha nueva.

Resultados de las mediciones

Conjunto de tareas Resultado Condiciones de ejecución Medido por
Arena Score en ruso 1.495,77 1.488–1.503
Arena Score, matemáticas 1.489,07 1.480–1.498
Arena Score en francés 1.488,01 1.474–1.502
Arena Score, preguntas expertas 1.486,42 1.479–1.494
Arena Score, consultas difíciles 1.484,41 1.480–1.489
Arena Score, programación 1.483,89 1.479–1.489
Arena Score, diálogo de varios turnos 1.482,41 1.476–1.489
Arena Score, consultas largas 1.482,3 1.477–1.487
Arena Score, escritura creativa 1.481,61 1.475–1.488
Arena Score en español 1.479,93 1.467–1.493
Arena Score, general 1.479,46 1.476–1.483
Arena Score en inglés 1.478,03 1.474–1.483
Arena Score, seguimiento de instrucciones 1.467,43 1.462–1.473
Arena Score, desarrollo web 1.446,83 1.441–1.452
Arena Score, comprensión de esquemas 1.312,53 1.305–1.320
Arena Score, reconocimiento de texto en imagen 1.305,79 1.300–1.311
Arena Score, trabajo con imágenes 1.295,15 1.289–1.301
ARC-AGI — generalización a patrones nuevos 98 % · con andamiaje ajustado ARC Prize Leaderboard
Mock AIME 2024–2025 — problemas de olimpiada 95,6 % · con andamiaje ajustado Epoch evaluations
GPQA Diamond — preguntas de nivel de posgrado 92,13 % · con andamiaje ajustado Epoch evaluations
Terminal-Bench — trabajo en la línea de comandos 80,2 % · con andamiaje ajustado https://www.tbench.ai/leaderboard/terminal-bench/2.0
SimpleQA Verified — exactitud factual 77,3 % Epoch evaluations
ARC-AGI-2 77,1 %
SimpleBench — preguntas con trampa 75,52 % SimpleBench Leaderboard
WeirdML — tareas inusuales de aprendizaje automático 72,1 % WeirdML Leaderboard
FrontierMath, niveles 1–3 59,65 % Epoch evaluations
BALROG — entornos de juego 57 % Balrog Leaderboard
Problemas de ajedrez 52,65 % Epoch evaluations
Humanity’s Last Exam — preguntas de nivel experto 43,74 %
APEX-Agents 33,5 %
FrontierMath, nivel 4 — problemas de investigación 26,83 % Epoch evaluations
GSO-Bench — optimización de código 22,55 % https://gso-bench.github.io/index.html
CritPt — problemas de física 17,71 %
Arena Score, tareas de agente -0,01 0–0