Google DeepMind

Gemini 3 Flash Preview

Tipo
modelo de lenguaje
Contexto
1.049K tokens
Salida máxima
66K
Lanzado el
17 diciembre 2025
Conocimientos hasta
enero 2025
Cadena para la API
google/gemini-3-flash-preview

Precios por proveedor

Proveedor Entrada, $ por 1M Salida, $ por 1M En nuestros datos desde
qihang-ai $0,07 $0,43 31 jul. 2026
frogbot $0,5 $3 31 jul. 2026
perplexity-agent $0,5 $3 31 jul. 2026
gmi $0,5 $3 31 jul. 2026
302.AI $0,5 $3 31 jul. 2026
AIHubMix $0,5 $3 31 jul. 2026
Abacus.AI $0,5 $3 31 jul. 2026
CrossModel $0,5 $3 31 jul. 2026
GitHub Copilot $0,5 $3 31 jul. 2026
Google DeepMind $0,5 $3 31 jul. 2026
Google Vertex AI $0,5 $3 31 jul. 2026
Jiekou.AI $0,5 $3 31 jul. 2026
Kilo Code $0,5 $3 31 jul. 2026
LLM Gateway $0,5 $3 31 jul. 2026
Merge Gateway $0,5 $3 31 jul. 2026
NanoGPT $0,5 $3 31 jul. 2026
OpenRouter $0,5 $3 31 jul. 2026
OrcaRouter $0,5 $3 31 jul. 2026
Requesty $0,5 $3 31 jul. 2026
ZenMux $0,5 $3 31 jul. 2026
Venice AI $0,7 $3,75 31 jul. 2026

Se muestra solo la tarifa base y solo precios por token. Las tarifas por lotes, reducidas o en caché, así como los precios por imagen o por segundo de vídeo, no entran en esta tabla: no se pueden poner en la misma columna que un precio por millón de tokens.

La fecha de la última columna es el día en que este precio entró por primera vez en nuestra recogida. El precio puede ser más antiguo: antes de ese día simplemente no lo registrábamos. Desde entonces no ha cambiado; si no, en su lugar habría una fila nueva con una fecha nueva.

Resultados de las mediciones

Conjunto de tareas Resultado Condiciones de ejecución Medido por
Mock AIME 2024–2025 — problemas de olimpiada 92,77 % · con andamiaje ajustado Epoch evaluations
GeoBench — localización de un lugar a partir de una foto 88 % GeoBench leaderboard
GPQA Diamond — preguntas de nivel de posgrado 77,61 % · con andamiaje ajustado Epoch evaluations
SWE-bench Verified — corrección de errores en repositorios 75,41 % · con andamiaje ajustado Epoch evaluations
SimpleQA Verified — exactitud factual 67,4 % Epoch evaluations
Terminal-Bench — trabajo en la línea de comandos 64,3 % · con andamiaje ajustado Terminal-Bench v2 Leaderboard
WeirdML — tareas inusuales de aprendizaje automático 61,6 % WeirdML Leaderboard
SimpleBench — preguntas con trampa 53,32 % SimpleBench Leaderboard
FrontierMath, niveles 1–3 51,23 % Epoch evaluations
BALROG — entornos de juego 48,1 % Balrog Leaderboard
Problemas de ajedrez 34,76 % Epoch evaluations
ARC-AGI-2 33,61 %
APEX-Agents 24 %
ARC-AGI — generalización a patrones nuevos 21,5 % · con andamiaje ajustado
FrontierMath, nivel 4 — problemas de investigación 17,07 % Epoch evaluations
GSO-Bench — optimización de código 9,8 % GSO Leaderboard