xAI

Grok 3 Mini

Tipo
modelo de lenguaje
Contexto
131K tokens
Salida máxima
8K
Lanzado el
11 abril 2025
Cadena para la API
xai/grok-3-mini

Precios por proveedor

Proveedor Entrada, $ por 1M Salida, $ por 1M En nuestros datos desde
Microsoft Foundry $0,25 $1,27 31 jul. 2026
vercel_ai_gateway $0,3 $0,5 31 jul. 2026
Helicone $0,3 $0,5 31 jul. 2026
OCI Generative AI $0,3 $0,5 31 jul. 2026
Poe $0,3 $0,5 31 jul. 2026
xAI $0,3 $0,5 31 jul. 2026

Se muestra solo la tarifa base y solo precios por token. Las tarifas por lotes, reducidas o en caché, así como los precios por imagen o por segundo de vídeo, no entran en esta tabla: no se pueden poner en la misma columna que un precio por millón de tokens.

La fecha de la última columna es el día en que este precio entró por primera vez en nuestra recogida. El precio puede ser más antiguo: antes de ese día simplemente no lo registrábamos. Desde entonces no ha cambiado; si no, en su lugar habría una fila nueva con una fecha nueva.

Resultados de las mediciones

Conjunto de tareas Resultado Condiciones de ejecución Medido por
Arena Score en inglés 1.373,29 1.367–1.380
Arena Score, matemáticas 1.370,22 1.356–1.384
Arena Score, programación 1.366,03 1.357–1.375
Arena Score, consultas difíciles 1.363,32 1.357–1.370
Arena Score, general 1.362,74 1.358–1.368
Arena Score, preguntas expertas 1.360,62 1.344–1.378
Arena Score, consultas largas 1.356,9 1.348–1.366
Arena Score en español 1.355,7 1.322–1.390 esfuerzo: high
Arena Score en francés 1.352,74 1.308–1.398 esfuerzo: high
Arena Score en ruso 1.350,69 1.335–1.366
Arena Score, diálogo de varios turnos 1.349,13 1.340–1.359
Arena Score, seguimiento de instrucciones 1.345,63 1.338–1.354
Arena Score, escritura creativa 1.330,28 1.317–1.343 esfuerzo: high
MATH, nivel de dificultad cinco 90,94 % esfuerzo: low · con andamiaje ajustado Epoch evaluations
Mock AIME 2024–2025 — problemas de olimpiada 77,76 % esfuerzo: low · con andamiaje ajustado Epoch evaluations
Escritura creativa (evaluación de Lech Mazur) 73,5 % esfuerzo: low lechmazur/writing Github repository
GPQA Diamond — preguntas de nivel de posgrado 68,35 % esfuerzo: high · con andamiaje ajustado Epoch evaluations
Fiction.LiveBench — retención de contexto largo 66,7 % esfuerzo: medium Fiction.live leaderboard
Aider Polyglot — ediciones de código en seis lenguajes 49,3 % esfuerzo: low · con andamiaje ajustado Aider LLM Leaderboards
WeirdML — tareas inusuales de aprendizaje automático 42,58 % esfuerzo: high WeirdML Leaderboard
SimpleQA Verified — exactitud factual 21,1 % esfuerzo: high Epoch evaluations
ARC-AGI — generalización a patrones nuevos 16,5 % esfuerzo: low · con andamiaje ajustado ARC Prize Leaderboard
ARC-AGI-2 0,42 % esfuerzo: low