Meta AI

Llama 3.1 8B

Tipo
modelo de lenguaje
Contexto
131K tokens
Salida máxima
128K
Lanzado el
23 julio 2024
Conocimientos hasta
diciembre 2023
Cadena para la API
meta-llama/Llama-3.1-8B-Instruct
Pesos
abiertos

Precios por proveedor

Proveedor Entrada, $ por 1M Salida, $ por 1M En nuestros datos desde
novita-ai $0,02 $0,05 31 jul. 2026
Abacus.AI $0,02 $0,05 1 ago. 2026
Helicone $0,02 $0,05 31 jul. 2026
Kilo Code $0,02 $0,05 31 jul. 2026
NanoGPT Meta-Llama-3-1-8B-Instruct-FP8 $0,02 $0,03 1 ago. 2026
Nebius Token Factory $0,02 $0,06 1 ago. 2026
Novita AI $0,02 $0,05 31 jul. 2026
inference $0,025 $0,025 31 jul. 2026
DeepInfra $0,03 $0,05 1 ago. 2026
Nscale $0,03 $0,03 31 jul. 2026
regolo-ai $0,05 $0,25 31 jul. 2026
OpenRouter $0,05 $0,08 31 jul. 2026
NanoGPT meta-llama/llama-3.1-8b-instruct $0,054 $0,054 31 jul. 2026
friendliai $0,1 $0,1 1 ago. 2026
OVHCloud AI Endpoints $0,1 $0,1 31 jul. 2026
SambaNova $0,1 $0,2 1 ago. 2026
Cloudflare AI Gateway workers-ai/@cf/meta/llama-3.1-8b-instruct-awq $0,12 $0,27 31 jul. 2026
Hyperbolic $0,12 $0,3 1 ago. 2026
neon $0,15 $0,45 1 ago. 2026
Cloudflare AI Gateway workers-ai/@cf/meta/llama-3.1-8b-instruct-fp8 $0,15 $0,29 31 jul. 2026
Databricks $0,15 $0,45 1 ago. 2026
cloudflare-workers-ai $0,152 $0,287 31 jul. 2026
Cloudflare Workers AI $0,152 $0,287 31 jul. 2026
Perplexity $0,2 $0,2 31 jul. 2026
Pioneer $0,2 $0,2 31 jul. 2026
Amazon Bedrock $0,22 $0,22 2 ago. 2026
Weights & Biases $0,22 $0,22 31 jul. 2026
Cloudflare AI Gateway workers-ai/@cf/meta/llama-3.1-8b-instruct $0,28 $0,83 31 jul. 2026
Microsoft Foundry $0,3 $0,61 1 ago. 2026
OCI Generative AI $0,72 $0,72 31 jul. 2026

Se muestra solo la tarifa base y solo precios por token. Las tarifas por lotes, reducidas o en caché, así como los precios por imagen o por segundo de vídeo, no entran en esta tabla: no se pueden poner en la misma columna que un precio por millón de tokens.

Un mismo proveedor aparece varias veces si vende este modelo con identificadores distintos y a precios distintos, por ejemplo con distinta precisión de pesos. El identificador se indica junto al nombre. Las ofertas idénticas llegadas de dos fuentes con grafías distintas se unen en una sola fila.

La fecha de la última columna es el día en que este precio entró por primera vez en nuestra recogida. El precio puede ser más antiguo: antes de ese día simplemente no lo registrábamos. Desde entonces no ha cambiado; si no, en su lugar habría una fila nueva con una fecha nueva.

Resultados de las mediciones

Conjunto de tareas Resultado Condiciones de ejecución Medido por
Arena Score en inglés 1.217,68 1.213–1.223
Arena Score, programación 1.195,29 1.188–1.203
Arena Score, general 1.186,74 1.183–1.191
Arena Score, consultas largas 1.181,83 1.174–1.190
Arena Score, matemáticas 1.179,26 1.171–1.187
Arena Score en francés 1.176,17 1.147–1.206
Arena Score, consultas difíciles 1.174,99 1.169–1.181
Arena Score, diálogo de varios turnos 1.172,04 1.164–1.180
Arena Score en español 1.168,43 1.141–1.196
Arena Score, seguimiento de instrucciones 1.159,42 1.154–1.165
Arena Score en ruso 1.157,4 1.149–1.166
Arena Score, escritura creativa 1.154,71 1.146–1.163
Arena Score, preguntas expertas 1.143,55 1.131–1.156
MATH, nivel de dificultad cinco 22,88 % · con andamiaje ajustado Epoch evaluations
BALROG — entornos de juego 15,1 % Balrog Leaderboard
Mock AIME 2024–2025 — problemas de olimpiada 2,4 % · con andamiaje ajustado Epoch evaluations
WeirdML — tareas inusuales de aprendizaje automático 1,73 % WeirdML Leaderboard
GPQA Diamond — preguntas de nivel de posgrado 1,26 % · con andamiaje ajustado Epoch evaluations
CritPt — problemas de física 0 %