Alibaba (Qwen)

Qwen2.5 72B Instruct

Tipo
modelo de lenguaje
Contexto
131K tokens
Salida máxima
4K
Lanzado el
18 septiembre 2024
Cadena para la API
Qwen/Qwen2.5-72B-Instruct
Pesos
abiertos

Precios por proveedor

Proveedor Entrada, $ por 1M Salida, $ por 1M En nuestros datos desde
Abacus.AI $0,11 $0,38 31 jul. 2026
DeepInfra $0,12 $0,39 31 jul. 2026
Hyperbolic $0,12 $0,3 31 jul. 2026
Nebius Token Factory $0,13 $0,4 31 jul. 2026
alibaba-cn $0,574 $1,721 31 jul. 2026
siliconflow-cn $0,59 $0,59 31 jul. 2026
SiliconFlow $0,59 $0,59 31 jul. 2026
Fireworks AI $0,9 $0,9 1 ago. 2026
Alibaba (Qwen) $1,4 $5,6 31 jul. 2026

Se muestra solo la tarifa base y solo precios por token. Las tarifas por lotes, reducidas o en caché, así como los precios por imagen o por segundo de vídeo, no entran en esta tabla: no se pueden poner en la misma columna que un precio por millón de tokens.

La fecha de la última columna es el día en que este precio entró por primera vez en nuestra recogida. El precio puede ser más antiguo: antes de ese día simplemente no lo registrábamos. Desde entonces no ha cambiado; si no, en su lugar habría una fila nueva con una fecha nueva.

Resultados de las mediciones

Conjunto de tareas Resultado Condiciones de ejecución Medido por
Arena Score, programación 1.292,93 1.285–1.301
Arena Score en inglés 1.282,77 1.278–1.288
Arena Score, matemáticas 1.282,63 1.274–1.291
Arena Score, consultas largas 1.281,92 1.274–1.290
Arena Score en francés 1.278,91 1.246–1.312
Arena Score, diálogo de varios turnos 1.271,85 1.264–1.280
Arena Score, consultas difíciles 1.270,92 1.265–1.277
Arena Score, general 1.269,18 1.265–1.273
Arena Score en ruso 1.262,99 1.254–1.272
Arena Score, seguimiento de instrucciones 1.254,53 1.249–1.260
Arena Score en español 1.254,22 1.223–1.285
Arena Score, preguntas expertas 1.244,85 1.233–1.257
Arena Score, escritura creativa 1.221,67 1.213–1.230
MATH, nivel de dificultad cinco 63,17 % · con andamiaje ajustado Epoch evaluations
GPQA Diamond — preguntas de nivel de posgrado 32,2 % · con andamiaje ajustado Epoch evaluations
BALROG — entornos de juego 16,2 % Balrog Leaderboard
WeirdML — tareas inusuales de aprendizaje automático 15,97 % WeirdML Leaderboard
Mock AIME 2024–2025 — problemas de olimpiada 7,96 % · con andamiaje ajustado Epoch evaluations
The Agent Company — tareas de trabajo en un entorno de oficina 5,7 % TheAgentCompany experiment results github