Proveedor de API

Weights & Biases

Qué vende este proveedor y a qué precio. El precio pertenece a la oferta, no al modelo: con otro proveedor el mismo modelo puede costar varias veces más o menos.

32 modelos con precio
de terceros modelos
bases agregadas fuente del precio

Modelos y precios

Modelo Desarrollador Entrada, $/1M Salida, $/1M Combinada, $/1M
Kimi K3 Moonshot AI (Kimi) $3 $15 $6
GLM 5.2 Zhipu AI / Z.ai $0,76 $2,42 $1,18
Kimi K2.7 Code Moonshot AI (Kimi) $0,71 $3,5 $1,41
MiniMax M3 MiniMax $0,23 $0,96 $0,41
Nemotron 3 Ultra 550B A55B NVIDIA $0,75 $2,75 $1,25
Mellum2 12B A2.5B JetBrains $0,05 $0,1 $0,06
Granite 4.1 8B IBM $0,05 $0,1 $0,06
DeepSeek V4 Flash DeepSeek $0,14 $0,28 $0,18
DeepSeek V4 Pro DeepSeek $1,74 $3,48 $2,18
Qwen3.6 27B Alibaba (Qwen) $0,6 $3,6 $1,35
Kimi K2.6 Moonshot AI (Kimi) $0,65 $3,41 $1,34
Qwen3.6 35B-A3B Alibaba (Qwen) $0,25 $1,25 $0,5
Gemma 4 31B Google DeepMind $0,1 $0,34 $0,16
GLM 5.1 Zhipu AI / Z.ai $1,4 $4,4 $2,15
Nemotron 3 Super NVIDIA $0,2 $0,8 $0,35
Qwen3.5 27B obsoleto Alibaba (Qwen) $0,39 $3,12 $1,07
Qwen3.5 35B A3B Alibaba (Qwen) $0,25 $1,25 $0,5
MiniMax M2.5 y otros 1 MiniMax $0,3 $1,2 $0,53
Kimi K2.5 y otros 1 Moonshot AI (Kimi) $0,6 $3 $1,2
DeepSeek V3.1 DeepSeek $0,55 $1,65 $0,83
GPT OSS 120B OpenAI $0,03 $0,17 $0,07
GPT OSS 20B OpenAI $0,03 $0,13 $0,06
Qwen3 30B A3B Instruct 2507 Alibaba (Qwen) $0,1 $0,3 $0,15
Qwen3 235B A22B Thinking-2507 obsoleto Alibaba (Qwen) $0,1 $0,1 $0,1
Qwen3 Coder 480B A35B Alibaba (Qwen) $1 $1,5 $1,13
Qwen3 235B A22B Instruct 2507 Alibaba (Qwen) $0,1 $0,1 $0,1
Kimi K2 Instruct Moonshot AI (Kimi) $0,6 $2,5 $1,08
Qwen3 14B Instruct Alibaba (Qwen) $0,05 $0,22 $0,09
Phi 4 Mini 3.8B obsoleto Microsoft $0,08 $0,35 $0,15
Llama 3.3 70B Instruct Meta AI $0,71 $0,71 $0,71
Llama 3.1 70B Meta AI $0,8 $0,8 $0,8
Llama 3.1 8B Meta AI $0,22 $0,22 $0,22

Son los precios de este proveedor, no los mejores del mercado: el mismo modelo puede costar distinto con otro proveedor. El precio combinado sigue el esquema de tres tokens de entrada por uno de salida, la forma de comparar modelos cuya salida cuesta varias veces más que la entrada. Solo se considera la tarifa base por token, sin descuentos ni tarifas batch; la entrada y la salida salen de una misma lista de precios, no de dos mínimos distintos.