Alibaba (Qwen)

Qwen3 235B A22B Thinking-2507

Tipo
modelo de lenguaje
Contexto
262K tokens
Salida máxima
262K
Lanzado el
25 julio 2025
Conocimientos hasta
junio 2025
Cadena para la API
Qwen/Qwen3-235B-A22B-Thinking-2507
Pesos
abiertos

El proveedor ha declarado obsoleto este modelo. Todavía responde, pero es mejor no empezar proyectos nuevos con él.

Precios por proveedor

Proveedor Entrada, $ por 1M Salida, $ por 1M En nuestros datos desde
Weights & Biases $0,1 $0,1 31 jul. 2026
Kilo Code $0,11 $0,6 31 jul. 2026
OpenRouter openrouter/qwen/qwen3-235b-a22b-thinking-2507 $0,11 $0,6 31 jul. 2026
io.net $0,11 $0,6 31 jul. 2026
siliconflow-cn $0,13 $0,6 31 jul. 2026
SiliconFlow $0,13 $0,6 31 jul. 2026
submodel $0,2 $0,6 31 jul. 2026
Fireworks AI $0,22 $0,88 31 jul. 2026
OpenRouter qwen/qwen3-235b-a22b-thinking-2507 $0,23 $2,3 1 ago. 2026
novita-ai $0,3 $3 31 jul. 2026
DeepInfra $0,3 $2,9 31 jul. 2026
Hugging Face $0,3 $3 31 jul. 2026
Jiekou.AI $0,3 $3 31 jul. 2026
LLM Gateway $0,3 $3 31 jul. 2026
NanoGPT $0,3 $0,5 31 jul. 2026
Novita AI $0,3 $3 31 jul. 2026
Venice AI $0,45 $3,5 31 jul. 2026
Together AI $0,65 $3 31 jul. 2026

Se muestra solo la tarifa base y solo precios por token. Las tarifas por lotes, reducidas o en caché, así como los precios por imagen o por segundo de vídeo, no entran en esta tabla: no se pueden poner en la misma columna que un precio por millón de tokens.

Un mismo proveedor aparece varias veces si vende este modelo con identificadores distintos y a precios distintos, por ejemplo con distinta precisión de pesos. El identificador se indica junto al nombre. Las ofertas idénticas llegadas de dos fuentes con grafías distintas se unen en una sola fila.

La fecha de la última columna es el día en que este precio entró por primera vez en nuestra recogida. El precio puede ser más antiguo: antes de ese día simplemente no lo registrábamos. Desde entonces no ha cambiado; si no, en su lugar habría una fila nueva con una fecha nueva.

Resultados de las mediciones

Conjunto de tareas Resultado Condiciones de ejecución Medido por
Arena Score, preguntas expertas 1.456,35 1.428–1.485
Arena Score en inglés 1.427,11 1.418–1.436
Arena Score, programación 1.423,79 1.409–1.438
Arena Score, consultas difíciles 1.415,65 1.406–1.425
Arena Score, general 1.413,74 1.407–1.420
Arena Score, matemáticas 1.412,99 1.389–1.437
Arena Score, diálogo de varios turnos 1.405,77 1.390–1.421
Arena Score en ruso 1.398,06 1.372–1.425
Arena Score, consultas largas 1.397,5 1.383–1.412
Arena Score en español 1.390,57 1.345–1.436
Arena Score, escritura creativa 1.386,32 1.368–1.404
Arena Score, seguimiento de instrucciones 1.384,95 1.373–1.397
Mock AIME 2024–2025 — problemas de olimpiada 86,65 % · con andamiaje ajustado Epoch evaluations
Escritura creativa (evaluación de Lech Mazur) 82,4 % lechmazur/writing Github repository
Fiction.LiveBench — retención de contexto largo 75 % Fiction.live leaderboard
GPQA Diamond — preguntas de nivel de posgrado 73,4 % · con andamiaje ajustado Epoch evaluations
SimpleQA Verified — exactitud factual 50,1 % Epoch evaluations
WeirdML — tareas inusuales de aprendizaje automático 41,04 % WeirdML Leaderboard
Problemas de ajedrez 7,41 % Epoch evaluations
CritPt — problemas de física 0 %