claude-sonnet-4-5-20250929| Proveedor | Entrada, $ por 1M | Salida, $ por 1M | En nuestros datos desde |
|---|---|---|---|
| qihang-ai | $0,43 | $2,14 | 31 jul. 2026 |
| Jiekou.AI | $2,7 | $13,5 | 31 jul. 2026 |
| NanoGPT | $2,992 | $14,994 | 31 jul. 2026 |
| 302.AI | $3 | $15 | 31 jul. 2026 |
| Abacus.AI | $3 | $15 | 31 jul. 2026 |
Amazon Bedrock
anthropic.claude-sonnet-4-5-20250929-v1:0
|
$3 | $15 | 2 ago. 2026 |
| Anthropic | $3 | $15 | 31 jul. 2026 |
| Helicone | $3 | $15 | 31 jul. 2026 |
| LLM Gateway | $3 | $15 | 31 jul. 2026 |
| Merge Gateway | $3 | $15 | 31 jul. 2026 |
Amazon Bedrock
eu.anthropic.claude-sonnet-4-5-20250929-v1:0
|
$3,3 | $16,5 | 2 ago. 2026 |
Amazon Bedrock
bedrock/us-gov-east-1/anthropic.claude-sonnet-4-5-20250929-v1:0
|
$3,6 | $18 | 2 ago. 2026 |
Se muestra solo la tarifa base y solo precios por token. Las tarifas por lotes, reducidas o en caché, así como los precios por imagen o por segundo de vídeo, no entran en esta tabla: no se pueden poner en la misma columna que un precio por millón de tokens.
Un mismo proveedor aparece varias veces si vende este modelo con identificadores distintos y a precios distintos, por ejemplo con distinta precisión de pesos. El identificador se indica junto al nombre. Las ofertas idénticas llegadas de dos fuentes con grafías distintas se unen en una sola fila.
La fecha de la última columna es el día en que este precio entró por primera vez en nuestra recogida. El precio puede ser más antiguo: antes de ese día simplemente no lo registrábamos. Desde entonces no ha cambiado; si no, en su lugar habría una fila nueva con una fecha nueva.
| Conjunto de tareas | Resultado | Condiciones de ejecución | Medido por |
|---|---|---|---|
| Arena Score, programación | 1.485,37 1.480–1.490 | — | — |
| Arena Score, consultas largas | 1.476,02 1.471–1.481 | — | — |
| Arena Score, preguntas expertas | 1.472,22 1.464–1.481 | — | — |
| Arena Score, diálogo de varios turnos | 1.464,84 1.459–1.471 | — | — |
| Arena Score, consultas difíciles | 1.461,7 1.458–1.465 | — | — |
| Arena Score, seguimiento de instrucciones | 1.458,64 1.454–1.463 | — | — |
| Arena Score en francés | 1.457,25 1.441–1.473 | — | — |
| Arena Score en español | 1.455,76 1.442–1.470 | — | — |
| Arena Score en inglés | 1.451,19 1.447–1.455 | — | — |
| Arena Score, escritura creativa | 1.440,99 1.435–1.447 | — | — |
| Arena Score, general | 1.437,78 1.435–1.441 | — | — |
| Arena Score en ruso | 1.435,09 1.428–1.442 | — | — |
| Arena Score, matemáticas | 1.421,66 1.413–1.430 | — | — |
| Arena Score, desarrollo web | 1.385,13 1.378–1.392 | — | — |
| MATH, nivel de dificultad cinco | 97,73 % | presupuesto de razonamiento: 32K · con andamiaje ajustado | Epoch evaluations |
| Mock AIME 2024–2025 — problemas de olimpiada | 77,76 % | presupuesto de razonamiento: 59K · con andamiaje ajustado | Epoch evaluations |
| GPQA Diamond — preguntas de nivel de posgrado | 76,43 % | presupuesto de razonamiento: 16K · con andamiaje ajustado | Epoch evaluations |
| SWE-bench Verified — corrección de errores en repositorios | 71,28 % | · con andamiaje ajustado | Epoch evaluations |
| ARC-AGI — generalización a patrones nuevos | 63,67 % | presupuesto de razonamiento: 32K · con andamiaje ajustado | — |
| OSWorld — trabajo en un sistema operativo, primera versión | 62,9 % | · con andamiaje ajustado | OS World Website |
| Cybench — tareas de ciberseguridad | 60 % | · con andamiaje ajustado | Opus 4.5 System Card autoinformado |
| DeepResearch Bench — investigación profunda | 52,6 % | presupuesto de razonamiento: 2K | DeepResearchBench Leaderboard |
| WeirdML — tareas inusuales de aprendizaje automático | 47,71 % | presupuesto de razonamiento: 16K | WeirdML Leaderboard |
| Terminal-Bench — trabajo en la línea de comandos | 46,5 % | · con andamiaje ajustado | Terminal-Bench v2 Leaderboard |
| SimpleBench — preguntas con trampa | 45,16 % | presupuesto de razonamiento: 12K | SimpleBench Leaderboard |
| GDPval — tareas de profesiones reales | 42,5 % | — | — |
| FrontierMath, niveles 1–3 | 23,86 % | presupuesto de razonamiento: 32K | Epoch evaluations |
| SimpleQA Verified — exactitud factual | 23,6 % | presupuesto de razonamiento: 59K | Epoch evaluations |
| GSO-Bench — optimización de código | 14,71 % | — | GSO Leaderboard |
| ARC-AGI-2 | 13,61 % | presupuesto de razonamiento: 32K | — |
| Humanity’s Last Exam — preguntas de nivel experto | 9,37 % | — | — |
| Problemas de ajedrez | 7,41 % | presupuesto de razonamiento: 32K | Epoch evaluations |
| FrontierMath, nivel 4 — problemas de investigación | 2,44 % | presupuesto de razonamiento: 32K | Epoch evaluations |
| Remote Labor Index — encargos de una plataforma de freelance | 2,08 % | — | — |
| CritPt — problemas de física | 1,14 % | — | — |