Anthropic

Claude Sonnet 4.5

Tipo
modelo de lenguaje
Contexto
1.000K tokens
Salida máxima
64K
Lanzado el
29 septiembre 2025
Conocimientos hasta
julio 2025
Cadena para la API
claude-sonnet-4-5-20250929

Precios por proveedor

Proveedor Entrada, $ por 1M Salida, $ por 1M En nuestros datos desde
qihang-ai $0,43 $2,14 31 jul. 2026
Jiekou.AI $2,7 $13,5 31 jul. 2026
NanoGPT $2,992 $14,994 31 jul. 2026
302.AI $3 $15 31 jul. 2026
Abacus.AI $3 $15 31 jul. 2026
Amazon Bedrock anthropic.claude-sonnet-4-5-20250929-v1:0 $3 $15 2 ago. 2026
Anthropic $3 $15 31 jul. 2026
Helicone $3 $15 31 jul. 2026
LLM Gateway $3 $15 31 jul. 2026
Merge Gateway $3 $15 31 jul. 2026
Amazon Bedrock eu.anthropic.claude-sonnet-4-5-20250929-v1:0 $3,3 $16,5 2 ago. 2026
Amazon Bedrock bedrock/us-gov-east-1/anthropic.claude-sonnet-4-5-20250929-v1:0 $3,6 $18 2 ago. 2026

Se muestra solo la tarifa base y solo precios por token. Las tarifas por lotes, reducidas o en caché, así como los precios por imagen o por segundo de vídeo, no entran en esta tabla: no se pueden poner en la misma columna que un precio por millón de tokens.

Un mismo proveedor aparece varias veces si vende este modelo con identificadores distintos y a precios distintos, por ejemplo con distinta precisión de pesos. El identificador se indica junto al nombre. Las ofertas idénticas llegadas de dos fuentes con grafías distintas se unen en una sola fila.

La fecha de la última columna es el día en que este precio entró por primera vez en nuestra recogida. El precio puede ser más antiguo: antes de ese día simplemente no lo registrábamos. Desde entonces no ha cambiado; si no, en su lugar habría una fila nueva con una fecha nueva.

Resultados de las mediciones

Conjunto de tareas Resultado Condiciones de ejecución Medido por
Arena Score, programación 1.485,37 1.480–1.490
Arena Score, consultas largas 1.476,02 1.471–1.481
Arena Score, preguntas expertas 1.472,22 1.464–1.481
Arena Score, diálogo de varios turnos 1.464,84 1.459–1.471
Arena Score, consultas difíciles 1.461,7 1.458–1.465
Arena Score, seguimiento de instrucciones 1.458,64 1.454–1.463
Arena Score en francés 1.457,25 1.441–1.473
Arena Score en español 1.455,76 1.442–1.470
Arena Score en inglés 1.451,19 1.447–1.455
Arena Score, escritura creativa 1.440,99 1.435–1.447
Arena Score, general 1.437,78 1.435–1.441
Arena Score en ruso 1.435,09 1.428–1.442
Arena Score, matemáticas 1.421,66 1.413–1.430
Arena Score, desarrollo web 1.385,13 1.378–1.392
MATH, nivel de dificultad cinco 97,73 % presupuesto de razonamiento: 32K · con andamiaje ajustado Epoch evaluations
Mock AIME 2024–2025 — problemas de olimpiada 77,76 % presupuesto de razonamiento: 59K · con andamiaje ajustado Epoch evaluations
GPQA Diamond — preguntas de nivel de posgrado 76,43 % presupuesto de razonamiento: 16K · con andamiaje ajustado Epoch evaluations
SWE-bench Verified — corrección de errores en repositorios 71,28 % · con andamiaje ajustado Epoch evaluations
ARC-AGI — generalización a patrones nuevos 63,67 % presupuesto de razonamiento: 32K · con andamiaje ajustado
OSWorld — trabajo en un sistema operativo, primera versión 62,9 % · con andamiaje ajustado OS World Website
Cybench — tareas de ciberseguridad 60 % · con andamiaje ajustado Opus 4.5 System Card autoinformado
DeepResearch Bench — investigación profunda 52,6 % presupuesto de razonamiento: 2K DeepResearchBench Leaderboard
WeirdML — tareas inusuales de aprendizaje automático 47,71 % presupuesto de razonamiento: 16K WeirdML Leaderboard
Terminal-Bench — trabajo en la línea de comandos 46,5 % · con andamiaje ajustado Terminal-Bench v2 Leaderboard
SimpleBench — preguntas con trampa 45,16 % presupuesto de razonamiento: 12K SimpleBench Leaderboard
GDPval — tareas de profesiones reales 42,5 %
FrontierMath, niveles 1–3 23,86 % presupuesto de razonamiento: 32K Epoch evaluations
SimpleQA Verified — exactitud factual 23,6 % presupuesto de razonamiento: 59K Epoch evaluations
GSO-Bench — optimización de código 14,71 % GSO Leaderboard
ARC-AGI-2 13,61 % presupuesto de razonamiento: 32K
Humanity’s Last Exam — preguntas de nivel experto 9,37 %
Problemas de ajedrez 7,41 % presupuesto de razonamiento: 32K Epoch evaluations
FrontierMath, nivel 4 — problemas de investigación 2,44 % presupuesto de razonamiento: 32K Epoch evaluations
Remote Labor Index — encargos de una plataforma de freelance 2,08 %
CritPt — problemas de física 1,14 %