Anthropic

Claude Sonnet 3.7

Tipo
modelo de lenguaje
Contexto
200K tokens
Salida máxima
64K
Lanzado el
19 febrero 2025
Conocimientos hasta
octubre 2024
Cadena para la API
claude-3-7-sonnet-20250219

Precios por proveedor

Proveedor Entrada, $ por 1M Salida, $ por 1M En nuestros datos desde
Abacus.AI $3 $15 1 ago. 2026
Amazon Bedrock anthropic.claude-3-7-sonnet-20250219-v1:0 $3 $15 2 ago. 2026
Anthropic $3 $15 1 ago. 2026
Merge Gateway $3 $15 1 ago. 2026
Amazon Bedrock bedrock/us-gov-west-1/anthropic.claude-3-7-sonnet-20250219-v1:0 $3,6 $18 2 ago. 2026

Se muestra solo la tarifa base y solo precios por token. Las tarifas por lotes, reducidas o en caché, así como los precios por imagen o por segundo de vídeo, no entran en esta tabla: no se pueden poner en la misma columna que un precio por millón de tokens.

Un mismo proveedor aparece varias veces si vende este modelo con identificadores distintos y a precios distintos, por ejemplo con distinta precisión de pesos. El identificador se indica junto al nombre. Las ofertas idénticas llegadas de dos fuentes con grafías distintas se unen en una sola fila.

La fecha de la última columna es el día en que este precio entró por primera vez en nuestra recogida. El precio puede ser más antiguo: antes de ese día simplemente no lo registrábamos. Desde entonces no ha cambiado; si no, en su lugar habría una fila nueva con una fecha nueva.

Resultados de las mediciones

Conjunto de tareas Resultado Condiciones de ejecución Medido por
Arena Score, consultas largas 1.354,73 1.347–1.362
Arena Score, programación 1.338,88 1.331–1.346
Arena Score, diálogo de varios turnos 1.338,32 1.331–1.346
Arena Score, seguimiento de instrucciones 1.325,19 1.319–1.331
Arena Score, matemáticas 1.318,41 1.308–1.328
Arena Score, escritura creativa 1.316,76 1.309–1.325
Arena Score, consultas difíciles 1.315,07 1.309–1.321
Arena Score en inglés 1.311,02 1.306–1.316
Arena Score en ruso 1.309,67 1.299–1.320
Arena Score en francés 1.302,75 1.275–1.330
Arena Score, preguntas expertas 1.300,32 1.287–1.313
Arena Score, general 1.299,32 1.295–1.303
Arena Score en español 1.289,11 1.263–1.315
Arena Score, reconocimiento de texto en imagen 1.158,07 1.139–1.177
Arena Score, comprensión de esquemas 1.151,01 1.119–1.183
Arena Score, trabajo con imágenes 1.151 1.142–1.160
MATH, nivel de dificultad cinco 91,16 % presupuesto de razonamiento: 64K · con andamiaje ajustado Epoch evaluations
Fiction.LiveBench — retención de contexto largo 83,3 % Fiction.live leaderboard
Escritura creativa (evaluación de Lech Mazur) 81,1 % presupuesto de razonamiento: 16K lechmazur/writing Github repository
GPQA Diamond — preguntas de nivel de posgrado 72,98 % presupuesto de razonamiento: 64K · con andamiaje ajustado Epoch evaluations
GeoBench — localización de un lugar a partir de una foto 68 % presupuesto de razonamiento: 15K GeoBench leaderboard
Aider Polyglot — ediciones de código en seis lenguajes 64,9 % · con andamiaje ajustado Aider LLM Leaderboards
SWE-bench Verified — corrección de errores en repositorios 60,95 % · con andamiaje ajustado Epoch evaluations
Mock AIME 2024–2025 — problemas de olimpiada 57,74 % presupuesto de razonamiento: 64K · con andamiaje ajustado Epoch evaluations
CadEval — construcción de modelos CAD con código 54 % CadEval Dashboard
DeepResearch Bench — investigación profunda 43,6 % presupuesto de razonamiento: 2K DeepResearchBench Leaderboard
OSWorld — trabajo en un sistema operativo, primera versión 35,8 % · con andamiaje ajustado OS World Website
SimpleBench — preguntas con trampa 35,68 % presupuesto de razonamiento: 12K SimpleBench Leaderboard
The Agent Company — tareas de trabajo en un entorno de oficina 30,9 % TheAgentCompany leaderboard
ARC-AGI — generalización a patrones nuevos 28,6 % presupuesto de razonamiento: 16K · con andamiaje ajustado ARC Prize Leaderboard
Cybench — tareas de ciberseguridad 20 % · con andamiaje ajustado Cybench leaderboard
GSO-Bench — optimización de código 3,8 % GSO Leaderboard
Humanity’s Last Exam — preguntas de nivel experto 3,4 %
ARC-AGI-2 0,9 % presupuesto de razonamiento: 8K