Skip to content
Volver al índice
04ProgramaciónPuntuación provisional

Claude Sonnet 5

Claude Sonnet 5

El caballo de batalla del código: cerca de la cima en tareas reales de software, a un precio viable.

Actualizado el

Claude Sonnet 5 preview

La reseña

Sonnet 5 es sobre lo que la mayoría de los agentes de código realmente funcionan, y la brecha de benchmarks con el nivel superior es menor que la brecha de precio. Aplica parches que compilan, sigue las convenciones existentes de un repositorio y aguanta las largas cadenas de llamadas a herramientas que generan los frameworks de agentes. Anthropic lo ha estado descontando, así que comprueba la tarifa actual antes de construir un presupuesto sobre él.

Dónde destaca

  • Uno de los modelos más fuertes en tareas verificadas de ingeniería de software
  • Precio pensado para ejecutarse continuamente, no de forma ocasional
  • Llamadas a herramientas fiables en cadenas largas, que es lo que hace fallar a los modelos más débiles

Conviene saber antes

  • El precio actual es promocional y sube en una fecha publicada
  • Cede terreno real a Opus en el razonamiento arquitectónico más exigente

Puntuación del índice

87.9

Provisional. Esta puntuación se basa en las capacidades públicas del producto, no en la reconstrucción con un único prompt que pasaron las entradas completamente revisadas. Trátala como una estimación, no como un veredicto.

Craft89
Speed88
Control89
Value84
Clasificación
04 de 53
Crea para
LLMs
Categoría
Programación
Resultado
Texto, código y llamadas a herramientas a través de una API
Precio
Solo de pago
Ideal para
Agentes de código e integraciones de editores a escala

Las puntuaciones son nuestro propio criterio editorial, ponderadas calidad 55, velocidad 10, control 15 y valor 20.