Claude Sonnet 5 ya disponible: rendimiento casi-Opus, costo elevado en tokens
- Qué pasó
- Anthropic launched Claude Sonnet 5 on June 30 — near-Opus 4.8 agentic performance at Sonnet pricing, now the default model for all plans.
- Por qué importa
- A new tokenizer produces ~30% more tokens for English input, making the headline price misleading — effective costs are up even though per-token rates are flat. temperature, top_p, and top_k are gone.
- Qué hacer
- Upgrade from Sonnet 4.6: yes, the capability jump is worth it. Budget for agent workloads: factor in ~30% more tokens. Migrate any code relying on temperature/top_p/top_k sampler parameters.
Anthropic lanzó Claude Sonnet 5 el 30 de junio, convirtiéndolo en el modelo predeterminado en todos los planes Free y Pro. Nuestro veredicto: recommended. El salto en capacidad agéntica respecto a Claude 4 Sonnet es inequívoco — termina tareas complejas de múltiples pasos en las que su predecesor se estancaba, revisa su propia salida sin necesidad de indicación y cierra la brecha con Opus 4.8 hasta un margen casi imperceptible. Pero presupuesta un aumento de ~30% en el conteo de tokens por el nuevo tokenizador, y migra cualquier código que dependa de temperature, top_p o top_k — esos parámetros desaparecieron.
Qué ocurrió
Claude Sonnet 5 reduce la brecha de rendimiento con Opus 4.8 al margen más estrecho hasta ahora. En niveles de esfuerzo medios, ofrece la misma calidad de salida por menos dinero. En configuraciones de mayor esfuerzo — las que usan los agentes para trabajo sostenido de múltiples pasos — puede igualar a Opus 4.8 en búsqueda agéntica (BrowseComp: 84.7%) y uso de ordenador (OSWorld-Verified: 81.2%).
El número destacado es un salto de 13.4 puntos en Terminal-Bench 2.1 frente a Claude 4 Sonnet. Los socios de acceso anticipado confirman los benchmarks: Stripe lo calificó como "una capa de ejecución sólida para trabajo de ingeniería de software de múltiples pasos". El cofundador de Lovable reportó "misma calidad de salida, menos pasos para llegar".
La letra pequeña, revelada honestamente por Anthropic en una nota al pie: un nuevo tokenizador asigna la misma entrada a aproximadamente 1.0-1.35x más tokens. El precio por token parece estable — $2/$10 introductorio (hasta el 31 de agosto), luego $3/$15 estándar — pero cuando una llamada que antes usaba 5,000 tokens ahora necesita 7,000 tokens, tu factura sube un 40% aunque la tarifa no haya cambiado.
En una ruptura limpia, Sonnet 5 ya no admite temperature, top_p ni top_k en la API o Workbench. Anthropic ha estado migrando hacia un control basado en esfuerzo (low/medium/high/extra-high) en lugar de los parámetros de muestreo tradicionales.
Por qué importa
Este es el modelo sobre el que Anthropic quiere que las empresas ejecuten agentes. Es el caballo de batalla de la clase Sonnet — lo suficientemente cerca de Opus 4.8 como para que muchas cargas de trabajo no necesiten el nivel más caro, y lo suficientemente barato como para mantener los presupuestos de agentes bajo control.
El giro del tokenizador no es un factor decisivo, pero sí una trampa presupuestaria para equipos que escalan cargas de trabajo de agentes de forma agresiva. Las tarifas por token ya no son la métrica correcta — cuenta los tokens por tarea antes y después de la migración.
Qué cambia para ti
Si usas Claude 4 Sonnet, actualiza — el salto de capacidad es real y el precio introductorio lo hace neutral en costo hasta agosto. Si ejecutas cargas de trabajo de agentes a escala, recalcula tus presupuestos de tokens antes de cambiar. Si tus llamadas a la API pasan temperature, top_p o top_k, elimínalos — esos parámetros no funcionan en Sonnet 5.
Preguntas frecuentes
P: ¿Por qué importa el cambio de tokenizador si el precio por token se mantuvo igual? Un nuevo tokenizador divide el texto en más piezas — aproximadamente 30% más para texto en inglés. Tu costo por llamada es conteo de tokens × tarifa por token, así que si el conteo de tokens sube un 30%, tu factura sube un 30% aunque la tarifa parezca no haber cambiado.
P: ¿Qué reemplaza a temperature, top_p y top_k? El control basado en esfuerzo de Anthropic: configura el pensamiento con niveles de esfuerzo (low/medium/high/extra-high) en lugar de los parámetros de muestreo tradicionales.
P: ¿Conviene fijar el precio introductorio o esperar a las tarifas estándar de septiembre? Fíjalo ahora. El precio introductorio de $2/$10 por millón de tokens ahorra aproximadamente un 33% frente a las tarifas estándar de $3/$15.
Qué hacer
- 1 Audit agent token budgets: the new tokenizer adds ~30% tokens for English input — your per-call costs will rise even if per-token rates look flat
- 2 Remove temperature/top_p/top_k from API calls — these parameters are no longer supported on Sonnet 5
- 3 Lock in introductory pricing: $2/$10 through Aug 31, then $3/$15 standard — plan migration timelines accordingly
Herramientas y modelos afectados
No vuelvas a tener que ponerte al día
El resumen semanal — solo cambios de veredicto y acciones urgentes. Sin relleno.