La semana en que el veredicto de programación cambió
Cambiamos nuestra recomendación de programación agéntica por primera vez en cuatro meses, OpenAI fijó una fecha límite que no puedes ignorar, y Google igualó discretamente una capacidad que todos decían que era un foso. Nueve cosas importaron esta semana. Dos cambian cómo deberías trabajar.
47 announcements scanned · 9 mattered · 2 verdicts changed
Veredictos cambiados
Best for agentic coding
31% fewer dead-end loops on long-horizon tasks in our pipeline runs. Opus 4.8 remains our pick for review-heavy work — this is a split, not a dethroning.
Best budget model for agents
Native tool use landed and held up in our reliability runs — at half the per-call cost.
Actúa antes del próximo número
GPT-4 Turbo shutdown — July 1, three weeks out
Migrate to GPT-4.1. Drop-in for most uses; function-calling payloads need one change.
Detalles y pasosEn nuestro radar
Mistral's agent runtime beta — Flips our EU-hosting verdict if latency claims hold. Testing now, verdict next issue.
Cursor pricing change — Per-seat → usage-based. Could change our team-tooling math for small teams.
Descartado
- MCP hits 100M downloads — milestone, no decision attached.
- Two "GPT-5.5 next month" rumors — we don't publish rumors.
- 14 new tool launches that duplicate existing picks without beating them.
Our take: La carrera de los modelos de programación ha dejado de ser sobre capacidad bruta y ha pasado a ser sobre quién falla menos en la tercera hora de una tarea. Por eso el cambio de veredicto de esta semana importa más que cualquier lanzamiento desde febrero.
— Neomanex, from our own production runs
Recibe el número 13
Los cambios de veredicto y fechas clave de la próxima semana, en tu bandeja de entrada.