SÁBADO, 25 DE JULIO DE 2026
Anthropic lanza Claude Opus 5 con dial de effort y 96% en SWE-bench Verified al mismo precio que 4.8
Opus 5 estrena el parámetro output_config.effort (low/medium/high/xhigh/max), que ya no controla solo el pensamiento sino también cuántas llamadas a herramientas hace el agente. Marca 96,0% en SWE-bench Verified y 79,2% en SWE-bench Pro con 1M de contexto y computer use, al mismo $5/$25 que 4.8, y ya es el modelo por defecto en Claude Code v2.1.219.
5 MIN LECTURAMCP publica el release candidate 2026-07-28: protocolo sin sesión y Tasks como extensión
La nueva spec deja atrás las sesiones con estado, mueve Tasks a extensión y endurece OAuth. Si tienes un MCP server en producción, tienes hasta el 28 de julio para migrar a tools/call con task handle y clientes que cachean tools/list.
Cursor Router: clasifica cada petición y la enruta al modelo más barato con calidad frontier
Analiza query, contexto y complejidad de cada petición para escoger modelo antes de que corra. En pruebas A/B declaran 30-50% menos coste con calidad frontier; disponible para Teams y Enterprise en tres modos: Intelligence, Balance y Cost.
Grok STT 1.0 aterriza en OpenRouter con 5% de error en llamadas por 0,10 $/hora
xAI abre su modelo de transcripción con 25 idiomas, diarización y timestamps por palabra: 5% de error en llamadas telefónicas (contra 12% de ElevenLabs) por 0,10 $/hora en batch y 0,20 $/hora en streaming, sin infraestructura propia.
Guía oficial de Anthropic para calibrar effort y verbosity en Claude Opus 5
La documentación explica por qué no puedes reutilizar los settings de 4.8: Opus 5 respeta más los niveles bajos y el effort deja de acortar la respuesta (para eso hay que pedir length en la instrucción). Incluye tabla de effort recomendado por caso de uso.
Ollama v0.32.1 estabiliza descargas y añade soporte para GPUs Nvidia B200
Añade compute capability 10.0 al backend CUDA v12 para que las B200 funcionen con drivers previos a CUDA v13, arregla descargas colgadas antes de recibir datos y traduce metadata GGUF antigua para no romper modelos ya bajados.
Nvidia, Microsoft, Meta y Hugging Face firman carta a Washington por los pesos abiertos
Coalición de más de 20 empresas, con el primer post en X de Jensen Huang, defiende que EEUU necesita 'frontier closed y frontier open'. Afecta a la política que puede vetar Kimi K3 o DeepSeek en el próximo ciclo regulatorio.
Una técnica, prompt o comando aplicable hoy. Cópialo, pruébalo en tu stack en menos de 5 minutos y reenvíalo a un colega si te resulta útil. Ejemplos típicos: un prompt para evals, un patrón de agente, un comando que recorta tokens o un truco de RAG.
Bajar el coste de subagentes con effort=low en Claude Opus 5
# El nuevo parametro output_config.effort de Opus 5 (24-jul-2026) # controla tokens de razonamiento Y cuantas tool calls hace el agente. # Anthropic recomienda `low` para subagentes de clasificacion o lookup # y `high` (por defecto) o `xhigh` para el orquestador principal. from anthropic import Anthropic client = Anthropic() # Subagente barato: clasificar la intencion del usuario triage = client.messages.create( model="claude-opus-5", max_tokens=512, messages=[{"role": "user", "content": user_query}], output_config={"effort": "low"}, # menos tool calls, respuesta directa ) # Orquestador: razona sobre el triage y coordina la tarea larga plan = client.messages.create( model="claude-opus-5", max_tokens=8192, messages=[...], output_config={"effort": "xhigh"}, # tareas agenticas de horas )
- 01 GitHub MCP Server ya soporta la próxima especificación stateless de MCP
- 02 Anthropic retira el modo Fast de Claude Opus 4.7 al lanzar Opus 5
- 03 Claude Code v2.1.219 pone claude-opus-5 como modelo por defecto
- 04 QwenPaw v2.0.1 estrena plugins Oh-My-Paw y memoria ReMe
- 05 Kimi K3 promete abrir los pesos del modelo de 2,8T el 27 de julio
Cierre
El dial de effort de Opus 5, el Cursor Router y el nuevo MCP 2026-07-28 sin sesión dibujan el mismo patrón: la elección de modelo y el gasto de tokens dejan de ser una decisión global del proyecto y pasan a decidirse por petición. Para el ingeniero que envía a producción, el reto ya no es escoger un modelo sino calibrar effort, ruta y stateful/stateless por endpoint. Quien no rehaga sus evals contra Opus 5 antes del 28 va a pagar Fable 5 sin motivo.
Iván consulta sobre todo esto
Ingeniero IA con 3 años llevando LLMs a producción y más de 15 construyendo producto para Openbank, Inditex e Iberia. Agentes autónomos, RAG auditable: del piloto al despliegue real.