DOMINGO, 26 DE JULIO DE 2026
Anthropic lanza Claude Opus 5: cerca de Fable 5 a la mitad de precio y dos betas nuevas para agentes en producción
Opus 5 llega a $5/$25 por millón (la mitad que Fable 5), Fast mode 2,5× y 1M de contexto por defecto. Bate a Fable 5 en 7 de 12 benchmarks (Frontier-Bench 43,3% vs 33,7%, y SOTA en OSWorld 2.0) y estrena dos betas que cambian la economía del agente en prod: cambiar tools sin invalidar la caché y fallback automático en el clasificador de seguridad.
5 MIN LECTURAMid-conversation tool changes y server-side fallback: dos betas de la Claude API que redibujan el ciclo del agente
Anthropic activa dos cabeceras beta con Opus 5: mid-conversation-tool-changes-2026-07-01 deja añadir o quitar tools entre turnos sin romper el prompt cache, y server-side-fallback-2026-07-01 enruta las peticiones bloqueadas por safety a un modelo alternativo en vez de fallar. Menos tokens perdidos por reenvío de tools y menos 5xx en producción.
Kimi K3 libera mañana los pesos abiertos: 2,8T parámetros MoE para autoalojar la frontera china
Moonshot AI publica los safetensors nativos MXFP4 (~594 GB, ~1,4 TB descomprimidos) el 27 de julio 00:00 UTC bajo huggingface.co/moonshotai. Autoalojarlo elimina el riesgo de exfiltración de datos que la API en Pekín nunca podrá garantizar y baja el suelo de coste para RAG y agentes de código.
Claude Code 2.1.219 pone Opus 5 por defecto y estrena strictAllowlist y el hook DirectoryAdded
El release del 24 de julio deja claude-opus-5 como Opus por defecto, añade sandbox.network.strictAllowlist para denegar hosts no permitidos sin preguntar y el hook DirectoryAdded que dispara tras /add-dir o register_repo_root. Suma subagentes anidados hasta profundidad 3 y errores HTTP explícitos en claude mcp list.
OpenAI Codex añade ChatGPT Voice y proyectos locales multi-carpeta en el desktop app
El release del 24 de julio incorpora GPT-Live para hablar con las tareas de Chat, Work y Codex, y proyectos locales con múltiples carpetas donde una es la principal para chats y Git. Útil para quien alterna monorepos y micro-repos sin abrir mil sesiones.
Cursor Router: enrutador automático con modos Intelligence, Balance y Cost por petición
El nuevo Auto de Cursor analiza cada petición y la manda al modelo adecuado según tres modos de optimización. Los admins pueden fijar el modo por equipo, limitar cuáles usan los miembros y allow/block-list de modelos subyacentes. Baja factura sin renunciar al mejor modelo cuando toca.
Astryx de Meta vuelve a GitHub Trending: manifiesto JSON del CLI para que los agentes no alucinen props
El design system de React que Meta libera bajo MIT expone npx astryx manifest --json con todo el contrato del CLI (comandos, flags, respuestas) más un flag --dense que despoja la documentación de prosa humana para ahorrar contexto. Ya supera 9.000 estrellas en tres semanas.
Una técnica, prompt o comando aplicable hoy. Cópialo, pruébalo en tu stack en menos de 5 minutos y reenvíalo a un colega si te resulta útil. Ejemplos típicos: un prompt para evals, un patrón de agente, un comando que recorta tokens o un truco de RAG.
Activa fallback y tool changes de Opus 5 en la misma llamada
# pip install "anthropic>=0.42" # Combina las dos betas nuevas de la Claude API para agentes en prod: # 1) mid-conversation-tool-changes: anade o quita tools entre turnos # sin invalidar el prompt cache (menos tokens y menos latencia). # 2) server-side-fallback: si safety bloquea la peticion, Anthropic # la enruta a un modelo alternativo en vez de fallar con 4xx. from anthropic import Anthropic client = Anthropic(default_headers={ "anthropic-beta": ( "mid-conversation-tool-changes-2026-07-01," "server-side-fallback-2026-07-01" ) }) resp = client.messages.create( model="claude-opus-5", max_tokens=4096, tools=[SEARCH_TOOL, TICKET_TOOL], # editables turno a turno fallbacks="default", # o ["claude-opus-4-8", "claude-sonnet-5"] messages=[{"role": "user", "content": "Refunde el ticket #12345"}], )
- 01 Anthropic añade la beta agent-memory-2026-07-22: listado de memoria con orden estable y filtros afinados
- 02 Claude Console: las API keys y Admin keys ya se crean con caducidad y aviso por email antes de expirar
- 03 Ollama v0.32.1 estrena modo agente interactivo al arrancar y skills system con tool loops sin límite
- 04 Hugging Face MCP añade el tool hf_fs y Sandboxes para crear Spaces con un agente
- 05 La spec MCP 2026-07-28 se cierra en 2 días: stateless HTTP, MCP Apps, extensión Tasks y OAuth reforzado
Cierre
El día se lee como la primera semana en la que la frontera deja de ser un lujo. Anthropic baja Opus 5 al mismo precio que Opus 4.8 y añade dos betas (tool changes sin invalidar caché y fallback automático) que atacan las dos fugas de coste crónicas del agente en producción: tokens malgastados y refusals que rompen el flujo. Moonshot libera mañana los pesos de Kimi K3 para autoalojar la frontera china sin ceder datos, y Meta con Astryx demuestra que el CLI de un design system puede describirse en JSON para que el agente deje de inventar props. La conclusión práctica: 2026 dejó de premiar quien tiene el mejor benchmark y empieza a premiar quien paga menos tokens por tarea útil.
Iván consulta sobre todo esto
Ingeniero IA con 3 años llevando LLMs a producción y más de 15 construyendo producto para Openbank, Inditex e Iberia. Agentes autónomos, RAG auditable: del piloto al despliegue real.