MIÉRCOLES, 2 DE SEPTIEMBRE DE 2026
Claude Code 2.1.257: Fable 5.1 por defecto, hooks PreModelSwitch y regla Containment Escape en auto mode
Auto mode deja de autoaprobar fetches a metadatos de nube, intentos de evasión de egress y accesos cross-tenant salvo que el entorno los marque como esperados. Fable 5.1 entra como modelo por defecto con 1M de contexto y cache reads a 0,25 $/Mtok, y los hooks PreModelSwitch/PostModelSwitch te dejan auditar o vetar cambios de modelo desde CI.
4 MIN LECTURAOpenAI Codex CLI 0.152.0: búsqueda vim con /?, límites de tokens por herramienta MCP y timeouts de shell mayores de 1h
Vim mode acepta /, ?, n, N sobre drafts largos, cada herramienta MCP declara su output_token_limit para cortar respuestas ruidosas antes de gastar contexto y los comandos de shell aceptan timeouts superiores a una hora sin cortes del runtime.
Gemini CLI 0.59.0-preview parchea SSRF en el discovery OAuth de MCP y filtra servidores en modo restringido
Corrige una SSRF crítica en el descubrimiento de metadatos OAuth de servidores MCP y estrena workspace trust fail-closed: en modo restringido los MCPs no confiables quedan fuera. Actualización obligatoria si expones o consumes MCPs de terceros en producción.
Simon Willison compara los cinco niveles de reasoning de Fable 5.1 con un pelícano animado
Genera el mismo SVG animado con low, medium, high, xhigh y max, mide latencia y tokens por nivel y deja una referencia visual clara para decidir el effort setting sin quemar tokens en tu propio A/B.
@huggingface/kernels: 207 kernels WebGPU cargables desde el Hub para inferencia local sin CUDA
Loader JavaScript Apache 2.0 que baja y ejecuta kernels versionados de attention, matmul y norms directamente desde el Hub. Corre inferencia en el navegador o en edge sin backend propio ni dependencia de CUDA.
browser-use/video-use edita vídeo desde Claude Code usando el transcript en lugar de los frames
Skill MIT que corta muletillas, aplica color, añade fades de 30 ms, quema subtítulos y genera overlays con Remotion o Manim leyendo el transcript. Tokens y latencia mínimos frente a procesar frames; una línea (`Set up ... for me`) lo instala en Claude Code.
Hermes Agent v0.21.0 estrena MCP command center con salud, coste 30 días y deep links hermes://
Unifica servidores y catálogo MCP en un panel con health checks en background, overlay de coste y uso a 30 días por servidor y deep links `hermes://` para instalar servidores con confirmación. Resuelve el dolor de operar 10+ MCPs sin fricción.
Una técnica, prompt o comando aplicable hoy. Cópialo, pruébalo en tu stack en menos de 5 minutos y reenvíalo a un colega si te resulta útil. Ejemplos típicos: un prompt para evals, un patrón de agente, un comando que recorta tokens o un truco de RAG.
Contextual Retrieval: contextualizar chunks antes de indexar
<document> {{WHOLE_DOCUMENT}} </document> Here is the chunk we want to situate within the whole document: <chunk> {{CHUNK_CONTENT}} </chunk> Please give a short succinct context to situate this chunk within the overall document for the purposes of improving search retrieval of the chunk. Answer only with the succinct context and nothing else. # Ejecuta este prompt con Haiku + prompt caching sobre {{WHOLE_DOCUMENT}} # (-90% coste). Prepende la salida a cada chunk ANTES de embed y BM25. # Anthropic reporta -49% de recuperaciones fallidas; -67% si añades reranker.
- 01 Codex 0.152.1: la revisión de Guardian ya respeta las políticas de Node REPL del metadata del modelo
- 02 Claude Code 2.1.258 corrige la regresión que impedía arrancar en macOS 12 desde la 2.1.255
- 03 Gemini CLI 0.58.0 estable refuerza el aislamiento de contenedores Docker en macOS
- 04 Simon Willison publica GeoJSON Map Viewer, herramienta gratuita para inspeccionar ficheros GeoJSON
- 05 Fable 5.1 y Mythos 5.1: cache reads a 0,25 $/Mtok, un 75% más baratos que Fable 5
Cierre
El día empuja a que reduzcas coste sin aflojar el perímetro. Anthropic baja los cache reads de Fable 5.1 a 0,25 $/Mtok (–75%), y a la vez Claude Code 2.1.257 lo pone por defecto y estrena la regla Containment Escape que corta de raíz los tres agujeros clásicos del auto mode: fetches a metadatos de nube, evasión de egress y accesos cross-tenant. OpenAI Codex 0.152 te deja cerrar el grifo por herramienta MCP con output_token_limit, y Gemini CLI 0.59.0-preview parchea una SSRF crítica en el discovery OAuth de MCP. Alrededor, Hugging Face libera 207 kernels WebGPU para inferencia local sin CUDA, browser-use edita vídeo desde el transcript en vez de los frames y NousResearch unifica la operación de MCPs con panel de salud y coste. El patrón está claro: cache más barato solo compensa si tu agente no autoaprueba lo que no debería, y hoy tienes menos excusas para dejar el auto mode abierto.
Iván consulta sobre todo esto
Ingeniero IA con 3 años llevando LLMs a producción y más de 15 construyendo producto para Openbank, Inditex e Iberia. Agentes autónomos, RAG auditable: del piloto al despliegue real.