Saltar al contenido
5 minutos de IA

MIÉRCOLES, 2 DE SEPTIEMBRE DE 2026

NOTICIA DESTACADA

Claude Code 2.1.257: Fable 5.1 por defecto, hooks PreModelSwitch y regla Containment Escape en auto mode

Auto mode deja de autoaprobar fetches a metadatos de nube, intentos de evasión de egress y accesos cross-tenant salvo que el entorno los marque como esperados. Fable 5.1 entra como modelo por defecto con 1M de contexto y cache reads a 0,25 $/Mtok, y los hooks PreModelSwitch/PostModelSwitch te dejan auditar o vetar cambios de modelo desde CI.

4 MIN LECTURA
NOTICIAS DEL DÍA
HERRAMIENTAS

OpenAI Codex CLI 0.152.0: búsqueda vim con /?, límites de tokens por herramienta MCP y timeouts de shell mayores de 1h

Vim mode acepta /, ?, n, N sobre drafts largos, cada herramienta MCP declara su output_token_limit para cortar respuestas ruidosas antes de gastar contexto y los comandos de shell aceptan timeouts superiores a una hora sin cortes del runtime.

OpenAI Codex Releases · 3 MIN LEER FUENTE →
HERRAMIENTAS

Gemini CLI 0.59.0-preview parchea SSRF en el discovery OAuth de MCP y filtra servidores en modo restringido

Corrige una SSRF crítica en el descubrimiento de metadatos OAuth de servidores MCP y estrena workspace trust fail-closed: en modo restringido los MCPs no confiables quedan fuera. Actualización obligatoria si expones o consumes MCPs de terceros en producción.

Gemini CLI Releases · 3 MIN LEER FUENTE →
TÉCNICAS

Simon Willison compara los cinco niveles de reasoning de Fable 5.1 con un pelícano animado

Genera el mismo SVG animado con low, medium, high, xhigh y max, mide latencia y tokens por nivel y deja una referencia visual clara para decidir el effort setting sin quemar tokens en tu propio A/B.

Simon Willison's Weblog · 4 MIN LEER FUENTE →
OPEN SOURCE

@huggingface/kernels: 207 kernels WebGPU cargables desde el Hub para inferencia local sin CUDA

Loader JavaScript Apache 2.0 que baja y ejecuta kernels versionados de attention, matmul y norms directamente desde el Hub. Corre inferencia en el navegador o en edge sin backend propio ni dependencia de CUDA.

Hugging Face Blog · 4 MIN LEER FUENTE →
INDIE / COMUNIDAD

browser-use/video-use edita vídeo desde Claude Code usando el transcript en lugar de los frames

Skill MIT que corta muletillas, aplica color, añade fades de 30 ms, quema subtítulos y genera overlays con Remotion o Manim leyendo el transcript. Tokens y latencia mínimos frente a procesar frames; una línea (`Set up ... for me`) lo instala en Claude Code.

GitHub · 3 MIN LEER FUENTE →
OPEN SOURCE

Hermes Agent v0.21.0 estrena MCP command center con salud, coste 30 días y deep links hermes://

Unifica servidores y catálogo MCP en un panel con health checks en background, overlay de coste y uso a 30 días por servidor y deep links `hermes://` para instalar servidores con confirmación. Resuelve el dolor de operar 10+ MCPs sin fricción.

NousResearch Releases · 4 MIN LEER FUENTE →
SNIPPET DEL DÍA

Una técnica, prompt o comando aplicable hoy. Cópialo, pruébalo en tu stack en menos de 5 minutos y reenvíalo a un colega si te resulta útil. Ejemplos típicos: un prompt para evals, un patrón de agente, un comando que recorta tokens o un truco de RAG.

Contextual Retrieval: contextualizar chunks antes de indexar

<document> {{WHOLE_DOCUMENT}} </document> Here is the chunk we want to situate within the whole document: <chunk> {{CHUNK_CONTENT}} </chunk> Please give a short succinct context to situate this chunk within the overall document for the purposes of improving search retrieval of the chunk. Answer only with the succinct context and nothing else. # Ejecuta este prompt con Haiku + prompt caching sobre {{WHOLE_DOCUMENT}} # (-90% coste). Prepende la salida a cada chunk ANTES de embed y BM25. # Anthropic reporta -49% de recuperaciones fallidas; -67% si añades reranker.

ANTHROPIC ENGINEERING VER FUENTE →

Cierre

El día empuja a que reduzcas coste sin aflojar el perímetro. Anthropic baja los cache reads de Fable 5.1 a 0,25 $/Mtok (–75%), y a la vez Claude Code 2.1.257 lo pone por defecto y estrena la regla Containment Escape que corta de raíz los tres agujeros clásicos del auto mode: fetches a metadatos de nube, evasión de egress y accesos cross-tenant. OpenAI Codex 0.152 te deja cerrar el grifo por herramienta MCP con output_token_limit, y Gemini CLI 0.59.0-preview parchea una SSRF crítica en el discovery OAuth de MCP. Alrededor, Hugging Face libera 207 kernels WebGPU para inferencia local sin CUDA, browser-use edita vídeo desde el transcript en vez de los frames y NousResearch unifica la operación de MCPs con panel de salud y coste. El patrón está claro: cache más barato solo compensa si tu agente no autoaprueba lo que no debería, y hoy tienes menos excusas para dejar el auto mode abierto.

¿LLEVAS IA A PRODUCCIÓN EN TU EMPRESA?

Iván consulta sobre todo esto

Ingeniero IA con 3 años llevando LLMs a producción y más de 15 construyendo producto para Openbank, Inditex e Iberia. Agentes autónomos, RAG auditable: del piloto al despliegue real.