Saltar al contenido
5 minutos de IA

MIÉRCOLES, 5 DE AGOSTO DE 2026

NOTICIA DESTACADA

Simon Willison libera llm 0.32 con reasoning traces, Responses API y PauseChain para tools

El CLI llm salta a 0.32, su mayor revisión desde el lanzamiento: reasoning traces por stderr en modelos como o3 o GPT-5.6, migración a la Responses API por defecto en modelos de razonamiento, server-side tools (WebSearch, CodeInterpreter), PauseChain para pausar cadenas con aprobación humana y un nuevo esquema SQLite content-addressed que deja de duplicar mensajes en tus logs.

4 MIN LECTURA
NOTICIAS DEL DÍA
HERRAMIENTAS

Claude Code v2.1.222 sella el escape de git en worktrees isolados y añade sandbox.filesystem.disabled

Segundo release en 24 horas tras la 2.1.221 de ayer: cierra el bypass por el que un subagente isolado podía redirigir git contra el checkout principal vía git -C, --git-dir o GIT_DIR, y añade sandbox.filesystem.disabled para agentes que necesitan escribir fuera del jail manteniendo el control de egress. Esencial si delegas ediciones automatizadas a subagentes con permisos amplios.

Claude Code changelog · 3 MIN LEER FUENTE →
HERRAMIENTAS

Codex CLI 0.146.0 activa los remote plugins por defecto y añade fuentes npm al marketplace

Los remote plugins dejan de ser opt-in y aparecen con versiones remote/local visibles en el catálogo; el marketplace admite ya fuentes de npm para publicar plugins como cualquier paquete. Además, el CLI respeta los proxies del sistema (PAC/WPAD en macOS y Windows) en auth, plugins, MCP y remote execution: instalable en corporate sin toquetear variables de entorno.

OpenAI Codex changelog · 3 MIN LEER FUENTE →
OPEN SOURCE

Microsoft Agent Framework marca Agent Skills for Python como estable y sin gate experimental

La API de skills sale del preview y entra en el soporte a largo plazo de Agent Framework 1.0. Puedes empaquetar dominios completos (instrucciones, referencia y scripts) como skills SKILL.md portables al mismo formato que Claude Code, Cursor o Codex, y reutilizarlos entre agentes Python en producción sin sobresaltos de API.

Microsoft Agent Framework · 3 MIN LEER FUENTE →
TUTORIALES

Pixel-Native RAG: guía práctica para indexar documentos visuales sin OCR ni chunking clásico

Pipeline completo desde cero que sustituye el clásico parse HTML + chunking por embeddings visuales directos sobre las páginas. Si tu RAG se rompe con PDFs escaneados, tablas complejas o layouts multicolumna, aquí tienes el código para probarlo hoy y comparar recall contra tu stack actual antes de invertir en un pipeline dedicado.

MarkTechPost · 6 MIN LEER FUENTE →
HERRAMIENTAS

Gemini CLI 0.53.1 estrena eval coverage report y arregla los loops ReAct infinitos

El CLI de Google publica una versión menor con un comando nuevo de cobertura de evaluaciones (mide qué caminos de decisión del agente tienes cubiertos), coalescencia de mensajes consecutivos del mismo rol para evitar 400 Bad Request, mitigación de bucles ReAct infinitos y aislamiento por workspace trust en el servidor A2A. Menos evals ciegas y menos agentes que se cuelgan en producción.

Gemini CLI changelog · 3 MIN LEER FUENTE →
SNIPPET DEL DÍA

Una técnica, prompt o comando aplicable hoy. Cópialo, pruébalo en tu stack en menos de 5 minutos y reenvíalo a un colega si te resulta útil. Ejemplos típicos: un prompt para evals, un patrón de agente, un comando que recorta tokens o un truco de RAG.

Explora los server-side tools nuevos de llm 0.32 sin invocarlos a ciegas

# llm 0.32 (Simon Willison, 4 ago 2026): reasoning traces por # stderr, esquema SQLite content-addressed que deja de duplicar # mensajes entre conversaciones y modelo por defecto cambiado # a GPT-5.6 Luna. Sirve como base para cualquier script que # llame a varios modelos desde bash sin pegamento propio. pip install -U llm # o: uv tool install llm # 1) Ver los server-side tools disponibles en cada modelo # (WebSearch, CodeInterpreter, etc.) antes de invocarlos. llm tools -m gpt-5.6-luna llm tools -m o3 # 2) Reasoning trace visible por stderr; el stdout queda limpio # para redirigir o pipear a jq/otro proceso sin ensuciarlo. llm -m o3 "explica este trace" < trace.log 2> reasoning.log | jq . # 3) En scripts: silenciar el reasoning con -R/--hide-reasoning # cuando solo te interesa el output final del modelo. llm -m o3 -R "extrae solo el JSON final" < prompt.txt # 4) El nuevo store SQLite es content-addressed: los mensajes # repetidos entre conversaciones dejan de duplicarse en disco. llm logs --json | jq '.[0] | {model, conversation_id, tools}'

SIMON WILLISON VER FUENTE →

Cierre

Hoy no hay un lanzamiento estelar único, hay uno colectivo: llm 0.32, Claude Code 2.1.222, Codex CLI 0.146 y Gemini CLI 0.53.1 publicaron el mismo día apretando la misma tuerca — reducir el pegamento entre el modelo y el resto del stack. Server-side tools para no montarte tu propio RAG básico, eval coverage para no volar a ciegas, sandbox y worktrees para que los subagentes no se salten la valla, y plugins vía npm para distribuir extensiones como paquetes normales. Menos ceremonia por debajo del prompt, más responsabilidad en las decisiones que sí importan.

¿LLEVAS IA A PRODUCCIÓN EN TU EMPRESA?

Iván consulta sobre todo esto

Ingeniero IA con 3 años llevando LLMs a producción y más de 15 construyendo producto para Openbank, Inditex e Iberia. Agentes autónomos, RAG auditable: del piloto al despliegue real.