LUNES, 7 DE SEPTIEMBRE DE 2026
OpenAI Codex 0.153.0: instalación de plugins desde marketplace remoto, reconexión del TUI y Vim con undo/redo
El CLI de Codex estrena `codex plugins list/install/remove` contra marketplaces remotos y hace que la sesión del TUI sobreviva a caídas del app-server, así que un agente largo ya no pierde el borrador cuando se cae el proceso. El modo Vim gana `u` y `Ctrl+R` preservando adjuntos, y `tui.auto_recap = false` te devuelve el control del gasto de tokens en loops largos.
3 MIN LECTURACursor lanza Self-Hosted Machines: código, secretos y build en tu VM
El agente ejecuta las llamadas a herramientas en tu máquina o pool de equipo (AWS Lambda, Cloudflare, Modal, E2B, Vercel) sin sacar el repo del entorno. Desbloquea despliegues empresariales que caían por revisión de cumplimiento.
mattpocock/skills: TDD, code review y diagnóstico de bugs como skills de Claude Code
Skills instalables como plugin de Claude Code que fuerzan sesiones de grilling, TDD y revisión estructurada. Compartes las mismas guardas de revisión entre todo el equipo sin depender de un CLAUDE.md por proyecto.
humanlayer/skills: reescribe CLAUDE.md, estrecha props de React y monta agentic loops
Colección de skills que arregla fallos concretos del día a día: adherencia a CLAUDE.md, tipado narrow de props sacado del uso real y bucles agénticos con GitHub Actions. Menos coste de mantenimiento por proyecto.
Simon Willison prueba Claude Fable 5.1: cinco niveles de reasoning en la práctica
Hands-on de Willison con los presets low → max de Fable 5.1: cuándo el reasoning bajo basta y en qué tareas el máximo compensa el coste. Útil para decidir el preset por herramienta sin quemar presupuesto en pruebas ciegas.
diagram-design: 39 tipos de diagrama editorial en HTML+SVG sin build
Plantillas autoalojadas que importan desde draw.io y Mermaid y exportan a PNG/SVG desde Claude Code o Codex. Documentación de arquitectura que no huele a IA-slop, generada dentro del propio review.
Una técnica, prompt o comando aplicable hoy. Cópialo, pruébalo en tu stack en menos de 5 minutos y reenvíalo a un colega si te resulta útil. Ejemplos típicos: un prompt para evals, un patrón de agente, un comando que recorta tokens o un truco de RAG.
Silenciar el recap automático del TUI de Codex 0.153
# ~/.codex/config.toml — Codex rust-v0.153.0 (3 sep 2026) # El TUI intercala turnos de "recap" que resumen el contexto en loops largos. # En agentes desatendidos comen tokens y cortan submissions encoladas. # Con esto desactivas el automático y sigues teniendo el /recap manual. [tui] auto_recap = false # Bonus del mismo release: modo Vim con `u` (undo) y `Ctrl+R` (redo) # preservando pegados y adjuntos, así un `dd` accidental no borra # un prompt de 200 líneas ni sus attachments.
- 01 Anthropic publica la guía de Claude Code autoalojado en Team y Enterprise
- 02 MCP Roadmap: identidad de agente con DPoP y eventos iniciados por el servidor
- 03 gemini-cli v0.60.0 nightly: consentimiento para cambios de entorno y validación de symlinks
- 04 LLaDA-Image: modelo 6B de imagen de pesos abiertos con variante Turbo de 4 pasos
- 05 NousResearch/hermes-agent: agente autoinformado con generación de skills y memoria entre sesiones
Cierre
El día lo firma la infraestructura del agente, no un modelo nuevo. Codex convierte los plugins en artefactos instalables desde marketplaces remotos y hace que su TUI sobreviva a cortes, Cursor empuja las Self-Hosted Machines para clientes que no pueden mover el código, y las dos colecciones de skills que trending publica hoy (Matt Pocock, humanlayer) codifican TDD, code review y reescritura de CLAUDE.md como piezas compartibles. La conclusión para quien lleva IA a producción: el próximo salto de productividad no vendrá de subir de modelo, sino de estabilizar el ejecutor (sesiones que resisten, plugins versionados, políticas locales) y de tratar el CLAUDE.md y las skills como código de primera clase.
Iván consulta sobre todo esto
Ingeniero IA con 3 años llevando LLMs a producción y más de 15 construyendo producto para Openbank, Inditex e Iberia. Agentes autónomos, RAG auditable: del piloto al despliegue real.