MARTES, 8 DE SEPTIEMBRE DE 2026
Claude Code 2.1.261: /skill-doctor detecta skills muertas y su coste real en contexto
Cada skill cargada gasta tokens en cada turno aunque nunca se dispare. /skill-doctor lista las que no se han invocado, muestra cuánto cuesta cada una y dónde apagarlas: si operas 15+ skills sueles recortar entre 6 y 12% del prompt inicial sin cambiar de modelo. Además llegan bashOutputMaxChars y taskOutputMaxChars (hasta 128K inline) y --append-subagent-system-prompt-file para prompts de subagente que ya no caben en la línea de comandos.
4 MIN LECTURACursor Self-Hosted Machines: agentes cloud sobre tu infraestructura con computer use en Mac y Linux
Cursor sigue orquestando el bucle del agente en su nube, pero la ejecución de herramientas y el código quedan en máquinas tuyas (laptop, VM, K8s, GPU box). Pools con autoscale, hibernación y control del navegador desde Mac o Linux: gobernanza real sin renunciar a Composer 2.5.
OpenAI Codex CLI 0.153: vim undo/redo, catálogo remoto de plugins y controles finos por herramienta MCP
Vim mode con `u`/Ctrl+R preserva drafts largos con pegado y adjuntos, `codex plugin` gestiona marketplaces remotos y la reconexión TUI recupera transcript y borrador tras un corte. Recorta fricción y pérdidas de trabajo en sesiones largas de agente.
Antigravity CLI 1.1.25: agentes custom heredan skills y subagentes del workspace y parchea OAuth de MCP >1024 chars
Los agentes definidos en Markdown ya no necesitan redeclarar skills, rules y subagentes: heredan del workspace por defecto, como los agentes stock. Corrige además fallos OAuth con códigos de autorización largos y añade Gemini 3.8 Flash al catálogo con GEMINI_API_KEY.
Mireye (YC S26) publica MCP con 300+ campos físicos por dirección de EE. UU. y 5 000 créditos gratis sin tarjeta
Una API + un MCP que devuelven suelo, pendiente, zona FEMA, línea de 345 kV más cercana o cola de interconexión de un condado para cualquier dirección. Pega su skills.md en Claude Code o Cursor y montas underwriting, screening de sitios o lead scoring sin pipeline propio.
Hybrid Search + reranking en producción: BM25 + denso + cross-encoder recupera 25-40% más que un RAG naive
Guía práctica con código: cómo fusionar BM25 y embeddings con RRF, cuándo meter un cross-encoder (BGE-reranker-v2) y qué ganan a costa de latencia y precio. Útil si tu RAG falla en la recuperación (73% de los casos según los análisis 2026) y no en la generación.
Simon Willison lanza llm 0.35: soporte para GPT-6-Astra desde la CLI (1M contexto, cache -90%)
Actualizas con `pip install -U llm` y `llm -m gpt-6-astra` te da 1 048 576 tokens de ventana y cache reads a 1 $/Mtok. Con `--system` pegas tu prompt de reviewer y el 90% del coste desaparece por el cache automático.
Una técnica, prompt o comando aplicable hoy. Cópialo, pruébalo en tu stack en menos de 5 minutos y reenvíalo a un colega si te resulta útil. Ejemplos típicos: un prompt para evals, un patrón de agente, un comando que recorta tokens o un truco de RAG.
Auditar skills muertas y su coste con /skill-doctor
# Requiere Claude Code v2.1.252 o superior. En sesión interactiva: /skill-doctor # Abre la pestaña Stats del /plugin manager: por skill muestra # invocaciones acumuladas, tokens en contexto por turno y flag # de "never invoked". Dice donde apagarla (skills/.../SKILL.md). # En headless (-p), imprime el mismo informe como texto plano: claude -p "/skill-doctor" --output-format text # Mide el ahorro real antes y despues con /cost: /cost # Luego apaga la sospechosa en tu settings.json y vuelve a medir: # { "skills": { "nombre-skill": { "enabled": false } } }
- 01 Claude Code 2.1.263: correcciones de estabilidad y menos crashes en la CLI
- 02 OpenAI Codex 0.154.0-alpha.6 abre el ciclo alpha con soporte MCP 2026-07-28 endurecido
- 03 AI Agents Listing (Product Hunt, 6 sep): directorio con MCP endpoint propio para descubrir agentes, MCPs y skills
- 04 Nvidia acuerda comprar Hugging Face por 12,93 mil M $: el repositorio de open-weight cambia de dueño
- 05 Simon Willison: "Creepy crawlies" analiza el nuevo oleaje de crawlers abusivos y cómo bloquearlos
Cierre
Se consolida un patrón: los harness sobre los que corremos los agentes se están volviendo instrumentables. Anthropic publica /skill-doctor para que Claude Code te diga qué skills te comen contexto sin devolver nada, Cursor te devuelve el control del entorno de ejecución con máquinas autoalojadas y computer use en Mac y Linux, y OpenAI Codex endurece la sesión larga con vim undo, marketplace remoto de plugins y reconexión con transcript intacto. Alrededor, Mireye demuestra que un buen MCP con datos ricos y un skills.md copy-paste vale más que otra demo de agente genérico. El vector del día no es “otro modelo mejor”: es dev tooling que se puede auditar, gobernar y desplegar sin depender de la nube del proveedor.
Iván consulta sobre todo esto
Ingeniero IA con 3 años llevando LLMs a producción y más de 15 construyendo producto para Openbank, Inditex e Iberia. Agentes autónomos, RAG auditable: del piloto al despliegue real.