SÁBADO, 5 DE SEPTIEMBRE DE 2026
Claude Code 2.1.261: /skill-doctor marca skills muertas, subagentes desde fichero y salida inline hasta 128K
El comando /skill-doctor lista cada skill cargada, su coste de contexto y cuáles no se han disparado en la sesión: puedes tirar de la maleza sin abrir cada SKILL.md. `--append-subagent-system-prompt-file` deja de meter el prompt del subagente por línea de comandos, y `bashOutputMaxChars`/`taskOutputMaxChars` suben la salida inline a 128K antes de mandarla a fichero.
4 MIN LECTURAOpenAI Codex CLI 0.153.0: marketplace remoto de plugins, vim con undo/redo y MCP 2026-07-28
`codex plugin install` tira ya de marketplaces remotos y no solo de rutas locales: montas tu registro de plugins interno con auth y despliegas cambios sin reinstalar. Vim en el TUI gana undo/redo con `u` y `Ctrl+R`, y el protocolo MCP 2026-07-28 estrena descubrimiento paginado y arranque no bloqueante — un servidor MCP lento deja de tumbarte la sesión.
Claude Code 2.1.260: panel /diff durante la edición y diagnóstico de fallos de caché en Fable 5.1
El panel `/diff` se abre al lado de la conversación en pantalla completa y muestra los cambios sin commitear mientras el agente escribe: revisas el patch en tiempo real sin salir del TUI. Además arregla el caché de instrucciones roto en Fable 5.1 (reenviaba sin cachear tras cada llamada a herramienta) y explica en `/cost` el motivo probable de cada miss.
Simon Willison publica llm 0.34, llm-anthropic 0.28, llm-gemini 0.34 y llm-openrouter 0.7.1 el mismo día
El mismo DSL de esquemas concisos (`name, age int, bio`) funciona ya en los tres proveedores principales y en OpenRouter: pides datos estructurados desde la terminal sin envolver un JSON Schema a mano. Sirve para pipelines de extracción cross-modelo con `llm -s` y para tests A/B entre Anthropic, Gemini y modelos open-weight sin cambiar la petición.
JoaquinCampo/skill-doctor: audita cada skill de Claude Code contra 9 criterios con evidencia file:line
Plugin comunitario que va más allá del `/skill-doctor` nativo: clasifica cada skill en Minimal, Standard o Rich y aplica solo los criterios que le tocan, así una skill sencilla bien escrita no la penaliza por no ser Rich. Devuelve un informe con hallazgos y línea concreta que arreglar, no un veredicto opaco.
GhostSplice: ataque que parte una instrucción MCP en dos y sube el cumplimiento del 42% al 82%
El PoC divide una exfiltración entre la descripción de una herramienta MCP y su resultado; ningún fragmento por separado parece malicioso, pero el agente los junta y manda las claves. Confirmado en 11 modelos con API: GPT-4o, Gemini 2.0 Flash y Llama 3.3 70B pasan del 0% al 100%. Guarda MCPs de terceros detrás de allow-lists por dominio y firma.
Gemini CLI 0.58.0: SSRF cerrado en OAuth de MCP, workspace-trust fail-closed y Docker aislado en macOS
Bloquea la fuga por SSRF en el descubrimiento de metadatos OAuth de servidores MCP y aísla los sockets de Docker en Seatbelt para que un servidor MCP no arranque contenedores por su cuenta. El modo restringido pasa a fail-closed: si no marcas el workspace como de confianza, no ejecuta nada.
Una técnica, prompt o comando aplicable hoy. Cópialo, pruébalo en tu stack en menos de 5 minutos y reenvíalo a un colega si te resulta útil. Ejemplos típicos: un prompt para evals, un patrón de agente, un comando que recorta tokens o un truco de RAG.
Auditar skills de Claude Code con /skill-doctor (2.1.261)
# Claude Code 2.1.261 (4 sep 2026): marca las skills cargadas # que no se han disparado en la sesion y su coste en tokens. /skill-doctor # Plugin comunitario que evalua cada skill contra 9 criterios # con evidencia file:line (no solo OK/KO). claude plugin install github:JoaquinCampo/skill-doctor /skill-doctor .claude/skills/mi-skill/ # Subir la salida inline antes de que vaya a fichero (max 128K). # .claude/settings.json: # { "bashOutputMaxChars": 65536, "taskOutputMaxChars": 131072 } # Cargar el system prompt del subagente desde fichero # (util cuando pasa de lo que cabe en la linea de comandos). claude --append-subagent-system-prompt-file ./subagent.md
- 01 Anthropic Fable 5.1 baja los cache reads a 0,25 $/Mtok y amplia el conocimiento hasta junio 2026
- 02 Z.ai libera GLM-5.3-Flash: MoE 320B/18B multimodal bajo MIT
- 03 Qwen3.8 27B (Apache 2.0) marca 73.0 en Terminal-Bench 2.1 con contexto nativo de 262K
- 04 Cursor lleva las Self-Hosted Machines a los agentes cloud
- 05 Zed suma spawn_agent y ask_user en el panel del agente para orquestar subagentes
Cierre
El día muestra un patrón cada vez más claro: los CLIs de agente (Claude Code, Codex, Gemini CLI) están dejando de competir por benchmarks y empiezan a competir por gobernanza del contexto. /skill-doctor, marketplace de plugins, panel /diff, límites de salida configurables o el endurecimiento de MCP contra SSRF y GhostSplice son la misma jugada: tratar al agente como software de producción con auditoría, límites y superficie de ataque reducida. Si esta semana no has medido cuántos tokens gastan tus skills cargadas ni pasado tus MCPs por una allow-list, tu agente ya está más caro y más inseguro que el del vecino.
Iván consulta sobre todo esto
Ingeniero IA con 3 años llevando LLMs a producción y más de 15 construyendo producto para Openbank, Inditex e Iberia. Agentes autónomos, RAG auditable: del piloto al despliegue real.