LUNES, 31 DE AGOSTO DE 2026
planning-with-files: skill que sobrevive al /clear de Claude Code guardando el plan del agente en tres markdown
Tres ficheros (task_plan.md, findings.md, progress.md) se re-inyectan en el contexto cada turno y sobreviven a `/clear`, compactación y crashes. Llega al 96,7% en evals contra sesión limpia y recupera el hilo en 5 turnos frente a 13 sin plan. Fin del agente que empieza cada mañana desde cero.
5 MIN LECTURAayghri/i-have-adhd: skill que fuerza al agente a responder con la acción primero y numerar los pasos
10 reglas para que el agente conteste con la acción primero, pasos numerados y sin preámbulo: menos tokens de salida y respuestas auditables en CI. `/i-have-adhd` la conmuta on/off.
p-e-w/heretic: quita los filtros de un modelo abierto con `pip install heretic-llm` y auto-tuneo Optuna
Ejecutas `heretic Qwen/Qwen3-4B-Instruct-2507` y en 20-30 min tienes un modelo sin filtros vía directional ablation con auto-tuning TPE. AGPL-3.0: para red-team y despliegues on-prem propios.
freellmapi 0.9.0: endpoint OpenAI-compatible con 34 proveedores gratis y Fetch Relay para regiones bloqueadas
Un `/v1` unificado enruta a Groq, Cerebras, Cloudflare, Zhipu y 30 proveedores gratis más con failover. La v0.9 añade Fetch Relay para saltar bloqueos regionales vía un Worker propio.
alirezarezvani/claude-skills: 388 skills exportables con un script a 13 agentes distintos
388 skills en 20 dominios se convierten con `./scripts/convert.sh --tool all` a Claude Code, Codex, Cursor, Gemini CLI, Aider, Windsurf y siete más. Dejas de mantener trece forks.
UditAkhourii/adhd: skill de árbol de pensamiento con poda que ya integran 17 proyectos
Tree-of-thought con divergencia paralela y poda de ramas antes de que se disparen los tokens. Repowire, mstack y wtfismyrepo ya lo usan para trabajo creativo e interdisciplinar.
THU-MAIC/OpenMAIC v1.0.0: un `pnpm dev` levanta una clase interactiva multi-agente
Un comando arranca clase con profesor, compañeros y whiteboard IA sobre tu tema o documento, con 15+ proveedores de LLM. MIT y con paper peer-reviewed: prototipas ed-tech sin partir de cero.
Una técnica, prompt o comando aplicable hoy. Cópialo, pruébalo en tu stack en menos de 5 minutos y reenvíalo a un colega si te resulta útil. Ejemplos típicos: un prompt para evals, un patrón de agente, un comando que recorta tokens o un truco de RAG.
Prompt de eval binario: ¿el agente entierra la respuesta?
Eres un juez estricto de agentes. Se te da una PREGUNTA del usuario y la RESPUESTA que el agente devolvio. Devuelve SOLO uno de estos tokens, sin explicacion: - DIRECT -> la primera linea util contiene la respuesta o la accion a ejecutar. - BURIED -> hay preambulo, saludo, resumen del pedido o tangente antes de la respuesta. - INCOMPLETE -> no responde a la PREGUNTA. Ejemplos: PREGUNTA: "Como listo los MCP servers activos?" RESPUESTA: "Buena pregunta! Los MCP servers son... Puedes ejecutar `claude mcp list`." => BURIED PREGUNTA: "Como listo los MCP servers activos?" RESPUESTA: "`claude mcp list`. Muestra estado y comando de arranque de cada server." => DIRECT PREGUNTA: {{question}} RESPUESTA: {{response}} VEREDICTO:
- 01 Gemini CLI 0.59-nightly sella workspace trust como fail-closed y filtra MCP en modo restringido
- 02 Codex CLI encadena seis alphas de 0.152.0 en 48h publicadas por github-actions
- 03 abhigyanpatwari/GitNexus: 17 herramientas MCP para impact analysis y refactoring en 14 lenguajes
- 04 pollen-robotics/microduck_rl entrena PPO en un bipedo de 25 cm con export ONNX para sim2real
- 05 claude-code-best-practice supera los 65k stars con guia 'de vibe coding a agentic engineering'
Cierre
El patrón que se cierra hoy viene de una idea sencilla: el agente rinde cuando no le dejas divagar. planning-with-files guarda el plan en tres markdown y los re-inyecta cada turno para sobrevivir al /clear; i-have-adhd obliga a responder con la acción primero y numerar pasos; UditAkhourii/adhd poda ramas de razonamiento antes de que se disparen los tokens. Todo apunta al mismo sitio: menos contexto libre y más andamio explícito. Alrededor, heretic demuestra que un pip install te libera de los filtros del proveedor, freellmapi te da 34 proveedores gratis tras un solo endpoint y alirezarezvani/claude-skills te ahorra mantener trece forks de la misma skill. Si sigues confiando en que el modelo “se acuerde” de tu plan sin ficheros ni reglas, hoy vuelves a llegar tarde.
Iván consulta sobre todo esto
Ingeniero IA con 3 años llevando LLMs a producción y más de 15 construyendo producto para Openbank, Inditex e Iberia. Agentes autónomos, RAG auditable: del piloto al despliegue real.