Saltar al contenido
5 minutos de IA

JUEVES, 27 DE AGOSTO DE 2026

NOTICIA DESTACADA

Claude Code v2.1.247 estrena /claude-api cost-optimize y SendFeedback tool

`/claude-api cost-optimize` audita tu gasto en la Claude API y te dirige a palancas concretas (caching, higiene de tokens, batch, effort, elección de modelo) un cambio medido a la vez. La misma skill cubre ya la Admin API (invites, workspaces, keys, informes de rate limit) y SendFeedback deja mandar repros desde el propio agente sin perder contexto.

4 MIN LECTURA
NOTICIAS DEL DÍA
HERRAMIENTAS

Codex 0.150 suma interrupt hooks y @mentions entre tareas desde la CLI

Interrupt hooks disparan limpieza (rollback, cierre de sandbox, flush de logs, aviso al MCP) al cancelar un turno: menos estados corruptos en agentes largos. @mentions deja que una tarea lea o escriba en otras sin bus de mensajes propio. El 0.150.1 mete además imágenes retenidas dentro del presupuesto de la compactación remota.

OpenAI Codex · 4 MIN LEER FUENTE →
HERRAMIENTAS

Ponytail: skill YAGNI para 20+ agentes que reporta -20% de coste en tareas reales

Aplica una escalera YAGNI antes de generar código en Claude Code, Codex, Cursor, Cline, Windsurf y otros 15. En 12 tareas reales sobre FastAPI+React reporta -54% LoC, -22% tokens, -20% coste y -27% de tiempo, con `/ponytail-review` y `/ponytail-audit` para revisar diffs y repo.

GitHub · 3 MIN LEER FUENTE →
OPEN SOURCE

Ollama v0.33.1: MLX runner estrena structured output nativo en Apple Silicon

JSON válido garantizado en MLX sin bucles de reintento ni guardrails externos. Suma soporte para Qwen 3.8 Flash Next como modelo local para coding/agentic y corrige los timeouts de Metal cargando pesos desde almacenamiento lento.

Ollama Releases · 3 MIN LEER FUENTE →
HERRAMIENTAS

Cline SDK v0.0.81 recorta los session snapshot events y salva RAM en agentes de CI

Los eventos de snapshot dejan de arrastrar la transcripción completa: agentes que corren horas en CI o servidores sin cabeza dejan de hincharse en memoria y de mandar megas por cada actualización de estado. Solo viajan status, uso, modelo, workspace y checkpoint.

Cline Releases · 3 MIN LEER FUENTE →
OPEN SOURCE

OmniRoute: gateway local con 350 proveedores, MCP server y 89% de compresión media

Pasarela MIT que unifica 350 proveedores tras `http://localhost:20128/v1` con 19 estrategias de routing (cost-optimized, weighted, fusion) y 12 motores de compresión apilables (89% de ahorro medio). Trae MCP server con 110 herramientas listo para Claude Code, Cursor y Cline.

GitHub · 5 MIN LEER FUENTE →
TÉCNICAS

opencode-mem: memoria persistente para agentes con libSQL embebido y DiskANN

Vector index nativo (`F32_BLOB` + `vector_top_k`) sin infra aparte, autocaptura en idle, perfil de usuario cross-proyecto y UI en `http://localhost:4747`. Ataca directamente el gasto de repetir contexto en cada sesión de tu agente de código.

GitHub · 4 MIN LEER FUENTE →
SNIPPET DEL DÍA

Una técnica, prompt o comando aplicable hoy. Cópialo, pruébalo en tu stack en menos de 5 minutos y reenvíalo a un colega si te resulta útil. Ejemplos típicos: un prompt para evals, un patrón de agente, un comando que recorta tokens o un truco de RAG.

Agente en 1 línea con tools server-side en LLM 0.33

# LLM 0.33 (2026-08-22, simonw): tools ejecutadas en el proveedor, # sin runner local, y templates apilables. uv tool install --upgrade llm # o: pipx upgrade llm # 1) Ejecuta código en el servidor del modelo desde la CLI llm -m gemini-3.7-flash -T CodeExecution \ 'factorial(20)/13! y explica el número resultante en 2 líneas' # 2) Reasoning summary detallada (Responses API, nuevo en 0.33) llm -m gpt-5 --reasoning-summary detailed \ 'Por qué el position bias sesga LLM-as-judge y cómo mitigarlo' # 3) Inspecciona I/O real de las tool calls: bloque "Tool results" # con la clave server_executed en el log llm logs -c --json | jq '.[0] | {response, server_executed}' # 4) Encadena varios templates en el mismo prompt (-t ahora repetible) llm prompt -t json-mode -t no-preamble -m claude-fable-5 \ "resume: $(cat README.md)"

SIMON WILLISON — LLM 0.33 VER FUENTE →

Cierre

El día empuja hacia una idea: los agentes de código dejan de ser cajas negras que queman tokens y pasan a exponer palancas medibles. Claude Code te enseña dónde sangra la factura, Codex te da hooks para no dejar sesiones corruptas cuando cortas, Cline deja de arrastrar transcripciones en cada evento y Ollama garantiza JSON válido en MLX sin loops de reintento. Al mismo tiempo, OmniRoute y opencode-mem normalizan dos primitivas que estaban ad-hoc en cada equipo: gateway multi-proveedor con compresión, y memoria persistente local. Si venías montándolo a mano, hoy toca borrar código.

¿LLEVAS IA A PRODUCCIÓN EN TU EMPRESA?

Iván consulta sobre todo esto

Ingeniero IA con 3 años llevando LLMs a producción y más de 15 construyendo producto para Openbank, Inditex e Iberia. Agentes autónomos, RAG auditable: del piloto al despliegue real.