DOMINGO, 9 DE AGOSTO DE 2026
prime-agent: PrimeIntellect libera un harness auto-mejorable con IPython persistente y subagentes
Harness MIT alternativo a Claude Code que ejecuta operaciones como código Python persistente, spawnea subagentes vía rlm() y auto-refina su estado con evidencia. La sesión sobrevive al cierre del terminal vía daemon y las skills son paquetes Python importables: dejas de escribir wrappers YAML y trabajas en el mismo lenguaje que el resto de tu stack. Trending #1 en GitHub con 9,3k stars en 48 horas.
5 MIN LECTURAaddyosmani/agent-skills roza 85k stars: 24 skills MIT para 10+ agentes de código
Colección modular que codifica el ciclo Define → Plan → Build → Verify → Review → Ship como skills versionables. Compatible con Claude Code, Cursor, Codex, Copilot y Cline vía `npx skills`: dejas de reescribir el mismo prompt engineering por cada herramienta y versionas el workflow como código.
Ryan Dahl lanza celld 0.1: Cloudflare Workers y Durable Objects auto-alojables sobre tu S3
Daemon Apache-2.0 de denoland que corre Workers y Durable Objects con las mismas APIs (V8, SQLite, LTX, S3). Cada objeto es una BBDD SQLite replicada al bucket que tú controlas, sin plano de control ni consenso: recorta un orden de magnitud el coste a escala y elimina el vendor lock-in del edge.
Antigravity CLI añade hiperlinks OSC8 y skill nativa Antigravity Guide
La nueva versión estampa links clicables en terminales que soportan OSC8 con fallback automático, integra una skill de guía, syntax highlight de C++/Python/Protobuf en diffs y reverse cycling con shift+n. Menos context switching al revisar cambios sin salir del terminal.
Meta libera Muse Code beta: agente de terminal impulsado por Muse Spark 1.2
Meta suma su propio agente de terminal al ecosistema, con Muse Spark 1.2 como backend por defecto y modo agent-ready para tareas largas. Alternativa nativa a Codex y Claude Code para equipos que ya viven en la infra de Meta AI y quieren evitar un proveedor más.
Simon Willison: los PDFs siguen siendo terribles y están causando el Tokenpocalypse
Análisis del coste real de meter PDFs mal escaneados directos al contexto del LLM. Convertir con OCR y estructura previa ahorra más tokens que cambiar a un modelo más barato: aplicable hoy en cualquier pipeline RAG con documentos legacy, con métricas concretas del gasto evitado por documento.
Ollama 0.32.6 acelera Qwen3 en Apple MLX con MTP speculative decoding
El release trae MTP (Multi-Token Prediction) speculative decoding para Qwen3 sobre backend MLX en Apple Silicon. Traducido: tokens/segundo notablemente más altos en tu M-series sin cambiar de modelo ni depender de una API remota para inferencia local.
Una técnica, prompt o comando aplicable hoy. Cópialo, pruébalo en tu stack en menos de 5 minutos y reenvíalo a un colega si te resulta útil. Ejemplos típicos: un prompt para evals, un patrón de agente, un comando que recorta tokens o un truco de RAG.
Auditar cualquier PR de GitHub con llm-fragments-github
# Requiere: llm (Simon Willison) 0.32+ y el plugin llm-fragments-github llm install llm-fragments-github # Carga el PR entero (diff + descripcion + comentarios) como fragmento # y pide un code review estructurado en una sola llamada llm -m claude-opus-5 \ -f pr:simonw/llm/1234 \ -s "Actua como reviewer senior. Devuelve JSON con las claves: bugs[], seguridad[], tests_faltantes[], sugerencias[]. Cita numero de linea cuando puedas." # Bonus: cargar TODO un repo publico como contexto de una prompt llm -f github:simonw/files-to-prompt "sugiere features nuevas" # Tambien soporta issues: -f issue:owner/repo/123
- 01 Anthropic abre beta pública de Claude Code self-hosted para Team y Enterprise
- 02 google/skills entra en GitHub trending diario con skills oficiales de Google
- 03 mattpocock/skills escala a 210k stars con nuevos packs /tdd, /handoff y /grill-with-docs
- 04 Cloudflare OS pasa a Apache 2 en os.cloudflare.app con onboarding self-serve
- 05 Simon Willison analiza la charla de OpenAI en Black Hat sobre el incidente de Hugging Face
Cierre
Hoy la señal es la fragmentación del stack propietario. prime-agent de PrimeIntellect propone un harness MIT que sustituye a Claude Code con IPython persistente y skills como paquetes Python importables. Ryan Dahl libera celld para ejecutar Workers y Durable Objects contra tu propio S3 sin plano de control ajeno. addyosmani codifica el ciclo Define → Plan → Build → Verify → Ship como skills portables entre Cursor, Codex, Copilot y Cline. Y Simon Willison vuelve a recordar que meter PDFs mal escaneados directo al contexto es la fuga silenciosa que revienta tu bill mucho antes que la elección del modelo. Lo que llega a producción hoy es opcionalidad: cada capa del stack cerrado ya tiene su equivalente auto-alojable.
Iván consulta sobre todo esto
Ingeniero IA con 3 años llevando LLMs a producción y más de 15 construyendo producto para Openbank, Inditex e Iberia. Agentes autónomos, RAG auditable: del piloto al despliegue real.