SÁBADO, 15 DE AGOSTO DE 2026
Qwen3.8-27B abre pesos con soporte inmediato en RTX y llega a 131 tokens/s en una 5090
Modelo denso de 27B pensado para agentes de código en local: lo enchufas a Ollama, llama.cpp, Unsloth o LM Studio y tienes un asistente sin filtrar tu repo a la nube. Con multi-token prediction alcanza 131 tokens/s en una RTX 5090 y AMD ha publicado guía inmediata para Ryzen AI Max y Radeon. Ideal si vendes a clientes con datos sensibles y necesitas mantener el contexto de proyecto autoalojado.
5 MIN LECTURAZ.ai lanza GLM-5.3: MoE de 753B con ventana de 1M y liderazgo en Terminal Bench 3.0
Disponible ya por API y en el GLM Coding Plan; los pesos llegan en dos semanas tras las evaluaciones de seguridad. Si tu producto ejecuta tareas de línea de comandos largas, es el modelo abierto a probar sin cambiar de proveedor de inferencia.
Claude Code v2.1.232 activa fork de subagentes por defecto y añade archive plugin con SHA-256
Los subagentes con subagent_type:"fork" heredan la caché del prompt padre (dejas de reenviar contexto y baja el coste por invocación) y ahora instalas plugins desde un zip por HTTPS con pin de SHA-256, sin git ni npm. Menos superficie de supply chain y menos ping-pong de contexto en tu orquestador.
GhostSplice: cómo un MCP hostil fragmenta instrucciones para robar secretos desde tu agente
El servidor esconde un trozo en la descripción de la herramienta y otro en el resultado; el agente une los fragmentos y ejecuta la exfiltración creyendo que hace una comprobación de cumplimiento. Defensa: allowlist estricta de servidores, pin de versión y tratar cada salida como dato, nunca como instrucción.
Anthropic hace permanente Sonnet 5 a $2/$10 y cancela la subida del 1 de septiembre
Se queda la tarifa de introducción: si dimensionaste tu presupuesto de inferencia para $3/$15, tienes un 33% de margen extra este trimestre. Aplica también al prompt caching, que ya recortaba coste hasta 90% en pipelines de RAG estables.
llm-gemini añade Gemini 3.7 Flash y dos modelos de embeddings con un pip install
Simon Willison publica soporte inmediato para Gemini 3.7 Flash, gemini-3.6-flash y gemini-3.5-flash-lite en su CLI LLM. Cambias de modelo sin tocar código, comparas latencia con un solo comando y logueas todo en SQLite local para auditar tokens y coste.
Framer estrena agentes en el canvas con integración de Claude Code y Codex
El sitio se diseña, escribe, analiza y organiza con agentes que puedes conectar a tu Claude Code o Codex. Branching evita romper producción cuando pruebas ideas y la nueva comunidad permite monetizar plantillas. Para quien vende landings a clientes, cierra el bucle diseño→código sin cambiar de herramienta.
Una técnica, prompt o comando aplicable hoy. Cópialo, pruébalo en tu stack en menos de 5 minutos y reenvíalo a un colega si te resulta útil. Ejemplos típicos: un prompt para evals, un patrón de agente, un comando que recorta tokens o un truco de RAG.
Activar fork subagents y pin SHA-256 en Claude Code v2.1.232
// ~/.claude/settings.json — orquestador que reutiliza caché de prompt // y fija el hash exacto del plugin que instalas (defensa supply chain). { "env": { "CLAUDE_CODE_FORK_SUBAGENT": "1" }, "plugins": { "sources": [ { "type": "archive", "url": "https://cdn.miorg.dev/plugins/security-review-1.4.2.zip", "sha256": "9f2b8e1c4a7d0f2b3c1e5a6d8f0b1c2e4d5f6a7b8c9d0e1f2a3b4c5d6e7f8a9" } ] } } # 1) subagentes con subagent_type:"fork" heredan la caché del prompt # padre: dejas de re-enviar contexto y bajas coste por invocación. # 2) 'archive' baja el plugin por HTTPS sin git ni npm; el pin de # sha256 aborta el install si alguien altera el zip en el CDN. # 3) En modo -p (no interactivo) y en el Agent SDK sigue apagado # salvo que exportes CLAUDE_CODE_FORK_SUBAGENT=1 también ahí. claude /plugin install security-review@miorg-marketplace # respeta el pin
- 01 Cursor lanza builds para Cloud Agents y arranca los entornos 3x más rápido
- 02 Unsloth cuantiza Kimi K3 a IQ2-XXS y lo baja de 711GB a 478GB
- 03 MiniMax abre los pesos de H3, modelo omni-modal de vídeo, con soporte nativo en ComfyUI
- 04 Voyage-3-large lidera MTEB retrieval y cuesta 2,2x menos que text-embedding-3-large
- 05 OpenClaw supera 382.000 estrellas en GitHub y se afianza como agente autoalojado de referencia
Cierre
El día empuja al dev senior hacia el mismo sitio por dos caminos distintos: Qwen3.8-27B y GLM-5.3 te dan capacidad de agente de código sin pagar peaje de inferencia por token, y Claude Code v2.1.232 afila el orquestador con fork de subagentes y plugins fijados por SHA-256. Mientras tanto, GhostSplice recuerda que cada servidor MCP que enchufas a tu agente es una superficie de ataque nueva: allowlist, pin de versión y tratar el output como dato, no como instrucción, dejan de ser paranoia y pasan a ser línea base. Con Anthropic congelando el precio de Sonnet 5, el argumento de “muevo esto a un modelo abierto para bajar coste” pierde fuerza salvo que necesites autoalojar. La pregunta ya no es qué modelo elegir, es cómo blindar el pipeline que lo llama.
Iván consulta sobre todo esto
Ingeniero IA con 3 años llevando LLMs a producción y más de 15 construyendo producto para Openbank, Inditex e Iberia. Agentes autónomos, RAG auditable: del piloto al despliegue real.