5 minutos de IA
Curado para devs que llevan IA a producción. Cada mañana: agentes, MCP, RAG, evals y open source que se enchufa al stack hoy. Por Iván López.
Cursor 3.9 estrena Customize: plugins, skills, MCPs, subagentes, reglas y hooks en un único panel
Panel único para gestionar plugins, skills, MCPs, subagentes, reglas, comandos y hooks a nivel usuario, equipo o workspace, con leaderboard de lo más instalado y canvases prebuilt que un equipo abre y reutiliza. Los admins configuran servers MCP una vez y se distribuyen a cloud agents, IDE y CLI vía team marketplace: reduce la sombra de reglas y MCPs artesanales que cada dev arrastra en su repo y da un carril de gobernanza real para introducir agentes en un equipo grande.
OpenCode 1.17.15: el agente de terminal de código abierto pasa los 165k stars y afina el modelo picker
El fork ahora vive en `anomalyco/opencode` y sirve como sustituto directo de Claude Code con soporte para 75+ endpoints (Anthropic, OpenAI, Google, Bedrock, Azure, OpenRouter y Ollama local). La 1.17.15 arregla la clasificación de overflows de contexto en Z.ai, la caída cuando el config dir no existe y devuelve los tooltips del picker: si buscas evitar vendor lock-in sin ceder ergonomía, es hoy la alternativa más pulida y con más recorrido en producción.
Ollama v0.30.8: `ollama launch` monta un agente completo y auto-instala Claude Code y opencode
El comando `ollama launch` levanta un agente de codificación con las variables de entorno preconfiguradas y descarga el modelo si falta; el runtime detecta si un modelo tiene modo pensamiento y auto-instala Claude Code y opencode contra el endpoint local. También trae Gemma 4 casi 90% más rápido en Apple Silicon con multi-token prediction. Menos fricción para dev que quiere agentes sobre modelos locales sin pelearse con exports de `OPENAI_API_BASE`.
Simon Willison publica su investigación con DSPy para el system prompt del Datasette Agent
Muestra cómo compilar los prompts SQL del Datasette Agent con DSPy en lugar de iterarlos a mano: dataset con preguntas y SQL esperado, optimizador MIPROv2 y regresión antes de promocionar. El aprendizaje operativo: fijar hash del dataset y del optimizador y sólo promocionar si TaskCompletion y token_count del prompt superan el umbral. Es el patrón que separa una compilación DSPy de laboratorio de una que resiste el cambio de tools o de corpus en prod.
Hamel Husain: Evals Skills for Coding Agents, guía para calibrar jueces binarios contra etiquetas humanas
Sistematiza el patrón de eval que le funciona en clientes reales: jueces LLM que devuelven PASS/FAIL (nunca Likert 1-5), validados contra ~100 etiquetas humanas usando TPR/TNR, y assertions de código para lo determinista. El repositorio adjunto es directamente instalable como skill de Claude Code y Cursor. Es la respuesta más concreta hoy a cómo bloquear regresiones cuando el agente decide llamar `git push --force` o promocionar SQL peligroso.
Moonshot libera Kimi K2.5, MoE multimodal nativo con orquestación en enjambre bajo licencia abierta
Modelo agéntico open-weight con soporte multimodal nativo, contexto largo y orquestación de tareas en enjambre pensada para agentes autónomos de larga duración. Se descarga desde Hugging Face con pesos y config, así que lo enchufas a tu stack (vLLM, SGLang, Ollama) sin depender del proveedor. Interesante si tu caso son agentes que planifican y ejecutan con browsing o herramientas de código, no solo chat.
-
#78
Claude Code 2.1.205: `/doctor` es un checkup completo del setup y auto-mode bloquea `rm -rf` sin resolver
-
#77
Claude Code 2.1.202: `/review` vuelve al análisis rápido de un solo pase y `/code-review` se queda con el multi-agente
-
#77
MCP 2026-07-28 Release Candidate: protocolo stateless, MCP Apps y Tasks — 10 semanas para migrar
-
#76
Willison publica sqlite-utils 4.0rc2 escrito casi entero por Fable: 5 blockers y $149,25 en tokens
-
#75
Claude Code 2.1.200 pasa el permiso a 'Manual' por defecto y apaga el auto-continue de AskUserQuestion
-
#75
Claude Code 2.1.198 pasa los subagentes a background y les deja abrir el draft PR sin turno
-
#75
GitHub Copilot suma Kimi K2.7 Code: primer modelo open source en el picker
-
#73
Anthropic lanza Claude Sonnet 5 como default en Claude Code: 1M de contexto y $2/$10 por millón de tokens
-
#74
Claude Sonnet 5 llega con 1M de contexto y calidad casi-Opus al precio de Sonnet
-
#73
Cursor para iOS sale en beta pública: lanzas agentes en la nube y revisas PRs desde el iPhone
-
#72
Microsoft estrena `@playwright/cli` para agentes: 4x menos tokens que Playwright MCP en la misma tarea de navegador
-
#71
Claude Code v2.1.196: `--safe-mode`, `/cd` y `disableBundledSkills` para depurar sin tirar el caché
-
#70
Claude Code v2.1.195: clasificador para TODOS los comandos Bash y autocompletado en vivo
-
#70
Claude Code v2.1.191: `/rewind` recupera conversación pre `/clear`, OAuth de MCP con reintentos y -37% CPU en streaming
-
#69
Pydantic AI v2.0 GA: capabilities como primitiva, harness-first y soporte Opus 4.8 + Fable 5
-
#68
Copilot CLI: agentes de organización, cola de mensajes y Claude como provider en JetBrains
-
#67
Codex Record & Replay: grabas un flujo en macOS y Codex genera una skill reutilizable
-
#66
Workload Identity Federation pasa a GA en Claude API: tokens OIDC efímeros sustituyen a las claves sk-ant-*
-
#65
Google, GitHub y Microsoft publican ARD: estándar abierto para descubrir MCP, A2A y skills
-
#64
Deployment Simulation: OpenAI replaya 1,3M conversaciones reales contra el modelo candidato
-
#63
Google retira Gemini CLI el 18 de junio: migración obligatoria a Antigravity CLI sin Node
-
#62
HCompany libera Holo 3.1: familia open-weight de computer use de 0.8B a 35B-A3B con function calling nativo
-
#61
Anthropic separa el Agent SDK del subscription: crédito mensual a tarifa API plena sin rollover desde hoy
-
#60
Moonshot lanza Kimi K2.7-Code: MoE de 1T con 32B activos, Modified MIT y 30% menos tokens de razonamiento
-
#59
Anthropic apaga Claude Fable 5 y Mythos 5 a las 17:21 ET tras directiva de export control de EEUU
-
#58
DiffusionGemma 26B: Google libera un MoE de difusión Apache 2.0 con 700 tok/s en una RTX 5090
-
#57
Cursor SDK suma custom tools por MCP, auto-review por clasificador y subagentes anidados
-
#56
Anthropic libera Claude Fable 5, primer modelo Mythos público, con agentes que corren días y 1M de contexto
-
#55
Xcode 27 mete agentes Claude, GPT y Gemini con Agent Mode y control del iOS Simulator desde el IDE
-
#54
Anthropic abre su catálogo interno de Skills de Claude Code y singulariza la verificación como el patrón con mayor retorno
-
#53
Cursor mete custom stores, custom tools, auto-review y subagentes anidados en el SDK del agente
-
#52
MIT e IBM liberan ChartNet: 1,7M de charts sintéticos Apache 2.0 que dejan a un modelo pequeño batir a GPT-4o
-
#51
CodeAct con Hyperlight: el modelo escribe un programa Python que llama N herramientas y se ejecuta en micro-VM aislada
-
#50
MAI-Code-1-Flash: MoE 137B con 256k de contexto en VS Code Copilot, Fireworks, Baseten y OpenRouter
-
#49
Nemotron 3 Ultra: 550B MoE de pesos abiertos para agentes, vivo en HF y OpenRouter el 4 de junio
-
#48
MiniMax M3: primer modelo de pesos abiertos con 1M de contexto, multimodal y 59% en SWE-bench Pro
-
#47
Semble: búsqueda de código para agentes con 98% menos tokens que grep+read
-
#46
Compound Engineering Plugin: 37 skills y 51 agentes MIT en Claude Code, Cursor y Codex
-
#45
Claude Code 2.1.157: plugins se autocargan desde .claude/skills y `claude plugin init` los crea
-
#44
Claude Code 2.1.154 lanza Opus 4.8 y Dynamic Workflows con cientos de subagentes en paralelo
-
#43
Claude Code 2.1.152 lanza /code-review --fix y skills que pueden bloquear herramientas del modelo
-
#42
Anthropic publica un marketplace con 11 plugins oficiales para Claude Code (Apache 2.0)
-
#41
Bernstein orquesta 44 agentes de IA en paralelo con una cadena de auditoría firmada (Apache 2.0)
-
#40
Salesforce abre el servidor MCP de Data 360: ~200 operaciones de la API tras 3 herramientas fachada
-
#39
LangGraph 1.2: timeouts por nodo, manejadores de error tipo Saga y apagado con checkpoint reanudable
-
#38
Cohere publica Command A+: modelo de código abierto de 218B (Apache 2.0) en 2 H100 con citas verificables
-
#36
Nvidia entrega un trimestre récord de $81.6B pero la acción cae: el listón ya es la perfección
-
#36
Cactus Needle: modelo MIT de 26M para function calling on-device en un binario de 14MB
-
#35
Google Antigravity 2.0: CLI, SDK y Managed Agents en la Gemini API para sustituir un harness propio
-
#34
Google I/O 2026 arranca con Gemini agentic, Android XR glasses y Googlebooks
-
#33
Google I/O 2026 abre mañana con Gemini Intelligence y un nuevo flagship apuntando a Mythos y GPT-5.5
-
#32
OpenAI lleva Codex al móvil de ChatGPT con relay seguro multi-dispositivo
-
#31
OpenAI lanza ChatGPT for Personal Finance y se conecta a 12.000 bancos vía Plaid
-
#30
Cline libera @cline/sdk: runtime agéntico que bate a Claude Code en Terminal Bench 2.0
-
#29
Anthropic lanza Claude for Legal con 20+ conectores MCP y 12 plugins por práctica jurídica
-
#28
Google estrena Googlebook con Aluminium OS y Gemini Intelligence en el Android Show I/O Edition
-
#27
OpenAI lanza la Deployment Company con 4.000M$, 19 inversores y la adquisición de Tomoro
-
#26
Nvidia supera 40.000M$ en participaciones de IA en 2026: 30.000M$ a OpenAI, 5.300M$ entre Corning e IREN
-
#25
Anthropic suma 'dreaming', outcomes y multi-agent orchestration a Claude Managed Agents
-
#24
OpenAI lanza GPT-5.5-Cyber con Trusted Access for Cyber como respuesta a Mythos
-
#23
OpenAI lanza GPT-Realtime-2: voz con razonamiento GPT-5, traducción en vivo y Whisper streaming
-
#22
Code w/ Claude 2026: Code Review en GA, debutan Remote Agents y Anthropic dobla los límites de Claude Code
-
#21
OpenAI activa GPT-5.5 Instant como default de ChatGPT con 52,5% menos alucinaciones
-
#20
Anthropic, Blackstone, Hellman & Friedman y Goldman Sachs lanzan firma de servicios AI por 1.500M$
-
#19
El Departamento de Guerra firma con 8 empresas de IA para redes clasificadas y excluye a Anthropic
-
#18
Baidu ERNIE 5.1 Preview destrona a DeepSeek V4 como mejor modelo chino en LMArena
-
#17
El Pentágono firma con 7 empresas de IA para sus redes clasificadas y mantiene a Anthropic en la lista negra
-
#16
Anthropic estudia una ronda de 50.000 M$ a una valoración superior a 900.000 M$, por delante de OpenAI
-
#15
OpenAI lanza GPT-5.5, Codex y Managed Agents en AWS Bedrock un día después del fin de la exclusividad con Microsoft
-
#14
Musk al estrado en el día 2 del juicio contra OpenAI: 'no está bien robar una organización benéfica'
-
#13
Arranca el juicio Musk v. Altman en Oakland: 150.000M en daños y la conversión a fines de lucro de OpenAI en juego
-
#12
Meta recorta 8.000 empleos y Microsoft ofrece bajas voluntarias a 9.000 para sostener un capex de IA récord
-
#11
Anthropic publica Project Deal: 186 transacciones cerradas por agentes Claude en un marketplace interno
-
#10
Google invertirá hasta 40.000M en Anthropic: 10.000M en cash a valoración de 350.000M y 5 GW de cómputo
-
#9
OpenAI lanza GPT-5.5: primer modelo reentrenado desde GPT-4.5 y 82,7% en Terminal-Bench 2.0
-
#8
Anthropic firma con Google hasta 1 millón de TPUs Ironwood y más de 1 GW de cómputo en 2026
-
#7
Gemma 4: Google libera su familia open-weight más capaz con 31B Dense y 256K de contexto
-
#6
Amazon invierte otros $5B en Anthropic y Anthropic se compromete a $100B en AWS durante 10 años
-
#5
OpenAI lanza GPT-Rosalind: modelo de razonamiento frontier para biología y drug discovery
-
#4
Cerebras presenta el S-1 para salir a bolsa: $510M en ingresos 2025 y valoración privada de $26-28B
-
#3
Anthropic lanza Claude Design: prototipos, slides y visuales generados con Opus 4.7
-
#2
OpenAI rehace el Agents SDK: harness model-native, sandbox y memoria configurable
-
#1
Anthropic lanza Claude Opus 4.7: 70% en CursorBench y visión hasta 2.576 px