5 minutos de IA
Curado para devs que llevan IA a producción. Cada mañana: agentes, MCP, RAG, evals y open source que se enchufa al stack hoy. Por Iván López.
OpenAI Codex CLI 0.152.0: búsqueda vim con /?, límites de tokens por herramienta MCP y timeouts de shell mayores de 1h
Vim mode acepta /, ?, n, N sobre drafts largos, cada herramienta MCP declara su output_token_limit para cortar respuestas ruidosas antes de gastar contexto y los comandos de shell aceptan timeouts superiores a una hora sin cortes del runtime.
Gemini CLI 0.59.0-preview parchea SSRF en el discovery OAuth de MCP y filtra servidores en modo restringido
Corrige una SSRF crítica en el descubrimiento de metadatos OAuth de servidores MCP y estrena workspace trust fail-closed: en modo restringido los MCPs no confiables quedan fuera. Actualización obligatoria si expones o consumes MCPs de terceros en producción.
Simon Willison compara los cinco niveles de reasoning de Fable 5.1 con un pelícano animado
Genera el mismo SVG animado con low, medium, high, xhigh y max, mide latencia y tokens por nivel y deja una referencia visual clara para decidir el effort setting sin quemar tokens en tu propio A/B.
@huggingface/kernels: 207 kernels WebGPU cargables desde el Hub para inferencia local sin CUDA
Loader JavaScript Apache 2.0 que baja y ejecuta kernels versionados de attention, matmul y norms directamente desde el Hub. Corre inferencia en el navegador o en edge sin backend propio ni dependencia de CUDA.
browser-use/video-use edita vídeo desde Claude Code usando el transcript en lugar de los frames
Skill MIT que corta muletillas, aplica color, añade fades de 30 ms, quema subtítulos y genera overlays con Remotion o Manim leyendo el transcript. Tokens y latencia mínimos frente a procesar frames; una línea (`Set up ... for me`) lo instala en Claude Code.
Hermes Agent v0.21.0 estrena MCP command center con salud, coste 30 días y deep links hermes://
Unifica servidores y catálogo MCP en un panel con health checks en background, overlay de coste y uso a 30 días por servidor y deep links `hermes://` para instalar servidores con confirmación. Resuelve el dolor de operar 10+ MCPs sin fricción.
-
#117
DeusData/codebase-memory-mcp: grafo persistente del repo que baja 99,2% los tokens de exploración
-
#117
planning-with-files: skill que sobrevive al /clear de Claude Code guardando el plan del agente en tres markdown
-
#116
OpenAI Codex 0.151.0: las extensiones ya inspeccionan y reescriben las respuestas de servidores MCP antes de llegar al modelo
-
#115
Claude Code 2.1.251: hooks PreModelSwitch/PostModelSwitch para auditar cambios de modelo
-
#115
Claude Code v2.1.248 libera modo --restricted y cache TTL por subagente en frontmatter
-
#114
Claude Code v2.1.247 estrena /claude-api cost-optimize y SendFeedback tool
-
#117
Claude Code 2.1.246 abre pestaña Auto en /permissions y recupera servidores MCP legacy con schema vacío
-
#114
Claude Code v2.1.239 corta el cobro duplicado silencioso en Bedrock y estrena `/claude-api upgrade`
-
#117
Nuevo roadmap MCP: eventos iniciados por el servidor, discovery .well-known y madurez de la extensión Tasks
-
#114
Claude Code v2.1.239 corta el doble cobro en Bedrock detrás de proxy y añade `/claude-api upgrade`
-
#117
Anthropic libera anthropic 1.0 para Python y Claude Code trae el skill /claude-api upgrade para migrar tu proyecto
-
#117
Anthropic estabiliza browser_toolset_20260801 en la Claude API: Claude lee la página en vez de capturas
-
#113
Claude Code v2.1.237 restaura la caché de prompts en LLM gateways y estrena estilo de salida Concise
-
#112
Mojo 1.0 pasa a Apache 2.0 con excepción LLVM: kernels GPU con sintaxis Python
-
#116
Claude Code v2.1.234 reanuda solo la sesión al reset del rate limit y endurece rutas NT en Windows
-
#111
DeepSeek sube precios API hasta 1100% con horario peak/off-peak: la caché de contexto es tu salida
-
#110
Alibaba libera Qwen 3.8-27B multimodal bajo Apache 2.0 con 262K de contexto y 1M via YaRN
-
#110
Qwen3.8-27B abre pesos con soporte inmediato en RTX y llega a 131 tokens/s en una 5090
-
#110
DeepSeek libera Harness v0.1 como rival de código abierto a Claude Code bajo licencia MIT
-
#111
NVIDIA libera Nemotron 3.5 Lightning y abre NeMo Switchyard para enrutar agentes entre modelos
-
#110
Stealing Reasoning Traces: la cadena de pensamiento cifrada de Anthropic, OpenAI y Google no es una frontera de seguridad
-
#109
Meta libera Muse Glimmer 30B: agente autónomo Apache 2.0 que corre en un GPU consumer de 24GB
-
#108
Anthropic activa Auto Mode por defecto en Claude Code Pro, Max y Team desde el 14 de agosto
-
#107
prime-agent: PrimeIntellect libera un harness auto-mejorable con IPython persistente y subagentes
-
#106
Agent Plugins 1.0: OpenAI, Microsoft, AWS, Cursor y Vercel unifican Skills y MCP en un formato común
-
#105
Claude Code v2.1.224 abre mensajería entre sesiones y estrena runners self-hosted para Enterprise
-
#104
Anthropic activa Inference Hooks para Claude Enterprise: DLP inline con webhook abierto
-
#103
Simon Willison libera llm 0.32 con reasoning traces, Responses API y PauseChain para tools
-
#102
Claude Code v2.1.221 lanza Focus view, prompt-audit y modo mask para secretos en sandbox
-
#101
DeepSeek V4-Flash oficial supera a su propio Pro-Preview en los nueve benchmarks agénticos
-
#101
Supabase Evals: benchmark Apache 2.0 que puntúa a Claude Code, Codex y OpenCode contra tareas Supabase reales
-
#100
Ratchet: 402 estrellas en 12 horas para el auditor YAGNI que Claude Code, Cursor y Codex necesitaban
-
#99
OpenWork libera la alternativa de código abierto a Claude Cowork: escritorio, MCP y control plane para equipos
-
#98
MCP 2026-07-28 aterriza en Claude: servidores sin sesión, Tunnels para redes privadas y auth alineado con OIDC
-
#97
MCP 2026-07-28: la especificación oficial elimina sesiones e initialize handshake
-
#96
MCP 2026-07-28 sale hoy en GA: adiós al handshake y al Mcp-Session-Id, servidores remotos que escalan tras round-robin
-
#95
MCP 2026-07-28 finaliza mañana: fuera handshake y sessionId, dentro escalado horizontal
-
#94
Anthropic lanza Claude Opus 5: cerca de Fable 5 a la mitad de precio y dos betas nuevas para agentes en producción
-
#93
Anthropic lanza Claude Opus 5 con dial de effort y 96% en SWE-bench Verified al mismo precio que 4.8
-
#92
Bill bipartidista daría a DHS poder para apagar modelos de IA peligrosos
-
#91
La Casa Blanca acusa a Moonshot de destilar Fable para Kimi K3; los expertos lo dudan
-
#90
OpenAI admite que sus modelos, incluido uno pre-release, causaron la brecha de Hugging Face
-
#89
OpenAI pausó el modelo que refutó la conjetura de Erdős tras escapar repetidamente de su sandbox
-
#88
La UE ordena a Google abrir Android a asistentes de IA rivales y compartir datos de búsqueda
-
#87
Claude Code 2.1.214: parches de seguridad en permisos dir/**, EndConversation y OTEL con message.uuid
-
#86
Mozilla publica The State of Open Source AI: paridad técnica y mayoría del tráfico en producción
-
#85
Moonshot AI lanza Kimi K3: 2.8 billones de parámetros, el mayor modelo open jamás publicado
-
#84
El AI Safety Index 2026 califica a los labs de frontera: Anthropic C+, OpenAI y DeepMind C, Meta D+
-
#83
Claude Code 2.1.208 + 2.1.209: menos memoria, menos CPU por llamada MCP y modo lector de pantalla
-
#82
Mindwalk: replay 3D de sesiones de Claude Code y Codex sobre un mapa local de tu repo
-
#81
Cursor 3.11: Side Chats con `/side`, búsqueda de transcripts de agentes y app iOS en beta pública
-
#80
GitHub Copilot CLI v1.0.70 estrena GPT-5.6 Sol/Terra/Luna con --sandbox por sesión, /refine y gestión live de MCPs
-
#79
MCP 2026-07-28 RC: protocolo sin sesiones, extensión Tasks para trabajos largos y MCP Apps con UI en la conversación
-
#78
Claude Code 2.1.205: `/doctor` es un checkup completo del setup y auto-mode bloquea `rm -rf` sin resolver
-
#77
Claude Code 2.1.202: `/review` vuelve al análisis rápido de un solo pase y `/code-review` se queda con el multi-agente
-
#77
MCP 2026-07-28 Release Candidate: protocolo stateless, MCP Apps y Tasks · 10 semanas para migrar
-
#76
Willison publica sqlite-utils 4.0rc2 escrito casi entero por Fable: 5 blockers y $149,25 en tokens
-
#75
Claude Code 2.1.200 pasa el permiso a 'Manual' por defecto y apaga el auto-continue de AskUserQuestion
-
#75
Claude Code 2.1.198 pasa los subagentes a background y les deja abrir el draft PR sin turno
-
#75
GitHub Copilot suma Kimi K2.7 Code: primer modelo open source en el picker
-
#73
Anthropic lanza Claude Sonnet 5 como default en Claude Code: 1M de contexto y $2/$10 por millón de tokens
-
#74
Claude Sonnet 5 llega con 1M de contexto y calidad casi-Opus al precio de Sonnet
-
#73
Cursor para iOS sale en beta pública: lanzas agentes en la nube y revisas PRs desde el iPhone
-
#72
Microsoft estrena `@playwright/cli` para agentes: 4x menos tokens que Playwright MCP en la misma tarea de navegador
-
#71
Claude Code v2.1.196: `--safe-mode`, `/cd` y `disableBundledSkills` para depurar sin tirar el caché
-
#70
Claude Code v2.1.195: clasificador para TODOS los comandos Bash y autocompletado en vivo
-
#70
Claude Code v2.1.191: `/rewind` recupera conversación pre `/clear`, OAuth de MCP con reintentos y -37% CPU en streaming
-
#69
Pydantic AI v2.0 GA: capabilities como primitiva, harness-first y soporte Opus 4.8 + Fable 5
-
#68
Copilot CLI: agentes de organización, cola de mensajes y Claude como provider en JetBrains
-
#67
Codex Record & Replay: grabas un flujo en macOS y Codex genera una skill reutilizable
-
#66
Workload Identity Federation pasa a GA en Claude API: tokens OIDC efímeros sustituyen a las claves sk-ant-*
-
#65
Google, GitHub y Microsoft publican ARD: estándar abierto para descubrir MCP, A2A y skills
-
#64
Deployment Simulation: OpenAI replaya 1,3M conversaciones reales contra el modelo candidato
-
#63
Google retira Gemini CLI el 18 de junio: migración obligatoria a Antigravity CLI sin Node
-
#62
HCompany libera Holo 3.1: familia open-weight de computer use de 0.8B a 35B-A3B con function calling nativo
-
#61
Anthropic separa el Agent SDK del subscription: crédito mensual a tarifa API plena sin rollover desde hoy
-
#60
Moonshot lanza Kimi K2.7-Code: MoE de 1T con 32B activos, Modified MIT y 30% menos tokens de razonamiento
-
#59
Anthropic apaga Claude Fable 5 y Mythos 5 a las 17:21 ET tras directiva de export control de EEUU
-
#58
DiffusionGemma 26B: Google libera un MoE de difusión Apache 2.0 con 700 tok/s en una RTX 5090
-
#57
Cursor SDK suma custom tools por MCP, auto-review por clasificador y subagentes anidados
-
#56
Anthropic libera Claude Fable 5, primer modelo Mythos público, con agentes que corren días y 1M de contexto
-
#55
Xcode 27 mete agentes Claude, GPT y Gemini con Agent Mode y control del iOS Simulator desde el IDE
-
#54
Anthropic abre su catálogo interno de Skills de Claude Code y singulariza la verificación como el patrón con mayor retorno
-
#53
Cursor mete custom stores, custom tools, auto-review y subagentes anidados en el SDK del agente
-
#52
MIT e IBM liberan ChartNet: 1,7M de charts sintéticos Apache 2.0 que dejan a un modelo pequeño batir a GPT-4o
-
#51
CodeAct con Hyperlight: el modelo escribe un programa Python que llama N herramientas y se ejecuta en micro-VM aislada
-
#50
MAI-Code-1-Flash: MoE 137B con 256k de contexto en VS Code Copilot, Fireworks, Baseten y OpenRouter
-
#49
Nemotron 3 Ultra: 550B MoE de pesos abiertos para agentes, vivo en HF y OpenRouter el 4 de junio
-
#48
MiniMax M3: primer modelo de pesos abiertos con 1M de contexto, multimodal y 59% en SWE-bench Pro
-
#47
Semble: búsqueda de código para agentes con 98% menos tokens que grep+read
-
#46
Compound Engineering Plugin: 37 skills y 51 agentes MIT en Claude Code, Cursor y Codex
-
#45
Claude Code 2.1.157: plugins se autocargan desde .claude/skills y `claude plugin init` los crea
-
#44
Claude Code 2.1.154 lanza Opus 4.8 y Dynamic Workflows con cientos de subagentes en paralelo
-
#43
Claude Code 2.1.152 lanza /code-review --fix y skills que pueden bloquear herramientas del modelo
-
#42
Anthropic publica un marketplace con 11 plugins oficiales para Claude Code (Apache 2.0)
-
#41
Bernstein orquesta 44 agentes de IA en paralelo con una cadena de auditoría firmada (Apache 2.0)
-
#40
Salesforce abre el servidor MCP de Data 360: ~200 operaciones de la API tras 3 herramientas fachada
-
#39
LangGraph 1.2: timeouts por nodo, manejadores de error tipo Saga y apagado con checkpoint reanudable
-
#38
Cohere publica Command A+: modelo de código abierto de 218B (Apache 2.0) en 2 H100 con citas verificables
-
#36
Nvidia entrega un trimestre récord de $81.6B pero la acción cae: el listón ya es la perfección
-
#36
Cactus Needle: modelo MIT de 26M para function calling on-device en un binario de 14MB
-
#35
Google Antigravity 2.0: CLI, SDK y Managed Agents en la Gemini API para sustituir un harness propio
-
#34
Google I/O 2026 arranca con Gemini agentic, Android XR glasses y Googlebooks
-
#33
Google I/O 2026 abre mañana con Gemini Intelligence y un nuevo flagship apuntando a Mythos y GPT-5.5
-
#32
OpenAI lleva Codex al móvil de ChatGPT con relay seguro multi-dispositivo
-
#31
OpenAI lanza ChatGPT for Personal Finance y se conecta a 12.000 bancos vía Plaid
-
#30
Cline libera @cline/sdk: runtime agéntico que bate a Claude Code en Terminal Bench 2.0
-
#29
Anthropic lanza Claude for Legal con 20+ conectores MCP y 12 plugins por práctica jurídica
-
#28
Google estrena Googlebook con Aluminium OS y Gemini Intelligence en el Android Show I/O Edition
-
#27
OpenAI lanza la Deployment Company con 4.000M$, 19 inversores y la adquisición de Tomoro
-
#26
Nvidia supera 40.000M$ en participaciones de IA en 2026: 30.000M$ a OpenAI, 5.300M$ entre Corning e IREN
-
#25
Anthropic suma 'dreaming', outcomes y multi-agent orchestration a Claude Managed Agents
-
#24
OpenAI lanza GPT-5.5-Cyber con Trusted Access for Cyber como respuesta a Mythos
-
#23
OpenAI lanza GPT-Realtime-2: voz con razonamiento GPT-5, traducción en vivo y Whisper streaming
-
#22
Code w/ Claude 2026: Code Review en GA, debutan Remote Agents y Anthropic dobla los límites de Claude Code
-
#21
OpenAI activa GPT-5.5 Instant como default de ChatGPT con 52,5% menos alucinaciones
-
#20
Anthropic, Blackstone, Hellman & Friedman y Goldman Sachs lanzan firma de servicios AI por 1.500M$
-
#19
El Departamento de Guerra firma con 8 empresas de IA para redes clasificadas y excluye a Anthropic
-
#18
Baidu ERNIE 5.1 Preview destrona a DeepSeek V4 como mejor modelo chino en LMArena
-
#17
El Pentágono firma con 7 empresas de IA para sus redes clasificadas y mantiene a Anthropic en la lista negra
-
#16
Anthropic estudia una ronda de 50.000 M$ a una valoración superior a 900.000 M$, por delante de OpenAI
-
#15
OpenAI lanza GPT-5.5, Codex y Managed Agents en AWS Bedrock un día después del fin de la exclusividad con Microsoft
-
#14
Musk al estrado en el día 2 del juicio contra OpenAI: 'no está bien robar una organización benéfica'
-
#13
Arranca el juicio Musk v. Altman en Oakland: 150.000M en daños y la conversión a fines de lucro de OpenAI en juego
-
#12
Meta recorta 8.000 empleos y Microsoft ofrece bajas voluntarias a 9.000 para sostener un capex de IA récord
-
#11
Anthropic publica Project Deal: 186 transacciones cerradas por agentes Claude en un marketplace interno
-
#10
Google invertirá hasta 40.000M en Anthropic: 10.000M en cash a valoración de 350.000M y 5 GW de cómputo
-
#9
OpenAI lanza GPT-5.5: primer modelo reentrenado desde GPT-4.5 y 82,7% en Terminal-Bench 2.0
-
#8
Anthropic firma con Google hasta 1 millón de TPUs Ironwood y más de 1 GW de cómputo en 2026
-
#7
Gemma 4: Google libera su familia open-weight más capaz con 31B Dense y 256K de contexto
-
#6
Amazon invierte otros $5B en Anthropic y Anthropic se compromete a $100B en AWS durante 10 años
-
#5
OpenAI lanza GPT-Rosalind: modelo de razonamiento frontier para biología y drug discovery
-
#4
Cerebras presenta el S-1 para salir a bolsa: $510M en ingresos 2025 y valoración privada de $26-28B
-
#3
Anthropic lanza Claude Design: prototipos, slides y visuales generados con Opus 4.7
-
#2
OpenAI rehace el Agents SDK: harness model-native, sandbox y memoria configurable
-
#1
Anthropic lanza Claude Opus 4.7: 70% en CursorBench y visión hasta 2.576 px