Saltar al contenido
5 minutos de IA

MARTES, 18 DE AGOSTO DE 2026

NOTICIA DESTACADA

Claude Code v2.1.234 reanuda solo la sesión al reset del rate limit y endurece rutas NT en Windows

Publicada el 17-ago, la versión reanuda la sesión sola cuando expira el límite de claude.ai (configurable en `/config`), añade badge del MR de GitLab en el statusline y rechaza rutas NT (`\??\`) en lecturas, restore, workflows y uploads. Recuperás horas de trabajo agente perdidas cada semana y cierras una vía de exfiltración NTLM en pipelines mixtos Linux/Windows.

4 MIN LECTURA
NOTICIAS DEL DÍA
TÉCNICAS

MCP 2026-07-28 aterriza en producción: SDKs de TypeScript, Python, Go y C# hablan ya la spec stateless

Adiós al par `initialize/initialized` y al `Mcp-Session-Id`: cada petición es autodescriptiva y `tools/list` devuelve `ttlMs` + `cacheScope`. Escalás MCP detrás de un balanceador sin almacén de sesión compartido y cacheás listados en la caché de instrucciones del cliente.

Model Context Protocol Blog · 5 MIN LEER FUENTE →
OPEN SOURCE

ai-evals-course/evals-skills abre 8 skills para que tu CLI de coding te monte los evals

El fork mantenido por Hamel Husain y Shreya Shankar sustituye al archivado hamelsmu/evals-skills: eval-audit, error-discovery, generate-synthetic-data, write-judge-prompt, validate-evaluator, evaluate-rag y build-review-interface. Las enchufás a Claude Code o Codex y dejás de escribir el andamiaje de evaluaciones a mano.

ai-evals-course/evals-skills · 4 MIN LEER FUENTE →
OPEN SOURCE

Strix libera bajo Apache 2.0 un pentester autónomo con recon, explotación y PoC ejecutable

Multiagente de código abierto (54,5k estrellas) con CLI, tablero local y acción de GitHub: escanea, valida vulnerabilidades con prueba de concepto y devuelve guía de remediación. Lo enchufás al pipeline como `strix scan` y bloqueás CVEs antes del despliegue sin depender de una SaaS externa.

usestrix/strix · 5 MIN LEER FUENTE →
HERRAMIENTAS

oMLX sirve LLMs, VLMs, embeddings y rerankers en Apple Silicon con la misma API que OpenAI o Anthropic

Servidor de inferencia Apache 2.0 para M-series con batching continuo y caché KV jerárquica (RAM + SSD) desde la barra de menú. Compatible con clientes OpenAI y Anthropic: migrás cargas sensibles al Mac sin tocar el código del agente.

jundot/omlx · 3 MIN LEER FUENTE →
HERRAMIENTAS

llmfit puntúa qué modelo cabe y corre bien en tu hardware antes de descargarlo

CLI y TUI en licencia MIT (32,4k estrellas) que detecta CPU, GPU y RAM y compara cada modelo por calidad, velocidad, ajuste y contexto sobre Ollama, llama.cpp, MLX, LM Studio y Docker Model Runner. Elimina el prueba y error al elegir cuantización para inferencia local.

AlexsJones/llmfit · 3 MIN LEER FUENTE →
INDIE / COMUNIDAD

career-ops: pipeline indie que evalúa el mercado laboral con un rubric A-F desde Claude Code o Codex

TUI en Node.js + Playwright que rastrea Greenhouse, Ashby y Lever, puntúa cada oferta con un rubric estructurado y genera CVs optimizados para ATS. Corre local con `npx @santifer/career-ops init` y nunca envía la candidatura sola: buena plantilla para cablear human-in-the-loop en tus propios agentes.

santifer/career-ops · 4 MIN LEER FUENTE →
SNIPPET DEL DÍA

Una técnica, prompt o comando aplicable hoy. Cópialo, pruébalo en tu stack en menos de 5 minutos y reenvíalo a un colega si te resulta útil. Ejemplos típicos: un prompt para evals, un patrón de agente, un comando que recorta tokens o un truco de RAG.

Loop de autoresearch a lo Karpathy: git commit si mejora, reset si no

# AUTORESEARCH LOOP — sistema para que un agente itere solo toda la noche. # Pegalo como parte de su system prompt; corre contra un train.py versionado # en git y usa el propio grafo de commits como memoria de que ideas ya # probo el agente y con que resultado. Sin infra, sin base de datos. BRANCH="autoresearch/$(date +%Y%m%d-%H%M)" git checkout -b "$BRANCH" LOOP FOREVER: 1. git status # donde estamos 2. edita train.py con UNA idea experimental # solo train.py, sin instalar 3. git commit -am "try: {{idea en 1 linea}}" 4. uv run train.py > run.log 2>&1 # presupuesto: 5 min wallclock 5. metric=$(grep "^val_bpb:" run.log | tail -1) 6. si run.log vacio: lee 50 lineas, arregla el crash, vuelve al paso 2 7. append a results.tsv (NO commitees results.tsv): commit, metric, vram 8. si metric MEJORA vs el mejor previo: manten el commit (avanza la rama) si NO mejora: git reset --hard HEAD~1 # descarta y prueba otra idea 9. NUNCA pauses para pedir permiso, sigue al paso 2 hasta interrupt humano

KARPATHY/AUTORESEARCH VER FUENTE →

Cierre

El día apunta a una tesis coherente: el operador por defecto ya no es una persona tecleando, sino un agente en bucle. Claude Code 2.1.234 reanuda solo tras el rate limit y karpathy/autoresearch publica el patrón mínimo para dejar experimentos corriendo toda la noche con git como memoria. Por abajo se cierra la foto: la spec MCP 2026-07-28 entra en los SDKs y ai-evals-course/evals-skills codifica cómo se calibra un juez LLM antes de creerse sus notas. Antes de sumar más autonomía, mide qué está fallando.

¿LLEVAS IA A PRODUCCIÓN EN TU EMPRESA?

Iván consulta sobre todo esto

Ingeniero IA con 3 años llevando LLMs a producción y más de 15 construyendo producto para Openbank, Inditex e Iberia. Agentes autónomos, RAG auditable: del piloto al despliegue real.