Saltar al contenido
5 minutos de IA

JUEVES, 6 DE AGOSTO DE 2026

NOTICIA DESTACADA

Anthropic activa Inference Hooks para Claude Enterprise: DLP inline con webhook abierto

Anthropic estrena en beta las Inference Hooks: cada prompt y cada respuesta de tool en Claude Enterprise pasa por un webhook tuyo (Netskope, Palo Alto, Proofpoint, Zscaler o propio) que devuelve allow o deny antes de que el modelo genere. Cubre chat, Claude Code, Cowork y tools de MCP, plugins y skills, con shadow mode, exclusiones por rol y rollouts porcentuales.

5 MIN LECTURA
NOTICIAS DEL DÍA
HERRAMIENTAS

Antigravity CLI llega a disponibilidad general y jubila gemini-cli en free, Pro y Ultra

Binario en Go que reemplaza gemini-cli con workflows asíncronos y el mismo harness que Antigravity 2.0. Compatibilidad con Skills, Hooks, Subagents y Extensions ahora como plugins: si tu prod aún llama a gemini-cli en free, Pro o Ultra, migras hoy o pierdes servicio.

Google Developers Blog · 3 MIN LEER FUENTE →
HERRAMIENTAS

Claude Code v2.1.223 cierra bypass de permisos en Bash y añade wildcard owner/* para marketplaces

Bypass real de permisos en Bash (comandos con tabulaciones o Unicode invisibles ocultaban parte del comando en el diálogo de aprobación) y escape del sandbox de workflow vía import() dinámico, ambos cerrados. Estrena wildcard owner/* para gobernar marketplaces por organización y hint /teleport en sesiones cloud.

Claude Code changelog · 3 MIN LEER FUENTE →
INDUSTRIA

Ayer expiró claude-opus-4-1-20250805: si tu prod aún lo llama, hoy responde 400

Hard retirement anunciado hace 60 días ejecutado ayer. Migra a claude-opus-4-8 (cambia solo el ID) y retira budget_tokens manual del bloque thinking o el nuevo modelo también responde 400. Corre tu evaluación antes del rollout: no es swap ciego.

TheRouter · 2 MIN LEER FUENTE →
TÉCNICAS

Simon Willison construye Raccoon Heist de un tirón con Claude Fable 5 en Claude Code for Web

Claude Fable 5 corriendo en Claude Code for Web construye un juego jugable completo a partir del contenido de un tuit de 2024 con concept-art de DALL-E. Repo y video demo incluidos: caso concreto para calibrar hasta dónde llega hoy el one-shot end-to-end con modelos Mythos.

Simon Willison · 5 MIN LEER FUENTE →
OPEN SOURCE

Skill Seekers convierte docs webs, repos y PDFs en Claude skills con detección de conflictos

Convierte cualquier documentación web, repo de GitHub, PDF, Word o EPUB en una skill SKILL.md lista para Claude Code, Cursor o Codex, con detección automática de conflictos entre skills. Menos copiar-pegar de docs y menos deriva de contenido cuando la documentación fuente cambia.

yusufkaraaslan/Skill_Seekers · 3 MIN LEER FUENTE →
HERRAMIENTAS

Cursor abre plugins de Google Workspace: el agente escribe en Gmail, Drive, Calendar, Docs y Sheets

Los plugins dan al agente acceso directo a Gmail, Drive, Calendar, Docs, Sheets y Chat desde el editor: buscar, redactar, enviar y agendar sin salir de Cursor. Elimina el pegamento manual entre el editor y la bandeja cuando el ticket exige contexto que vive en Google.

Cursor · 3 MIN LEER FUENTE →
SNIPPET DEL DÍA

Una técnica, prompt o comando aplicable hoy. Cópialo, pruébalo en tu stack en menos de 5 minutos y reenvíalo a un colega si te resulta útil. Ejemplos típicos: un prompt para evals, un patrón de agente, un comando que recorta tokens o un truco de RAG.

Test binario de alucinación en CI con DeepEval strict_mode

# DeepEval convierte el juicio LLM-as-judge en un test de pytest. # strict_mode=True fuerza puntuacion binaria (0 grounded, 1 falla) # y rompe el build en CI. Corre con `deepeval test run` o `pytest`; # el exit code se comporta como un test unitario cualquiera. # test_hallucination.py from deepeval import assert_test from deepeval.metrics import HallucinationMetric from deepeval.test_case import LLMTestCase def test_no_alucina_fuera_del_contexto(): metric = HallucinationMetric( threshold=0.0, # ignorado en modo estricto strict_mode=True, # binario: 0 grounded, 1 hallucinated model="gpt-5.6-luna", # juez barato; en alto stake usa opus-5 ) case = LLMTestCase( input="Cuando cerro Anthropic la Serie E?", actual_output=agente_bajo_test("Cuando cerro Anthropic la Serie E?"), context=[open("docs/anthropic-funding.md").read()], ) assert_test(case, [metric])

DEEPEVAL DOCS VER FUENTE →

Cierre

Hoy la señal es una: la gobernanza de agentes deja de ser un check post-hoc. Anthropic activa Inference Hooks para bloquear prompts antes de que el modelo genere, Claude Code v2.1.223 cierra tres rutas por las que un subagente podía saltarse los permisos y Google lleva Antigravity CLI a disponibilidad general con el mismo harness que su desktop. Al mismo tiempo, Opus 4.1 ya devuelve 400: si tu producción aún lo llama, se cae. La demo de Fable 5 con Raccoon Heist sube el listón del one-shot, pero lo que llega a producción es la infraestructura que audita, no la que asombra.

¿LLEVAS IA A PRODUCCIÓN EN TU EMPRESA?

Iván consulta sobre todo esto

Ingeniero IA con 3 años llevando LLMs a producción y más de 15 construyendo producto para Openbank, Inditex e Iberia. Agentes autónomos, RAG auditable: del piloto al despliegue real.