JUEVES, 6 DE AGOSTO DE 2026
Anthropic activa Inference Hooks para Claude Enterprise: DLP inline con webhook abierto
Anthropic estrena en beta las Inference Hooks: cada prompt y cada respuesta de tool en Claude Enterprise pasa por un webhook tuyo (Netskope, Palo Alto, Proofpoint, Zscaler o propio) que devuelve allow o deny antes de que el modelo genere. Cubre chat, Claude Code, Cowork y tools de MCP, plugins y skills, con shadow mode, exclusiones por rol y rollouts porcentuales.
5 MIN LECTURAAntigravity CLI llega a disponibilidad general y jubila gemini-cli en free, Pro y Ultra
Binario en Go que reemplaza gemini-cli con workflows asíncronos y el mismo harness que Antigravity 2.0. Compatibilidad con Skills, Hooks, Subagents y Extensions ahora como plugins: si tu prod aún llama a gemini-cli en free, Pro o Ultra, migras hoy o pierdes servicio.
Claude Code v2.1.223 cierra bypass de permisos en Bash y añade wildcard owner/* para marketplaces
Bypass real de permisos en Bash (comandos con tabulaciones o Unicode invisibles ocultaban parte del comando en el diálogo de aprobación) y escape del sandbox de workflow vía import() dinámico, ambos cerrados. Estrena wildcard owner/* para gobernar marketplaces por organización y hint /teleport en sesiones cloud.
Ayer expiró claude-opus-4-1-20250805: si tu prod aún lo llama, hoy responde 400
Hard retirement anunciado hace 60 días ejecutado ayer. Migra a claude-opus-4-8 (cambia solo el ID) y retira budget_tokens manual del bloque thinking o el nuevo modelo también responde 400. Corre tu evaluación antes del rollout: no es swap ciego.
Simon Willison construye Raccoon Heist de un tirón con Claude Fable 5 en Claude Code for Web
Claude Fable 5 corriendo en Claude Code for Web construye un juego jugable completo a partir del contenido de un tuit de 2024 con concept-art de DALL-E. Repo y video demo incluidos: caso concreto para calibrar hasta dónde llega hoy el one-shot end-to-end con modelos Mythos.
Skill Seekers convierte docs webs, repos y PDFs en Claude skills con detección de conflictos
Convierte cualquier documentación web, repo de GitHub, PDF, Word o EPUB en una skill SKILL.md lista para Claude Code, Cursor o Codex, con detección automática de conflictos entre skills. Menos copiar-pegar de docs y menos deriva de contenido cuando la documentación fuente cambia.
Cursor abre plugins de Google Workspace: el agente escribe en Gmail, Drive, Calendar, Docs y Sheets
Los plugins dan al agente acceso directo a Gmail, Drive, Calendar, Docs, Sheets y Chat desde el editor: buscar, redactar, enviar y agendar sin salir de Cursor. Elimina el pegamento manual entre el editor y la bandeja cuando el ticket exige contexto que vive en Google.
Una técnica, prompt o comando aplicable hoy. Cópialo, pruébalo en tu stack en menos de 5 minutos y reenvíalo a un colega si te resulta útil. Ejemplos típicos: un prompt para evals, un patrón de agente, un comando que recorta tokens o un truco de RAG.
Test binario de alucinación en CI con DeepEval strict_mode
# DeepEval convierte el juicio LLM-as-judge en un test de pytest. # strict_mode=True fuerza puntuacion binaria (0 grounded, 1 falla) # y rompe el build en CI. Corre con `deepeval test run` o `pytest`; # el exit code se comporta como un test unitario cualquiera. # test_hallucination.py from deepeval import assert_test from deepeval.metrics import HallucinationMetric from deepeval.test_case import LLMTestCase def test_no_alucina_fuera_del_contexto(): metric = HallucinationMetric( threshold=0.0, # ignorado en modo estricto strict_mode=True, # binario: 0 grounded, 1 hallucinated model="gpt-5.6-luna", # juez barato; en alto stake usa opus-5 ) case = LLMTestCase( input="Cuando cerro Anthropic la Serie E?", actual_output=agente_bajo_test("Cuando cerro Anthropic la Serie E?"), context=[open("docs/anthropic-funding.md").read()], ) assert_test(case, [metric])
- 01 llm-anthropic 0.26 estrena server-side tools (WebSearch, WebFetch, CodeExecution) y streaming tipado
- 02 Simon Willison compara Spark 1.2, Spark 1.1 y Spark con el benchmark del pelícano en SVG
- 03 Metasploit 6.5 abre su motor de exploits a Claude y Cursor vía MCP con 16 tools expuestas
- 04 EU AI Act: reglas de transparencia ya exigibles, chatbots y deepfakes deben identificarse
- 05 Cursor Auto pasa a enrutarse por Cursor Router en desktop, web, iOS, CLI y SDK
Cierre
Hoy la señal es una: la gobernanza de agentes deja de ser un check post-hoc. Anthropic activa Inference Hooks para bloquear prompts antes de que el modelo genere, Claude Code v2.1.223 cierra tres rutas por las que un subagente podía saltarse los permisos y Google lleva Antigravity CLI a disponibilidad general con el mismo harness que su desktop. Al mismo tiempo, Opus 4.1 ya devuelve 400: si tu producción aún lo llama, se cae. La demo de Fable 5 con Raccoon Heist sube el listón del one-shot, pero lo que llega a producción es la infraestructura que audita, no la que asombra.
Iván consulta sobre todo esto
Ingeniero IA con 3 años llevando LLMs a producción y más de 15 construyendo producto para Openbank, Inditex e Iberia. Agentes autónomos, RAG auditable: del piloto al despliegue real.