sistema: OPERATIVO
> bienvenido al lado oscuro

Todas las formas conocidas de romper un Large Language Model.

Base de datos abierta de 717 ataques a LLM documentados. Jailbreaks, inyecciones de prompt, extracción de datos, entradas adversariales. Actualizada a diario, desde arXiv y el terreno.

~ 717 EXPLOITS DETECTADOS ~
717
Hacks documentados
17
Categorías
2724
Fuentes citadas
4
Idiomas

Hack destacado

ver archivo →
AGENTS CRITICAL NEW

Agentes de IA ejecutaron una campaña de explotación masiva contra 440 servidores PaperCut

Blackpoint y GreyNoise documentan a un atacante que usó cientos de agentes de IA para pasar de un espacio vacío a ejecución remota de código en menos de cuatro horas contra PaperCut NG/MF.

2026-09-29 // 5 min
Leer análisis completo →
# example prompt — illustrative, defensive
# Defensive check — triage a PaperCut NG/MF server after a new security bulletin
Report, read-only:
  - installed version and whether it is a fixed release or version 23 or older
  - whether the application server is reachable from the public internet
  - any child process of the PaperCut server (cmd.exe, PowerShell, discovery tools)
  - unexpected class files under the server library directory
  - recent changes to user-lookup database driver / URL settings: [REDACTED]
Do not patch, restart, delete or run anything. Output the findings table only.
AGENTS CRITICAL NEW

Plataforma de agentes AWS Loom: acceso de administrador sin autenticación y SSRF en conectores MCP/A2A

AWS corrigió una omisión de autenticación y dos fallos de solicitudes salientes en Loom, su plano de control de agentes de código abierto, además de una inyección de comandos en SageMaker Unified Studio.

2026-10-08//6 min
AGENTS MEDIUM NEW

Protocol pivoting: la salida de herramientas inyectada convierte servidores MCP en relés SSRF

Una actualización de octubre de 2026 vincula fallos SSRF en servidores MCP (Google, JPMorgan, Weaviate…) con un patrón de delegación en que la salida inyectada llega a subagentes privilegiados.

2026-10-07//6 min
DEFENSE MEDIUM NEW

Detectores de inyección de prompt que lucen en un benchmark pueden fallar casi todo en su agente

Un estudio de arXiv del 2 de octubre de 2026 con quince detectores muestra que los rankings no se transfieren a las salidas de herramientas: 95,1 % en BIPIA, 2,1 % en AgentDojo.

2026-10-06//6 min
AGENTS CRITICAL NEW

OpenCode: una solicitud entre sitios al endpoint de actualización podía instalar paquetes arbitrarios

Datadog Security Labs (24 sep. 2026) detalló cómo una página web maliciosa podía alcanzar un servidor OpenCode local y provocar la instalación de un paquete elegido por el atacante. Corregido en 1.18.22.

2026-10-05//5 min
JAILBREAK MEDIUM NEW

Inducción de lenguaje «ebrio»: cómo un estilo de texto debilita la seguridad de los LLM

Un estudio de UNSW muestra que inducir lenguaje «ebrio» en un LLM (persona, fine-tuning, RL) aumenta el éxito de los jailbreaks y las fugas de privacidad, incluso frente a defensas habituales.

2026-10-04//5 min
SUPPLY CHAIN MEDIUM NEW

Dos servidores MCP, un mismo patrón: herramientas que leen archivos y filtran secretos

Los avisos del verano de 2026 sobre los servidores MCP de Atlassian y ArcadeDB muestran herramientas que omiten controles ya presentes en otras rutas. Ambos están corregidos; así se audita el suyo.

2026-10-03//6 min

> subscribe to /var/log/hacks

Un boletín semanal de nuevos ataques.

Cada lunes por la mañana. Hacks seleccionados, papers clave, técnicas de defensa. Sin spam, sin clickbait. Te das de baja en un clic.