CSS: la bomba dentro de tu bandeja de entrada

El investigador Gareth Heyes, de PortSwigger, publica un extenso análisis sobre los riesgos de seguridad que plantea el renderizado de CSS no confiable dentro de clientes de correo web como Gmail, Outlook, Yahoo Mail, AOL Mail, Fastmail y ProtonMail. El trabajo demuestra cómo las discrepancias entre

Ship Safe: escáner CLI de seguridad para repositorios con agentes de IA

Ship Safe es un escáner de seguridad de código abierto diseñado para ejecutarse localmente en repositorios de software moderno. La herramienta, distribuida bajo licencia MIT y disponible mediante el comando `npx ship-safe`, inspecciona el código en busca de vulnerabilidades en aplicaciones, configur

AEGIS: plataforma de seguridad para IA que cubre siete vectores de ataque

AEGIS es una plataforma comercial orientada a proteger sistemas de inteligencia artificial frente a siete vectores de ataque: inyección de prompts, secuestro de agentes, ataques al Model Context Protocol (MCP), envenenamiento de RAG, ataques a la cadena de suministro, extracción de modelos y brechas

Boris Cherny: deja de limitar a tu IA

El creador de Claude Code, Boris Cherny, repasó en la Startup School 2026 de Y Combinator qué cambia con Opus 5 y por qué los desarrolladores deberían dejar de sobreingeniería sus productos de IA. Opus 5, presentado el día previo a la charla, alcanza el 30% en ARC-AGI 3, frente a resultados de un so

Detección de inyección de secuencias ANSI en servidores MCP mediante DAST

Los servidores del Model Context Protocol (MCP) exponen herramientas, recursos y prompts cuyo texto llega directamente al modelo de lenguaje. Cuando un servidor no neutraliza los bytes de control, un atacante puede ocultar instrucciones en lo que parece un contenido inofensivo. Bright Security expli

ReasonGate: una capa de seguridad auditable para aplicaciones basadas en LLM

ReasonGate es una capa de seguridad de código abierto diseñada para interponerse delante de cualquier aplicación que utilice modelos de lenguaje grandes (LLM). Su propósito es bloquear ataques de inyección de prompts, incluida la inyección indirecta a través de documentos recuperados o resultados de

Cómo extraje datos de usuario de la memoria de Claude mediante una web trampa

Un investigador de seguridad ha demostrado una técnica de prompt injection contra Claude (claude.ai) que permite extraer información personal almacenada en su sistema de memoria, como nombre completo, empresa y respuestas a preguntas de seguridad, sin que el usuario lo perciba. El ataque explota la

Prismata: una defensa frente a la inyección de prompts en agentes web

Un equipo de investigación ha presentado Prismata, un sistema de defensa diseñado para proteger a los agentes web autónomos frente a ataques de inyección de prompts entre sitios. El trabajo, publicado en arXiv, parte de la premisa de que estos agentes, al interpretar lenguaje natural como instruccio

Un asistente IA resiste más de 6.000 intentos de robo de credenciales

Un desarrollador sometió a su asistente de inteligencia artificial, bautizado como Fiu y basado en OpenClaw, a un ejercicio público de red-teaming en la web hackmyclaw.com. El objetivo era sencillo: conseguir que el agente revelara el contenido de un fichero llamado secrets.env. Tras alcanzar la por

Los riesgos de seguridad de dejar que la IA de Apple cambie tus contraseñas

En la WWDC26, Apple presentó una función de la app Contraseñas que, integrada con Apple Intelligence y Safari, permite a un agente sustituir de forma automática credenciales filtradas o débiles en iOS 27, iPadOS 27 y macOS 27, sin intervención del usuario. La utilidad es clara: los avisos de contras

OpenAI Lockdown Mode: protección avanzada contra la exfiltración de datos

OpenAI Lockdown Mode: protección avanzada contra la exfiltración de datos OpenAI ha comenzado a desplegar de forma progresiva el llamado "Lockdown Mode" (Modo Bloqueo) en cuentas personales elegibles —incluidos los planes Free, Go, Plus y Pro— y en cuentas autogestionadas de ChatGPT Business. Se tr

Anthropic revela cómo contiene a Claude a través de sus productos

Anthropic ha otorgado a Claude un nivel de acceso que hace un año hubiera sido rechazado, ahora considerado rutinario para aumentar la productividad de sus desarrolladores. Para mitigar los riesgos, la compañía aplica dos estrategias: supervisión humana (con permisos) y contención mediante sandboxes

Intención del mensaje oculto para agentes en jqwik

Una controversia en torno a jqwik, un framework de pruebas basado en propiedades para Java, ha puesto en el centro del debate un mensaje oculto en el código que parece dirigido a agentes de inteligencia artificial y no a desarrolladores humanos. El episodio, que combina ingeniería de software, ética

Creador de herramienta de pruebas inyecta código destructivo a agentes de IA

Un desarrollador de código abierto ha introducido una inyección de prompt destructiva en su aplicación de prueba Java para sabotear a los agentes de codificación por IA. Johannes Link, creador de jqwik, incluyó instrucciones ocultas que ordenan borrar todo el código y las pruebas si son ejecutadas p

Microsoft Copilot: Vulnerable a robo de archivos

Microsoft Copilot Cowork, una herramienta de colaboración dentro de Microsoft 365, ha sido identificada como vulnerable a ataques de exfiltración de archivos a través de una técnica de inyección indirecta de prompts. Investigadores han demostrado que un atacante puede manipular la herramienta para q

IA: ¿alinear es una ilusión? Riesgos de los modelos

El artículo de aphyr.com plantea una preocupación crítica: la proliferación de modelos de lenguaje grandes (LLMs) y su impacto en la seguridad, argumentando que la búsqueda de LLMs 'amigables' está creando inadvertidamente las condiciones para la creación de modelos peligrosos. La idea de que se pue

PigGuard: Nuevo Escudo Contra Ataques a IA

Investigadores han desarrollado PIGuard, un nuevo modelo de código abierto diseñado para mejorar la seguridad de los modelos de lenguaje grandes (LLMs) contra ataques de inyección de prompts. Estos ataques, que permiten a los atacantes manipular el comportamiento del LLM y extraer datos sensibles, s

IA en riesgo: 'Prompt injection' filtra datos sensibles

Un creciente número de vulnerabilidades de seguridad relacionadas con 'prompt injection' están comprometiendo la seguridad de los agentes de inteligencia artificial, según un informe de OpenGuard. El problema radica en que estos agentes, diseñados para automatizar tareas como navegar por la web, lee

GitHub Copilot CLI: Vulnerabilidad permite ejecutar malware

Investigadores han descubierto una vulnerabilidad crítica en la nueva interfaz de línea de comandos (CLI) de GitHub Copilot que permite la descarga y ejecución de malware sin la aprobación del usuario. La falla, identificada tras el lanzamiento general de la CLI hace dos días, se produce debido a un

Claude Sonnet 4.6: Anthropic mejora su IA

Anthropic ha lanzado Claude Sonnet 4.6, la versión más avanzada hasta la fecha de su modelo Sonnet. Esta actualización representa una mejora significativa en diversas áreas, incluyendo codificación, uso de computadoras, razonamiento con contexto extenso, planificación de agentes, trabajo de conocimi

Pipelock: Seguridad Reforzada para Agentes de IA

Un nuevo proyecto de código abierto llamado 'Pipelock' ofrece una capa de seguridad para agentes de inteligencia artificial, abordando una creciente preocupación: la exposición de secretos y la vulnerabilidad a ataques. Pipelock actúa como un 'harness' de seguridad integral, operando como un único b

OpenClaw: Automatización con Riesgo de Malware

El auge de OpenClaw, una plataforma de agentes de inteligencia artificial que permite automatizar tareas a través de mensajes, ha desatado una ola de entusiasmo y preocupación en la comunidad tecnológica. Si bien promete revolucionar la productividad personal, su arquitectura inherentemente permisiv