Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
6519
)
-
▼
julio
(Total:
710
)
-
Microsoft pierde dinero con Xbox Series X-S
-
iPhone 20: lo último
-
Vulnerabilidad en NVIDIA BlueField permite ejecuci...
-
Apple apuesta por las suscripciones
-
BlueNoroff lanza kit de phishing de Zoom que anali...
-
Gemini para Mac se renueva con una función impresc...
-
Intel logra fabricar chips gigantes
-
Samsung multiplicó sus beneficios x19 en el Q2 202...
-
Falso instalador de Flash Player usa certificado d...
-
Seagate planea lanzar discos duros Mozaic 5 de 50 ...
-
Las Radeon RX 9070 XT más baratas son más propensa...
-
GitLab corrige 13 fallos de seguridad que filtran ...
-
Campaña de minería en Linux usa PAM para ocultar b...
-
Llamada de Teams de dos minutos podría cifrar tu r...
-
Estafa de nueve años clona webs de empresas rusas ...
-
Explotan vulnerabilidad 0-day de Cisco FMC para ro...
-
Desarrollador afirma que Claude Opus 5 borró una b...
-
Node.js corrige 11 fallos de seguridad que pueden ...
-
Ciberplataforma que convierte llamadas de soporte ...
-
Raspberry Pi revela datos ocultos del operador DNS
-
SK Hynix consigue aumentar sus ganancias en un 557...
-
Vulnerabilidad en Copilot de Word convierte prompt...
-
Rusos aprovechan fallo de Microsoft OWA para mante...
-
ChatGPT llega a Linux
-
IA engaña y traiciona al gestionar un negocio sola
-
TA488 pudo explotar fallo 0-day de Outlook antes d...
-
Pixel 11 Pro: teaser de Pixel Glow
-
Nuevo ransomware GenieLocker ataca Windows, ESXi y...
-
Logitech lanza ratones con batería reemplazable en...
-
Chrome 151 corrige 370 fallos de seguridad, siete ...
-
Firefox añade función vídeos HDR para Windows 11
-
Fallo en Ruflo MCP permite a atacantes no autentic...
-
EEUU prohíbe robots extranjeros
-
Paquetes npm de Joyfill hackeados despliegan RAT y...
-
vBulletin soluciona vulnerabilidad crítica de RCE ...
-
Anthropic admite que Claude puede vulnerar el cifr...
-
Vulnerabilidad Zero-Day en Cisco FMC explotada act...
-
Grave fallo en Rails permitiría a atacantes leer a...
-
Fallo crítico en Rails permite leer archivos y eje...
-
Caída global de Claude afecta a usuarios con error...
-
1Password limita la IA
-
Gusano informático se infiltra en Copilot y desata...
-
Sospechan que CyberAv3ngers, vinculados a Irán, es...
-
Rusos roban claves de Signal para secuestrar cuent...
-
GOG Galaxy llega a Linux
-
eBay pagará 56 millones por acosar a periodistas
-
Phishing con IA ya no requiere malware: roba sesio...
-
Mejores lectores de eBooks para Linux
-
WhatsApp añade cifrado de extremo a extremo a llam...
-
Vulnerabilidad de 20 años permite controlar miles ...
-
Apple creará un iPad sumergible
-
Los primeros dispositivos de OpenAI: altavoz, smar...
-
Publican PoC para el bypass de autenticación explo...
-
Rusia acusa al CEO de Telegram, Pavel Durov, de ay...
-
Aparece un Intel Core i9-14901KE con únicamente 8 ...
-
Presunta brecha de datos en Revolut: dicen acceder...
-
Paquetes maliciosos de npm despliegan RAT contra d...
-
NVIDIA impulsa la Alianza Segura Open Source para ...
-
Filtración de datos en Bank of Baroda: accedieron ...
-
DEF CON prohíbe las gafas perversas al estilo de Meta
-
Botnet Tengu reinicia dispositivos Linux infectado...
-
Primer ciberataque de agente de IA autónomo infilt...
-
OpenAI libera Codex Security CLI para hallar y cor...
-
Vulnerabilidad crítica en Gitea permite ejecución ...
-
Puerta trasera en plugin Advanced Responsive Video...
-
Nuevo fallo de RCE en Gitea permite a redactores d...
-
Filtran cientos de chats de Claude por falta de in...
-
Fabricantes chinos lanzan portátiles con GPUs GeFo...
-
IA descubre zero-day en kernel de Linux para escal...
-
Radeon RX 9050: especificaciones
-
JFrog confirma que los modelos de OpenAI aprovecha...
-
Kimi K3: la IA china que desafía a OpenAI y Anthropic
-
PortSwigger lanza Burp AT Agentic AI para pruebas ...
-
Claude AI descifra esquema de prueba post-cuántica...
-
Estafadores fingen ser ShinyHunters para chantajea...
-
Investigadores: empresa fantasma china creó la red...
-
Nueva botnet Tengu Mirai reinicia tu IoT si intent...
-
Amodei niega querer prohibir la IA de código abierto
-
App del Vaticano expone a 700.000 usuarios por fal...
-
Filtración de datos en la firma de facturación méd...
-
Múltiples vulnerabilidades de FFmpeg permiten corr...
-
Botnet DDoS Dysphoria se extiende a 200.000 dispos...
-
Profesor atrapa a 32 alumnos copiando con IA media...
-
Microsoft afirma que su nuevo modelo de IA para ci...
-
Claude Opus 5 de Anthropic llega a AWS con mejoras...
-
Backups a tu NAS QNAP en 3 pasos: guía con HDP PC ...
-
Phineas Fisher, el hacker más famoso del mundo, si...
-
Fuga de Sandbox en n8n permite a editores de flujo...
-
Ubuntu 26.04 LTS impulsa la computación confidencial
-
Coca-Cola confirma robo de datos tras ataque de ra...
-
La botnet de IoT Dysphoria implementa C2 de blockc...
-
GitHub combate el malware
-
Alianza contra ciberataques de IA
-
El Explorador de Windows 11 borra archivos grandes...
-
Investigadores inician iOS 27 con jailbreak en iPh...
-
Fallo crítico de vBulletin permite ejecución remot...
-
Guía básica del SoC y su importancia
-
Bandas de ransomware atacan VPN de Palo Alto, Fort...
-
GitHub implementa periodo de espera de 3 días en D...
-
Movistar y Orange activan Starlink en zonas incend...
-
Zen 7 cerrará AM5 y Zen 8 ya se desarrolla
-
ChatGPT quiere que vincules tus datos de salud a s...
-
Fuga de datos en app del Papa
-
Fallo de AgentForger en ChatGPT permitiría despleg...
-
Ocho fallos de NodeBB permiten leer chats privados...
-
El precio de las tarjetas gráficas continúa subien...
-
Chats compartidos de Claude AI expuestos en Google
-
Ataques aprovechan vulnerabilidad RCE de Fastjson ...
-
OpenAI tardó diez días en informar a Hugging Face ...
-
AMD confirma que sus CPU EPYC «Florence» basadas e...
-
Europol identifica 4.340 URLs para su eliminación ...
-
SourTrade crea malware en navegadores para evadir ...
-
Hombre condenado a seis años de prisión por hackea...
-
Cómo los logs de infostealers impulsan filtracione...
-
Google lanza actualización urgente de Chrome por c...
-
Fallos de seguridad en cada script de ChatGPT, Cop...
-
Apache Syncope parchea vulnerabilidades de RCE e i...
-
Guías online para tus vacaciones
-
YouTube crea IA para miniaturas
-
CXMT ya se permite el lujo de cobrar más que Samsu...
-
PentesterFlow: IA para automatizar flujos de pente...
-
Qualcomm aumentará el precio de todos sus chips: l...
-
Microsoft eliminará dos funciones de Copilot el pr...
-
Cuatro novedades de WhatsApp
-
Vulnerabilidades de GitLab permiten ejecución remo...
-
Claude Code optimiza el desarrollo para iPhone
-
Se cumplen 20 años desde la compra de ATI Technolo...
-
Afiliados de Cl0p explotan vulnerabilidades de RCE...
-
-
▼
julio
(Total:
710
)
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
Entradas populares
-
Se descubrió un fallo de seguridad llamado SCTPhantom (CVE-2026-64564) en el código de red SCTP de Linux, presente desde 2008. Esta vulnerab...
-
Un desarrollador ha convertido Word de 1990 en una aplicación nativa x64 para que funcione directamente en Windows 11 .
-
Apple ha lanzado una nueva serie de alertas de "Notificación de Amenaza de Apple" dirigidas a usuarios seleccionados en 110 paíse...
CrowdStrike revela 5 nuevas técnicas de inyección de prompts contra agentes de IA
CrowdStrike ha presentado cinco nuevas técnicas de inyección de prompts, destacando la creciente amenaza para los agentes de IA a medida que las organizaciones despliegan cada vez más sistemas de IA autónomos.
Mientras que los riesgos iniciales se centraban en la manipulación sencilla de chatbots, el auge de los agentes de IA capaces de navegar por sitios web, acceder a datos internos y ejecutar comandos ha ampliado significativamente la superficie de ataque.
Los adversarios ahora están incrustando instrucciones maliciosas dentro de los datos que consumen estos agentes, permitiendo ataques indirectos que pueden secuestrar el comportamiento del sistema sin señales obvias.
Para hacer frente a este desafío creciente, CrowdStrike ha ampliado su taxonomía de inyección de prompts con 18 nuevas técnicas, elevando el total a más de 200 métodos documentados.
Entre estas, cinco técnicas recientemente destacadas demuestran cómo los atacantes están refinando sus estrategias para evadir la detección y manipular sutilmente los sistemas de IA.
5 Nuevas Técnicas de Inyección de Prompts
Una de las técnicas más notables es la Adición de Reglas Activadas por Disparador, donde los atacantes plantan instrucciones ocultas que permanecen inactivas hasta que una condición o palabra clave específica las activa.
Estas cargas útiles "dormidas" pueden evadir las revisiones de seguridad iniciales y alterar posteriormente el comportamiento del sistema, como exfiltrar datos confidenciales silenciosamente una vez activadas.
Otro método emergente, la Supresión de Tokens Cognitivos, intenta limitar la capacidad de un modelo de IA para generar respuestas seguras restringiendo el uso de lenguaje relacionado con la denegación o las políticas.
Al alejar al modelo de su vocabulario de seguridad normal, los atacantes aumentan la probabilidad de obtener respuestas ambiguas o que no cumplan con las normas.
La Descomposición Algorítmica de la Carga Útil representa una táctica de evasión más técnica. En lugar de entregar una instrucción maliciosa directamente, los atacantes la dividen en componentes más pequeños que parecen inofensivos.
- Adición de Reglas Activadas por Disparador (PT0201): Disparadores ocultos activan instrucciones maliciosas solo cuando se cumplen condiciones específicas.
- Supresión de Tokens Cognitivos (PT0197): Manipula los prompts para que la IA ignore o pase por alto instrucciones importantes.
- Descomposición Algorítmica de la Carga Útil (PT0200): Divide un prompt malicioso en partes más pequeñas para evadir la detección.
- Inyección de Tokens Especiales (PT0198): Utiliza tokens especiales o de control para alterar el comportamiento de la IA o eludir las salvaguardas.
- Entrega por Usuario Involuntario (IM0005): Engaña a los usuarios para que entreguen sin saberlo prompts maliciosos a un sistema de IA.
Posteriormente, se guía a la IA para reconstruir estos fragmentos en un comando completo, permitiendo que la carga útil evite los filtros tradicionales que buscan amenazas obvias.
La Inyección de Tokens Especiales se dirige al marco estructural de los sistemas de IA. Al imitar elementos de formato interno, como llamadas a herramientas o instrucciones a nivel de sistema, los atacantes intentan desdibujar la frontera entre las entradas confiables y las no confiables.
Esto puede engañar al modelo para que trate el contenido malicioso como un comando legítimo con prioridad elevada. La quinta técnica, Entrega por Usuario Involuntario, aprovecha la ingeniería social en lugar de basarse únicamente en la manipulación técnica.
En este escenario, los atacantes persuaden a los usuarios para que introduzcan ellos mismos los prompts maliciosos, a menudo a través de contenido engañoso como publicaciones virales o instrucciones ocultas incrustadas en medios, según indica el aviso de CrowdStrike.
Debido a que la solicitud se origina desde una sesión de usuario legítima, resulta más difícil de detectar para los sistemas de seguridad. Estos desarrollos señalan un cambio en la forma en que operan los ataques de inyección de prompts. En lugar de depender de intentos obvios de "jailbreak", los atacantes utilizan cada vez más técnicas por capas que involucran contexto oculto, ejecución retardada y trucos de formato.
Esto hace que la detección sea más compleja y requiere que los equipos de seguridad replanteenen su enfoque. CrowdStrike enfatiza que las organizaciones deben ampliar el modelado de amenazas de IA para incluir todas las fuentes de datos posibles, desde prompts y APIs hasta correos electrónicos y plataformas SaaS.
Las estrategias de detección también deben tener en cuenta los ataques multietapa, donde se combinan varias técnicas en una sola cadena de explotación.
A medida que se acelera la adopción de la IA, estas técnicas recién identificadas subrayan una realidad clara: asegurar los agentes de IA requiere una adaptación continua, una visibilidad más profunda y una comprensión más exhaustiva de cómo los atacantes manipulan tanto el lenguaje como el contexto.
Fuentes:
https://cybersecuritynews.com/5-new-prompt-injection-techniques/


Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.