Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
6187
)
-
▼
July
(Total:
710
)
-
Microsoft pierde dinero con Xbox Series X-S
-
iPhone 20: lo último
-
Vulnerabilidad en NVIDIA BlueField permite ejecuci...
-
Apple apuesta por las suscripciones
-
BlueNoroff lanza kit de phishing de Zoom que anali...
-
Gemini para Mac se renueva con una función impresc...
-
Intel logra fabricar chips gigantes
-
Samsung multiplicó sus beneficios x19 en el Q2 202...
-
Falso instalador de Flash Player usa certificado d...
-
Seagate planea lanzar discos duros Mozaic 5 de 50 ...
-
Las Radeon RX 9070 XT más baratas son más propensa...
-
GitLab corrige 13 fallos de seguridad que filtran ...
-
Campaña de minería en Linux usa PAM para ocultar b...
-
Llamada de Teams de dos minutos podría cifrar tu r...
-
Estafa de nueve años clona webs de empresas rusas ...
-
Explotan vulnerabilidad 0-day de Cisco FMC para ro...
-
Desarrollador afirma que Claude Opus 5 borró una b...
-
Node.js corrige 11 fallos de seguridad que pueden ...
-
Ciberplataforma que convierte llamadas de soporte ...
-
Raspberry Pi revela datos ocultos del operador DNS
-
SK Hynix consigue aumentar sus ganancias en un 557...
-
Vulnerabilidad en Copilot de Word convierte prompt...
-
Rusos aprovechan fallo de Microsoft OWA para mante...
-
ChatGPT llega a Linux
-
IA engaña y traiciona al gestionar un negocio sola
-
TA488 pudo explotar fallo 0-day de Outlook antes d...
-
Pixel 11 Pro: teaser de Pixel Glow
-
Nuevo ransomware GenieLocker ataca Windows, ESXi y...
-
Logitech lanza ratones con batería reemplazable en...
-
Chrome 151 corrige 370 fallos de seguridad, siete ...
-
Firefox añade función vídeos HDR para Windows 11
-
Fallo en Ruflo MCP permite a atacantes no autentic...
-
EEUU prohíbe robots extranjeros
-
Paquetes npm de Joyfill hackeados despliegan RAT y...
-
vBulletin soluciona vulnerabilidad crítica de RCE ...
-
Anthropic admite que Claude puede vulnerar el cifr...
-
Vulnerabilidad Zero-Day en Cisco FMC explotada act...
-
Grave fallo en Rails permitiría a atacantes leer a...
-
Fallo crítico en Rails permite leer archivos y eje...
-
Caída global de Claude afecta a usuarios con error...
-
1Password limita la IA
-
Gusano informático se infiltra en Copilot y desata...
-
Sospechan que CyberAv3ngers, vinculados a Irán, es...
-
Rusos roban claves de Signal para secuestrar cuent...
-
GOG Galaxy llega a Linux
-
eBay pagará 56 millones por acosar a periodistas
-
Phishing con IA ya no requiere malware: roba sesio...
-
Mejores lectores de eBooks para Linux
-
WhatsApp añade cifrado de extremo a extremo a llam...
-
Vulnerabilidad de 20 años permite controlar miles ...
-
Apple creará un iPad sumergible
-
Los primeros dispositivos de OpenAI: altavoz, smar...
-
Publican PoC para el bypass de autenticación explo...
-
Rusia acusa al CEO de Telegram, Pavel Durov, de ay...
-
Aparece un Intel Core i9-14901KE con únicamente 8 ...
-
Presunta brecha de datos en Revolut: dicen acceder...
-
Paquetes maliciosos de npm despliegan RAT contra d...
-
NVIDIA impulsa la Alianza Segura Open Source para ...
-
Filtración de datos en Bank of Baroda: accedieron ...
-
DEF CON prohíbe las gafas perversas al estilo de Meta
-
Botnet Tengu reinicia dispositivos Linux infectado...
-
Primer ciberataque de agente de IA autónomo infilt...
-
OpenAI libera Codex Security CLI para hallar y cor...
-
Vulnerabilidad crítica en Gitea permite ejecución ...
-
Puerta trasera en plugin Advanced Responsive Video...
-
Nuevo fallo de RCE en Gitea permite a redactores d...
-
Filtran cientos de chats de Claude por falta de in...
-
Fabricantes chinos lanzan portátiles con GPUs GeFo...
-
IA descubre zero-day en kernel de Linux para escal...
-
Radeon RX 9050: especificaciones
-
JFrog confirma que los modelos de OpenAI aprovecha...
-
Kimi K3: la IA china que desafía a OpenAI y Anthropic
-
PortSwigger lanza Burp AT Agentic AI para pruebas ...
-
Claude AI descifra esquema de prueba post-cuántica...
-
Estafadores fingen ser ShinyHunters para chantajea...
-
Investigadores: empresa fantasma china creó la red...
-
Nueva botnet Tengu Mirai reinicia tu IoT si intent...
-
Amodei niega querer prohibir la IA de código abierto
-
App del Vaticano expone a 700.000 usuarios por fal...
-
Filtración de datos en la firma de facturación méd...
-
Múltiples vulnerabilidades de FFmpeg permiten corr...
-
Botnet DDoS Dysphoria se extiende a 200.000 dispos...
-
Profesor atrapa a 32 alumnos copiando con IA media...
-
Microsoft afirma que su nuevo modelo de IA para ci...
-
Claude Opus 5 de Anthropic llega a AWS con mejoras...
-
Backups a tu NAS QNAP en 3 pasos: guía con HDP PC ...
-
Phineas Fisher, el hacker más famoso del mundo, si...
-
Fuga de Sandbox en n8n permite a editores de flujo...
-
Ubuntu 26.04 LTS impulsa la computación confidencial
-
Coca-Cola confirma robo de datos tras ataque de ra...
-
La botnet de IoT Dysphoria implementa C2 de blockc...
-
GitHub combate el malware
-
Alianza contra ciberataques de IA
-
El Explorador de Windows 11 borra archivos grandes...
-
Investigadores inician iOS 27 con jailbreak en iPh...
-
Fallo crítico de vBulletin permite ejecución remot...
-
Guía básica del SoC y su importancia
-
Bandas de ransomware atacan VPN de Palo Alto, Fort...
-
GitHub implementa periodo de espera de 3 días en D...
-
Movistar y Orange activan Starlink en zonas incend...
-
Zen 7 cerrará AM5 y Zen 8 ya se desarrolla
-
ChatGPT quiere que vincules tus datos de salud a s...
-
Fuga de datos en app del Papa
-
Fallo de AgentForger en ChatGPT permitiría despleg...
-
Ocho fallos de NodeBB permiten leer chats privados...
-
El precio de las tarjetas gráficas continúa subien...
-
Chats compartidos de Claude AI expuestos en Google
-
Ataques aprovechan vulnerabilidad RCE de Fastjson ...
-
OpenAI tardó diez días en informar a Hugging Face ...
-
AMD confirma que sus CPU EPYC «Florence» basadas e...
-
Europol identifica 4.340 URLs para su eliminación ...
-
SourTrade crea malware en navegadores para evadir ...
-
Hombre condenado a seis años de prisión por hackea...
-
Cómo los logs de infostealers impulsan filtracione...
-
Google lanza actualización urgente de Chrome por c...
-
Fallos de seguridad en cada script de ChatGPT, Cop...
-
Apache Syncope parchea vulnerabilidades de RCE e i...
-
Guías online para tus vacaciones
-
YouTube crea IA para miniaturas
-
CXMT ya se permite el lujo de cobrar más que Samsu...
-
PentesterFlow: IA para automatizar flujos de pente...
-
Qualcomm aumentará el precio de todos sus chips: l...
-
Microsoft eliminará dos funciones de Copilot el pr...
-
Cuatro novedades de WhatsApp
-
Vulnerabilidades de GitLab permiten ejecución remo...
-
Claude Code optimiza el desarrollo para iPhone
-
Se cumplen 20 años desde la compra de ATI Technolo...
-
Afiliados de Cl0p explotan vulnerabilidades de RCE...
-
-
▼
July
(Total:
710
)
Blogroll
Labels
seguridad
(
1637
)
vulnerabilidad
(
1602
)
software
(
927
)
hardware
(
861
)
google
(
749
)
Malware
(
708
)
privacidad
(
648
)
Windows
(
521
)
ransomware
(
521
)
android
(
456
)
exploit
(
424
)
linux
(
392
)
cve
(
374
)
tutorial
(
299
)
nvidia
(
293
)
manual
(
282
)
hacking
(
244
)
ssd
(
176
)
WhatsApp
(
173
)
ddos
(
134
)
Wifi
(
131
)
app
(
126
)
cifrado
(
121
)
twitter
(
121
)
programación
(
106
)
youtube
(
82
)
herramientas
(
80
)
firefox
(
76
)
firmware
(
74
)
Networking
(
73
)
sysadmin
(
72
)
adobe
(
66
)
office
(
62
)
hack
(
51
)
Kernel
(
49
)
antivirus
(
49
)
javascript
(
48
)
apache
(
46
)
juegos
(
42
)
contraseñas
(
39
)
multimedia
(
36
)
cms
(
35
)
flash
(
33
)
eventos
(
32
)
MAC
(
30
)
anonymous
(
28
)
ssl
(
24
)
Forense
(
20
)
conferencia
(
20
)
SeguridadWireless
(
17
)
documental
(
17
)
auditoría
(
15
)
Debugger
(
14
)
Rootkit
(
14
)
lizard squad
(
14
)
metasploit
(
13
)
técnicas hacking
(
13
)
Virtualización
(
11
)
delitos
(
11
)
reversing
(
10
)
adamo
(
9
)
Ehn-Dev
(
7
)
MAC Adress
(
6
)
antimalware
(
6
)
oclHashcat
(
5
)
Entradas populares
-
Un usuario de Reddit adquirió una memoria DDR5 de 32 GB valorada en 500 euros por solo 12,50 euros en una tienda de segunda mano.
-
Google prepara el lanzamiento de Pixel Tag , un localizador de objetos similar al AirTag para llenar el hueco de hardware en su ecosistema A...
-
Tinfoleak permite extraer y analizar información relevante de la red Twitter mediante técnicas OSINT ( Open-Source Intelligence ). Si ya pe...
GuardFall revela que los agentes de IA de código abierto son vulnerables a riesgos de inyección de shell de hace décadas
Wednesday, 1 July 2026
|
Posted by
el-brujo
|
Edit Post
Investigadores de Adversa AI descubrieron que la mayoría de los agentes de codificación de IA son vulnerables a la inyección de comandos mediante el bypass GuardFall. Esta falla permite ejecutar órdenes peligrosas evadiendo los filtros de seguridad mediante trucos simples de shell, poniendo en riesgo archivos y credenciales del usuario. Para mitigarlo, se recomienda desactivar la ejecución automática y limitar los permisos de acceso a carpetas sensibles.
La verificación de seguridad que debería evitar que un agente de codificación de IA ejecute un comando peligroso puede eludirse fácilmente mediante un truco de shell que ha sido público durante décadas.Una nueva investigación de Adversa AI, denominada bypass GuardFall, descubrió que funciona contra diez de los once agentes populares de codificación y uso de computadoras de código abierto que la firma probó. Solo uno, "Continue", fue construido para defenderse de ello.
¿Por qué es importante? Estos agentes ejecutan comandos de shell con acceso total a tu cuenta. Basta con apuntar uno a un repositorio o paquete de software con trampas, y una instrucción oculta puede ejecutar silenciosamente un comando que borre archivos o robe los secretos a los que tu cuenta tiene acceso, desde claves SSH y credenciales de la nube hasta cualquier cosa en tu carpeta personal.
¿Cómo logra burlar la guardia?
La mayoría de estos agentes intentan mantenerse seguros comprobando cada comando contra una lista negra de patrones peligrosos antes de ejecutarlo. El fallo es que comprueban el comando como texto plano, mientras que bash reescribe ese texto antes de que realmente se ejecute. El shell elimina las comillas y expande los atajos, por lo que el filtro y el shell terminan mirando dos cosas diferentes.El ejemplo más sencillo: un filtro que busca
rm no ve nada malo en r''m, porque para un comparador de texto son cadenas diferentes. Bash elimina las comillas vacías y ejecuta rm de todos modos.La misma idea funciona de otras formas: un comando oculto en base64 y enviado a un shell, o herramientas ordinarias como
find y dd convertidas en destructivas con la bandera adecuada.Los investigadores afirman que esto no es un bug, sino "una convención peligrosa y una clase de problemas", razón por la cual añadir más patrones a la lista negra no soluciona nada. No hay un único CVE que rastrear o parchear.
Dos cosas deben alinearse para que un ataque tenga éxito, y ninguna es exótica:
* Primero, la IA tiene que producir el comando malicioso. Un "ejecuta
rm -rf" directo suele ser rechazado, pero el mismo comando metido dentro de un trabajo con apariencia normal, como un archivo de compilación o la respuesta de "documentación" de una herramienta, se emite como un paso rutinario.* Segundo, el agente tiene que estarse ejecutando por su cuenta, con una bandera de auto-ejecución activada o su sandbox de contenedor desactivado, algo rutinario en los flujos automatizados. Las pruebas en vivo utilizaron Claude Sonnet 4.6.
Las otras diez herramientas dejaron la brecha abierta: opencode, Goose, Cline, Roo-Code, Aider, Plandex, Open Interpreter, OpenHands, SWE-agent y el proyecto Hermes, donde el bug apareció primero y está documentado en el rastreador de problemas de Hermes.
Las herramientas de la encuesta de Adversa sumaban aproximadamente 548,000 estrellas en GitHub hasta mayo de 2026. Adversa demostró el ataque completo de extremo a extremo contra el binario de producción de Plandex, y el mismo método funcionó contra otros ocho. Describe el trabajo como investigación de laboratorio; no se han reportado explotaciones públicas.Continue, el único agente que resistió, se defiende leyendo el comando de la misma manera que lo hará bash antes de decidir: descompone el comando en las mismas piezas que el shell, comprueba qué se ejecuta realmente y mantiene una lista estricta de comandos destructivos que están bloqueados por completo.
Esa protección resistió contra cada carga útil en el modo de editor predeterminado de Continue. Su modo de ejecución automática de línea de comandos es más débil: algunas cargas útiles lograron pasar, aunque las más destructivas siguieron chocando con el bloqueo estricto. Adversa califica el diseño como portátil y afirma que reimplementarlo es un trabajo de aproximadamente dos días para un ingeniero experimentado.
Qué hacer ahora
Ninguna de las soluciones rápidas es una respuesta completa, pero reducen tu exposición hasta que haya una protección adecuada:* Ejecuta los agentes con
$HOME apuntando a una carpeta temporal, para que los secretos como ~/.ssh y ~/.aws estén fuera de su alcance.* Desactiva las banderas de auto-ejecución como
--auto-exec, --auto-run, --auto-test y dangerously-skip-permissions a menos que la tarea realmente no pueda pausarse para una revisión humana.* No permitas que los agentes se ejecuten en pull requests de forks, que es la ruta más sencilla para que un atacante llegue a tus secretos.
* Trata los archivos de configuración enviados dentro de un repositorio, como
.aider.conf.yml, como código no confiable; uno malicioso puede activar el ataque en la primera edición aceptada.GuardFall llega en medio de una serie de hallazgos similares este año. El propio TrustFall de Adversa afectó a Claude Code, Cursor, Gemini CLI y Copilot CLI, y un bypass de reglas de denegación independiente afectó a Claude Code.
Ataques similares convirtieron contenido envenenado en comandos que un agente ejecuta con los privilegios de su propietario. El hilo común es simple: el texto no confiable sigue llegando a un shell real antes de que la protección comprenda qué es lo que bash ejecutará realmente.
Fuente:
THN


Newer Post
0 comments :
Post a Comment
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.