Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
6436
)
-
▼
julio
(Total:
710
)
-
Microsoft pierde dinero con Xbox Series X-S
-
iPhone 20: lo último
-
Vulnerabilidad en NVIDIA BlueField permite ejecuci...
-
Apple apuesta por las suscripciones
-
BlueNoroff lanza kit de phishing de Zoom que anali...
-
Gemini para Mac se renueva con una función impresc...
-
Intel logra fabricar chips gigantes
-
Samsung multiplicó sus beneficios x19 en el Q2 202...
-
Falso instalador de Flash Player usa certificado d...
-
Seagate planea lanzar discos duros Mozaic 5 de 50 ...
-
Las Radeon RX 9070 XT más baratas son más propensa...
-
GitLab corrige 13 fallos de seguridad que filtran ...
-
Campaña de minería en Linux usa PAM para ocultar b...
-
Llamada de Teams de dos minutos podría cifrar tu r...
-
Estafa de nueve años clona webs de empresas rusas ...
-
Explotan vulnerabilidad 0-day de Cisco FMC para ro...
-
Desarrollador afirma que Claude Opus 5 borró una b...
-
Node.js corrige 11 fallos de seguridad que pueden ...
-
Ciberplataforma que convierte llamadas de soporte ...
-
Raspberry Pi revela datos ocultos del operador DNS
-
SK Hynix consigue aumentar sus ganancias en un 557...
-
Vulnerabilidad en Copilot de Word convierte prompt...
-
Rusos aprovechan fallo de Microsoft OWA para mante...
-
ChatGPT llega a Linux
-
IA engaña y traiciona al gestionar un negocio sola
-
TA488 pudo explotar fallo 0-day de Outlook antes d...
-
Pixel 11 Pro: teaser de Pixel Glow
-
Nuevo ransomware GenieLocker ataca Windows, ESXi y...
-
Logitech lanza ratones con batería reemplazable en...
-
Chrome 151 corrige 370 fallos de seguridad, siete ...
-
Firefox añade función vídeos HDR para Windows 11
-
Fallo en Ruflo MCP permite a atacantes no autentic...
-
EEUU prohíbe robots extranjeros
-
Paquetes npm de Joyfill hackeados despliegan RAT y...
-
vBulletin soluciona vulnerabilidad crítica de RCE ...
-
Anthropic admite que Claude puede vulnerar el cifr...
-
Vulnerabilidad Zero-Day en Cisco FMC explotada act...
-
Grave fallo en Rails permitiría a atacantes leer a...
-
Fallo crítico en Rails permite leer archivos y eje...
-
Caída global de Claude afecta a usuarios con error...
-
1Password limita la IA
-
Gusano informático se infiltra en Copilot y desata...
-
Sospechan que CyberAv3ngers, vinculados a Irán, es...
-
Rusos roban claves de Signal para secuestrar cuent...
-
GOG Galaxy llega a Linux
-
eBay pagará 56 millones por acosar a periodistas
-
Phishing con IA ya no requiere malware: roba sesio...
-
Mejores lectores de eBooks para Linux
-
WhatsApp añade cifrado de extremo a extremo a llam...
-
Vulnerabilidad de 20 años permite controlar miles ...
-
Apple creará un iPad sumergible
-
Los primeros dispositivos de OpenAI: altavoz, smar...
-
Publican PoC para el bypass de autenticación explo...
-
Rusia acusa al CEO de Telegram, Pavel Durov, de ay...
-
Aparece un Intel Core i9-14901KE con únicamente 8 ...
-
Presunta brecha de datos en Revolut: dicen acceder...
-
Paquetes maliciosos de npm despliegan RAT contra d...
-
NVIDIA impulsa la Alianza Segura Open Source para ...
-
Filtración de datos en Bank of Baroda: accedieron ...
-
DEF CON prohíbe las gafas perversas al estilo de Meta
-
Botnet Tengu reinicia dispositivos Linux infectado...
-
Primer ciberataque de agente de IA autónomo infilt...
-
OpenAI libera Codex Security CLI para hallar y cor...
-
Vulnerabilidad crítica en Gitea permite ejecución ...
-
Puerta trasera en plugin Advanced Responsive Video...
-
Nuevo fallo de RCE en Gitea permite a redactores d...
-
Filtran cientos de chats de Claude por falta de in...
-
Fabricantes chinos lanzan portátiles con GPUs GeFo...
-
IA descubre zero-day en kernel de Linux para escal...
-
Radeon RX 9050: especificaciones
-
JFrog confirma que los modelos de OpenAI aprovecha...
-
Kimi K3: la IA china que desafía a OpenAI y Anthropic
-
PortSwigger lanza Burp AT Agentic AI para pruebas ...
-
Claude AI descifra esquema de prueba post-cuántica...
-
Estafadores fingen ser ShinyHunters para chantajea...
-
Investigadores: empresa fantasma china creó la red...
-
Nueva botnet Tengu Mirai reinicia tu IoT si intent...
-
Amodei niega querer prohibir la IA de código abierto
-
App del Vaticano expone a 700.000 usuarios por fal...
-
Filtración de datos en la firma de facturación méd...
-
Múltiples vulnerabilidades de FFmpeg permiten corr...
-
Botnet DDoS Dysphoria se extiende a 200.000 dispos...
-
Profesor atrapa a 32 alumnos copiando con IA media...
-
Microsoft afirma que su nuevo modelo de IA para ci...
-
Claude Opus 5 de Anthropic llega a AWS con mejoras...
-
Backups a tu NAS QNAP en 3 pasos: guía con HDP PC ...
-
Phineas Fisher, el hacker más famoso del mundo, si...
-
Fuga de Sandbox en n8n permite a editores de flujo...
-
Ubuntu 26.04 LTS impulsa la computación confidencial
-
Coca-Cola confirma robo de datos tras ataque de ra...
-
La botnet de IoT Dysphoria implementa C2 de blockc...
-
GitHub combate el malware
-
Alianza contra ciberataques de IA
-
El Explorador de Windows 11 borra archivos grandes...
-
Investigadores inician iOS 27 con jailbreak en iPh...
-
Fallo crítico de vBulletin permite ejecución remot...
-
Guía básica del SoC y su importancia
-
Bandas de ransomware atacan VPN de Palo Alto, Fort...
-
GitHub implementa periodo de espera de 3 días en D...
-
Movistar y Orange activan Starlink en zonas incend...
-
Zen 7 cerrará AM5 y Zen 8 ya se desarrolla
-
ChatGPT quiere que vincules tus datos de salud a s...
-
Fuga de datos en app del Papa
-
Fallo de AgentForger en ChatGPT permitiría despleg...
-
Ocho fallos de NodeBB permiten leer chats privados...
-
El precio de las tarjetas gráficas continúa subien...
-
Chats compartidos de Claude AI expuestos en Google
-
Ataques aprovechan vulnerabilidad RCE de Fastjson ...
-
OpenAI tardó diez días en informar a Hugging Face ...
-
AMD confirma que sus CPU EPYC «Florence» basadas e...
-
Europol identifica 4.340 URLs para su eliminación ...
-
SourTrade crea malware en navegadores para evadir ...
-
Hombre condenado a seis años de prisión por hackea...
-
Cómo los logs de infostealers impulsan filtracione...
-
Google lanza actualización urgente de Chrome por c...
-
Fallos de seguridad en cada script de ChatGPT, Cop...
-
Apache Syncope parchea vulnerabilidades de RCE e i...
-
Guías online para tus vacaciones
-
YouTube crea IA para miniaturas
-
CXMT ya se permite el lujo de cobrar más que Samsu...
-
PentesterFlow: IA para automatizar flujos de pente...
-
Qualcomm aumentará el precio de todos sus chips: l...
-
Microsoft eliminará dos funciones de Copilot el pr...
-
Cuatro novedades de WhatsApp
-
Vulnerabilidades de GitLab permiten ejecución remo...
-
Claude Code optimiza el desarrollo para iPhone
-
Se cumplen 20 años desde la compra de ATI Technolo...
-
Afiliados de Cl0p explotan vulnerabilidades de RCE...
-
-
▼
julio
(Total:
710
)
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
seguridad
(
1686
)
vulnerabilidad
(
1672
)
software
(
984
)
hardware
(
885
)
google
(
764
)
Malware
(
708
)
privacidad
(
658
)
ransomware
(
527
)
Windows
(
521
)
android
(
462
)
exploit
(
451
)
linux
(
413
)
cve
(
374
)
tutorial
(
299
)
nvidia
(
298
)
manual
(
281
)
hacking
(
249
)
ssd
(
181
)
WhatsApp
(
173
)
ddos
(
138
)
Wifi
(
131
)
app
(
127
)
cifrado
(
121
)
twitter
(
121
)
programación
(
112
)
youtube
(
82
)
herramientas
(
80
)
firefox
(
77
)
firmware
(
74
)
Networking
(
73
)
sysadmin
(
72
)
adobe
(
68
)
office
(
62
)
hack
(
51
)
antivirus
(
50
)
Kernel
(
49
)
javascript
(
48
)
apache
(
46
)
juegos
(
42
)
contraseñas
(
39
)
multimedia
(
36
)
cms
(
35
)
flash
(
33
)
eventos
(
32
)
MAC
(
30
)
anonymous
(
28
)
ssl
(
24
)
conferencia
(
21
)
Forense
(
20
)
SeguridadWireless
(
17
)
documental
(
17
)
auditoría
(
15
)
Debugger
(
14
)
Rootkit
(
14
)
lizard squad
(
14
)
metasploit
(
13
)
técnicas hacking
(
13
)
Virtualización
(
11
)
delitos
(
11
)
reversing
(
10
)
adamo
(
9
)
Ehn-Dev
(
7
)
MAC Adress
(
6
)
antimalware
(
6
)
oclHashcat
(
5
)
Entradas populares
-
Kioxia y Sandisk presentan la memoria BiCS10 QLC , la NAND Flash más densa de la industria con 332 capas y una capacidad de 2 Tb por chip...
-
Apple ha lanzado una nueva serie de alertas de "Notificación de Amenaza de Apple" dirigidas a usuarios seleccionados en 110 paíse...
-
Ventoy surge como alternativa a Rufus y Etcher, permitiendo crear pendrives multisistemas para arrancar Windows 11 o Linux sin necesidad d...
Nueva técnica SkillCloak permite que agentes de IA maliciosos evadan escáneres estáticos
lunes, 6 de julio de 2026
|
Publicado por
el-brujo
|
Editar entrada
Investigadores de Hong Kong revelaron que los escáneres de seguridad para agentes de IA son fácilmente engañados por cambios simples en el código, permitiendo que malware robe credenciales o archivos. Para solucionar esto, propusieron SKILLDETONATE, una herramienta que analiza el comportamiento del programa en tiempo real en lugar de solo su apariencia. El estudio concluye que la defensa más efectiva es monitorear la ejecución del software y limitar los permisos de acceso de los agentes.
Los escáneres diseñados para detectar "skills" (habilidades) maliciosas para agentes de programación de IA pueden ser engañados con unos pocos cambios sencillos que dejan el malware funcionando, según un nuevo estudio de investigadores de la Universidad de Ciencia y Tecnología de Hong Kong.Su truco más potente logró evadir todos los escáneres probados en más del 90% de las veces, y el mismo equipo creó un verificador en tiempo de ejecución que detecta la mayoría de las habilidades disfrazadas que los escáneres pasan por alto.
Las skills son paquetes pequeños, generalmente un archivo de instrucciones en Markdown más algunos scripts, que agentes como Claude Code, OpenAI Codex y OpenClaw cargan para adquirir una nueva capacidad. Debido a que una skill es solo un conjunto de archivos, la misma puede ejecutarse en diferentes agentes. Y se ejecuta con el propio acceso del agente: tus archivos, tu terminal, tus contraseñas guardadas.
Una skill maliciosa puede robar credenciales, copiar código fuente o instalar una puerta trasera. La mayor parte de lo que aparece en un mercado público es subido por desconocidos con muy poca supervisión.
La defensa principal hasta ahora ha sido el escáner de skills, que lee los archivos de una habilidad antes de que la instales y bloquea cualquier cosa que parezca peligrosa. El artículo, titulado "Cloak and Detonate", pone a prueba si esto realmente funciona. La respuesta es que no. Aunque burlar los escáneres no es algo nuevo. The Hacker News ha informado sobre investigadores que lograron pasar una skill falsa a través de cada escáner que enfrentaron, lo que, según la propia firma, llegó a decenas de miles de agentes. Lo que este artículo añade es una forma de hacerlo sistemáticamente, a escala, y una defensa que sigue funcionando cuando ocurre.
Cómo pasan las habilidades disfrazadas
La herramienta de los investigadores, SKILLCLOAK, reescribe una skill maliciosa para que parezca limpia mientras se comporta exactamente igual. Funciona de dos maneras.La más ligera reescribe los bytes reveladores en los que se basa un escáner, utilizando sus propios operadores: cambiar un carácter por uno similar de otro alfabeto, o dividir un comando marcado en una nueva línea, de modo que el patrón del escáner ya no coincida, pero el comando se siga ejecutando.
La más pesada, el empaquetado autoextraíble, mueve toda la carga útil a un directorio que el escáner omite, como .git/, detrás de un decodificador de apariencia inofensiva que reconstruye la skill solo cuando el agente la ejecuta. Los escáneres omiten tales directorios para ahorrar tiempo y reducir las falsas alarmas, que es exactamente el punto ciego que explota el truco.
En ocho escáneres y 1,613 skills maliciosas reales extraídas de ClawHub, un mercado público, el truco del empaquetado superó a cada uno de los ocho más del 90% de las veces, y a la mayoría de ellos en más del 99%.La reescritura ligera superó el 80% en la mayoría de los escáneres y el 96% en uno. Y el disfraz no le cuesta casi nada al atacante: en Claude Code y OpenAI Codex, las skills disfrazadas funcionaron tan bien como las originales.
Vigilar lo que hace una skill, no cómo se ve
Dado que la apariencia puede ser falsificada, los investigadores proponen verificar el comportamiento en su lugar, en una herramienta que llaman SKILLDETONATE. Esta ejecuta la skill en un entorno aislado (sandbox) y observa lo que hace a nivel de sistema operativo: qué lee, qué escribe y a dónde envía los datos.Dos ideas hacen que funcione para los agentes. Rastrea los datos sensibles por dónde fluyen en lugar de cómo se ven, por lo que el base64 o el cifrado no lo confunden. Y ejecuta las instrucciones que construye una skill solo en el tiempo de ejecución, que es exactamente donde el truco del empaquetado oculta su carga útil.
En una prueba controlada, el verificador detectó el 97% de los ataques mientras marcaba erróneamente el 2% de las skills seguras, una tasa de falsas alarmas inferior a la de los escáneres que vence, y se mantuvo estable cuando las skills estaban disfrazadas. En skills maliciosas del mundo real, detectó el 87%.
El escáner de Cisco, el más fuerte probado, hizo lo contrario: detectó el 99% de las skills del mundo real antes del disfraz y aproximadamente el 10% después.
El inconveniente es la velocidad: un par de minutos por skill frente a los pocos segundos de un escáner, aunque se ejecuta una sola vez antes de que la skill entre en funcionamiento. El trabajo es un preprint y aún no ha sido revisado por pares; los investigadores han liberado su código.
Ya está sucediendo en el mundo real
Nada de esto es hipotético. Los mercados públicos ya están llenos de skills maliciosas que los escáneres no están deteniendo: Bitdefender encontró que aproximadamente el 17% de las skills que revisó en un mercado contenían código malicioso oculto, y Koi Security contó 341 en una sola campaña que llamó ClawHavoc, y más tarde 824 a medida que el mercado crecía.Algunas utilizan los trucos exactos del artículo. De cinco skills evasivas que Unit 42 encontró que aún estaban activas en ClawHub a pesar de su escaneo integrado, una, omnicogg, rellenó su README con 22 MB de basura para evadir el límite de tamaño del escáner, el mismo operador de relleno de tamaño que prueba el artículo. Otras dos entregaban robadores de contraseñas de Mac, y dos más secuestraron los consejos financieros del agente para promocionar enlaces de afiliados y manipular lanzamientos de meme-coins.
La brecha del tiempo de ejecución también aparece fuera de los mercados de skills. Un repositorio de GitHub de apariencia limpia llevó recientemente a Claude Code a abrir una shell inversa en la propia máquina del desarrollador, entregando el control remoto al atacante. El código malicioso nunca estuvo en el repo; el script de configuración lo obtuvo en tiempo de ejecución desde un registro DNS, por lo que un escaneo estático no tuvo nada que capturar. El equipo 0DIN de Mozilla rastreó la cadena.
Un fallo relacionado afecta a las descripciones de herramientas que los agentes leen a través del Protocolo de Contexto de Modelo (MCP). Microsoft advirtió que una descripción envenenada, cambiada después de que la herramienta fuera aprobada, empujó silenciosamente a un agente financiero a filtrar facturas impagadas. El mecanismo es diferente, pero la suposición errónea es la misma: que lo que pasó la revisión es lo que se ejecuta.
Vale la pena mencionar algunas limitaciones claramente. Nadie ha capturado aún a atacantes utilizando estos trucos de empaquetado exactos a escala; los casos del mundo real aquí son evasiones adyacentes, no SKILLCLOAK en sí. El verificador de tiempo de ejecución es un prototipo de investigación, fuerte en el laboratorio pero no probado en un mercado en vivo o bajo un atacante que intente evadirlo activamente. Y cada número de rendimiento es de los propios autores, de un artículo que no ha sido revisado por pares. La dirección está bien evidenciada; las cifras específicas merecen la precaución habitual debida al trabajo temprano de un solo grupo.
Esa es la verdadera lección, y es donde converge una línea creciente de trabajo. Un escáner juzga una skill por cómo se ve cuando se envía, pero el comportamiento malicioso solo aparece una vez que la skill se ejecuta, después de que el escaneo haya pasado. Por lo tanto, la decisión de confianza debe trasladarse de la puerta del mercado a la máquina donde se ejecuta la skill.
¿Qué buscar? Las evasiones del artículo dejan señales que un defensor puede buscar, incluso en una skill que pasó un escaneo:
* Archivos grandes o de alta entropía escondidos en directorios que un escáner tiende a omitir, como .git/ o build/.
* Skills que descomprimen o ensamblan código solo cuando se ejecutan, en lugar de enviarlo a plena vista.
* Archivos rellenados mucho más allá de un tamaño sensato, el truco que desliza una skill bajo el límite de tamaño de un escáner.
Ninguno de estos es una prueba por sí solo. Son primeras banderas económicas, no un veredicto.
Para los equipos que utilizan agentes de programación, esto convierte la insignia de "pasó el escaneo" en un punto de partida, no en una garantía. Mantén el escaneo estático como una higiene económica, pero vigila lo que hace una skill cuando se ejecuta: los archivos que toca, los comandos que ejecuta y a dónde envía los datos.
El artículo también ofrece soluciones temporales concretas, como generar el hash de una skill cuando es escaneada y volver a comprobarlo antes de cada ejecución para capturar cargas útiles que se descompriman más tarde, y marcar las skills que envían blobs opacos en carpetas ignoradas o rellenan archivos más allá de un límite de tamaño. Ninguna de estas cierra la brecha por sí sola, que es el punto: la defensa duradera es vigilar el comportamiento en tiempo de ejecución.
Más allá de eso, instala solo desde una fuente verificada, da a los agentes el acceso mínimo que necesiten y no los ejecutes en máquinas que contengan secretos que valga la pena robar.
Fuente:
THN
Enviar por correo electrónico
Escribe un blog
Compartir en X
Compartir con Facebook
Compartir en Pinterest

Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.