Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
6489
)
-
▼
julio
(Total:
710
)
-
Microsoft pierde dinero con Xbox Series X-S
-
iPhone 20: lo último
-
Vulnerabilidad en NVIDIA BlueField permite ejecuci...
-
Apple apuesta por las suscripciones
-
BlueNoroff lanza kit de phishing de Zoom que anali...
-
Gemini para Mac se renueva con una función impresc...
-
Intel logra fabricar chips gigantes
-
Samsung multiplicó sus beneficios x19 en el Q2 202...
-
Falso instalador de Flash Player usa certificado d...
-
Seagate planea lanzar discos duros Mozaic 5 de 50 ...
-
Las Radeon RX 9070 XT más baratas son más propensa...
-
GitLab corrige 13 fallos de seguridad que filtran ...
-
Campaña de minería en Linux usa PAM para ocultar b...
-
Llamada de Teams de dos minutos podría cifrar tu r...
-
Estafa de nueve años clona webs de empresas rusas ...
-
Explotan vulnerabilidad 0-day de Cisco FMC para ro...
-
Desarrollador afirma que Claude Opus 5 borró una b...
-
Node.js corrige 11 fallos de seguridad que pueden ...
-
Ciberplataforma que convierte llamadas de soporte ...
-
Raspberry Pi revela datos ocultos del operador DNS
-
SK Hynix consigue aumentar sus ganancias en un 557...
-
Vulnerabilidad en Copilot de Word convierte prompt...
-
Rusos aprovechan fallo de Microsoft OWA para mante...
-
ChatGPT llega a Linux
-
IA engaña y traiciona al gestionar un negocio sola
-
TA488 pudo explotar fallo 0-day de Outlook antes d...
-
Pixel 11 Pro: teaser de Pixel Glow
-
Nuevo ransomware GenieLocker ataca Windows, ESXi y...
-
Logitech lanza ratones con batería reemplazable en...
-
Chrome 151 corrige 370 fallos de seguridad, siete ...
-
Firefox añade función vídeos HDR para Windows 11
-
Fallo en Ruflo MCP permite a atacantes no autentic...
-
EEUU prohíbe robots extranjeros
-
Paquetes npm de Joyfill hackeados despliegan RAT y...
-
vBulletin soluciona vulnerabilidad crítica de RCE ...
-
Anthropic admite que Claude puede vulnerar el cifr...
-
Vulnerabilidad Zero-Day en Cisco FMC explotada act...
-
Grave fallo en Rails permitiría a atacantes leer a...
-
Fallo crítico en Rails permite leer archivos y eje...
-
Caída global de Claude afecta a usuarios con error...
-
1Password limita la IA
-
Gusano informático se infiltra en Copilot y desata...
-
Sospechan que CyberAv3ngers, vinculados a Irán, es...
-
Rusos roban claves de Signal para secuestrar cuent...
-
GOG Galaxy llega a Linux
-
eBay pagará 56 millones por acosar a periodistas
-
Phishing con IA ya no requiere malware: roba sesio...
-
Mejores lectores de eBooks para Linux
-
WhatsApp añade cifrado de extremo a extremo a llam...
-
Vulnerabilidad de 20 años permite controlar miles ...
-
Apple creará un iPad sumergible
-
Los primeros dispositivos de OpenAI: altavoz, smar...
-
Publican PoC para el bypass de autenticación explo...
-
Rusia acusa al CEO de Telegram, Pavel Durov, de ay...
-
Aparece un Intel Core i9-14901KE con únicamente 8 ...
-
Presunta brecha de datos en Revolut: dicen acceder...
-
Paquetes maliciosos de npm despliegan RAT contra d...
-
NVIDIA impulsa la Alianza Segura Open Source para ...
-
Filtración de datos en Bank of Baroda: accedieron ...
-
DEF CON prohíbe las gafas perversas al estilo de Meta
-
Botnet Tengu reinicia dispositivos Linux infectado...
-
Primer ciberataque de agente de IA autónomo infilt...
-
OpenAI libera Codex Security CLI para hallar y cor...
-
Vulnerabilidad crítica en Gitea permite ejecución ...
-
Puerta trasera en plugin Advanced Responsive Video...
-
Nuevo fallo de RCE en Gitea permite a redactores d...
-
Filtran cientos de chats de Claude por falta de in...
-
Fabricantes chinos lanzan portátiles con GPUs GeFo...
-
IA descubre zero-day en kernel de Linux para escal...
-
Radeon RX 9050: especificaciones
-
JFrog confirma que los modelos de OpenAI aprovecha...
-
Kimi K3: la IA china que desafía a OpenAI y Anthropic
-
PortSwigger lanza Burp AT Agentic AI para pruebas ...
-
Claude AI descifra esquema de prueba post-cuántica...
-
Estafadores fingen ser ShinyHunters para chantajea...
-
Investigadores: empresa fantasma china creó la red...
-
Nueva botnet Tengu Mirai reinicia tu IoT si intent...
-
Amodei niega querer prohibir la IA de código abierto
-
App del Vaticano expone a 700.000 usuarios por fal...
-
Filtración de datos en la firma de facturación méd...
-
Múltiples vulnerabilidades de FFmpeg permiten corr...
-
Botnet DDoS Dysphoria se extiende a 200.000 dispos...
-
Profesor atrapa a 32 alumnos copiando con IA media...
-
Microsoft afirma que su nuevo modelo de IA para ci...
-
Claude Opus 5 de Anthropic llega a AWS con mejoras...
-
Backups a tu NAS QNAP en 3 pasos: guía con HDP PC ...
-
Phineas Fisher, el hacker más famoso del mundo, si...
-
Fuga de Sandbox en n8n permite a editores de flujo...
-
Ubuntu 26.04 LTS impulsa la computación confidencial
-
Coca-Cola confirma robo de datos tras ataque de ra...
-
La botnet de IoT Dysphoria implementa C2 de blockc...
-
GitHub combate el malware
-
Alianza contra ciberataques de IA
-
El Explorador de Windows 11 borra archivos grandes...
-
Investigadores inician iOS 27 con jailbreak en iPh...
-
Fallo crítico de vBulletin permite ejecución remot...
-
Guía básica del SoC y su importancia
-
Bandas de ransomware atacan VPN de Palo Alto, Fort...
-
GitHub implementa periodo de espera de 3 días en D...
-
Movistar y Orange activan Starlink en zonas incend...
-
Zen 7 cerrará AM5 y Zen 8 ya se desarrolla
-
ChatGPT quiere que vincules tus datos de salud a s...
-
Fuga de datos en app del Papa
-
Fallo de AgentForger en ChatGPT permitiría despleg...
-
Ocho fallos de NodeBB permiten leer chats privados...
-
El precio de las tarjetas gráficas continúa subien...
-
Chats compartidos de Claude AI expuestos en Google
-
Ataques aprovechan vulnerabilidad RCE de Fastjson ...
-
OpenAI tardó diez días en informar a Hugging Face ...
-
AMD confirma que sus CPU EPYC «Florence» basadas e...
-
Europol identifica 4.340 URLs para su eliminación ...
-
SourTrade crea malware en navegadores para evadir ...
-
Hombre condenado a seis años de prisión por hackea...
-
Cómo los logs de infostealers impulsan filtracione...
-
Google lanza actualización urgente de Chrome por c...
-
Fallos de seguridad en cada script de ChatGPT, Cop...
-
Apache Syncope parchea vulnerabilidades de RCE e i...
-
Guías online para tus vacaciones
-
YouTube crea IA para miniaturas
-
CXMT ya se permite el lujo de cobrar más que Samsu...
-
PentesterFlow: IA para automatizar flujos de pente...
-
Qualcomm aumentará el precio de todos sus chips: l...
-
Microsoft eliminará dos funciones de Copilot el pr...
-
Cuatro novedades de WhatsApp
-
Vulnerabilidades de GitLab permiten ejecución remo...
-
Claude Code optimiza el desarrollo para iPhone
-
Se cumplen 20 años desde la compra de ATI Technolo...
-
Afiliados de Cl0p explotan vulnerabilidades de RCE...
-
-
▼
julio
(Total:
710
)
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
seguridad
(
1696
)
vulnerabilidad
(
1691
)
software
(
999
)
hardware
(
891
)
google
(
765
)
Malware
(
708
)
privacidad
(
660
)
ransomware
(
531
)
Windows
(
521
)
android
(
464
)
exploit
(
459
)
linux
(
417
)
cve
(
374
)
tutorial
(
300
)
nvidia
(
298
)
manual
(
282
)
hacking
(
251
)
ssd
(
181
)
WhatsApp
(
173
)
ddos
(
139
)
Wifi
(
131
)
app
(
127
)
cifrado
(
121
)
twitter
(
121
)
programación
(
114
)
youtube
(
83
)
herramientas
(
80
)
firefox
(
77
)
firmware
(
75
)
Networking
(
73
)
sysadmin
(
72
)
adobe
(
68
)
office
(
62
)
hack
(
51
)
antivirus
(
50
)
Kernel
(
49
)
javascript
(
48
)
apache
(
46
)
juegos
(
42
)
contraseñas
(
39
)
multimedia
(
36
)
cms
(
35
)
flash
(
33
)
eventos
(
32
)
MAC
(
30
)
anonymous
(
28
)
ssl
(
24
)
conferencia
(
21
)
Forense
(
20
)
SeguridadWireless
(
17
)
documental
(
17
)
auditoría
(
15
)
Debugger
(
14
)
Rootkit
(
14
)
lizard squad
(
14
)
metasploit
(
13
)
técnicas hacking
(
13
)
Virtualización
(
11
)
delitos
(
11
)
reversing
(
10
)
adamo
(
9
)
Ehn-Dev
(
7
)
antimalware
(
7
)
MAC Adress
(
6
)
oclHashcat
(
5
)
Entradas populares
-
Se descubrió un fallo de seguridad llamado SCTPhantom (CVE-2026-64564) en el código de red SCTP de Linux, presente desde 2008. Esta vulnerab...
-
Apple ha lanzado una nueva serie de alertas de "Notificación de Amenaza de Apple" dirigidas a usuarios seleccionados en 110 paíse...
-
Un actor de amenazas apodado "TheHatman" está llevando a cabo una extensa campaña de exfiltración de datos de Azure en la dark w...
Cuidado con el nuevo ataque HalluSquatting: podría engañar a los asistentes de IA para instalar malware de botnets
miércoles, 8 de julio de 2026
|
Publicado por
el-brujo
|
Editar entrada
El HalluSquatting es un ataque que aprovecha las alucinaciones de los asistentes de IA, quienes suelen inventar nombres de herramientas inexistentes. Los atacantes registran estos nombres falsos en repositorios para que, cuando un usuario pida la herramienta, la IA descargue y ejecute código malicioso. Esto permite crear botnets masivas saltándose firewalls y afectan a herramientas como Copilot y Gemini.
Los asistentes de programación con IA tienen la costumbre de inventar cosas. Si le pides que busque una herramienta popular, a veces te devolverá un nombre que suena real para un proyecto que no existe.
Una nueva investigación, que sus autores llaman HalluSquatting, convierte ese hábito en un ataque: descubrir los nombres falsos que una IA inventa de forma fiable, registrarlos primero y esperar a que el asistente active tu trampa en nombre de un usuario.
Cualquier persona cuyo asistente de IA pueda obtener un recurso externo y luego ejecutar comandos con poca revisión humana está expuesta. En las pruebas, esa ruta llevó al asistente a ejecutar código suministrado por el atacante en la máquina.
Si repites esto con un recurso lo suficientemente popular, un solo nombre plantado puede llegar a muchas máquinas, razón por la cual los investigadores lo plantean como una forma de ensamblar una botnet.
El ataque encadena dos peculiaridades de la IA. La primera es una alucinación: una IA que inventa algo y lo presenta como real. La segunda es una inyección de prompts: una instrucción con trampa que secuestra la IA para que siga a un atacante en lugar de al usuario.
Aquí, la inyección es de tipo indirecto, llegando a través del contenido que el asistente obtiene en lugar de algo que el usuario escriba.
1. Elige un objetivo. El atacante encuentra un repositorio o plugin que sea tendencia, para que mucha gente le pida a su IA que lo busque. La tendencia es importante porque un recurso nuevo no está en los datos de entrenamiento de la IA, que es precisamente cuando el modelo empieza a adivinar nombres.
2. Aprende el error. El atacante pide a una IA que busque ese recurso una y otra vez y registra el nombre falso que inventa con más frecuencia.
3. Reclama el nombre falso. El atacante registra ese nombre en GitHub o en una tienda de plugins y oculta instrucciones adversas dentro de él.
4. Espera. Un usuario real pide a su asistente que obtenga el recurso popular. El asistente inventa el mismo nombre falso y extrae la versión del atacante en su lugar. Sus instrucciones ocultas se integran en lo que el asistente cree que se le ordenó hacer, y el asistente secuestrado utiliza su propia herramienta de ejecución de comandos para llevarlas a cabo.
La trampa no es código que se ejecuta por sí solo. Funciona porque estos asistentes mantienen una terminal entre sus herramientas integradas, por lo que, una vez que las instrucciones plantadas toman el control, "instalar un bot" es simplemente algo que el asistente puede hacer.
Lo que lo hace práctico es que los nombres falsos no son aleatorios. En los experimentos de los investigadores, el error fue consistente: en diferentes formulaciones y modelos de distintas empresas, el asistente recurrió al mismo nombre incorrecto en hasta el 85% de las solicitudes de repositorios y el 100% de las instalaciones de habilidades. Estas son las tasas máximas que reportan los autores; el documento contiene el desglose completo.
Lo probaron contra herramientas como Cursor, Windsurf, GitHub Copilot, Cline, Google Gemini CLI y la familia de asistentes OpenClaw, logrando que cada uno ejecutara el código del atacante. Las cargas de prueba eran marcadores de posición inofensivos, no malware real; uno real seguiría el mismo camino.
La investigación https://sites.google.com/view/agentic-botnets/home proviene de Aya Spira y sus colegas del grupo de Ben Nassi en la Universidad de Tel Aviv, con Stav Cohen en Technion y Ron Bitton en Intuit. El grupo de Nassi ya ha hecho esto antes, creando un gusano de correo electrónico de IA que se propaga solo y una invitación de calendario que secuestró el Gemini de Google.
El equipo afirma que informó a los proveedores afectados, creadores de modelos y operadores de mercados antes de hacerlo público, y omitió los pasos exactos necesarios para copiar el ataque.
Las botnets tradicionales requieren trabajo para construirse. Se basan en contraseñas débiles o malware que se propaga de máquina en máquina, y generalmente agrupan un solo tipo de dispositivo, como Mirai hizo con cámaras y routers.
Esto no necesita nada de eso. Sin contraseñas, sin propagación de gusanos, y debido a que la carga llega como texto que la IA lee en lugar de un exploit de red, no es el tipo de cosa que un firewall vigila. Las máquinas en las que aterriza pueden ejecutar cualquier sistema operativo, no una flota uniforme.
La IA es la furgoneta de reparto aquí, no la carga. Las instrucciones plantadas la engañan para instalar un bot ordinario, y una vez que ese bot está funcionando, la máquina pertenece a una botnet como cualquier otra. Lo nuevo es la combinación que lo logra: un nombre que una IA inventa predeciblemente, un mercado donde cualquiera puede registrar ese nombre y un agente con permiso para obtener y ejecutar.
Las piezas no son nuevas, aunque la combinación sí lo sea. Los atacantes primero aprendieron a registrar nombres de paquetes de software falsos que las IA inventan, un truco llamado "slopsquatting".
En enero de 2026, Charlie Eriksen de Aikido Security encontró uno de esos paquetes npm inventados, react-codeshift, que instrucciones escritas por IA ya habían propagado a 237 proyectos de código, con agentes intentando instalarlo diariamente; él mismo lo registró aquí antes de que cualquier atacante pudiera hacerlo, por lo que no causó daño.
La idea luego saltó de los paquetes a las direcciones web. La Unit 42 de Palo Alto Networks describió recientemente el "phantom squatting", aquí, aproximadamente 250,000 dominios alucinados que se encuentran sin registrar y libres para ser tomados.
HalluSquatting es la versión que llega hasta la ejecución de código secuestrando al agente que realiza la búsqueda. Y los mercados destinados a filtrar las subidas maliciosas no son un gran respaldo: en junio, Trail of Bits logró colar "habilidades" maliciosas a través de varios escáneres de tiendas en menos de una hora aquí.
Todo depende de una condición: un agente que obtiene un recurso externo y lo ejecuta sin que nadie lo revise. Cierra eso y el ataque se detiene. La solución más efectiva es también la más simple: haz que el asistente busque antes de obtener.
Una búsqueda real basa al agente en lo que realmente existe y reduce drásticamente las conjeturas. Ese es un trabajo para las personas que construyen estas herramientas, quienes también pueden entrenar al planificador (la parte que mapea una solicitud a pasos) para buscar un recurso primero y tratar palabras como clone, install y fetch como banderas de alerta.
Tú y los equipos de seguridad tienen palancas a corto plazo. Por defecto, estos agentes preguntan antes de ejecutar un comando. La exposición son los modos de ejecución automática (como la bandera skip-permissions de Claude Code o el modo yolo de Gemini CLI) que desactivan eso, por lo que la primera regla es no dejar que un agente se ejecute sin supervisión en nada que haya obtenido.
Algunas herramientas ahora añaden una capa de seguridad que inspecciona lo que el agente lee o está a punto de hacer antes de actuar, como el modo auto de Claude Code y la verificación Conseca de Gemini CLI, pero eso reduce el riesgo en lugar de eliminarlo. Ningún interruptor único cierra esto, así que verifica también que un nombre de repositorio o paquete se resuelva a la fuente real y esperada antes de que un agente lo descargue, y trata cualquier nombre que una IA te dé como una suposición, no como un hecho.
Las plataformas tienen su propia palanca. Pueden dejar de permitir que las personas reutilicen nombres de repositorios conocidos bajo cuentas nuevas y pre-registrar los nombres falsos que las IA probablemente inventen, para que esos nombres apunten de vuelta al proyecto real.
Los investigadores llaman a sus resultados un límite inferior: "Los ataques siempre mejoran; nunca empeoran". No hay un único CVE que parchear aquí. Lo plantean no como el error de un producto, sino como una debilidad en la forma en que los agentes de IA confían en nombres que nunca se les dieron realmente.
Fuente:
THN
Los asistentes de programación con IA tienen la costumbre de inventar cosas. Si le pides que busque una herramienta popular, a veces te devolverá un nombre que suena real para un proyecto que no existe.
Una nueva investigación, que sus autores llaman HalluSquatting, convierte ese hábito en un ataque: descubrir los nombres falsos que una IA inventa de forma fiable, registrarlos primero y esperar a que el asistente active tu trampa en nombre de un usuario.
Cualquier persona cuyo asistente de IA pueda obtener un recurso externo y luego ejecutar comandos con poca revisión humana está expuesta. En las pruebas, esa ruta llevó al asistente a ejecutar código suministrado por el atacante en la máquina.
Si repites esto con un recurso lo suficientemente popular, un solo nombre plantado puede llegar a muchas máquinas, razón por la cual los investigadores lo plantean como una forma de ensamblar una botnet.
Cómo funciona
El ataque encadena dos peculiaridades de la IA. La primera es una alucinación: una IA que inventa algo y lo presenta como real. La segunda es una inyección de prompts: una instrucción con trampa que secuestra la IA para que siga a un atacante en lugar de al usuario.
Aquí, la inyección es de tipo indirecto, llegando a través del contenido que el asistente obtiene en lugar de algo que el usuario escriba.
1. Elige un objetivo. El atacante encuentra un repositorio o plugin que sea tendencia, para que mucha gente le pida a su IA que lo busque. La tendencia es importante porque un recurso nuevo no está en los datos de entrenamiento de la IA, que es precisamente cuando el modelo empieza a adivinar nombres.
2. Aprende el error. El atacante pide a una IA que busque ese recurso una y otra vez y registra el nombre falso que inventa con más frecuencia.
3. Reclama el nombre falso. El atacante registra ese nombre en GitHub o en una tienda de plugins y oculta instrucciones adversas dentro de él.
4. Espera. Un usuario real pide a su asistente que obtenga el recurso popular. El asistente inventa el mismo nombre falso y extrae la versión del atacante en su lugar. Sus instrucciones ocultas se integran en lo que el asistente cree que se le ordenó hacer, y el asistente secuestrado utiliza su propia herramienta de ejecución de comandos para llevarlas a cabo.
La trampa no es código que se ejecuta por sí solo. Funciona porque estos asistentes mantienen una terminal entre sus herramientas integradas, por lo que, una vez que las instrucciones plantadas toman el control, "instalar un bot" es simplemente algo que el asistente puede hacer.
Lo que lo hace práctico es que los nombres falsos no son aleatorios. En los experimentos de los investigadores, el error fue consistente: en diferentes formulaciones y modelos de distintas empresas, el asistente recurrió al mismo nombre incorrecto en hasta el 85% de las solicitudes de repositorios y el 100% de las instalaciones de habilidades. Estas son las tasas máximas que reportan los autores; el documento contiene el desglose completo.
Lo probaron contra herramientas como Cursor, Windsurf, GitHub Copilot, Cline, Google Gemini CLI y la familia de asistentes OpenClaw, logrando que cada uno ejecutara el código del atacante. Las cargas de prueba eran marcadores de posición inofensivos, no malware real; uno real seguiría el mismo camino.
La investigación https://sites.google.com/view/agentic-botnets/home proviene de Aya Spira y sus colegas del grupo de Ben Nassi en la Universidad de Tel Aviv, con Stav Cohen en Technion y Ron Bitton en Intuit. El grupo de Nassi ya ha hecho esto antes, creando un gusano de correo electrónico de IA que se propaga solo y una invitación de calendario que secuestró el Gemini de Google.
El equipo afirma que informó a los proveedores afectados, creadores de modelos y operadores de mercados antes de hacerlo público, y omitió los pasos exactos necesarios para copiar el ataque.
Por qué es un nuevo tipo de botnet
Las botnets tradicionales requieren trabajo para construirse. Se basan en contraseñas débiles o malware que se propaga de máquina en máquina, y generalmente agrupan un solo tipo de dispositivo, como Mirai hizo con cámaras y routers.
Esto no necesita nada de eso. Sin contraseñas, sin propagación de gusanos, y debido a que la carga llega como texto que la IA lee en lugar de un exploit de red, no es el tipo de cosa que un firewall vigila. Las máquinas en las que aterriza pueden ejecutar cualquier sistema operativo, no una flota uniforme.
La IA es la furgoneta de reparto aquí, no la carga. Las instrucciones plantadas la engañan para instalar un bot ordinario, y una vez que ese bot está funcionando, la máquina pertenece a una botnet como cualquier otra. Lo nuevo es la combinación que lo logra: un nombre que una IA inventa predeciblemente, un mercado donde cualquiera puede registrar ese nombre y un agente con permiso para obtener y ejecutar.
Las piezas no son nuevas, aunque la combinación sí lo sea. Los atacantes primero aprendieron a registrar nombres de paquetes de software falsos que las IA inventan, un truco llamado "slopsquatting".
En enero de 2026, Charlie Eriksen de Aikido Security encontró uno de esos paquetes npm inventados, react-codeshift, que instrucciones escritas por IA ya habían propagado a 237 proyectos de código, con agentes intentando instalarlo diariamente; él mismo lo registró aquí antes de que cualquier atacante pudiera hacerlo, por lo que no causó daño.
La idea luego saltó de los paquetes a las direcciones web. La Unit 42 de Palo Alto Networks describió recientemente el "phantom squatting", aquí, aproximadamente 250,000 dominios alucinados que se encuentran sin registrar y libres para ser tomados.
HalluSquatting es la versión que llega hasta la ejecución de código secuestrando al agente que realiza la búsqueda. Y los mercados destinados a filtrar las subidas maliciosas no son un gran respaldo: en junio, Trail of Bits logró colar "habilidades" maliciosas a través de varios escáneres de tiendas en menos de una hora aquí.
Qué hacer
Todo depende de una condición: un agente que obtiene un recurso externo y lo ejecuta sin que nadie lo revise. Cierra eso y el ataque se detiene. La solución más efectiva es también la más simple: haz que el asistente busque antes de obtener.
Una búsqueda real basa al agente en lo que realmente existe y reduce drásticamente las conjeturas. Ese es un trabajo para las personas que construyen estas herramientas, quienes también pueden entrenar al planificador (la parte que mapea una solicitud a pasos) para buscar un recurso primero y tratar palabras como clone, install y fetch como banderas de alerta.
Tú y los equipos de seguridad tienen palancas a corto plazo. Por defecto, estos agentes preguntan antes de ejecutar un comando. La exposición son los modos de ejecución automática (como la bandera skip-permissions de Claude Code o el modo yolo de Gemini CLI) que desactivan eso, por lo que la primera regla es no dejar que un agente se ejecute sin supervisión en nada que haya obtenido.
Algunas herramientas ahora añaden una capa de seguridad que inspecciona lo que el agente lee o está a punto de hacer antes de actuar, como el modo auto de Claude Code y la verificación Conseca de Gemini CLI, pero eso reduce el riesgo en lugar de eliminarlo. Ningún interruptor único cierra esto, así que verifica también que un nombre de repositorio o paquete se resuelva a la fuente real y esperada antes de que un agente lo descargue, y trata cualquier nombre que una IA te dé como una suposición, no como un hecho.
Las plataformas tienen su propia palanca. Pueden dejar de permitir que las personas reutilicen nombres de repositorios conocidos bajo cuentas nuevas y pre-registrar los nombres falsos que las IA probablemente inventen, para que esos nombres apunten de vuelta al proyecto real.
Los investigadores llaman a sus resultados un límite inferior: "Los ataques siempre mejoran; nunca empeoran". No hay un único CVE que parchear aquí. Lo plantean no como el error de un producto, sino como una debilidad en la forma en que los agentes de IA confían en nombres que nunca se les dieron realmente.
Fuente:
THN
Enviar por correo electrónico
Escribe un blog
Compartir en X
Compartir con Facebook
Compartir en Pinterest

Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.