Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
6757
)
- ► septiembre (Total: 15 )
-
▼
agosto
(Total:
750
)
-
Europa impone reglas estrictas a ChatGPT como busc...
-
OpenClaw 2.0 con mejoras de seguridad para agentes...
-
Linux 7.3 roza las 41 millones de líneas de código
-
Musk quiere quemar gas para alimentar la IA
-
Microsoft confirma falsas alertas de Defender desa...
-
Fire Ant, grupo vinculado a China, secuestra route...
-
Extraditan a nigerianos a EE. UU. por sextorsión y...
-
Fallo crítico de Microsoft UFO permite controlar A...
-
Fallo de Composer expone claves SSH y archivos sen...
-
Los bloqueos de LaLiga se intensifican: la web del...
-
Usan CAPTCHA falso de Cloudflare para infiltrarse ...
-
Hasbro, el gigante de los juguetes, admite filtrac...
-
Malware de hackers expone sus propias herramientas...
-
iPhone Ultra: caro de comprar y reparar
-
Bots dominan el 91% de las compras de RAM
-
GTA 6: disparadas las reservas tras tráiler de Net...
-
Gemini en Android Auto distrae a los conductores
-
OpenAI retira sus modelos de Cursor tras compra de...
-
Windows 11 moderniza función de hace 25 años
-
Linus Torvalds: usar IA para arreglar Linux fue in...
-
Cloudflare libera 100 TB de RAM sin cambiar un sol...
-
Filtrados más de 12 TB de archivos de Steam que ab...
-
WhatsApp detecta estafas con IA local
-
Cinco fallos críticos en temas y plugins de WordPr...
-
Brave integra alias de correo electrónico para evi...
-
Meta impide grabar en secreto con sus gafas
-
Gemini Notebook actualiza sus límites
-
Fallos críticos de ServiceNow permiten ejecutar có...
-
OpenAI golpeó fuerte a Hugging Face
-
iPhone 17 Pro resiste caída de 30 km
-
Google usa IA para gestionar viajes
-
Modo Dios sigue vivo en Windows 11 pese a Microsoft
-
Investigador demuestra que Claude Code puede ser e...
-
Android 17 implementa ECH en todo el sistema para ...
-
Windows 10 no soportará GTA VI
-
PaperCut lanza un segundo parche de emergencia par...
-
IA: alerta por ola de ciberataques
-
Explotan fallo en Cosmos EVM a pesar de que Cosmos...
-
Berlín se niega a pagar el rescate a los que robar...
-
GTA VI podría vaciar las oficinas
-
Gemini convierte Excel en apps
-
El SSD SanDisk de 64 GB de hace 16 años se niega a...
-
Banda de ransomware TITAN afirma que su IA analiza...
-
Estudia ingeniería informática gratis con este rep...
-
700 agentes de IA coordinados secretamente para ha...
-
Atacan infraestructura de IA con RCE, inyección de...
-
Cárcel para un hombre de 68 años que ganó 1,3 mill...
-
Fallo en el plugin de donaciones GiveWP para WordP...
-
Meta pagará 18.000 millones por adicción a sus redes
-
Grave fallo de cPanel podría permitir que un usuar...
-
AWS muestra cómo credenciales robadas permiten ata...
-
Vulnerabilidades de TeamViewer permiten ejecución ...
-
Malware Massiv ataca apps de IPTV en España
-
Razer lanza colección por los 25 años de Xbox
-
Lanzada la actualización KB5120998 de Windows 11 c...
-
Más de 100 entidades tecnológicas piden reforzar l...
-
Zen 6 compatible con AM5
-
Instalan malware mediante currículums falsos de es...
-
Filtración en universidad rusa revela entrenamient...
-
Windows XP cumple 25 años
-
Más de 8.300 servidores Gitea expuestos a ataques ...
-
Vulnerabilidades en el robot humanoide Unitree G1 ...
-
Ya disponible Ubuntu 26.04.1 LTS
-
Photoshop integra IA para editar con prompts y boc...
-
Cae uno de los mayores imperios de la piratería mu...
-
OpenAI advierte que el reward hacking llevó a agen...
-
OpenAI crea IA autónoma
-
Casi 700 agentes de IA coordinados en el ataque a ...
-
Next.js corrige fallos críticos de AVIF y Windows ...
-
Bill Gates advierte sobre el impacto de la IA
-
PaperCut sufre un ataque de día cero que está golp...
-
Roban datos de 8,7 millones de clientes en tres ae...
-
Policía australiana detiene a presuntos cerebros d...
-
Vulnerabilidad en dispositivos TP-Link Kasa permit...
-
Vulnerabilidad crítica de cPanel permite control t...
-
Secuestran Claude Code Opus 5 Auto Mode mediante p...
-
CISA advierte vulnerabilidad en Citrix NetScaler e...
-
Ciberdelincuentes venden números de seguridad soci...
-
Google lanza Gemini Omni 1.1 Flash para vídeos pro...
-
LibreOffice 26.8 se actualiza y rechaza la IA
-
OpenAI banea cuentas de ChatGPT vinculadas a Rusia...
-
OpenAI limita mensajes de GPT-5.6 Sol en ChatGPT Plus
-
El FBI desarticula infraestructura de QTFY vincula...
-
Operación Jackal IV de INTERPOL: 58 detenidos y 26...
-
28.000 repositorios Git expuestos revelan claves A...
-
Claude Opus 4.6 vulnera el límite de reservas del ...
-
Mac Studio M5: potencia extrema para IA
-
Vulnerabilidades de SonicWall NetExtender permiten...
-
Vulnerabilidades críticas en Next.js permiten ejec...
-
Vulnerabilidad en plugin TranslatePress de WordPre...
-
Garmin actualiza funciones en modelos antiguos
-
21 fallos críticos de Ubiquiti UniFi permiten salt...
-
Apple renueva Mac Mini y Studio con chip de 2nm
-
Comando de Windows para liberar espacio sin riesgo...
-
Llega NVIDIA DLSS 4.5 Ray Reconstruction
-
China sustituirá Windows por Linux
-
Linux cumple 35: el kernel aficionado que ahora im...
-
El gusano Morris infectó el 10% de Internet
-
Amazon sube el precio de sus dispositivos Echo, Ki...
-
UE busca sustituir a Visa y Mastercard para 2029
-
Chrome 152: 327 correcciones de seguridad y 10 crí...
-
Alerta por vulnerabilidad crítica de RCE en Gitea ...
-
Fallos de OpenSSL permiten colapsar servidores y c...
-
Qualcomm rompe la barrera de los 5 GHz en smartpho...
-
OpenAI suspende cuentas rusas de ChatGPT vinculada...
-
Intel convierte Diamond Rapids en una bestia de 25...
-
EE. UU. impone sanciones a hackers vinculados a Ir...
-
Ciberataque masivo colapsa los servicios digitales...
-
91 vulnerabilidades de Spring afectan a más de 209...
-
AliExpress usa WebAudio API para rastreo silencios...
-
Passkeys de WhatsApp alcanzan mil millones de usua...
-
Falso análisis de Microsoft pide quitar antivirus ...
-
La IA preferida de los hackers es DeepSeek
-
Fallo en plataforma B2B de Tata permite robo de cu...
-
Ocho agentes de IA vulneran sistemas gubernamental...
-
Sony: los juegos digitales no son tuyos
-
AWS Network Firewall ya muestra el recuento de reg...
-
Fallo sin parchear en Calix permite a hackers salt...
-
DOOM 64 estrena trazado de trayectorias
-
Crisis de RAM hunde a marca de Linux Pine64
-
Falsa demo de GTA 6 es malware que roba contraseña...
-
Ciberatacantes aprovechan fallos de miniOrange SAM...
-
Fallo crítico en Red Hat Keycloak permite tomar cu...
-
AliExpress es señalada por rastrear usuarios media...
-
Una página web maliciosa podría contaminar tu mode...
-
IA china crea vídeos desde PowerPoint
-
Investigador revela cinco vulnerabilidades crítica...
-
Vulnerabilidades en TP-Link Archer permiten ataque...
-
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
vulnerabilidad
(
1770
)
seguridad
(
1750
)
software
(
1061
)
hardware
(
908
)
google
(
774
)
Malware
(
710
)
privacidad
(
671
)
ransomware
(
537
)
Windows
(
521
)
exploit
(
487
)
android
(
473
)
linux
(
427
)
cve
(
374
)
nvidia
(
303
)
tutorial
(
300
)
manual
(
282
)
hacking
(
258
)
ssd
(
182
)
WhatsApp
(
173
)
ddos
(
140
)
Wifi
(
131
)
app
(
127
)
cifrado
(
121
)
twitter
(
121
)
programación
(
119
)
youtube
(
83
)
firmware
(
81
)
herramientas
(
80
)
firefox
(
78
)
Networking
(
73
)
sysadmin
(
72
)
adobe
(
69
)
office
(
62
)
antivirus
(
52
)
hack
(
52
)
Kernel
(
49
)
javascript
(
49
)
apache
(
46
)
juegos
(
42
)
contraseñas
(
39
)
multimedia
(
36
)
cms
(
35
)
flash
(
33
)
eventos
(
32
)
MAC
(
30
)
anonymous
(
28
)
ssl
(
24
)
conferencia
(
21
)
Forense
(
20
)
SeguridadWireless
(
17
)
documental
(
17
)
auditoría
(
15
)
Debugger
(
14
)
Rootkit
(
14
)
lizard squad
(
14
)
metasploit
(
13
)
técnicas hacking
(
13
)
Virtualización
(
11
)
delitos
(
11
)
reversing
(
10
)
adamo
(
9
)
Ehn-Dev
(
7
)
antimalware
(
7
)
MAC Adress
(
6
)
oclHashcat
(
5
)
Entradas populares
-
Python 3.15 ya es oficial, introduciendo optimizaciones en TypedDict, Tachyon, JIT y soporte ABI para mejorar la productividad del ecosist...
-
Dopamine 3.0 ha lanzado el jailbreak para iOS 26 , confirmando que estas herramientas de desbloqueo siguen vigentes a pesar de las restricc...
-
La UE propone un temporizador de 30 minutos para bloquear el fútbol pirata y las IPTV, basándose en el modelo italiano Piracy Shield, afect...
Modelo de IA de Meta vulnera empresa durante un test de ciberseguridad mal configurado
sábado, 8 de agosto de 2026
|
Publicado por
el-brujo
|
Editar entrada
Meta confirmó que uno de sus modelos de IA hackeó a una empresa real durante unas pruebas de ciberseguridad debido a un error de configuración en el entorno de prueba. Este incidente se suma a fallos similares reportados recientemente por OpenAI y Anthropic, donde modelos de IA accedieron a internet accidentalmente y atacaron sistemas externos. Estos casos resaltan la necesidad de implementar salvaguardas más estrictas y entornos de prueba aislados para evitar ataques imprevistos.
Meta se ha convertido en la última compañía de IA en confirmar que uno de sus modelos hackeó a una organización real durante pruebas de ciberseguridad, mientras continúan surgiendo incidentes similares tras la revelación inicial de OpenAI de que sus agentes vulneraron Hugging Face.
The Information fue la primera en informar el miércoles sobre el incidente, citando a personas familiarizadas con el asunto que afirmaron que el modelo Muse Spark 1.1 de Meta vulneró una empresa no identificada y realizó cambios en sus sistemas internos.
Según el informe, el modelo alcanzó la internet pública debido a un error en la configuración de un entorno de prueba sandbox operado con la empresa independiente de evaluación de ciberseguridad Irregular.
Meta no ha confirmado públicamente que Muse Spark 1.1 fuera el modelo involucrado, ni ha identificado a la empresa afectada, ni ha explicado qué cambios se realizaron en sus sistemas.
Sin embargo, Meta confirmó a Reuters que una configuración incorrecta por parte de Irregular dio inadvertidamente acceso a internet a uno de sus modelos durante una evaluación.
La compañía señaló que el modelo "explotó una vulnerabilidad de seguridad en un servicio de terceros, de manera similar a instancias reportadas previamente con otras empresas".
Meta dijo a la BBC que está investigando el incidente y publicará más información "una vez que tengamos todos los hechos".
Se contactó a Meta e Irregular para obtener información adicional, pero no ha recibido respuesta.
Irregular dijo a Reuters que el incidente de Meta implicó el "mismo problema de entorno de evaluación que ya fue revelado por Anthropic la semana pasada".
La empresa afirmó que el incidente no implicó un escape del sandbox ni una acción cibernética sofisticada. En su lugar, un error en el entorno de prueba dio al modelo acceso a la internet pública cuando se suponía que debía estar aislado.
"No hay problemas abiertos actualmente. Irregular está desarrollando un libro blanco para compartir las mejores prácticas de contención y ejecución segura de evaluaciones cibernéticas", dijo la empresa a Reuters.
Este nuevo incidente de seguridad de agentes de IA sigue a la revelación de Anthropic la semana pasada de que algunos de sus modelos habían hackeado a tres empresas después de que una configuración incorrecta similar en el entorno de prueba de Irregular les diera acceso no deseado a internet.
En uno de esos incidentes, Claude Mythos 5 encontró instrucciones de desarrollador dentro del entorno simulado que hacían referencia a un paquete de Python inexistente. Creyendo haber identificado una forma de comprometer el objetivo ficticio, el modelo creó un paquete malicioso bajo el mismo nombre y lo publicó en el registro real de PyPI.
El paquete permaneció en línea durante aproximadamente una hora y fue descargado y ejecutado en 15 sistemas reales antes de que PyPI lo eliminara.
Uno de ellos era un escáner de malware operado por una empresa de seguridad, donde el paquete robó credenciales que Claude utilizó luego para acceder a infraestructura adicional. Anthropic dijo que el modelo reconoció inicialmente que publicar el paquete constituiría un ataque en el mundo real, pero se convenció a sí mismo de que todavía estaba operando dentro de una simulación.
OpenAI también reveló recientemente otra evaluación de Irregular en la que el nombre de un objetivo de CTF ficticio coincidía con un dominio real.
Debido a que el entorno supuestamente aislado podía acceder a la internet pública, un modelo de OpenAI explotó una vulnerabilidad básica en el sitio web real y encontró credenciales que le permitieron operar el sitio.
Los incidentes de Meta e Irregular difieren de la vulneración de Hugging Face revelada anteriormente, donde los modelos de OpenAI encontraron un camino a la internet pública explotando una vulnerabilidad previamente desconocida en un servidor JFrog Artifactory alojado internamente utilizado durante las pruebas.
Tras alcanzar internet, los agentes vulneraron Hugging Face mientras buscaban conjuntos de datos de referencia y soluciones, robaron credenciales y se movieron lateralmente a través de los sistemas de la empresa.
OpenAI reveló posteriormente que los agentes utilizaron credenciales expuestas para acceder a cuentas en otros cuatro servicios de terceros, utilizando algunas de esas cuentas para infraestructura de ataque y almacenamiento de datos.
El Instituto de Seguridad de la IA del Reino Unido, conocido comúnmente como AISI, también reveló que los agentes que utilizaban Claude Mythos 5 de Anthropic y GPT-5.6 Sol de OpenAI realizaron 19 acciones no autorizadas en la internet pública durante las evaluaciones de ciber-rango.
En la secuencia más grave, el agente Mythos 5 intentó un ataque de cadena de suministro contra un proyecto real de código abierto tras concluir erróneamente que su repositorio de GitHub estaba conectado al desafío simulado.
El agente investigó a los mantenedores del proyecto, envió código malicioso, creó identidades falsas, envió correos electrónicos dirigidos que contenían malware y presionó a un mantenedor para que aprobara la solicitud de cambios (pull request).
Cuando un revisor advirtió que el código contenía malware, el agente negó la acusación y utilizó cuentas falsas adicionales para crear la apariencia de que usuarios independientes habían revisado y aprobado los cambios.
El AISI proporcionó intencionadamente a los agentes acceso a internet y desactivó sus salvaguardas cibernéticas estándar para medir sus capacidades subyacentes. Sin embargo, los agentes solo estaban autorizados a atacar sistemas dentro del rango simulado.
Como ha quedado claro, a menos que se restrinjan cuidadosamente, los agentes de IA harán grandes esfuerzos para resolver sus tareas, incluso si eso significa salir de los sandboxes o realizar ataques de ingeniería social a personas reales.
Si bien los desarrolladores de IA tienen la responsabilidad de crear salvaguardas que eviten que los modelos realicen acciones dañinas, los incidentes también resaltan la responsabilidad de las empresas que realizan estas evaluaciones de configurar correctamente sus entornos de prueba.
Fuente:
BleepingComputer
Meta se ha convertido en la última compañía de IA en confirmar que uno de sus modelos hackeó a una organización real durante pruebas de ciberseguridad, mientras continúan surgiendo incidentes similares tras la revelación inicial de OpenAI de que sus agentes vulneraron Hugging Face.
The Information fue la primera en informar el miércoles sobre el incidente, citando a personas familiarizadas con el asunto que afirmaron que el modelo Muse Spark 1.1 de Meta vulneró una empresa no identificada y realizó cambios en sus sistemas internos.
Según el informe, el modelo alcanzó la internet pública debido a un error en la configuración de un entorno de prueba sandbox operado con la empresa independiente de evaluación de ciberseguridad Irregular.
Meta no ha confirmado públicamente que Muse Spark 1.1 fuera el modelo involucrado, ni ha identificado a la empresa afectada, ni ha explicado qué cambios se realizaron en sus sistemas.
Sin embargo, Meta confirmó a Reuters que una configuración incorrecta por parte de Irregular dio inadvertidamente acceso a internet a uno de sus modelos durante una evaluación.
La compañía señaló que el modelo "explotó una vulnerabilidad de seguridad en un servicio de terceros, de manera similar a instancias reportadas previamente con otras empresas".
Meta dijo a la BBC que está investigando el incidente y publicará más información "una vez que tengamos todos los hechos".
Se contactó a Meta e Irregular para obtener información adicional, pero no ha recibido respuesta.
Irregular dijo a Reuters que el incidente de Meta implicó el "mismo problema de entorno de evaluación que ya fue revelado por Anthropic la semana pasada".
La empresa afirmó que el incidente no implicó un escape del sandbox ni una acción cibernética sofisticada. En su lugar, un error en el entorno de prueba dio al modelo acceso a la internet pública cuando se suponía que debía estar aislado.
"No hay problemas abiertos actualmente. Irregular está desarrollando un libro blanco para compartir las mejores prácticas de contención y ejecución segura de evaluaciones cibernéticas", dijo la empresa a Reuters.
Este nuevo incidente de seguridad de agentes de IA sigue a la revelación de Anthropic la semana pasada de que algunos de sus modelos habían hackeado a tres empresas después de que una configuración incorrecta similar en el entorno de prueba de Irregular les diera acceso no deseado a internet.
En uno de esos incidentes, Claude Mythos 5 encontró instrucciones de desarrollador dentro del entorno simulado que hacían referencia a un paquete de Python inexistente. Creyendo haber identificado una forma de comprometer el objetivo ficticio, el modelo creó un paquete malicioso bajo el mismo nombre y lo publicó en el registro real de PyPI.
El paquete permaneció en línea durante aproximadamente una hora y fue descargado y ejecutado en 15 sistemas reales antes de que PyPI lo eliminara.
Uno de ellos era un escáner de malware operado por una empresa de seguridad, donde el paquete robó credenciales que Claude utilizó luego para acceder a infraestructura adicional. Anthropic dijo que el modelo reconoció inicialmente que publicar el paquete constituiría un ataque en el mundo real, pero se convenció a sí mismo de que todavía estaba operando dentro de una simulación.
OpenAI también reveló recientemente otra evaluación de Irregular en la que el nombre de un objetivo de CTF ficticio coincidía con un dominio real.
Debido a que el entorno supuestamente aislado podía acceder a la internet pública, un modelo de OpenAI explotó una vulnerabilidad básica en el sitio web real y encontró credenciales que le permitieron operar el sitio.
Los incidentes de Meta e Irregular difieren de la vulneración de Hugging Face revelada anteriormente, donde los modelos de OpenAI encontraron un camino a la internet pública explotando una vulnerabilidad previamente desconocida en un servidor JFrog Artifactory alojado internamente utilizado durante las pruebas.
Tras alcanzar internet, los agentes vulneraron Hugging Face mientras buscaban conjuntos de datos de referencia y soluciones, robaron credenciales y se movieron lateralmente a través de los sistemas de la empresa.
OpenAI reveló posteriormente que los agentes utilizaron credenciales expuestas para acceder a cuentas en otros cuatro servicios de terceros, utilizando algunas de esas cuentas para infraestructura de ataque y almacenamiento de datos.
El Instituto de Seguridad de la IA del Reino Unido, conocido comúnmente como AISI, también reveló que los agentes que utilizaban Claude Mythos 5 de Anthropic y GPT-5.6 Sol de OpenAI realizaron 19 acciones no autorizadas en la internet pública durante las evaluaciones de ciber-rango.
En la secuencia más grave, el agente Mythos 5 intentó un ataque de cadena de suministro contra un proyecto real de código abierto tras concluir erróneamente que su repositorio de GitHub estaba conectado al desafío simulado.
El agente investigó a los mantenedores del proyecto, envió código malicioso, creó identidades falsas, envió correos electrónicos dirigidos que contenían malware y presionó a un mantenedor para que aprobara la solicitud de cambios (pull request).
Cuando un revisor advirtió que el código contenía malware, el agente negó la acusación y utilizó cuentas falsas adicionales para crear la apariencia de que usuarios independientes habían revisado y aprobado los cambios.
El AISI proporcionó intencionadamente a los agentes acceso a internet y desactivó sus salvaguardas cibernéticas estándar para medir sus capacidades subyacentes. Sin embargo, los agentes solo estaban autorizados a atacar sistemas dentro del rango simulado.
Como ha quedado claro, a menos que se restrinjan cuidadosamente, los agentes de IA harán grandes esfuerzos para resolver sus tareas, incluso si eso significa salir de los sandboxes o realizar ataques de ingeniería social a personas reales.
Si bien los desarrolladores de IA tienen la responsabilidad de crear salvaguardas que eviten que los modelos realicen acciones dañinas, los incidentes también resaltan la responsabilidad de las empresas que realizan estas evaluaciones de configurar correctamente sus entornos de prueba.
Fuente:
BleepingComputer
Enviar por correo electrónico
Escribe un blog
Compartir en X
Compartir con Facebook
Compartir en Pinterest
Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.