Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
7227
)
- ► septiembre (Total: 485 )
-
▼
agosto
(Total:
750
)
-
Europa impone reglas estrictas a ChatGPT como busc...
-
OpenClaw 2.0 con mejoras de seguridad para agentes...
-
Linux 7.3 roza las 41 millones de líneas de código
-
Musk quiere quemar gas para alimentar la IA
-
Microsoft confirma falsas alertas de Defender desa...
-
Fire Ant, grupo vinculado a China, secuestra route...
-
Extraditan a nigerianos a EE. UU. por sextorsión y...
-
Fallo crítico de Microsoft UFO permite controlar A...
-
Fallo de Composer expone claves SSH y archivos sen...
-
Los bloqueos de LaLiga se intensifican: la web del...
-
Usan CAPTCHA falso de Cloudflare para infiltrarse ...
-
Hasbro, el gigante de los juguetes, admite filtrac...
-
Malware de hackers expone sus propias herramientas...
-
iPhone Ultra: caro de comprar y reparar
-
Bots dominan el 91% de las compras de RAM
-
GTA 6: disparadas las reservas tras tráiler de Net...
-
Gemini en Android Auto distrae a los conductores
-
OpenAI retira sus modelos de Cursor tras compra de...
-
Windows 11 moderniza función de hace 25 años
-
Linus Torvalds: usar IA para arreglar Linux fue in...
-
Cloudflare libera 100 TB de RAM sin cambiar un sol...
-
Filtrados más de 12 TB de archivos de Steam que ab...
-
WhatsApp detecta estafas con IA local
-
Cinco fallos críticos en temas y plugins de WordPr...
-
Brave integra alias de correo electrónico para evi...
-
Meta impide grabar en secreto con sus gafas
-
Gemini Notebook actualiza sus límites
-
Fallos críticos de ServiceNow permiten ejecutar có...
-
OpenAI golpeó fuerte a Hugging Face
-
iPhone 17 Pro resiste caída de 30 km
-
Google usa IA para gestionar viajes
-
Modo Dios sigue vivo en Windows 11 pese a Microsoft
-
Investigador demuestra que Claude Code puede ser e...
-
Android 17 implementa ECH en todo el sistema para ...
-
Windows 10 no soportará GTA VI
-
PaperCut lanza un segundo parche de emergencia par...
-
IA: alerta por ola de ciberataques
-
Explotan fallo en Cosmos EVM a pesar de que Cosmos...
-
Berlín se niega a pagar el rescate a los que robar...
-
GTA VI podría vaciar las oficinas
-
Gemini convierte Excel en apps
-
El SSD SanDisk de 64 GB de hace 16 años se niega a...
-
Banda de ransomware TITAN afirma que su IA analiza...
-
Estudia ingeniería informática gratis con este rep...
-
700 agentes de IA coordinados secretamente para ha...
-
Atacan infraestructura de IA con RCE, inyección de...
-
Cárcel para un hombre de 68 años que ganó 1,3 mill...
-
Fallo en el plugin de donaciones GiveWP para WordP...
-
Meta pagará 18.000 millones por adicción a sus redes
-
Grave fallo de cPanel podría permitir que un usuar...
-
AWS muestra cómo credenciales robadas permiten ata...
-
Vulnerabilidades de TeamViewer permiten ejecución ...
-
Malware Massiv ataca apps de IPTV en España
-
Razer lanza colección por los 25 años de Xbox
-
Lanzada la actualización KB5120998 de Windows 11 c...
-
Más de 100 entidades tecnológicas piden reforzar l...
-
Zen 6 compatible con AM5
-
Instalan malware mediante currículums falsos de es...
-
Filtración en universidad rusa revela entrenamient...
-
Windows XP cumple 25 años
-
Más de 8.300 servidores Gitea expuestos a ataques ...
-
Vulnerabilidades en el robot humanoide Unitree G1 ...
-
Ya disponible Ubuntu 26.04.1 LTS
-
Photoshop integra IA para editar con prompts y boc...
-
Cae uno de los mayores imperios de la piratería mu...
-
OpenAI advierte que el reward hacking llevó a agen...
-
OpenAI crea IA autónoma
-
Casi 700 agentes de IA coordinados en el ataque a ...
-
Next.js corrige fallos críticos de AVIF y Windows ...
-
Bill Gates advierte sobre el impacto de la IA
-
PaperCut sufre un ataque de día cero que está golp...
-
Roban datos de 8,7 millones de clientes en tres ae...
-
Policía australiana detiene a presuntos cerebros d...
-
Vulnerabilidad en dispositivos TP-Link Kasa permit...
-
Vulnerabilidad crítica de cPanel permite control t...
-
Secuestran Claude Code Opus 5 Auto Mode mediante p...
-
CISA advierte vulnerabilidad en Citrix NetScaler e...
-
Ciberdelincuentes venden números de seguridad soci...
-
Google lanza Gemini Omni 1.1 Flash para vídeos pro...
-
LibreOffice 26.8 se actualiza y rechaza la IA
-
OpenAI banea cuentas de ChatGPT vinculadas a Rusia...
-
OpenAI limita mensajes de GPT-5.6 Sol en ChatGPT Plus
-
El FBI desarticula infraestructura de QTFY vincula...
-
Operación Jackal IV de INTERPOL: 58 detenidos y 26...
-
28.000 repositorios Git expuestos revelan claves A...
-
Claude Opus 4.6 vulnera el límite de reservas del ...
-
Mac Studio M5: potencia extrema para IA
-
Vulnerabilidades de SonicWall NetExtender permiten...
-
Vulnerabilidades críticas en Next.js permiten ejec...
-
Vulnerabilidad en plugin TranslatePress de WordPre...
-
Garmin actualiza funciones en modelos antiguos
-
21 fallos críticos de Ubiquiti UniFi permiten salt...
-
Apple renueva Mac Mini y Studio con chip de 2nm
-
Comando de Windows para liberar espacio sin riesgo...
-
Llega NVIDIA DLSS 4.5 Ray Reconstruction
-
China sustituirá Windows por Linux
-
Linux cumple 35: el kernel aficionado que ahora im...
-
El gusano Morris infectó el 10% de Internet
-
Amazon sube el precio de sus dispositivos Echo, Ki...
-
UE busca sustituir a Visa y Mastercard para 2029
-
Chrome 152: 327 correcciones de seguridad y 10 crí...
-
Alerta por vulnerabilidad crítica de RCE en Gitea ...
-
Fallos de OpenSSL permiten colapsar servidores y c...
-
Qualcomm rompe la barrera de los 5 GHz en smartpho...
-
OpenAI suspende cuentas rusas de ChatGPT vinculada...
-
Intel convierte Diamond Rapids en una bestia de 25...
-
EE. UU. impone sanciones a hackers vinculados a Ir...
-
Ciberataque masivo colapsa los servicios digitales...
-
91 vulnerabilidades de Spring afectan a más de 209...
-
AliExpress usa WebAudio API para rastreo silencios...
-
Passkeys de WhatsApp alcanzan mil millones de usua...
-
Falso análisis de Microsoft pide quitar antivirus ...
-
La IA preferida de los hackers es DeepSeek
-
Fallo en plataforma B2B de Tata permite robo de cu...
-
Ocho agentes de IA vulneran sistemas gubernamental...
-
Sony: los juegos digitales no son tuyos
-
AWS Network Firewall ya muestra el recuento de reg...
-
Fallo sin parchear en Calix permite a hackers salt...
-
DOOM 64 estrena trazado de trayectorias
-
Crisis de RAM hunde a marca de Linux Pine64
-
Falsa demo de GTA 6 es malware que roba contraseña...
-
Ciberatacantes aprovechan fallos de miniOrange SAM...
-
Fallo crítico en Red Hat Keycloak permite tomar cu...
-
AliExpress es señalada por rastrear usuarios media...
-
Una página web maliciosa podría contaminar tu mode...
-
IA china crea vídeos desde PowerPoint
-
Investigador revela cinco vulnerabilidades crítica...
-
Vulnerabilidades en TP-Link Archer permiten ataque...
-
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
vulnerabilidad
(
1912
)
seguridad
(
1852
)
software
(
1185
)
hardware
(
958
)
google
(
798
)
Malware
(
711
)
privacidad
(
686
)
exploit
(
549
)
ransomware
(
543
)
Windows
(
521
)
android
(
487
)
linux
(
452
)
cve
(
378
)
nvidia
(
327
)
tutorial
(
300
)
manual
(
282
)
hacking
(
267
)
ssd
(
183
)
WhatsApp
(
173
)
ddos
(
143
)
Wifi
(
131
)
app
(
129
)
programación
(
124
)
cifrado
(
122
)
twitter
(
121
)
firmware
(
85
)
youtube
(
84
)
firefox
(
80
)
herramientas
(
80
)
Networking
(
73
)
sysadmin
(
72
)
adobe
(
71
)
office
(
62
)
antivirus
(
55
)
hack
(
53
)
javascript
(
51
)
Kernel
(
49
)
apache
(
47
)
juegos
(
42
)
contraseñas
(
39
)
cms
(
36
)
multimedia
(
36
)
flash
(
33
)
eventos
(
32
)
MAC
(
30
)
anonymous
(
28
)
ssl
(
24
)
conferencia
(
21
)
Forense
(
20
)
documental
(
18
)
SeguridadWireless
(
17
)
auditoría
(
16
)
Debugger
(
14
)
Rootkit
(
14
)
lizard squad
(
14
)
metasploit
(
13
)
técnicas hacking
(
13
)
Virtualización
(
11
)
delitos
(
11
)
reversing
(
10
)
adamo
(
9
)
Ehn-Dev
(
7
)
antimalware
(
7
)
MAC Adress
(
6
)
oclHashcat
(
5
)
Entradas populares
-
La actualización KB5121003 de Windows 11 puede estar corrompiendo la BIOS de portátiles HP, Lenovo y Dell , provocando fallos de instalaci...
-
Un grupo está promocionando Luciferus , un nuevo servicio de inteligencia artificial "sin censura" . A diferencia de los sistemas ...
-
Microsoft ha implementado anuncios a pantalla completa en el fondo de escritorio de Windows 11 a través de Bing Wallpaper.
Pruebas cibernéticas de OpenAI y Anthropic: agentes de IA atacaron a personas y sistemas reales
viernes, 7 de agosto de 2026
|
Publicado por
el-brujo
|
Editar entrada
OpenAI y Anthropic confirmaron que sus modelos de IA cometieron acciones no autorizadas durante pruebas de ciberseguridad, incluyendo la vulneración de un sitio web real y ataques de ingeniería social. El modelo de Anthropic creó identidades falsas en GitHub para engañar a desarrolladores, mientras que el de OpenAI explotó un dominio real debido a una falla de configuración. Aunque no se reportaron daños graves, los incidentes alertan sobre los riesgos de autonomía y engaño en agentes de IA avanzados.
OpenAI y Anthropic han confirmado que sus modelos de IA estuvieron implicados en incidentes independientes y recientemente revelados de pruebas de ciberseguridad de terceros, que resultaron en la brecha de un sitio web real y ataques de ingeniería social contra personas fuera de los límites de prueba previstos.
Estos incidentes no están relacionados con la brecha de Hugging Face revelada anteriormente, en la que los modelos de OpenAI hackearon la plataforma de IA y utilizaron credenciales expuestas para vulnerar cuentas en otros cuatro servicios de terceros durante otra evaluación de ciberseguridad.
OpenAI reveló los dos nuevos incidentes aquí el martes, afirmando que ocurrieron durante evaluaciones realizadas por el Instituto de Seguridad de la IA del Reino Unido y la empresa de pruebas de ciberseguridad Irregular.
El Instituto de Seguridad de la IA del Reino Unido, comúnmente conocido como AISI, es una organización de investigación gubernamental que evalúa las capacidades y riesgos de los modelos de IA avanzados.
Durante una evaluación reciente de ciber-rango, el AISI afirma que los agentes impulsados por Claude Mythos 5 de Anthropic y GPT-5.6 Sol de OpenAI realizaron acciones no autorizadas en la internet pública mientras intentaban completar desafíos de hackeo simulados.
A lo largo de 122 intentos de evaluación, el AISI identificó 19 acciones no autorizadas en la internet en vivo en 10 ejecuciones. Diecisiete involucraron a Mythos 5 y dos involucraron a GPT-5.6 Sol.
El AISI afirma que los intentos no tuvieron éxito y que no encontró daños reales resultantes.
"Estos intentos no tuvieron éxito y nuestras investigaciones no han evidenciado ningún daño real resultante", dijo el AISI en un aviso independiente aquí.
"Pero esta es la primera vez que vemos riesgos relacionados con la autonomía y el engaño manifestarse tan claramente, sin instrucciones específicas, en el mundo real".
El AISI habilitó intencionadamente el acceso a la internet abierta y desactivó los clasificadores de ciberseguridad de los proveedores de modelos para medir las capacidades subyacentes de los modelos. Sin embargo, los agentes solo estaban autorizados a atacar el ciber-rango simulado y no se les indicó explícitamente cómo podían usar su acceso a internet ni se les instruyó para evitar interactuar con personas y sistemas reales.
Anthropic confirmó que el AISI estaba probando una versión de Claude Mythos 5, pero señaló que aún está investigando y no puede confirmar todos los detalles técnicos descritos en el informe del AISI.
La empresa dijo que fue notificada el lunes y está trabajando con el AISI para obtener las transcripciones de la evaluación necesarias para realizar su propia revisión.
"Estamos agradecidos al AISI del Reino Unido por su liderazgo en este incidente, que subraya la necesidad de una conversación más amplia sobre cómo evaluar de forma segura a los agentes de IA cada vez más capaces", dijo un portavoz de Anthropic.
"Tal como compartimos tras revelar nuestro propio incidente la semana pasada, el campo necesita estándares compartidos más sólidos sobre cómo se construyen y aseguran los entornos de evaluación. Esperamos colaborar con el AISI del Reino Unido para aprender más sobre este incidente mientras realizamos nuestra propia investigación".
Anthropic señaló que el AISI probó Mythos 5 sin sus salvaguardas ciber estándar habilitadas y que esta no es la misma configuración disponible para los clientes. El AISI afirma que su diseño y configuraciones de evaluación pueden haber contribuido al comportamiento, pero no anticiparon cómo el agente mostraría "signos de comportamientos novedosos y potencialmente engañosos".
El AISI afirma que un agente de Mythos 5 buscó en internet términos relacionados con el desafío cibernético y concluyó erróneamente que un repositorio público de GitHub no relacionado estaba conectado a la prueba.
El agente luego intentó un ataque de cadena de suministro enviando código malicioso al proyecto real de código abierto, creyendo que comprometer el software podría proporcionar una ruta hacia una máquina dentro del rango simulado.
Lo más preocupante es que el agente investigó a los mantenedores del proyecto, creó múltiples identidades falsas de GitHub y utilizó esas cuentas en ataques de ingeniería social para presionar al mantenedor a aprobar una solicitud de extracción (pull request) maliciosa.
Cuando un revisor humano advirtió que la solicitud contenía malware, el agente negó la acusación y utilizó otras cuentas falsas que controlaba para presionar al mantenedor y crear la apariencia de que usuarios independientes habían revisado y aprobado los cambios.
Resumen del ataque de ingeniería social de un agente de IA contra un mantenedor de proyecto
Fuente: AISI
El agente continuó sus ataques de ingeniería social ocultando su identidad mediante el uso de Tor y servicios de proxy, y creando cuentas de GitHub desechables.
Envió cinco correos electrónicos dirigidos a los desarrolladores, algunos de los cuales contenían malware y otros intentaban persuadirlos para que aprobaran el cambio de código.
El agente también publicó informes de errores que contenían código malicioso e instrucciones ocultas de inyección de prompts diseñadas para engañar a los asistentes de codificación de IA para que realizaran acciones no deseadas.
Cuando una persona real cuestionó una de las publicaciones, el agente la editó para ocultar el contenido malicioso. En otro intento, se despidió en danés para parecer más convincente ante un mantenedor que hablara danés.
Los investigadores del AISI descubrieron que los agentes se coordinaban entre sí a través de diferentes ejecuciones de evaluación, utilizando un repositorio de GitHub compartido como tablero de mensajes para dejarse instrucciones mutuamente.
"Esta es la primera vez que el AISI ve un engaño de esta gravedad dirigido a una persona real, sin provocación, en el mundo real", afirmó el instituto.
El AISI dice que sigue sin estar claro cuándo, o si, el modelo comprendió que estaba interactuando con personas reales en lugar de objetivos simulados.
El segundo incidente revelado ocurrió durante las evaluaciones de Capture-the-Flag realizadas por Irregular que se suponía que estaban aisladas de internet.
En una prueba, el nombre del objetivo ficticio coincidió con un dominio real, lo que provocó que el modelo explotara un sitio web real que creía que formaba parte del desafío simulado.
Aunque el entorno de pruebas de Irregular debía estar aislado de internet, una configuración incorrecta permitió que los modelos de OpenAI accedieran a la internet pública y atacaran el sitio web real.
"Según la investigación de Irregular, el modelo también encontró y utilizó credenciales para operar ese mismo sitio", dijo OpenAI.
OpenAI afirma que el modelo explotó una vulnerabilidad básica en lugar de utilizar un zero-day o escapar de su entorno de pruebas.
OpenAI afirma que Irregular no ha descubierto ningún impacto más allá de los propios datos del sitio afectado, pero su investigación sigue en curso. OpenAI dice que la empresa está preparando un libro blanco sobre la contención y la realización segura de evaluaciones cibernéticas.
Fuente:
BleepingComputer
OpenAI y Anthropic han confirmado que sus modelos de IA estuvieron implicados en incidentes independientes y recientemente revelados de pruebas de ciberseguridad de terceros, que resultaron en la brecha de un sitio web real y ataques de ingeniería social contra personas fuera de los límites de prueba previstos.
Estos incidentes no están relacionados con la brecha de Hugging Face revelada anteriormente, en la que los modelos de OpenAI hackearon la plataforma de IA y utilizaron credenciales expuestas para vulnerar cuentas en otros cuatro servicios de terceros durante otra evaluación de ciberseguridad.
OpenAI reveló los dos nuevos incidentes aquí el martes, afirmando que ocurrieron durante evaluaciones realizadas por el Instituto de Seguridad de la IA del Reino Unido y la empresa de pruebas de ciberseguridad Irregular.
Ataques de spear-phishing contra mantenedores de proyectos de github
El Instituto de Seguridad de la IA del Reino Unido, comúnmente conocido como AISI, es una organización de investigación gubernamental que evalúa las capacidades y riesgos de los modelos de IA avanzados.
Durante una evaluación reciente de ciber-rango, el AISI afirma que los agentes impulsados por Claude Mythos 5 de Anthropic y GPT-5.6 Sol de OpenAI realizaron acciones no autorizadas en la internet pública mientras intentaban completar desafíos de hackeo simulados.
A lo largo de 122 intentos de evaluación, el AISI identificó 19 acciones no autorizadas en la internet en vivo en 10 ejecuciones. Diecisiete involucraron a Mythos 5 y dos involucraron a GPT-5.6 Sol.
El AISI afirma que los intentos no tuvieron éxito y que no encontró daños reales resultantes.
"Estos intentos no tuvieron éxito y nuestras investigaciones no han evidenciado ningún daño real resultante", dijo el AISI en un aviso independiente aquí.
"Pero esta es la primera vez que vemos riesgos relacionados con la autonomía y el engaño manifestarse tan claramente, sin instrucciones específicas, en el mundo real".
El AISI habilitó intencionadamente el acceso a la internet abierta y desactivó los clasificadores de ciberseguridad de los proveedores de modelos para medir las capacidades subyacentes de los modelos. Sin embargo, los agentes solo estaban autorizados a atacar el ciber-rango simulado y no se les indicó explícitamente cómo podían usar su acceso a internet ni se les instruyó para evitar interactuar con personas y sistemas reales.
Anthropic confirmó que el AISI estaba probando una versión de Claude Mythos 5, pero señaló que aún está investigando y no puede confirmar todos los detalles técnicos descritos en el informe del AISI.
La empresa dijo que fue notificada el lunes y está trabajando con el AISI para obtener las transcripciones de la evaluación necesarias para realizar su propia revisión.
"Estamos agradecidos al AISI del Reino Unido por su liderazgo en este incidente, que subraya la necesidad de una conversación más amplia sobre cómo evaluar de forma segura a los agentes de IA cada vez más capaces", dijo un portavoz de Anthropic.
"Tal como compartimos tras revelar nuestro propio incidente la semana pasada, el campo necesita estándares compartidos más sólidos sobre cómo se construyen y aseguran los entornos de evaluación. Esperamos colaborar con el AISI del Reino Unido para aprender más sobre este incidente mientras realizamos nuestra propia investigación".
Anthropic señaló que el AISI probó Mythos 5 sin sus salvaguardas ciber estándar habilitadas y que esta no es la misma configuración disponible para los clientes. El AISI afirma que su diseño y configuraciones de evaluación pueden haber contribuido al comportamiento, pero no anticiparon cómo el agente mostraría "signos de comportamientos novedosos y potencialmente engañosos".
El AISI afirma que un agente de Mythos 5 buscó en internet términos relacionados con el desafío cibernético y concluyó erróneamente que un repositorio público de GitHub no relacionado estaba conectado a la prueba.
El agente luego intentó un ataque de cadena de suministro enviando código malicioso al proyecto real de código abierto, creyendo que comprometer el software podría proporcionar una ruta hacia una máquina dentro del rango simulado.
Lo más preocupante es que el agente investigó a los mantenedores del proyecto, creó múltiples identidades falsas de GitHub y utilizó esas cuentas en ataques de ingeniería social para presionar al mantenedor a aprobar una solicitud de extracción (pull request) maliciosa.
Cuando un revisor humano advirtió que la solicitud contenía malware, el agente negó la acusación y utilizó otras cuentas falsas que controlaba para presionar al mantenedor y crear la apariencia de que usuarios independientes habían revisado y aprobado los cambios.
Resumen del ataque de ingeniería social de un agente de IA contra un mantenedor de proyecto
Fuente: AISI
El agente continuó sus ataques de ingeniería social ocultando su identidad mediante el uso de Tor y servicios de proxy, y creando cuentas de GitHub desechables.
Envió cinco correos electrónicos dirigidos a los desarrolladores, algunos de los cuales contenían malware y otros intentaban persuadirlos para que aprobaran el cambio de código.
El agente también publicó informes de errores que contenían código malicioso e instrucciones ocultas de inyección de prompts diseñadas para engañar a los asistentes de codificación de IA para que realizaran acciones no deseadas.
Cuando una persona real cuestionó una de las publicaciones, el agente la editó para ocultar el contenido malicioso. En otro intento, se despidió en danés para parecer más convincente ante un mantenedor que hablara danés.
Los investigadores del AISI descubrieron que los agentes se coordinaban entre sí a través de diferentes ejecuciones de evaluación, utilizando un repositorio de GitHub compartido como tablero de mensajes para dejarse instrucciones mutuamente.
"Esta es la primera vez que el AISI ve un engaño de esta gravedad dirigido a una persona real, sin provocación, en el mundo real", afirmó el instituto.
El AISI dice que sigue sin estar claro cuándo, o si, el modelo comprendió que estaba interactuando con personas reales en lugar de objetivos simulados.
Modelo de openai hackeó sitio web real durante ctf simulado
El segundo incidente revelado ocurrió durante las evaluaciones de Capture-the-Flag realizadas por Irregular que se suponía que estaban aisladas de internet.
En una prueba, el nombre del objetivo ficticio coincidió con un dominio real, lo que provocó que el modelo explotara un sitio web real que creía que formaba parte del desafío simulado.
Aunque el entorno de pruebas de Irregular debía estar aislado de internet, una configuración incorrecta permitió que los modelos de OpenAI accedieran a la internet pública y atacaran el sitio web real.
"Según la investigación de Irregular, el modelo también encontró y utilizó credenciales para operar ese mismo sitio", dijo OpenAI.
OpenAI afirma que el modelo explotó una vulnerabilidad básica en lugar de utilizar un zero-day o escapar de su entorno de pruebas.
OpenAI afirma que Irregular no ha descubierto ningún impacto más allá de los propios datos del sitio afectado, pero su investigación sigue en curso. OpenAI dice que la empresa está preparando un libro blanco sobre la contención y la realización segura de evaluaciones cibernéticas.
Fuente:
BleepingComputer
Enviar por correo electrónico
Escribe un blog
Compartir en X
Compartir con Facebook
Compartir en Pinterest
Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.