Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
7778
)
-
▼
octubre
(Total:
105
)
-
Samsung lanza Galaxy Tab S12
-
OpenAI desarticula campaña de extracción de razona...
-
Conceptos clave de rendimiento web
-
Ransomware Warlock ataca operadoras de agua y tele...
-
FTC investiga riesgos de OpenAI, Anthropic y otros...
-
Programador tortura IA y obtiene respuestas horrip...
-
Micron avisa: la escasez de memoria RAM será aún p...
-
ElmorLabs PMD2X: permite medir el el voltaje, corr...
-
Creador de Rails deja de programar profesionalmente
-
¿Tu coche es un espía?
-
Copilot será el sistema operativo de Office
-
El MI5 advierte a académicos británicos que sus in...
-
Ciberdelincuentes emplean NeedyMantis para asegura...
-
Anthropic afirma que modelo chino de IA tiene capa...
-
GTA VI: 12 nuevas imágenes
-
Trump firma el primer pacto con los gigantes de la...
-
Cuenta de Microsoft en X es hackeada para estafa d...
-
Android 17 refuerza la seguridad limitando los ser...
-
GitLab corrige vulnerabilidad crítica en AI Gatewa...
-
ArXiv limita la frecuencia de envío de artículos p...
-
El Papa rechaza la IA generativa
-
NVIDIA, Google y AMD concentrarían el 85% de la de...
-
Ryzen Z3: Zen 6 y RDNA 4m
-
LaLiga pide vigilar los principales VPN contra la ...
-
Usan exclusiones de Microsoft Defender para oculta...
-
MSI activa Microsoft Security Level 2 en sus nueva...
-
Sesgo de género en IA ante catástrofe nuclear
-
Las escuelas de Inglaterra mejoran su capacidad de...
-
OpenClaw lanza plataforma gratuita y abierta de ag...
-
Recompensa por denunciar IPTV en bares
-
Sony lanza actualización de seguridad para PS5 tra...
-
postmarketOS pasa a llamarse Nura
-
Microsoft activa copia de seguridad de Windows 11 ...
-
Vulnerabilidad en ImageResponse de Node.js permite...
-
Hackean a la tienda online LDLC robando datos de l...
-
Los precios de la Raspberry Pi 4 y Raspberry Pi 5 ...
-
Misterio sobre el próximo lanzamiento de Nothing
-
Cloudflare lanza autoridad de certificación gratui...
-
Alerta por estafa de fotos efímeras en WhatsApp
-
Intel Core Ultra 4000 «Nova Lake-S» filtrados: has...
-
NVIDIA busca abaratar Rubin Ultra: prueba nuevos m...
-
Microsoft detecta grupos aprovechando un fallo de ...
-
Vulnerabilidades de Apache HTTP Server podrían per...
-
Explotan vulnerabilidad crítica de día cero en For...
-
NVIDIA actualiza drivers de GeForce GTX
-
Instalador falso de Zoom engaña a usuarios de Mac ...
-
Chinos suplantan a empleado de Anthropic para atac...
-
El router de TP-Link con WiFi 8 ya se puede precom...
-
Fallos de Axios HTTP/2 permiten bypass de SSRF y D...
-
Creador de Downloader responde a LaLiga
-
Acceden remotamente a servidores Zimbra mediante c...
-
Lanzado WSL 3.0 para Windows
-
Vulnerabilidades críticas de API en WatchGuard per...
-
AMD habría vendido toda su producción de CPU EPYC ...
-
La Steam Deck 2 usará una APU AMD «Gainsborough» b...
-
Crean puerta trasera en Windows con C2 en Microsof...
-
Fallo crítico en MikroTik RouterOS permite ejecuta...
-
La presencia femenina cae a mínimos históricos en ...
-
Detienen en Alicante a un joven de 16 años presunt...
-
Intel Nova Lake: USB4 a 80 Gbps en portátiles y PC...
-
Investigadores roban hash de contraseña root de Li...
-
Más de 543.000 credenciales de GitHub siguen activ...
-
Rroban datos personales de más de 3 millones de em...
-
Incidente de seguridad en MetaMask afecta parte de...
-
Nuevo exploit de PS5 vulnera el kernel en varias v...
-
Vulnerabilidades de ModSecurity permiten saltar el...
-
Malware de WordPress reaparece tras su eliminación...
-
Google lanza IA open source para Android: Artemis
-
La policía desmantela la banda de ransomware KillS...
-
Broadcom financiará chips de IA para Anthropic
-
La demanda de memoria en IA provoca una subida de ...
-
Arrestan a líder de 16 años de KillSec y desmantel...
-
Bitget confirma que un exploit de día cero de terc...
-
Google lanza Gemini 4 Argon
-
Payload de post-explotación de Citrix NetScaler cr...
-
Fallo en Docker permite a contenedores sobrescribi...
-
Surge PoC de Apple CoreGraphics mientras análisis ...
-
Falso ChatGPT infecta PC vía Google
-
Países Bajos creará su propio Linux
-
Más de 543.000 credenciales válidas quedan expuest...
-
Google lanza Gemini 4 Argon para expertos en ciber...
-
Rusos atacan a más de 100 organizaciones con RedFlick
-
IA: el reto de los 6 billones
-
Instagram usa IA para optimizar tus vídeos
-
Apple presentará HomePad el 13 de octubre
-
Cloudflare crea CA poscuántica con certificados Me...
-
CISA alerta sobre vulnerabilidad crítica de ejecuc...
-
El SMT en la CPU NVIDIA Vera aporta un 20% más de ...
-
Accedieron a Microsoft 365 mediante cuentas olvidadas
-
El internet por satélite de Starlink ya convence a...
-
Windows 11 26H2: novedades e instalación
-
Usaron servidor PaperCut para llegar al controlado...
-
Agentes de IA filtran más de 13.000 capturas inter...
-
Usan instaladores de Zoom y PDF para controlar PCs
-
Exagente de la NCA implicado en el caso Silk Road ...
-
Cisco alerta sobre vulnerabilidad zero-day en SD-W...
-
Operación Blackout del FBI desmantela estafadores ...
-
Explotan vulnerabilidad 0-day en Cisco SD-WAN Manager
-
Desarrollador entrena IA pequeña en una RTX 3080 T...
-
Vulnerabilidades críticas de TeamViewer permiten e...
-
Nuevo malware 2CLoader evade seguridad para desple...
-
Windows 11 Assisted Setup: más bloatware para tu PC
-
Jailbreak disponible para casi toda la PS5
-
Internet Society lanza Centro Global de Confianza ...
-
Aprovechan vulnerabilidad zero-day de Citrix NetSc...
-
- ► septiembre (Total: 931 )
-
▼
octubre
(Total:
105
)
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
vulnerabilidad
(
2074
)
seguridad
(
1971
)
software
(
1308
)
hardware
(
1017
)
google
(
824
)
Malware
(
711
)
privacidad
(
699
)
exploit
(
622
)
ransomware
(
556
)
Windows
(
521
)
android
(
509
)
linux
(
473
)
cve
(
380
)
nvidia
(
355
)
tutorial
(
300
)
manual
(
282
)
hacking
(
275
)
ssd
(
183
)
WhatsApp
(
173
)
ddos
(
143
)
Wifi
(
131
)
app
(
131
)
programación
(
129
)
cifrado
(
122
)
twitter
(
121
)
firmware
(
89
)
youtube
(
85
)
firefox
(
81
)
herramientas
(
80
)
Networking
(
73
)
adobe
(
72
)
sysadmin
(
72
)
office
(
64
)
antivirus
(
56
)
hack
(
54
)
javascript
(
52
)
Kernel
(
49
)
apache
(
49
)
juegos
(
42
)
contraseñas
(
39
)
cms
(
37
)
multimedia
(
36
)
flash
(
33
)
eventos
(
32
)
MAC
(
30
)
anonymous
(
28
)
ssl
(
24
)
conferencia
(
21
)
Forense
(
20
)
documental
(
18
)
SeguridadWireless
(
17
)
auditoría
(
16
)
Debugger
(
14
)
Rootkit
(
14
)
lizard squad
(
14
)
metasploit
(
13
)
técnicas hacking
(
13
)
Virtualización
(
11
)
delitos
(
11
)
reversing
(
10
)
adamo
(
9
)
Ehn-Dev
(
7
)
antimalware
(
7
)
MAC Adress
(
6
)
oclHashcat
(
5
)
Entradas populares
-
Se ha descubierto una vulnerabilidad en Docker denominada CopyEscape (CVE-2026-17106), la cual permite que contenedores maliciosos escriban...
-
Se ha detectado una vulnerabilidad de seguridad de alta gravedad en Sudo (CVE-2026-96512) que podría permitir a atacantes locales evadir la...
-
OpenAI ha presentado GPT-6.1 Sol , un modelo con un desempeño similar a Astra pero que cuesta cinco veces menos .
OpenAI desarticula campaña de extracción de razonamiento vinculada a colaboradores de Moonshot AI
sábado, 3 de octubre de 2026
|
Posted by
el-brujo
OpenAI detuvo una campaña de destilación adversaria coordinada, presuntamente vinculada a la empresa china Moonshot AI, para extraer razonamientos protegidos de sus modelos. Los atacantes manipularon las interacciones del sistema para reproducir procesos internos y entrenar otros modelos sin respetar las medidas de seguridad originales. OpenAI ya bloqueó las cuentas implicadas y desplegó nuevas mitigaciones para cerrar las vulnerabilidades arquitectónicas explotadas.
OpenAI afirmó el miércoles que identificó e interrumpió una campaña coordinada de destilación diseñada para extraer ilícitamente el razonamiento protegido de sus modelos de inteligencia artificial (IA).
Un "núcleo central de la actividad", que se remonta a la primera semana de julio, ha sido atribuido a personas asociadas con Moonshot AI, una empresa de IA china con sede en Pekín. La compañía no citó ninguna evidencia técnica para respaldar esta evaluación, probablemente por razones de seguridad.
"Los operadores no rompieron nuestro cifrado, no comprometieron una base de datos ni obtuvieron acceso directo a las conversaciones almacenadas de los usuarios", dijo OpenAI aquí. "En cambio, manipularon las interacciones del modelo para que el razonamiento protegido pudiera reproducirse en formas visibles para el solicitante de manera coordinada y a escala, violando nuestros términos de servicio".
Se dice que la actividad comenzó el 1 de julio de 2026, inicialmente con un volumen bajo antes de dispararse el 24 y 25 de julio de 2026, con 16,000 solicitudes intentadas utilizando un patrón de extracción relevante de más de 4,000 usuarios. Tras una investigación más profunda, la empresa dijo que identificó una "actividad de patrones de prompts" relacionada en más de 15,000 usuarios. La campaña fue totalmente interrumpida el 28 de julio de 2026.
La startup de IA caracterizó la actividad como destilación adversarial, la cual implica el uso sistemático y no autorizado de las salidas de un modelo para ayudar a entrenar, reproducir o mejorar otro modelo. OpenAI dijo que desde entonces ha implementado mitigaciones adicionales para combatir este ataque y ha prohibido las cuentas fraudulentas involucradas en la actividad.
Además, OpenAI dijo que cerró una "vía" que permitía que algunos que ya poseían el razonamiento cifrado de otro usuario pudieran reproducirlo y recuperar su contenido, además de añadir comprobaciones para detectar y retener la salida transmitida que pudiera exponer el razonamiento.
En un estudio publicado en agosto de 2026, un grupo de investigadores encontró una vulnerabilidad arquitectónica que hacía que los rastros de razonamiento cifrados fueran "totalmente compatibles e intercambiables entre diferentes sesiones, usuarios y modelos dentro del ecosistema de un proveedor", lo que un atacante podría explotar para desarrollar un jailbreak de descifrado escalable y eludir los mecanismos antidestilación.
"Al inyectar un rastro de razonamiento cifrado de un modelo determinado en un modelo más débil y menos protegido del mismo proveedor, lo obligamos a decodificar y emitir el rastro textualmente en texto plano, sin necesidad de hacer un jailbreak directamente al modelo más capaz", dijeron investigadores de MATS Research, ELLIS Institute Tübingen y Synk aquí.
Además, esto permite la extracción de datos privados a gran escala, abre la puerta a inyecciones de prompts invisibles al incrustar cargas maliciosas enteramente dentro de bloques cifrados, y revela inadvertidamente información peligrosa oculta dentro del proceso de razonamiento, incluso si la salida final y visible del modelo rechaza una solicitud dañina.
Dado que el razonamiento protegido ofrece información sobre cómo un modelo resuelve una tarea, extraer esta información puede revelar datos sensibles y ayudar a otros a reproducir las capacidades del modelo, añadió OpenAI.
"La destilación adversarial plantea riesgos para la seguridad y la seguridad nacional", dijo la empresa. "El razonamiento extraído podría usarse para entrenar otro modelo sin preservar las salvaguardas aplicadas a las salidas orientadas al usuario del modelo original".
"A escala, la destilación también puede acelerar la transferencia de capacidades avanzadas sin requerir la misma inversión en seguridad. Estas preocupaciones aumentan a medida que los modelos adquieren capacidades en dominios de doble uso".
Esta no es la primera vez que Moonshot AI enfrenta acusaciones de destilación. El mes pasado, su rival Anthropic acusó a Moonshot AI de retransmitir sigilosamente las solicitudes de los clientes a Claude en lugar de procesarlas usando Kimi, y luego mostrar las respuestas de Claude a los usuarios.
También se alega que la empresa conservó un subconjunto de estos intercambios para entrenar su modelo de cadena de pensamiento (CoT). La actividad ha sido rastreada bajo el apodo GTG-16002.
Fuente:
THN
OpenAI afirmó el miércoles que identificó e interrumpió una campaña coordinada de destilación diseñada para extraer ilícitamente el razonamiento protegido de sus modelos de inteligencia artificial (IA).
Un "núcleo central de la actividad", que se remonta a la primera semana de julio, ha sido atribuido a personas asociadas con Moonshot AI, una empresa de IA china con sede en Pekín. La compañía no citó ninguna evidencia técnica para respaldar esta evaluación, probablemente por razones de seguridad.
"Los operadores no rompieron nuestro cifrado, no comprometieron una base de datos ni obtuvieron acceso directo a las conversaciones almacenadas de los usuarios", dijo OpenAI aquí. "En cambio, manipularon las interacciones del modelo para que el razonamiento protegido pudiera reproducirse en formas visibles para el solicitante de manera coordinada y a escala, violando nuestros términos de servicio".
Se dice que la actividad comenzó el 1 de julio de 2026, inicialmente con un volumen bajo antes de dispararse el 24 y 25 de julio de 2026, con 16,000 solicitudes intentadas utilizando un patrón de extracción relevante de más de 4,000 usuarios. Tras una investigación más profunda, la empresa dijo que identificó una "actividad de patrones de prompts" relacionada en más de 15,000 usuarios. La campaña fue totalmente interrumpida el 28 de julio de 2026.
La startup de IA caracterizó la actividad como destilación adversarial, la cual implica el uso sistemático y no autorizado de las salidas de un modelo para ayudar a entrenar, reproducir o mejorar otro modelo. OpenAI dijo que desde entonces ha implementado mitigaciones adicionales para combatir este ataque y ha prohibido las cuentas fraudulentas involucradas en la actividad.
Además, OpenAI dijo que cerró una "vía" que permitía que algunos que ya poseían el razonamiento cifrado de otro usuario pudieran reproducirlo y recuperar su contenido, además de añadir comprobaciones para detectar y retener la salida transmitida que pudiera exponer el razonamiento.
En un estudio publicado en agosto de 2026, un grupo de investigadores encontró una vulnerabilidad arquitectónica que hacía que los rastros de razonamiento cifrados fueran "totalmente compatibles e intercambiables entre diferentes sesiones, usuarios y modelos dentro del ecosistema de un proveedor", lo que un atacante podría explotar para desarrollar un jailbreak de descifrado escalable y eludir los mecanismos antidestilación.
"Al inyectar un rastro de razonamiento cifrado de un modelo determinado en un modelo más débil y menos protegido del mismo proveedor, lo obligamos a decodificar y emitir el rastro textualmente en texto plano, sin necesidad de hacer un jailbreak directamente al modelo más capaz", dijeron investigadores de MATS Research, ELLIS Institute Tübingen y Synk aquí.
Además, esto permite la extracción de datos privados a gran escala, abre la puerta a inyecciones de prompts invisibles al incrustar cargas maliciosas enteramente dentro de bloques cifrados, y revela inadvertidamente información peligrosa oculta dentro del proceso de razonamiento, incluso si la salida final y visible del modelo rechaza una solicitud dañina.
Dado que el razonamiento protegido ofrece información sobre cómo un modelo resuelve una tarea, extraer esta información puede revelar datos sensibles y ayudar a otros a reproducir las capacidades del modelo, añadió OpenAI.
"La destilación adversarial plantea riesgos para la seguridad y la seguridad nacional", dijo la empresa. "El razonamiento extraído podría usarse para entrenar otro modelo sin preservar las salvaguardas aplicadas a las salidas orientadas al usuario del modelo original".
"A escala, la destilación también puede acelerar la transferencia de capacidades avanzadas sin requerir la misma inversión en seguridad. Estas preocupaciones aumentan a medida que los modelos adquieren capacidades en dominios de doble uso".
Esta no es la primera vez que Moonshot AI enfrenta acusaciones de destilación. El mes pasado, su rival Anthropic acusó a Moonshot AI de retransmitir sigilosamente las solicitudes de los clientes a Claude en lugar de procesarlas usando Kimi, y luego mostrar las respuestas de Claude a los usuarios.
También se alega que la empresa conservó un subconjunto de estos intercambios para entrenar su modelo de cadena de pensamiento (CoT). La actividad ha sido rastreada bajo el apodo GTG-16002.
Fuente:
THN
Enviar por correo electrónico
Escribe un blog
Compartir en X
Compartir con Facebook
Compartir en Pinterest
Entrada más reciente
0 comments :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.