Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
7815
)
-
▼
October
(Total:
142
)
-
OpenAI bloquea campaña de 15.000 usuarios para ext...
-
España limita el coste de las llamadas de emergencia
-
Equipos de seguridad ya pueden supervisar chats, a...
-
Experto prueba la corrupción de Windows sin limpia...
-
Agentes de IA vencen y roban correos electrónicos ...
-
El modelo Mythos de Anthropic es una bestia en mat...
-
Amazon lanza tres nuevos Kindle
-
El ASIC Jalapeño de OpenAI es para uso interno, au...
-
Warlock aprovecha fallos de SharePoint para desact...
-
Ganó 200.000 euros con una app de IA sin programar
-
Supuestos espías chinos suplantan a directivo de A...
-
Miembro de ShinyHunters detenido en Jordania; ayud...
-
EE. UU. sanciona red de cajeros del Tren de Aragua...
-
EE. UU. arresta a dueño de empresa tecnológica por...
-
PS5 estrena escalado QSSR
-
Chrome exigirá biometría para contraseñas
-
California cita a OpenAI por agentes de IA que hac...
-
Dots: agentes incansables de ChatGPT
-
Agentes de IA usan 5 veces más tokens que humanos ...
-
Gemini integra Mapas para mejorar sus respuestas
-
AMD llegó a crear un Ryzen 9 5900X3D que nunca lle...
-
AMD llevaría los chiplets un paso más allá con RDN...
-
Red PaperPhone usa 75.000 IPs e identidades móvile...
-
«Las RTX 5090 se queman antes o después»: un YouTu...
-
Windows 11 adopta atajo de Linux
-
Filtran los 7 modelos de Intel Nova Lake-S
-
WhatsApp Business Platform dejará de ser gratis en...
-
Fallos críticos en almacenamiento Dell permiten co...
-
Wall Street duda de NVIDIA y la burbuja de la IA
-
GPT-6 Astra descifra mensaje de la Segunda Guerra ...
-
OperTraitors revela rutas de escalada de privilegi...
-
Acceden a Azure DevOps y Kubernetes mediante una c...
-
Agentes de IA autónomos intentaron hackear sitios ...
-
Debian corrige 1.313 fallos en actualización masiv...
-
Cómo eliminar Bing de Windows 11
-
Google advierte explotación vulnerabilidades 0-day...
-
Samsung lanza Galaxy Tab S12
-
OpenAI desarticula campaña de extracción de razona...
-
Conceptos clave de rendimiento web
-
Ransomware Warlock ataca operadoras de agua y tele...
-
FTC investiga riesgos de OpenAI, Anthropic y otros...
-
Programador tortura IA y obtiene respuestas horrip...
-
Citrix NetScaler se reinicia tras parche de día cero
-
Micron avisa: la escasez de memoria RAM será aún p...
-
ElmorLabs PMD2X: permite medir el el voltaje, corr...
-
Creador de Rails deja de programar profesionalmente
-
¿Tu coche es un espía?
-
Copilot será el sistema operativo de Office
-
El MI5 advierte a académicos británicos que sus in...
-
Ciberdelincuentes emplean NeedyMantis para asegura...
-
Anthropic afirma que modelo chino de IA tiene capa...
-
GTA VI: 12 nuevas imágenes
-
Trump firma el primer pacto con los gigantes de la...
-
Cuenta de Microsoft en X es hackeada para estafa d...
-
Android 17 refuerza la seguridad limitando los ser...
-
GitLab corrige vulnerabilidad crítica en AI Gatewa...
-
ArXiv limita la frecuencia de envío de artículos p...
-
El Papa rechaza la IA generativa
-
NVIDIA, Google y AMD concentrarían el 85% de la de...
-
Ryzen Z3: Zen 6 y RDNA 4m
-
LaLiga pide vigilar los principales VPN contra la ...
-
Usan exclusiones de Microsoft Defender para oculta...
-
MSI activa Microsoft Security Level 2 en sus nueva...
-
Sesgo de género en IA ante catástrofe nuclear
-
Las escuelas de Inglaterra mejoran su capacidad de...
-
OpenClaw lanza plataforma gratuita y abierta de ag...
-
Recompensa por denunciar IPTV en bares
-
Sony lanza actualización de seguridad para PS5 tra...
-
postmarketOS pasa a llamarse Nura
-
Microsoft activa copia de seguridad de Windows 11 ...
-
Vulnerabilidad en ImageResponse de Node.js permite...
-
Hackean a la tienda online LDLC robando datos de l...
-
Los precios de la Raspberry Pi 4 y Raspberry Pi 5 ...
-
Misterio sobre el próximo lanzamiento de Nothing
-
Cloudflare lanza autoridad de certificación gratui...
-
Alerta por estafa de fotos efímeras en WhatsApp
-
Intel Core Ultra 4000 «Nova Lake-S» filtrados: has...
-
NVIDIA busca abaratar Rubin Ultra: prueba nuevos m...
-
Microsoft detecta grupos aprovechando un fallo de ...
-
Vulnerabilidades de Apache HTTP Server podrían per...
-
Explotan vulnerabilidad crítica de día cero en For...
-
NVIDIA actualiza drivers de GeForce GTX
-
Instalador falso de Zoom engaña a usuarios de Mac ...
-
Chinos suplantan a empleado de Anthropic para atac...
-
El router de TP-Link con WiFi 8 ya se puede precom...
-
Fallos de Axios HTTP/2 permiten bypass de SSRF y D...
-
Creador de Downloader responde a LaLiga
-
Acceden remotamente a servidores Zimbra mediante c...
-
Lanzado WSL 3.0 para Windows
-
Vulnerabilidades críticas de API en WatchGuard per...
-
AMD habría vendido toda su producción de CPU EPYC ...
-
La Steam Deck 2 usará una APU AMD «Gainsborough» b...
-
Crean puerta trasera en Windows con C2 en Microsof...
-
Fallo crítico en MikroTik RouterOS permite ejecuta...
-
La presencia femenina cae a mínimos históricos en ...
-
Detienen en Alicante a un joven de 16 años presunt...
-
Intel Nova Lake: USB4 a 80 Gbps en portátiles y PC...
-
Investigadores roban hash de contraseña root de Li...
-
Más de 543.000 credenciales de GitHub siguen activ...
-
Rroban datos personales de más de 3 millones de em...
-
Incidente de seguridad en MetaMask afecta parte de...
-
Nuevo exploit de PS5 vulnera el kernel en varias v...
-
Vulnerabilidades de ModSecurity permiten saltar el...
-
Malware de WordPress reaparece tras su eliminación...
-
Google lanza IA open source para Android: Artemis
-
La policía desmantela la banda de ransomware KillS...
-
Broadcom financiará chips de IA para Anthropic
-
La demanda de memoria en IA provoca una subida de ...
-
Arrestan a líder de 16 años de KillSec y desmantel...
-
Bitget confirma que un exploit de día cero de terc...
-
Google lanza Gemini 4 Argon
-
Payload de post-explotación de Citrix NetScaler cr...
-
Fallo en Docker permite a contenedores sobrescribi...
-
Surge PoC de Apple CoreGraphics mientras análisis ...
-
Falso ChatGPT infecta PC vía Google
-
Países Bajos creará su propio Linux
-
Más de 543.000 credenciales válidas quedan expuest...
-
Google lanza Gemini 4 Argon para expertos en ciber...
-
Rusos atacan a más de 100 organizaciones con RedFlick
-
IA: el reto de los 6 billones
-
Instagram usa IA para optimizar tus vídeos
-
Apple presentará HomePad el 13 de octubre
-
Cloudflare crea CA poscuántica con certificados Me...
-
CISA alerta sobre vulnerabilidad crítica de ejecuc...
-
El SMT en la CPU NVIDIA Vera aporta un 20% más de ...
-
Accedieron a Microsoft 365 mediante cuentas olvidadas
-
El internet por satélite de Starlink ya convence a...
-
Windows 11 26H2: novedades e instalación
-
-
▼
October
(Total:
142
)
Blogroll
Labels
Entradas populares
-
Un YouTuber ha perdido su segunda RTX 5090 debido a que la tarjeta se quemó apenas seis meses después de la primera, a pesar de haber mejo...
-
Se ha detectado una vulnerabilidad de seguridad de alta gravedad en Sudo (CVE-2026-96512) que podría permitir a atacantes locales evadir la...
-
Se ha descubierto una vulnerabilidad en Docker denominada CopyEscape (CVE-2026-17106), la cual permite que contenedores maliciosos escriban...
OpenAI bloquea campaña de 15.000 usuarios para extraer el razonamiento de su IA
OpenAI ha desbaratado una campaña coordinada en la que participaron más de 15.000 usuarios que intentaron extraer el razonamiento protegido de sus modelos de IA mediante la destilación adversaria.
El razonamiento protegido se refiere al proceso interno que utiliza un modelo para resolver una tarea antes de producir su respuesta final. Este razonamiento oculto puede incluir análisis intermedios, pasos de planificación e información omitida intencionadamente para los usuarios finales.
Si los atacantes logran obtenerlo a gran escala, podrían conseguir un atajo para reproducir capacidades de modelos avanzados sin realizar inversiones equivalentes en desarrollo, pruebas de seguridad e infraestructura.
OpenAI afirmó que la campaña no implicó una brecha en sus sistemas de cifrado, bases de datos o conversaciones de usuarios almacenadas. En su lugar, los operadores presuntamente manipularon las interacciones normales del modelo para hacer visible el razonamiento oculto a través de prompts coordinados y técnicas de conversación cruzada.
Un método observado consistía en copiar el razonamiento cifrado de una conversación y enviarlo a otra conversación con instrucciones para descifrar y transcribir el contenido.
OpenAI bloquea campaña de 15.000 usuarios
La actividad sospechosa comenzó el 1 de julio con un volumen bajo. Más tarde, OpenAI registró picos importantes el 24 y 25 de julio, cuando detectó 16.000 solicitudes que coincidían con un patrón de extracción de más de 4.000 usuarios.
La investigación se amplió a partir de esas solicitudes y descubrió actividad de prompts relacionada en un grupo más grande de más de 15.000 usuarios.
OpenAI afirmó que desbarató completamente la operación para el 28 de julio. La empresa atribuyó una parte central de la actividad a personas asociadas con Moonshot AI, el desarrollador del modelo Kimi AI.
Sin embargo, OpenAI señaló que no pudo confirmar que cada cuenta u operador implicado en la campaña más amplia perteneciera a un único actor.
Por lo tanto, la divulgación pública vincula un grupo central con asociados de Moonshot AI, en lugar de atribuir definitivamente toda la red de 15.000 usuarios a la empresa. OpenAI describió la actividad como un problema de seguridad de la IA más general, en lugar de una debilidad limitada a sus propios servicios.
Investigadores independientes también habían informado sobre rutas de ataque relacionadas con modelos cruzados y compactación de conversaciones a través de la divulgación responsable, ayudando a la empresa a investigar la clase más amplia de técnicas de extracción de razonamiento.
En respuesta, OpenAI prohibió o restringió cuentas fraudulentas, reforzó los controles de registro e infraestructura, y aumentó el monitoreo de las redes de cuentas asociadas.
También cerró una vía de reproducción que podría permitir que alguien con el razonamiento cifrado de otro usuario recuperara su contenido. La empresa añadió salvaguardas para detectar y retener la salida transmitida que pudiera exponer el razonamiento oculto.
La compañía también compartió información relevante con socios de la industria a través del Frontier Model Forum y con canales gubernamentales de intercambio de información. Esto es significativo porque los artefactos de razonamiento portátiles o reproducibles pueden crear riesgos comparables para otros desarrolladores de IA de vanguardia.
El incidente resalta un problema de ciberseguridad creciente para los proveedores de IA generativa. A medida que los modelos se vuelven más capaces en programación, ciencia, herramientas autónomas y otras áreas de doble uso, el razonamiento oculto puede convertirse en un objetivo de alto valor para competidores y actores de amenazas.
OpenAI afirmó que espera que los intentos de destilación adversaria se vuelvan más sofisticados y que continuará mejorando la detección, la aplicación de normas, los rechazos del modelo, las defensas de las herramientas y las protecciones en los despliegues de nube alojados por socios.
Fuentes:
https://cybersecuritynews.com/openai-blocks-ai-reasoning-extraction/
0 comments :
Post a Comment
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.