Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
7851
)
-
▼
October
(Total:
178
)
-
Ataques de cadena de suministro usan equipos de de...
-
Microsoft elimina función mítica de Skins en Windo...
-
Kit Milk Dragon AiTM usa relay OTP y keylogging pa...
-
Instala Windows 11 26H2 en PCs no compatibles
-
AOC lanza monitor de 1000 Hz
-
Ventoy: revitaliza tus memorias USB
-
Etiquetas de historial de Safari revelan navegació...
-
Schwarzenegger supervisa escena Terminator 2 robot...
-
Fallo crítico en Capacitor permite acceso a datos ...
-
Una GeForce RTX 4090 Founders Edition pierde parte...
-
Tornyol: el dron que caza mosquitos autónomamente
-
GIGABYTE AI TOP ATOM llega con 64 GB
-
Android XR llega a Samsung en noviembre
-
Windows 11 26H2 solo beneficia a PCs con mucha RAM
-
Windows 11 mejora para jugadores mediante Advanced...
-
El secreto final de PlayStation 2
-
Nueva PS5 más resistente
-
Fuga en OpenAI: la IA ya no admite errores
-
Google frena el uso de Gemini en Meta
-
Usan SQL Server de Microsoft para filtrar datos
-
Vulnerabilidades en cPanel/WHM permiten ejecutar c...
-
EE. UU. sanciona a miembros del Tren de Aragua por...
-
Copias de WordPress expuestas: mina de credenciale...
-
Fallo crítico en Red Hat Satellite permitiría robo...
-
OpenAI despide a tres investigadores de seguridad ...
-
Dell urge a los administradores a corregir fallos ...
-
Vulnerabilidad de cookies permite saltar MFA de En...
-
Tiendas comienzan a pedir un DNI al comprar una RT...
-
Google Search desploma el tráfico web un 40%
-
Explotan vulnerabilidades 0-day en Zammad para eje...
-
Cuentas gratuitas de iCloud permitirían suplantar ...
-
Guía rápida de Intel Nova Lake-S
-
Vercel confirma escape de VM KVM y premia a invest...
-
Kiteworks corrige 126 vulnerabilidades en gran act...
-
WhatsApp lanza chats restringidos
-
Google mantiene sus resúmenes de IA pese a demandas
-
OpenAI bloquea campaña de 15.000 usuarios para ext...
-
España limita el coste de las llamadas de emergencia
-
Equipos de seguridad ya pueden supervisar chats, a...
-
Experto prueba la corrupción de Windows sin limpia...
-
Agentes de IA vencen y roban correos electrónicos ...
-
El modelo Mythos de Anthropic es una bestia en mat...
-
Amazon lanza tres nuevos Kindle
-
El ASIC Jalapeño de OpenAI es para uso interno, au...
-
Warlock aprovecha fallos de SharePoint para desact...
-
Ganó 200.000 euros con una app de IA sin programar
-
Supuestos espías chinos suplantan a directivo de A...
-
Miembro de ShinyHunters detenido en Jordania; ayud...
-
EE. UU. sanciona red de cajeros del Tren de Aragua...
-
EE. UU. arresta a dueño de empresa tecnológica por...
-
PS5 estrena escalado QSSR
-
Chrome exigirá biometría para contraseñas
-
California cita a OpenAI por agentes de IA que hac...
-
Dots: agentes incansables de ChatGPT
-
Agentes de IA usan 5 veces más tokens que humanos ...
-
Gemini integra Mapas para mejorar sus respuestas
-
AMD llegó a crear un Ryzen 9 5900X3D que nunca lle...
-
AMD llevaría los chiplets un paso más allá con RDN...
-
Red PaperPhone usa 75.000 IPs e identidades móvile...
-
«Las RTX 5090 se queman antes o después»: un YouTu...
-
Windows 11 adopta atajo de Linux
-
Filtran los 7 modelos de Intel Nova Lake-S
-
WhatsApp Business Platform dejará de ser gratis en...
-
Fallos críticos en almacenamiento Dell permiten co...
-
Wall Street duda de NVIDIA y la burbuja de la IA
-
GPT-6 Astra descifra mensaje de la Segunda Guerra ...
-
OperTraitors revela rutas de escalada de privilegi...
-
Acceden a Azure DevOps y Kubernetes mediante una c...
-
Agentes de IA autónomos intentaron hackear sitios ...
-
Debian corrige 1.313 fallos en actualización masiv...
-
Cómo eliminar Bing de Windows 11
-
Google advierte explotación vulnerabilidades 0-day...
-
Samsung lanza Galaxy Tab S12
-
OpenAI desarticula campaña de extracción de razona...
-
Conceptos clave de rendimiento web
-
Ransomware Warlock ataca operadoras de agua y tele...
-
FTC investiga riesgos de OpenAI, Anthropic y otros...
-
Programador tortura IA y obtiene respuestas horrip...
-
Citrix NetScaler se reinicia tras parche de día cero
-
Micron avisa: la escasez de memoria RAM será aún p...
-
ElmorLabs PMD2X: permite medir el el voltaje, corr...
-
Creador de Rails deja de programar profesionalmente
-
¿Tu coche es un espía?
-
Copilot será el sistema operativo de Office
-
El MI5 advierte a académicos británicos que sus in...
-
Ciberdelincuentes emplean NeedyMantis para asegura...
-
Anthropic afirma que modelo chino de IA tiene capa...
-
GTA VI: 12 nuevas imágenes
-
Trump firma el primer pacto con los gigantes de la...
-
Cuenta de Microsoft en X es hackeada para estafa d...
-
Android 17 refuerza la seguridad limitando los ser...
-
GitLab corrige vulnerabilidad crítica en AI Gatewa...
-
ArXiv limita la frecuencia de envío de artículos p...
-
El Papa rechaza la IA generativa
-
NVIDIA, Google y AMD concentrarían el 85% de la de...
-
Ryzen Z3: Zen 6 y RDNA 4m
-
LaLiga pide vigilar los principales VPN contra la ...
-
Usan exclusiones de Microsoft Defender para oculta...
-
MSI activa Microsoft Security Level 2 en sus nueva...
-
Sesgo de género en IA ante catástrofe nuclear
-
Las escuelas de Inglaterra mejoran su capacidad de...
-
OpenClaw lanza plataforma gratuita y abierta de ag...
-
Recompensa por denunciar IPTV en bares
-
Sony lanza actualización de seguridad para PS5 tra...
-
postmarketOS pasa a llamarse Nura
-
Microsoft activa copia de seguridad de Windows 11 ...
-
Vulnerabilidad en ImageResponse de Node.js permite...
-
Hackean a la tienda online LDLC robando datos de l...
-
Los precios de la Raspberry Pi 4 y Raspberry Pi 5 ...
-
Misterio sobre el próximo lanzamiento de Nothing
-
Cloudflare lanza autoridad de certificación gratui...
-
Alerta por estafa de fotos efímeras en WhatsApp
-
Intel Core Ultra 4000 «Nova Lake-S» filtrados: has...
-
NVIDIA busca abaratar Rubin Ultra: prueba nuevos m...
-
Microsoft detecta grupos aprovechando un fallo de ...
-
Vulnerabilidades de Apache HTTP Server podrían per...
-
Explotan vulnerabilidad crítica de día cero en For...
-
NVIDIA actualiza drivers de GeForce GTX
-
Instalador falso de Zoom engaña a usuarios de Mac ...
-
Chinos suplantan a empleado de Anthropic para atac...
-
El router de TP-Link con WiFi 8 ya se puede precom...
-
Fallos de Axios HTTP/2 permiten bypass de SSRF y D...
-
Creador de Downloader responde a LaLiga
-
Acceden remotamente a servidores Zimbra mediante c...
-
Lanzado WSL 3.0 para Windows
-
Vulnerabilidades críticas de API en WatchGuard per...
-
AMD habría vendido toda su producción de CPU EPYC ...
-
La Steam Deck 2 usará una APU AMD «Gainsborough» b...
-
-
▼
October
(Total:
178
)
Blogroll
Labels
Entradas populares
-
Un YouTuber ha perdido su segunda RTX 5090 debido a que la tarjeta se quemó apenas seis meses después de la primera, a pesar de haber mejo...
-
Se ha descubierto una vulnerabilidad en Docker denominada CopyEscape (CVE-2026-17106), la cual permite que contenedores maliciosos escriban...
-
OpenAI ha presentado GPT-6.1 Sol , un modelo con un desempeño similar a Astra pero que cuesta cinco veces menos .
OpenAI bloquea campaña de 15.000 usuarios para extraer el razonamiento de su IA
OpenAI ha desbaratado una campaña coordinada en la que participaron más de 15.000 usuarios que intentaron extraer el razonamiento protegido de sus modelos de IA mediante la destilación adversaria.
El razonamiento protegido se refiere al proceso interno que utiliza un modelo para resolver una tarea antes de producir su respuesta final. Este razonamiento oculto puede incluir análisis intermedios, pasos de planificación e información omitida intencionadamente para los usuarios finales.
Si los atacantes logran obtenerlo a gran escala, podrían conseguir un atajo para reproducir capacidades de modelos avanzados sin realizar inversiones equivalentes en desarrollo, pruebas de seguridad e infraestructura.
OpenAI afirmó que la campaña no implicó una brecha en sus sistemas de cifrado, bases de datos o conversaciones de usuarios almacenadas. En su lugar, los operadores presuntamente manipularon las interacciones normales del modelo para hacer visible el razonamiento oculto a través de prompts coordinados y técnicas de conversación cruzada.
Un método observado consistía en copiar el razonamiento cifrado de una conversación y enviarlo a otra conversación con instrucciones para descifrar y transcribir el contenido.
OpenAI bloquea campaña de 15.000 usuarios
La actividad sospechosa comenzó el 1 de julio con un volumen bajo. Más tarde, OpenAI registró picos importantes el 24 y 25 de julio, cuando detectó 16.000 solicitudes que coincidían con un patrón de extracción de más de 4.000 usuarios.
La investigación se amplió a partir de esas solicitudes y descubrió actividad de prompts relacionada en un grupo más grande de más de 15.000 usuarios.
OpenAI afirmó que desbarató completamente la operación para el 28 de julio. La empresa atribuyó una parte central de la actividad a personas asociadas con Moonshot AI, el desarrollador del modelo Kimi AI.
Sin embargo, OpenAI señaló que no pudo confirmar que cada cuenta u operador implicado en la campaña más amplia perteneciera a un único actor.
Por lo tanto, la divulgación pública vincula un grupo central con asociados de Moonshot AI, en lugar de atribuir definitivamente toda la red de 15.000 usuarios a la empresa. OpenAI describió la actividad como un problema de seguridad de la IA más general, en lugar de una debilidad limitada a sus propios servicios.
Investigadores independientes también habían informado sobre rutas de ataque relacionadas con modelos cruzados y compactación de conversaciones a través de la divulgación responsable, ayudando a la empresa a investigar la clase más amplia de técnicas de extracción de razonamiento.
En respuesta, OpenAI prohibió o restringió cuentas fraudulentas, reforzó los controles de registro e infraestructura, y aumentó el monitoreo de las redes de cuentas asociadas.
También cerró una vía de reproducción que podría permitir que alguien con el razonamiento cifrado de otro usuario recuperara su contenido. La empresa añadió salvaguardas para detectar y retener la salida transmitida que pudiera exponer el razonamiento oculto.
La compañía también compartió información relevante con socios de la industria a través del Frontier Model Forum y con canales gubernamentales de intercambio de información. Esto es significativo porque los artefactos de razonamiento portátiles o reproducibles pueden crear riesgos comparables para otros desarrolladores de IA de vanguardia.
El incidente resalta un problema de ciberseguridad creciente para los proveedores de IA generativa. A medida que los modelos se vuelven más capaces en programación, ciencia, herramientas autónomas y otras áreas de doble uso, el razonamiento oculto puede convertirse en un objetivo de alto valor para competidores y actores de amenazas.
OpenAI afirmó que espera que los intentos de destilación adversaria se vuelvan más sofisticados y que continuará mejorando la detección, la aplicación de normas, los rechazos del modelo, las defensas de las herramientas y las protecciones en los despliegues de nube alojados por socios.
Fuentes:
https://cybersecuritynews.com/openai-blocks-ai-reasoning-extraction/
Newer Post
0 comments :
Post a Comment
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.