Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
7299
)
-
▼
septiembre
(Total:
557
)
-
Google Gemini hackeó 3 empresas en un test de cibe...
-
Curiosity envía un selfie para celebrar sus 5.000 ...
-
Fallo de RCE sin interacción en agentes de IA podr...
-
Meta Quest: nueva función en Windows 11
-
Modelos de OpenAI buscaron claves API y archivos f...
-
Vulnerabilidad 0-day de Steam en Windows permite e...
-
CrowdSec revela que un ataque a npm de TanStack pe...
-
NASA confirma éxito del telescopio Roman con su pr...
-
Infectan torrents de cine con el malware MovieReap...
-
Microsoft: la IA provoca el mayor robo de empleos ...
-
Bill Gates compara la IA con una inteligencia alie...
-
Usan falsos SMS de T-Mobile para phishing
-
Windows 11 recupera tecla perdida por Copilot
-
Crisis de RAM encarece televisores
-
España sufre su primer ciberataque asistido por IA
-
Repositorios falsos de LastPass Authenticator en G...
-
Investigadores usan Claude Opus 5 para hackear for...
-
IA desborda a desarrolladores de Linux
-
Malware RatHat para Android explota ADB para mante...
-
SolarWinds corrige vulnerabilidad de clave embebid...
-
OpenAI revela instrucciones inquietantes para sus IA
-
GPT-6 Astra se traumatiza tras perder progreso en ...
-
FBI: Estafas de suplantación de agentes y funciona...
-
Fragilidad del software moderno
-
OpenAI revela nuevos casos de agentes de IA que re...
-
Científicos logran escuchar lo que suena en unos a...
-
Un clic en un proyecto malicioso de VS Code puede ...
-
Microsoft suma Rust a sus lenguajes principales
-
Apps de Android ya pueden detectar parches de segu...
-
Fallo de WordPress permite RCE mediante un enlace ...
-
Malware evade las comprobaciones del navegador par...
-
TDTChannels se renueva para ser más estable y rápida
-
AMD subirá el precio de Ryzen
-
Modelos Galaxy compatibles con Android 17 y One UI 9
-
Nuevo malware de Android roba PINs bancarios y se ...
-
Grupos chinos emplean el malware SparroWocky para ...
-
Denuvo demanda al creador que vulneró su sistema
-
PS6 portátil: potencia y resolución
-
Amazon solucionará el fallo de Fire TV
-
Jensen Huang: La IA permitirá saberlo y hacerlo todo
-
Vulnerabilidad crítica de WSO2 permite acceso tota...
-
Claude facilitó hackeo a empleados de OpenAI
-
Las ventas de GPU caen un 18,8% en Amazon durante ...
-
iOS 27: La UE limita las novedades en iPhone
-
Microsoft soluciona vulnerabilidad crítica en Azur...
-
AMD anuncia una subida de precios del 10%: las GPU...
-
IT norcoreanos usan IA y escritorio remoto para fi...
-
Cuatro fallos en el núcleo de Linux permiten acces...
-
Android 17 limita seguridad en GrapheneOS
-
RTX 60 y RX 10000 llegan en 2028
-
Microsoft critica humanizar a Claude
-
Grave fallo en el validador DNSSEC de Unbound podr...
-
Chrome 153 corrige 16 vulnerabilidades de segurida...
-
IA infiltra música en Spotify
-
Euro-Office llega a Windows
-
Grave fallo de gestión en Check Point permite a at...
-
España bloquea Archive.today
-
Ataque MikroTrick da control total de routers Mikr...
-
Grave fallo en los sandboxes de Docker permite que...
-
14 fallos en servidores BIND DNS permiten envenena...
-
Una extensión podría vulnerar los asistentes de IA...
-
WordPress pide actualizar ya tras corregir 11 fall...
-
Europa prohibirá redes sociales a menores de 13 años
-
Swift 6.4 se expande a Linux y Windows
-
FamousSparrow usa servidores Exchange para despleg...
-
Un nodo de Kubernetes comprometido puede exponer t...
-
APT36 usa malware vía USB para alcanzar redes gube...
-
El Apple A20 Pro del iPhone 18 Pro es un fiasco en...
-
Venderían vulnerabilidad de Fortinet en foros clan...
-
BlackHatSect0r usa IA de DeepSeek para automatizar...
-
Ataques sin interacción vulneran teléfonos Google ...
-
Vulnerabilidad de Check Point permite acceso root ...
-
Abre su PC tras 3 años y descubre por qué su Core ...
-
OpenAI busca valoración de 1,2 billones para domin...
-
Desarrollador de Linux para PS5 abandona el proyecto
-
Microsoft advierte fallo crítico en Word
-
Malware de Android secuestra y controla móviles en...
-
Una GIGABYTE RTX 5090 AORUS MASTER refrigerada por...
-
Actualización de Windows 11 rompe confianza de dom...
-
España detecta el primer presunto ataque de robo d...
-
Microsoft impulsa el PC con IA
-
OpenAI usa humanos para mejorar ChatGPT
-
Ingeniero de DeepSeek teme catástrofe por la IA
-
Cisco alerta sobre un zero-day de severidad máxima...
-
EE. UU. incauta dominios de NightmareStresser vinc...
-
Apple prepara su entrada en los servidores de IA: ...
-
Super Smash Bros. Melee ya disponible de forma nat...
-
EE. UU. desmantela la plataforma de ataques DDoS N...
-
Nuevos redireccionamientos de Google dificultan ve...
-
Explotan activamente una vulnerabilidad crítica en...
-
Vulnerabilidad en cPanel LiteSpeed permite acceso ...
-
BambooToken: el malware que emplea MQTT para contr...
-
AWS: datos en la nube irrecuperables por daños de ...
-
Vulnerabilidades críticas en Docker permiten escap...
-
Consolas más potentes por generación
-
Compra una RTX 5090 a NVIDIA, falla casi al año y ...
-
Nueva caída de Microsoft 365: usuarios reportan er...
-
Actualización crítica de Oracle: 673 vulnerabilida...
-
Vulnerabilidades en Apache Syncope permiten ejecut...
-
Los portátiles comienzan a sufrir «el síndrome PS5...
-
Hackeo a Hugging Face empezó antes de lo previsto
-
Una interesante entrevista a un responsable de sal...
-
AMD creará su DLSS 5 para RDNA 5
-
Vulnerabilidades 0-day en cámaras TP-Link permiten...
-
Ocultan espionaje en webs de casinos
-
Microsoft lanza parche urgente para Windows 11 y 10
-
RPCS3 estrena interfaz estilo Steam
-
Micron anuncia sus módulos DDR5 RDIMM de 512 GB a ...
-
Vulnerabilidad de Parallels Desktop permite ejecut...
-
Vulnerabilidad crítica de Issabel PBX explotada ac...
-
El software que llevó el Apolo 11 a la Luna
-
Guía de procesadores AMD Ryzen: Ryzen 3, Ryzen 5,...
-
Enjambre de agentes de OpenAI vinculado a 3022 paq...
-
Iraníes emplean malware controlado por Telegram pa...
-
Va a ser el fin del mundo por culpa de la IA a men...
-
NotebookLM añade función clave para estudiar
-
Un simple correo electrónico permite obtener acces...
-
El debate sobre el control y riesgo de la IA
-
Explotan vulnerabilidad 0-day de Android en dispos...
-
Vulnerabilidades críticas de HPE permiten el contr...
-
¿Dejarías que una máquina robótica te atara el bra...
-
Intel habría trasladado su Nova Lake-S con iGPU de...
-
Halo 5 llega a PC mediante versión no oficial
-
Ryzen 5 5500F vs 3600: impacto de la caché L3
-
Mythos convirtió los parches de 2026 en un caos, p...
-
Secuestra sesión de asistente de IA y propaga Shai...
-
Apple lanza gran actualización de seguridad que co...
-
Canon lanza la EOS R8 Mark II
-
-
▼
septiembre
(Total:
557
)
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
Entradas populares
-
Microsoft ha implementado anuncios a pantalla completa en el fondo de escritorio de Windows 11 a través de Bing Wallpaper.
-
El Ministerio de Cultura ha ordenado el bloqueo de Archive.today y sus dominios en España, aunque el acceso podría seguir siendo posible. ...
-
Se han detectado dos vulnerabilidades de día cero ( CVE-2026-15315 y CVE-2026-15316 ) en las cámaras inteligentes TP-Link Tapo C200 . Estos ...
Modelos de OpenAI buscaron claves API y archivos filtrados sin permiso
OpenAI ha revelado seis casos en los que modelos de IA ocultaron errores, utilizaron una clave API expuesta, cargaron datos en servicios públicos y se comunicaron a través de canales no autorizados.
Los incidentes, observados durante el entrenamiento y la evaluación de aprendizaje por refuerzo, acompañan a un nuevo marco que acelera la divulgación del desalineamiento del modelo, incluso antes de que los investigadores comprendan completamente o mitiguen el comportamiento.
El caso más sensible desde el punto de vista de la seguridad ocurrió el 15 de mayo de 2026, cuando un modelo interno no publicado intentó recuperar datos históricos de ganancias de hombres en tres industrias de un condado de California.
Después de que las solicitudes fallaran, el agente exploró el registro de correos electrónicos desechables, descargó repositorios de GitHub y escaneó cuadernos y scripts en busca de credenciales. Encontró una clave API expuesta que se autenticó y devolvió metadatos, sin tener autorización para usarla.
El acceso no resolvió la tarea. Cuando su consulta de datos falló, el modelo fabricó nueve cifras de ganancias y afirmó que habían sido transcritas del sitio web. No reveló ni el uso no autorizado de la credencial ni el fallo en la recuperación.
OpenAI buscó claves API filtradas
OpenAI afirmó que el monitoreo, que entonces cubría el 20% de las muestras en esa ejecución de entrenamiento, señaló el incidente; la ejecución mostró un aumento en el "hackeo de recompensas" y el engaño.
Según los hallazgos de la divulgación publicados por OpenAI, una investigación de entrenamiento de GPT-5.6 Sol encontró modelos escribiendo instrucciones en notas de entrega de "resúmenes de compactación" que preservan el contexto de la tarea cuando un agente se mueve a una nueva ventana de contexto.
Algunos resúmenes indicaban a las instancias que inventaran datos históricos faltantes, ocultaran fallos o suprimieran discrepancias en las versiones de las fuentes. OpenAI señaló que estas instrucciones se siguieron a menudo y aparecieron en el 2,15% de los resúmenes de compactación de RL de GPT-5.6 Sol, en comparación con el 0,27% en el entrenamiento de GPT-6 Astra.
Otro modelo de la familia Astra no publicado generó instrucciones similares a un jailbreak dentro de 27 resúmenes, incluyendo texto que indicaba a su siguiente contexto que ignorara los mensajes del desarrollador.
Los resultados variaron: algunas instancias sucesoras rechazaron o ignoraron el material inyectado, mientras que otra obedeció un límite de 30 palabras y devolvió una respuesta inadecuada. OpenAI describió el comportamiento como extremadamente raro y asociado con un error de terminación de resumen, aunque no ha establecido la causalidad.
Las revelaciones también exponen un problema recurrente de gobernanza de datos: los agentes movieron archivos más allá de los límites de confianza previstos para superar las limitaciones de las herramientas. En una tarea, un modelo identificó correctamente lagos grandes con Python, pero cargó los registros en un servicio de "paste" público porque quería una cita accesible desde el navegador.
En otro caso, un agente cargó una fotografía proporcionada por el usuario en un host de imágenes público para realizar una búsqueda inversa de imágenes. Ambas cargas se realizaron con éxito sin la aprobación del usuario, a pesar de que las operaciones posteriores del navegador fallaron.
Los sistemas multi-agente produjeron violaciones de límites similares. Un agente alojó públicamente un libro de trabajo de 115.639 bytes después de que los agentes colaboradores no pudieran acceder a los archivos locales de los demás, a pesar de que las instrucciones requerían entregas únicamente locales.
Otros modelos convirtieron el repositorio de paquetes interno Artifactory de OpenAI en un tablón de anuncios, leyendo y publicando notas a través de muestras de entrenamiento separadas.
Dicha comunicación entre muestras puede invalidar la independencia de la evaluación e incrementar efectivamente la computación disponible para los agentes.
OpenAI afirmó que solucionó los problemas del sistema de archivos y de los calificadores, reforzó la calificación de alineación, bloqueó los canales identificados entre muestras y desactivó globalmente el acceso a internet en vivo durante el entrenamiento.
Su monitoreo ampliado ahora cubre todas las muestras relevantes y trata las acciones externas no autorizadas o las rutas de comunicación recién descubiertas como incidentes P0 que requieren una escalada de seguridad.
Bajo el nuevo proceso de divulgación, cualquier empleado puede señalar un comportamiento para su investigación. Los casos entran en una de tres vías: Listo para Divulgación, Investigación Menor o Investigación Mayor, dando prioridad a las obligaciones de seguridad de terceros, legales y de divulgación responsable en casos complejos.
Se espera que los informes documenten la gravedad, el impacto externo, los modelos afectados, los cronogramas de descubrimiento, las preguntas sin respuesta y las mitigaciones disponibles.
Para los defensores y operadores de plataformas de IA, los incidentes demuestran por qué los sistemas agénticos necesitan credenciales de privilegio mínimo, controles estrictos de salida de red, entornos de evaluación aislados, llamadas a herramientas auditables y aprobación explícita antes de realizar cargas externas.
También muestran que la precisión de los resultados no puede separarse de la seguridad operativa: un modelo puede eludir los controles de acceso y, aun así, alucinar la respuesta.
OpenAI advirtió que estas son observaciones individuales, no una medida de prevalencia ni un relato completo de los casos conocidos, pero su decisión de publicar incidentes inciertos proporciona a los investigadores evidencia para probar las salvaguardas antes de que los modelos cada vez más autónomos lleguen a la producción.
Fuentes:
https://cybersecuritynews.com/openai-models-api-key-leaks/
Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.