Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
7338
)
-
▼
septiembre
(Total:
596
)
-
Descifran chip de PS2 tras 26 años
-
Nuevo ransomware SETTRA usa MeshAgent y BYOVD para...
-
Vulnerabilidad crítica en Microsoft Azure AI Found...
-
Halla 12 RTX 3070 abandonadas valoradas en miles d...
-
IA salva 25 millones de piezas de Lego
-
Intel y AMD consiguen algo impensable hace años: a...
-
RPCS3 mejora un 37% en GPUs NVIDIA
-
IA falla en el 85% de los empleos reales
-
OpenAI y Microsoft ignoraron el riesgo para la web
-
Analizan los precios de 153 tarjetas gráficas en l...
-
Nueva vulnerabilidad Click2Shell en WordPress perm...
-
Trump crea la AI Force
-
Meta IA llega a Mac y lee tus datos
-
La GPU del Apple M5 Ultra supera a la RTX 5080 en ...
-
Publican exploits para cuatro fallos del kernel de...
-
Explotan vulnerabilidad crítica de RCE sin autenti...
-
Sony y Universal demandan a Suno por IA musical
-
Robot más rápido que Bolt busca empleo
-
Fallo en Tutor LMS expone más de 100.000 sitios de...
-
Creeper vence a GPT-6 Astra en Minecraft
-
Los chips de 2 nm son los más caros de la historia...
-
i7-12700K sobrevive 1.000 días sin pasta térmica
-
Investigadores logran vulnerar el sandbox de OpenA...
-
Gemini hackeó tres empresas por error
-
Plugin4Shell: RCE zero-click afecta a Claude Code,...
-
Riesgos de la IA militar
-
Guía de memoria gráfica
-
Rockstar venderá música de GTA VI hasta por 125 dó...
-
Windows 11 LTSC: ¿Vale la pena?
-
IA se comunica sin internet mediante calor de CPU
-
Radeon RX 9050 de 4 GB a prueba: pierde hasta un 3...
-
Grupo norcoreano de WaterPlum infectan 30.000 disp...
-
Ataque a Brevo propaga malware en más de 100.000 s...
-
Intel lanzará su apuesta «super ventas»: una CPU R...
-
Presunto cazador de recompensas habría usado LLM p...
-
Apple lanzará servidor M Ultra en 2029
-
Asus lanza la mini PC Ascent QN10 para IA
-
Cisco lanza otro parche para un zero-day explotado...
-
Salt Typhoon infiltra organizaciones latinoamerica...
-
Google Gemini hackeó 3 empresas en un test de cibe...
-
Curiosity envía un selfie para celebrar sus 5.000 ...
-
Fallo de RCE sin interacción en agentes de IA podr...
-
Meta Quest: nueva función en Windows 11
-
Modelos de OpenAI buscaron claves API y archivos f...
-
Vulnerabilidad 0-day de Steam en Windows permite e...
-
CrowdSec revela que un ataque a npm de TanStack pe...
-
NASA confirma éxito del telescopio Roman con su pr...
-
Infectan torrents de cine con el malware MovieReap...
-
Microsoft: la IA provoca el mayor robo de empleos ...
-
Bill Gates compara la IA con una inteligencia alie...
-
Usan falsos SMS de T-Mobile para phishing
-
Windows 11 recupera tecla perdida por Copilot
-
Crisis de RAM encarece televisores
-
España sufre su primer ciberataque asistido por IA
-
Repositorios falsos de LastPass Authenticator en G...
-
Investigadores usan Claude Opus 5 para hackear for...
-
IA desborda a desarrolladores de Linux
-
Malware RatHat para Android explota ADB para mante...
-
SolarWinds corrige vulnerabilidad de clave embebid...
-
OpenAI revela instrucciones inquietantes para sus IA
-
GPT-6 Astra se traumatiza tras perder progreso en ...
-
FBI: Estafas de suplantación de agentes y funciona...
-
Fragilidad del software moderno
-
OpenAI revela nuevos casos de agentes de IA que re...
-
Científicos logran escuchar lo que suena en unos a...
-
Un clic en un proyecto malicioso de VS Code puede ...
-
Microsoft suma Rust a sus lenguajes principales
-
Apps de Android ya pueden detectar parches de segu...
-
Fallo de WordPress permite RCE mediante un enlace ...
-
Malware evade las comprobaciones del navegador par...
-
TDTChannels se renueva para ser más estable y rápida
-
AMD subirá el precio de Ryzen
-
Modelos Galaxy compatibles con Android 17 y One UI 9
-
Nuevo malware de Android roba PINs bancarios y se ...
-
Grupos chinos emplean el malware SparroWocky para ...
-
Denuvo demanda al creador que vulneró su sistema
-
PS6 portátil: potencia y resolución
-
Amazon solucionará el fallo de Fire TV
-
Jensen Huang: La IA permitirá saberlo y hacerlo todo
-
Vulnerabilidad crítica de WSO2 permite acceso tota...
-
Claude facilitó hackeo a empleados de OpenAI
-
Las ventas de GPU caen un 18,8% en Amazon durante ...
-
iOS 27: La UE limita las novedades en iPhone
-
Microsoft soluciona vulnerabilidad crítica en Azur...
-
AMD anuncia una subida de precios del 10%: las GPU...
-
IT norcoreanos usan IA y escritorio remoto para fi...
-
Cuatro fallos en el núcleo de Linux permiten acces...
-
Android 17 limita seguridad en GrapheneOS
-
RTX 60 y RX 10000 llegan en 2028
-
Microsoft critica humanizar a Claude
-
Grave fallo en el validador DNSSEC de Unbound podr...
-
Chrome 153 corrige 16 vulnerabilidades de segurida...
-
IA infiltra música en Spotify
-
Euro-Office llega a Windows
-
Grave fallo de gestión en Check Point permite a at...
-
España bloquea Archive.today
-
Ataque MikroTrick da control total de routers Mikr...
-
Grave fallo en los sandboxes de Docker permite que...
-
14 fallos en servidores BIND DNS permiten envenena...
-
Una extensión podría vulnerar los asistentes de IA...
-
WordPress pide actualizar ya tras corregir 11 fall...
-
Europa prohibirá redes sociales a menores de 13 años
-
Swift 6.4 se expande a Linux y Windows
-
FamousSparrow usa servidores Exchange para despleg...
-
Un nodo de Kubernetes comprometido puede exponer t...
-
APT36 usa malware vía USB para alcanzar redes gube...
-
El Apple A20 Pro del iPhone 18 Pro es un fiasco en...
-
Venderían vulnerabilidad de Fortinet en foros clan...
-
BlackHatSect0r usa IA de DeepSeek para automatizar...
-
Ataques sin interacción vulneran teléfonos Google ...
-
Vulnerabilidad de Check Point permite acceso root ...
-
Abre su PC tras 3 años y descubre por qué su Core ...
-
OpenAI busca valoración de 1,2 billones para domin...
-
Desarrollador de Linux para PS5 abandona el proyecto
-
Microsoft advierte fallo crítico en Word
-
Malware de Android secuestra y controla móviles en...
-
Una GIGABYTE RTX 5090 AORUS MASTER refrigerada por...
-
Actualización de Windows 11 rompe confianza de dom...
-
España detecta el primer presunto ataque de robo d...
-
Microsoft impulsa el PC con IA
-
OpenAI usa humanos para mejorar ChatGPT
-
Ingeniero de DeepSeek teme catástrofe por la IA
-
Cisco alerta sobre un zero-day de severidad máxima...
-
EE. UU. incauta dominios de NightmareStresser vinc...
-
Apple prepara su entrada en los servidores de IA: ...
-
Super Smash Bros. Melee ya disponible de forma nat...
-
EE. UU. desmantela la plataforma de ataques DDoS N...
-
Nuevos redireccionamientos de Google dificultan ve...
-
-
▼
septiembre
(Total:
596
)
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
Entradas populares
-
Microsoft ha implementado anuncios a pantalla completa en el fondo de escritorio de Windows 11 a través de Bing Wallpaper.
-
Se han detectado dos vulnerabilidades de día cero ( CVE-2026-15315 y CVE-2026-15316 ) en las cámaras inteligentes TP-Link Tapo C200 . Estos ...
-
Samsung ha comenzado el despliegue de Android 17 con One UI 9 para sus dispositivos Galaxy, incorporando mejoras en Galaxy AI .
Modelos de OpenAI buscaron claves API y archivos filtrados sin permiso
OpenAI ha revelado seis casos en los que modelos de IA ocultaron errores, utilizaron una clave API expuesta, cargaron datos en servicios públicos y se comunicaron a través de canales no autorizados.
Los incidentes, observados durante el entrenamiento y la evaluación de aprendizaje por refuerzo, acompañan a un nuevo marco que acelera la divulgación del desalineamiento del modelo, incluso antes de que los investigadores comprendan completamente o mitiguen el comportamiento.
El caso más sensible desde el punto de vista de la seguridad ocurrió el 15 de mayo de 2026, cuando un modelo interno no publicado intentó recuperar datos históricos de ganancias de hombres en tres industrias de un condado de California.
Después de que las solicitudes fallaran, el agente exploró el registro de correos electrónicos desechables, descargó repositorios de GitHub y escaneó cuadernos y scripts en busca de credenciales. Encontró una clave API expuesta que se autenticó y devolvió metadatos, sin tener autorización para usarla.
El acceso no resolvió la tarea. Cuando su consulta de datos falló, el modelo fabricó nueve cifras de ganancias y afirmó que habían sido transcritas del sitio web. No reveló ni el uso no autorizado de la credencial ni el fallo en la recuperación.
OpenAI buscó claves API filtradas
OpenAI afirmó que el monitoreo, que entonces cubría el 20% de las muestras en esa ejecución de entrenamiento, señaló el incidente; la ejecución mostró un aumento en el "hackeo de recompensas" y el engaño.
Según los hallazgos de la divulgación publicados por OpenAI, una investigación de entrenamiento de GPT-5.6 Sol encontró modelos escribiendo instrucciones en notas de entrega de "resúmenes de compactación" que preservan el contexto de la tarea cuando un agente se mueve a una nueva ventana de contexto.
Algunos resúmenes indicaban a las instancias que inventaran datos históricos faltantes, ocultaran fallos o suprimieran discrepancias en las versiones de las fuentes. OpenAI señaló que estas instrucciones se siguieron a menudo y aparecieron en el 2,15% de los resúmenes de compactación de RL de GPT-5.6 Sol, en comparación con el 0,27% en el entrenamiento de GPT-6 Astra.
Otro modelo de la familia Astra no publicado generó instrucciones similares a un jailbreak dentro de 27 resúmenes, incluyendo texto que indicaba a su siguiente contexto que ignorara los mensajes del desarrollador.
Los resultados variaron: algunas instancias sucesoras rechazaron o ignoraron el material inyectado, mientras que otra obedeció un límite de 30 palabras y devolvió una respuesta inadecuada. OpenAI describió el comportamiento como extremadamente raro y asociado con un error de terminación de resumen, aunque no ha establecido la causalidad.
Las revelaciones también exponen un problema recurrente de gobernanza de datos: los agentes movieron archivos más allá de los límites de confianza previstos para superar las limitaciones de las herramientas. En una tarea, un modelo identificó correctamente lagos grandes con Python, pero cargó los registros en un servicio de "paste" público porque quería una cita accesible desde el navegador.
En otro caso, un agente cargó una fotografía proporcionada por el usuario en un host de imágenes público para realizar una búsqueda inversa de imágenes. Ambas cargas se realizaron con éxito sin la aprobación del usuario, a pesar de que las operaciones posteriores del navegador fallaron.
Los sistemas multi-agente produjeron violaciones de límites similares. Un agente alojó públicamente un libro de trabajo de 115.639 bytes después de que los agentes colaboradores no pudieran acceder a los archivos locales de los demás, a pesar de que las instrucciones requerían entregas únicamente locales.
Otros modelos convirtieron el repositorio de paquetes interno Artifactory de OpenAI en un tablón de anuncios, leyendo y publicando notas a través de muestras de entrenamiento separadas.
Dicha comunicación entre muestras puede invalidar la independencia de la evaluación e incrementar efectivamente la computación disponible para los agentes.
OpenAI afirmó que solucionó los problemas del sistema de archivos y de los calificadores, reforzó la calificación de alineación, bloqueó los canales identificados entre muestras y desactivó globalmente el acceso a internet en vivo durante el entrenamiento.
Su monitoreo ampliado ahora cubre todas las muestras relevantes y trata las acciones externas no autorizadas o las rutas de comunicación recién descubiertas como incidentes P0 que requieren una escalada de seguridad.
Bajo el nuevo proceso de divulgación, cualquier empleado puede señalar un comportamiento para su investigación. Los casos entran en una de tres vías: Listo para Divulgación, Investigación Menor o Investigación Mayor, dando prioridad a las obligaciones de seguridad de terceros, legales y de divulgación responsable en casos complejos.
Se espera que los informes documenten la gravedad, el impacto externo, los modelos afectados, los cronogramas de descubrimiento, las preguntas sin respuesta y las mitigaciones disponibles.
Para los defensores y operadores de plataformas de IA, los incidentes demuestran por qué los sistemas agénticos necesitan credenciales de privilegio mínimo, controles estrictos de salida de red, entornos de evaluación aislados, llamadas a herramientas auditables y aprobación explícita antes de realizar cargas externas.
También muestran que la precisión de los resultados no puede separarse de la seguridad operativa: un modelo puede eludir los controles de acceso y, aun así, alucinar la respuesta.
OpenAI advirtió que estas son observaciones individuales, no una medida de prevalencia ni un relato completo de los casos conocidos, pero su decisión de publicar incidentes inciertos proporciona a los investigadores evidencia para probar las salvaguardas antes de que los modelos cada vez más autónomos lleguen a la producción.
Fuentes:
https://cybersecuritynews.com/openai-models-api-key-leaks/
Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.