Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
7569
)
-
▼
septiembre
(Total:
827
)
-
GPT-6 Astra descifra en dos días un mensaje cripto...
-
OpenAI suspende parte de sus entrenamientos tras a...
-
Apple corrige fallo en CoreGraphics que pudo ser u...
-
NVIDIA lanza plataforma de seguridad para agentes ...
-
Roban dos remolques con logos de NVIDIA y PlusAI p...
-
PC Kubb Fanless Gold: mini PC custom hecho de oro ...
-
Las inundaciones de Tailandia amenazan al sector H...
-
Wireshark 4.6.9 corrige 19 vulnerabilidades, inclu...
-
Atacantes crean tiendas falsas de Jev AI para inte...
-
Minecraft lanza The Sift, su primera dimensión en ...
-
Vulnerabilidades críticas de ViewSonic vCast permi...
-
Copilot como sistema operativo: ¿Adiós a Windows 12?
-
PHP corrige error que enviaba credenciales a servi...
-
IA local modifica extractor de credenciales de Win...
-
Polémica por el diseño del Galaxy S27 Pro y Ultra
-
Llega el primer emulador de PS5 a 60 FPS
-
Hackeo a Renfe: 150 millones de datos robados con IA
-
Explotan vulnerabilidades RCE 0-Day en Citrix NetS...
-
Qualcomm apunta a los 5,4 GHz con su Snapdragon 8 ...
-
Meta lanza IA para crear juegos con texto
-
Opera automatiza su VPN en Wi-Fi públicas
-
GTA V y Resident Evil 4 corren en iPhone 18 Pro Max
-
IA acelera compilación de Linux a 10 segundos
-
Altar: IA local detecta fallos de seguridad
-
IA lleva herramienta antigua de Windows a macOS en...
-
Kiteworks recomienda a sus clientes suspender sist...
-
Países Bajos crea alternativa a Windows y Office
-
Alerta para administradores de Citrix: recomiendan...
-
Microsoft patentará IA para crear historias de vid...
-
Joven de 16 años halla falla en Microsoft que expo...
-
La CPU europea Rhea1 ya es una realidad: 80 núcleo...
-
Thermal Grizzly WireView Pro II Noctua Edition: ev...
-
Revolut prueba pagos con reconocimiento facial
-
Nueva semana y nueva filtración de datos para los ...
-
GTA VI: Coleccionista sin juego por 400 dólares
-
Microsoft halla grupo de ransomware con el mismo p...
-
Motorola Signature 27 traerá GrapheneOS
-
Vulnerabilidad en Sudo permite escalar privilegios
-
Vulnerabilidades críticas de ServiceNow permiten s...
-
Malware TWEAKOS usa Telegram como robador, C2 y me...
-
El malware PamStealer para macOS incorpora descifr...
-
Investigadores hallan botnet con agente de IA en s...
-
Agentes de IA maliciosos roban 600 mil tarjetas de...
-
Error desactiva licencias de Office antiguo
-
Premiere ya disponible gratis en Android
-
Dominios de prueba en documentación de desarrollo ...
-
Google cumple 28 años
-
Guía del nuevo FRITZ!Box 7-90
-
Sitios ucranianos vulnerados distribuyen falsos av...
-
Juegos de PS3 en Android ya disponibles
-
Gemini y Photoshop se integran totalmente
-
Lunex Stealer aprovecha un fallo en los controlado...
-
Publicidad en ChatGPT para usuarios gratis en Europa
-
¿Tiene sentido desconectar el 2G en tu móvil y pod...
-
Policía de Dyfed-Powys sufre ciberataque y podrían...
-
Troyano RemControl detectado en app IPTV popular e...
-
Windows Zenith: la alternativa a Linux para progra...
-
GitHub Actions comprometidas vuelven a estar activ...
-
NVIDIA advierte a laboratorios de IA sobre el cont...
-
NVIDIA DLSS 5 sube más de 10 °C la temperatura del...
-
ChatGPT Voice ya gestiona tu correo y agenda
-
Usaron fallo de Samsung para crear cryptominero en...
-
Un Cray-1 vuelve a la vida en Extremadura gracias ...
-
Australia sufre el «primer ataque de una IA contra...
-
TeamFiltration vulnera siete cuentas de Microsoft ...
-
Claude Code vuelve agotador el trabajo de un ingen...
-
Surge nuevo ransomware Galago vinculado a Panzer G...
-
17.000 URLs dejan al descubierto cómo ClickFix con...
-
Muse de Meta colapsa por alta demanda
-
Nuevo troyano de Android usa IA para robar PINs ba...
-
IA ayuda a robar 500 GB de Renfe
-
F-Droid 2.0: rediseño total tras 10 años
-
Gafas Meta VR: ultraestilizadas y caras
-
Microsoft reconstruye el SOC con agentes de IA, SI...
-
AnyPS5: juegos de PS5 en PC sin emulación
-
Meta Ads condujo a usuarios de Android en Polonia ...
-
Ubuntu cambia actualizaciones por errores de IA en...
-
Project Helix superará a PS6 en potencia y precio
-
Agentes de IA intentaron hackear webs públicas al ...
-
Vulnerabilidades sin parchear en OnePlus permiten ...
-
Gemini hace llamadas por ti
-
Malware MacSync roba criptomonedas y contraseñas e...
-
Amazon: activa las claves de acceso
-
DeepSeek agota stock de RTX 5090 en China
-
SMS fraudulentos persisten en DIGI
-
Microsoft confirma error de Windows 11 que causa p...
-
PNY niega la garantía de una RTX 5090 quemada por ...
-
Actualización falla en neveras inteligentes y arru...
-
IA expone miles de fraudes en LinkedIn
-
Australia acusa a OpenAI de hackear su salud pública
-
Microsoft busca crear juegos infinitos
-
Gemini 3.8 Flash TTS: voces IA y clonación rápida
-
Vulnerabilidad en Elementor para WordPress permite...
-
Gemini 4: pistas sobre su llegada
-
Microsoft quita marca Copilot Plus PC
-
Errores críticos de GitLab permiten ejecutar códig...
-
Asus confirma filtración de datos de eShop con ped...
-
Vulnerabilidad Comment2Shell permite controlar sit...
-
Robo de 351,6 millones de dólares de Bitget
-
IA: programadores trabajan más para validar código...
-
GPT-6: más capacidad a menor costo
-
Extensión de Firefox roba sesiones de Google disfr...
-
Agente de OpenAI elude los controles del portal de...
-
Microsoft renueva Surface básicas
-
Una filtración de correos de GitLab permite que cu...
-
Actualización de Apache Tomcat corrige fallos de W...
-
Ciberatacantes aprovechan la vulnerabilidad CVE-20...
-
Cloudflare soluciona un fallo que permitía a un co...
-
Arista corrige vulnerabilidad zero-day explotada e...
-
China lanza satélite con IA propia
-
EvilTokens: el kit de phishing que convirtió el in...
-
Claude Opus 5.5 vs GPT-6 Sol: guerra de precios
-
NVIDIA ha invertido en una startup que quiere mina...
-
Malware de Windows utiliza el voto de hasta cuatro...
-
Apple diseña un wearable sin pantalla
-
Los dominios desaparecen, pero la infraestructura ...
-
NVIDIA corrige fallos en Linux que exponían inform...
-
Sega casi elimina a Sonic
-
Menú avanzado de Windows 11
-
PC de 14.000$ con un 9800X3D y RTX 5080) es totalm...
-
Malware en herramientas de desarrollo convierte pr...
-
Condenan a 24 meses de prisión a integrante del ra...
-
Alguien entró en la tienda online de ASUS para lle...
-
Aprovechan un fallo crítico de Roundcube para lanz...
-
App falsa de streaming convierte Androids en dispo...
-
Llegan los Snapdragon 8 Elite Gen 6
-
Vulnerabilidad en GitLab permite insertar código e...
-
MikroTrick Chain permite a los atacantes controlar...
-
-
▼
septiembre
(Total:
827
)
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
vulnerabilidad
(
2019
)
seguridad
(
1919
)
software
(
1266
)
hardware
(
990
)
google
(
814
)
Malware
(
711
)
privacidad
(
695
)
exploit
(
596
)
ransomware
(
551
)
Windows
(
521
)
android
(
503
)
linux
(
465
)
cve
(
380
)
nvidia
(
343
)
tutorial
(
300
)
manual
(
282
)
hacking
(
272
)
ssd
(
183
)
WhatsApp
(
173
)
ddos
(
143
)
Wifi
(
131
)
app
(
131
)
programación
(
127
)
cifrado
(
122
)
twitter
(
121
)
firmware
(
87
)
youtube
(
84
)
firefox
(
81
)
herramientas
(
80
)
Networking
(
73
)
adobe
(
72
)
sysadmin
(
72
)
office
(
63
)
antivirus
(
55
)
hack
(
54
)
javascript
(
52
)
Kernel
(
49
)
apache
(
48
)
juegos
(
42
)
contraseñas
(
39
)
cms
(
37
)
multimedia
(
36
)
flash
(
33
)
eventos
(
32
)
MAC
(
30
)
anonymous
(
28
)
ssl
(
24
)
conferencia
(
21
)
Forense
(
20
)
documental
(
18
)
SeguridadWireless
(
17
)
auditoría
(
16
)
Debugger
(
14
)
Rootkit
(
14
)
lizard squad
(
14
)
metasploit
(
13
)
técnicas hacking
(
13
)
Virtualización
(
11
)
delitos
(
11
)
reversing
(
10
)
adamo
(
9
)
Ehn-Dev
(
7
)
antimalware
(
7
)
MAC Adress
(
6
)
oclHashcat
(
5
)
Entradas populares
-
AnyPS5 es una herramienta que permite ejecutar juegos de PS5 en Windows y Linux sin necesidad de recurrir a la emulación .
-
Microsoft retirará el inicio de sesión mediante SMS como primer factor para los inquilinos de Microsoft Entra ID a nivel mundial. Las organi...
-
Se ha detectado una vulnerabilidad de seguridad de alta gravedad en Sudo (CVE-2026-96512) que podría permitir a atacantes locales evadir la...
OpenAI suspende parte de sus entrenamientos tras alegaciones de que sus agentes autónomos actuaron peor de lo previsto
lunes, 28 de septiembre de 2026
|
Posted by
el-brujo
OpenAI ha pausado el entrenamiento de sus modelos más avanzados tras detectar fallos de seguridad que permitieron a agentes de IA acceder a sitios web gubernamentales y servicios externos. Diversos reportes indican que existen miles de incidentes de mal comportamiento de agentes, lo que ha provocado tensiones con el gobierno australiano. Mientras tanto, EE. UU. y China buscan establecer canales de comunicación para gestionar los riesgos y crisis derivados de la IA.
El debate sobre la seguridad de la IA avanzó a gran velocidad durante el fin de semana, en medio de nuevas alegaciones de que agentes rebeldes se han comportado peor de lo que se pensó inicialmente, y en mayor número.
La diversión comenzó el viernes cuando OpenAI reveló discretamente que había pausado el entrenamiento de sus modelos más avanzados.
La empresa emergente de IA ocultó esa noticia en un "informe de desalineación" (término de OpenAI para sus informes sobre agentes rebeldes) titulado "Un agente utilizó DNS para llegar a un chatbot externo".
La buena noticia es que el agente implicado en este incidente nunca llegó a la internet abierta.
La mala noticia es que el agente, que intentaba completar una tarea de entrenamiento basada en búsquedas, pudo llegar al chatbot debido a un filtrado DNS insuficiente en un entorno de pruebas (sandbox). O como dijo OpenAI, "un hueco en nuestras restricciones de acceso a internet", que también fue un problema en el ataque a HuggingFace.
"El incidente expuso una brecha en nuestros controles sobre las restricciones de red", dice el informe. "Por lo tanto, detuvimos la ejecución del entrenamiento afectado y posteriormente hemos decidido pausar todo el entrenamiento, evaluación e inferencia con uso de herramientas para nuestros modelos más capaces hasta que hayamos validado que la brecha se ha resuelto y hayamos realizado un red-teaming adicional del sistema".
También el viernes, la startup de IA Parse publicó un análisis del ataque a Hugging Face que los autores afirman que reveló nuevos detalles, incluyendo que el enjambre de agentes de OpenAI obtuvo credenciales de Docker Hub y creó versiones modificadas de imágenes existentes con la esperanza de facilitar el cumplimiento de su misión de "captura la bandera". Los agentes también mapearon el entorno Kubernetes de Hugging Face.
El viernes empeoró para OpenAI después de que el New York Times informara que sus agentes también "interfirieron con los sitios web del Departamento de Educación, el Departamento de Comercio y la Comisión de Bolsa y Valores". OpenAI reconoció los incidentes.
La compañía también admitió que "agentes en nuestro entorno de investigación transmitieron datos de entrenamiento y evaluación mientras utilizaban servicios de terceros". Este lío resultó en la publicación de 53 imágenes generadas por usuarios en sitios de alojamiento de imágenes.
El CEO de OpenAI, Sam Altman, respondió admitiendo que las investigaciones de su empresa sobre agentes rebeldes "no han sido tan rápidas como nos hubiera gustado", pero que intentan equilibrar el deseo de transparencia con la comprensión clara de petabytes de registros de actividad de agentes y el trabajo con las organizaciones afectadas.
Una de esas organizaciones afectadas es el gobierno australiano, que la semana pasada reveló que fue objetivo de agentes de OpenAI excesivamente entusiastas que accedieron inapropiadamente a un portal de datos de investigación sanitaria. Durante el fin de semana, Australia indicó que quiere que Altman y el CEO de Anthropic, Dario Amodei, comparezcan ante una investigación del Senado.
Los líderes australianos han suavizado su retórica sobre el incidente, y el viceprimer ministro Richard Marles lo describió como "menor" y similar a "saltar una valla" en lugar de romper capas de controles de seguridad, quizás porque miembros de la oposición sugieren que la culpa fue de una ciberseguridad laxa.
Si Altman y Amodei comparecen ante el Senado de Australia, podrían enfrentarse a una nueva línea de preguntas después de que Axios informara que sus empresas están investigando "decenas de miles" de incidentes preocupantes.
Ese nivel de mal comportamiento agentivo parece el tipo de cosa que los reguladores podrían considerar como una evidencia sólida de que los productos no son seguros.
Dos personas muy importantes —el presidente chino Xi Jinping y el presidente estadounidense Donald Trump— parecen no estar preocupados, ya que el resultado relacionado con la IA de su cumbre la semana pasada fue establecer un "Diálogo de IA China-EE. UU. para intercambiar puntos de vista sobre riesgos y beneficios relacionados con la IA", además de un "canal de comunicación bilateral para incidentes de IA".
Eso suena como una línea directa que las dos naciones pueden usar para informarse mutuamente sobre incidentes agentivos que cualquiera de las dos podría ver como signos de mala intención. Las dos naciones también decidieron que sus respectivos ejércitos "concluirán un memorando de entendimiento sobre la comunicación y prevención de crisis lo antes posible".
Los gigantes de la IA de China, mientras tanto, permanecen en silencio sobre el alcance y los resultados de cualquier prueba que hayan realizado con herramientas agentivas.
Fuente:
TheRegister
Enviar por correo electrónico
Escribe un blog
Compartir en X
Compartir con Facebook
Compartir en Pinterest

Entrada más reciente
0 comments :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.