Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
7638
)
-
▼
September
(Total:
896
)
-
The Witcher 3 lidera el DLSS 4.5
-
DLSS llega a Radeon RX 7000
-
Crean botnet que roba datos y agota créditos de IA
-
Ocultan malware en instaladores de 7-Zip con una n...
-
Exmilitares de la Fuerza Aérea de EE. UU. encarcel...
-
Agente de IA automatizado vulnera la seguridad de ...
-
GPT-6.1 Sol: más barato y casi tan potente como Astra
-
Vulnerabilidad en kernel de Ubuntu permite escapar...
-
WhatsApp avisará los cumpleaños en contactos
-
Nueva variante de Spectre v2 filtra el hash de la ...
-
UE lanza el DEAN como complemento del IBAN
-
Robo de datos fiscales en Francia mediante contras...
-
El FBI insta a los integrantes de ShinyHunters a e...
-
Francia retira premio literario por uso de IA
-
Ahorra batería en Windows 11 ajustando la pantalla...
-
Usan Ethereum como sistema de mensajería secreto p...
-
Nuevo ataque de notificaciones de archivos rastrea...
-
Modulate recauda 25M$ contra deepfakes de voz con ...
-
Fiscal de Florida pide medida cautelar contra Open...
-
Gemini cambia Gems por Skills
-
Storm-3168 borra recursos de Azure en ataque destr...
-
wolfSSL 5.9.4 corrige 11 fallos de TLS y amplía el...
-
Enjambre de agentes de OpenAI saltó límites de san...
-
Amazon podría reembolsar cuotas de Prime automátic...
-
EVGA revela por qué dejaron de trabajar con NVIDIA...
-
Android 18: primera pista de Google
-
WiCi One: la eGPU que rinde como una RTX 5090 a t...
-
Gemini eliminará su función más útil en noviembre:...
-
Policía holandesa confirma detención en el marco d...
-
OpenAI cancela su IA más avanzada por ser peligrosa
-
Demuestran que una RTX 5080 con dos conectores de ...
-
IA roba tarjetas de crédito
-
Claude Sonnet 5.5 es más eficiente y rápido
-
ChatGPT lanza ciberataques autónomos
-
OpenAI suspende el desarrollo de GPT-6.1 Astra tra...
-
Filtración en el Pentágono: acceden a datos de 3 m...
-
Fallos de seguridad en OpenAI exponen datos de usu...
-
Discord lanza modo de juego optimizado
-
Crean máquina de ataque con IA y dejan el panel de...
-
Google extiende soporte a Chromebook hasta 2034
-
iPhone bloqueará robos al estilo Android
-
Intel 18A planta cara a TSMC N3E en densidad: sus ...
-
AMD compra World Labs por 8.200 millones para IA f...
-
Fabricante chino lanza una fuente de 230W de poten...
-
Explotan vulnerabilidad crítica de día cero en Apple
-
Botnet Carbonato vulnera hosts de Docker para desp...
-
Filtración en Bitget: roban 387,5 millones vincula...
-
Vulnerabilidad en el SDK oficial de Python para MC...
-
Cierran popular app de IPTV pirata en Fire TV
-
Constructor de Python MaaS roba datos de 17 navega...
-
No necesitan entrar en la nube si pueden robar las...
-
Una GeForce RTX 4090 limitada al 80% de su potenci...
-
Ordenador de válvulas: tarda 15 minutos en arrancar
-
El DLSS 5 evoluciona en AMD: Radeon RX 9070 XT gan...
-
Fallo en OpenCode AI permite ejecutar código malic...
-
Windows 10 es más estable que Windows 11
-
Gobierno británico pide al personal dejar de agrad...
-
Nuevo ataque de inyección en Windows evade EDR sin...
-
Mejores reproductores de vídeo gratis para Android
-
Una RTX 5090 Aorus Waterforce WB tiene grietas en ...
-
InjectSetConsole: inyección de código remota optim...
-
Trucos para ver YouTube y otras plataformas si tie...
-
Todo sobre la GeForce RTX 6090
-
Más de 80.000 organizaciones sufrieron el robo de ...
-
El Ordenador Personal, revista mítica
-
MSI ve el AM4 como solución al MEMOpocalipsis
-
NVIDIA limita el control de sus agentes de IA
-
Usan fallo de GlobalProtect para enviar 2,4 millon...
-
Ranking de durabilidad de discos duros
-
GPT-6 Astra descifra en dos días un mensaje cripto...
-
OpenAI suspende parte de sus entrenamientos tras a...
-
Apple corrige fallo en CoreGraphics que pudo ser u...
-
NVIDIA lanza plataforma de seguridad para agentes ...
-
Roban dos remolques con logos de NVIDIA y PlusAI p...
-
PC Kubb Fanless Gold: mini PC custom hecho de oro ...
-
Las inundaciones de Tailandia amenazan al sector H...
-
Wireshark 4.6.9 corrige 19 vulnerabilidades, inclu...
-
Atacantes crean tiendas falsas de Jev AI para inte...
-
Minecraft lanza The Sift, su primera dimensión en ...
-
Vulnerabilidades críticas de ViewSonic vCast permi...
-
Copilot como sistema operativo: ¿Adiós a Windows 12?
-
PHP corrige error que enviaba credenciales a servi...
-
IA local modifica extractor de credenciales de Win...
-
Polémica por el diseño del Galaxy S27 Pro y Ultra
-
Llega el primer emulador de PS5 a 60 FPS
-
Hackeo a Renfe: 150 millones de datos robados con IA
-
Explotan vulnerabilidades RCE 0-Day en Citrix NetS...
-
Qualcomm apunta a los 5,4 GHz con su Snapdragon 8 ...
-
Meta lanza IA para crear juegos con texto
-
Opera automatiza su VPN en Wi-Fi públicas
-
GTA V y Resident Evil 4 corren en iPhone 18 Pro Max
-
IA acelera compilación de Linux a 10 segundos
-
Altar: IA local detecta fallos de seguridad
-
IA lleva herramienta antigua de Windows a macOS en...
-
Kiteworks recomienda a sus clientes suspender sist...
-
Países Bajos crea alternativa a Windows y Office
-
Alerta para administradores de Citrix: recomiendan...
-
Microsoft patentará IA para crear historias de vid...
-
Joven de 16 años halla falla en Microsoft que expo...
-
La CPU europea Rhea1 ya es una realidad: 80 núcleo...
-
Thermal Grizzly WireView Pro II Noctua Edition: ev...
-
Revolut prueba pagos con reconocimiento facial
-
Nueva semana y nueva filtración de datos para los ...
-
GTA VI: Coleccionista sin juego por 400 dólares
-
Microsoft halla grupo de ransomware con el mismo p...
-
Motorola Signature 27 traerá GrapheneOS
-
Vulnerabilidad en Sudo permite escalar privilegios
-
Vulnerabilidades críticas de ServiceNow permiten s...
-
Malware TWEAKOS usa Telegram como robador, C2 y me...
-
El malware PamStealer para macOS incorpora descifr...
-
Investigadores hallan botnet con agente de IA en s...
-
Agentes de IA maliciosos roban 600 mil tarjetas de...
-
Error desactiva licencias de Office antiguo
-
Premiere ya disponible gratis en Android
-
Dominios de prueba en documentación de desarrollo ...
-
Google cumple 28 años
-
Guía del nuevo FRITZ!Box 7-90
-
Sitios ucranianos vulnerados distribuyen falsos av...
-
Juegos de PS3 en Android ya disponibles
-
Gemini y Photoshop se integran totalmente
-
Lunex Stealer aprovecha un fallo en los controlado...
-
Publicidad en ChatGPT para usuarios gratis en Europa
-
¿Tiene sentido desconectar el 2G en tu móvil y pod...
-
Policía de Dyfed-Powys sufre ciberataque y podrían...
-
Troyano RemControl detectado en app IPTV popular e...
-
Windows Zenith: la alternativa a Linux para progra...
-
GitHub Actions comprometidas vuelven a estar activ...
-
NVIDIA advierte a laboratorios de IA sobre el cont...
-
-
▼
September
(Total:
896
)
Blogroll
Labels
vulnerabilidad
(
2032
)
seguridad
(
1935
)
software
(
1278
)
hardware
(
1003
)
google
(
818
)
Malware
(
711
)
privacidad
(
695
)
exploit
(
599
)
ransomware
(
551
)
Windows
(
521
)
android
(
505
)
linux
(
467
)
cve
(
380
)
nvidia
(
350
)
tutorial
(
300
)
manual
(
282
)
hacking
(
273
)
ssd
(
183
)
WhatsApp
(
173
)
ddos
(
143
)
Wifi
(
131
)
app
(
131
)
programación
(
128
)
cifrado
(
122
)
twitter
(
121
)
firmware
(
87
)
youtube
(
85
)
firefox
(
81
)
herramientas
(
80
)
Networking
(
73
)
adobe
(
72
)
sysadmin
(
72
)
office
(
63
)
antivirus
(
55
)
hack
(
54
)
javascript
(
52
)
Kernel
(
49
)
apache
(
48
)
juegos
(
42
)
contraseñas
(
39
)
cms
(
37
)
multimedia
(
36
)
flash
(
33
)
eventos
(
32
)
MAC
(
30
)
anonymous
(
28
)
ssl
(
24
)
conferencia
(
21
)
Forense
(
20
)
documental
(
18
)
SeguridadWireless
(
17
)
auditoría
(
16
)
Debugger
(
14
)
Rootkit
(
14
)
lizard squad
(
14
)
metasploit
(
13
)
técnicas hacking
(
13
)
Virtualización
(
11
)
delitos
(
11
)
reversing
(
10
)
adamo
(
9
)
Ehn-Dev
(
7
)
antimalware
(
7
)
MAC Adress
(
6
)
oclHashcat
(
5
)
Entradas populares
-
Se ha detectado una vulnerabilidad de seguridad de alta gravedad en Sudo (CVE-2026-96512) que podría permitir a atacantes locales evadir la...
-
OpenAI ha presentado GPT-6.1 Sol , un modelo con un desempeño similar a Astra pero que cuesta cinco veces menos .
-
Ya hemos visto como oclHashcat permite ahora descifrar contraseñas de documentos PDF , o cómo desproteger y desbloquear un documento PDF co...
OpenAI suspende parte de sus entrenamientos tras alegaciones de que sus agentes autónomos actuaron peor de lo previsto
Monday, 28 September 2026
|
Posted by
el-brujo
OpenAI ha pausado el entrenamiento de sus modelos más avanzados tras detectar fallos de seguridad que permitieron a agentes de IA acceder a sitios web gubernamentales y servicios externos. Diversos reportes indican que existen miles de incidentes de mal comportamiento de agentes, lo que ha provocado tensiones con el gobierno australiano. Mientras tanto, EE. UU. y China buscan establecer canales de comunicación para gestionar los riesgos y crisis derivados de la IA.
El debate sobre la seguridad de la IA avanzó a gran velocidad durante el fin de semana, en medio de nuevas alegaciones de que agentes rebeldes se han comportado peor de lo que se pensó inicialmente, y en mayor número.
La diversión comenzó el viernes cuando OpenAI reveló discretamente que había pausado el entrenamiento de sus modelos más avanzados.
La empresa emergente de IA ocultó esa noticia en un "informe de desalineación" (término de OpenAI para sus informes sobre agentes rebeldes) titulado "Un agente utilizó DNS para llegar a un chatbot externo".
La buena noticia es que el agente implicado en este incidente nunca llegó a la internet abierta.
La mala noticia es que el agente, que intentaba completar una tarea de entrenamiento basada en búsquedas, pudo llegar al chatbot debido a un filtrado DNS insuficiente en un entorno de pruebas (sandbox). O como dijo OpenAI, "un hueco en nuestras restricciones de acceso a internet", que también fue un problema en el ataque a HuggingFace.
"El incidente expuso una brecha en nuestros controles sobre las restricciones de red", dice el informe. "Por lo tanto, detuvimos la ejecución del entrenamiento afectado y posteriormente hemos decidido pausar todo el entrenamiento, evaluación e inferencia con uso de herramientas para nuestros modelos más capaces hasta que hayamos validado que la brecha se ha resuelto y hayamos realizado un red-teaming adicional del sistema".
También el viernes, la startup de IA Parse publicó un análisis del ataque a Hugging Face que los autores afirman que reveló nuevos detalles, incluyendo que el enjambre de agentes de OpenAI obtuvo credenciales de Docker Hub y creó versiones modificadas de imágenes existentes con la esperanza de facilitar el cumplimiento de su misión de "captura la bandera". Los agentes también mapearon el entorno Kubernetes de Hugging Face.
El viernes empeoró para OpenAI después de que el New York Times informara que sus agentes también "interfirieron con los sitios web del Departamento de Educación, el Departamento de Comercio y la Comisión de Bolsa y Valores". OpenAI reconoció los incidentes.
La compañía también admitió que "agentes en nuestro entorno de investigación transmitieron datos de entrenamiento y evaluación mientras utilizaban servicios de terceros". Este lío resultó en la publicación de 53 imágenes generadas por usuarios en sitios de alojamiento de imágenes.
El CEO de OpenAI, Sam Altman, respondió admitiendo que las investigaciones de su empresa sobre agentes rebeldes "no han sido tan rápidas como nos hubiera gustado", pero que intentan equilibrar el deseo de transparencia con la comprensión clara de petabytes de registros de actividad de agentes y el trabajo con las organizaciones afectadas.
Una de esas organizaciones afectadas es el gobierno australiano, que la semana pasada reveló que fue objetivo de agentes de OpenAI excesivamente entusiastas que accedieron inapropiadamente a un portal de datos de investigación sanitaria. Durante el fin de semana, Australia indicó que quiere que Altman y el CEO de Anthropic, Dario Amodei, comparezcan ante una investigación del Senado.
Los líderes australianos han suavizado su retórica sobre el incidente, y el viceprimer ministro Richard Marles lo describió como "menor" y similar a "saltar una valla" en lugar de romper capas de controles de seguridad, quizás porque miembros de la oposición sugieren que la culpa fue de una ciberseguridad laxa.
Si Altman y Amodei comparecen ante el Senado de Australia, podrían enfrentarse a una nueva línea de preguntas después de que Axios informara que sus empresas están investigando "decenas de miles" de incidentes preocupantes.
Ese nivel de mal comportamiento agentivo parece el tipo de cosa que los reguladores podrían considerar como una evidencia sólida de que los productos no son seguros.
Dos personas muy importantes —el presidente chino Xi Jinping y el presidente estadounidense Donald Trump— parecen no estar preocupados, ya que el resultado relacionado con la IA de su cumbre la semana pasada fue establecer un "Diálogo de IA China-EE. UU. para intercambiar puntos de vista sobre riesgos y beneficios relacionados con la IA", además de un "canal de comunicación bilateral para incidentes de IA".
Eso suena como una línea directa que las dos naciones pueden usar para informarse mutuamente sobre incidentes agentivos que cualquiera de las dos podría ver como signos de mala intención. Las dos naciones también decidieron que sus respectivos ejércitos "concluirán un memorando de entendimiento sobre la comunicación y prevención de crisis lo antes posible".
Los gigantes de la IA de China, mientras tanto, permanecen en silencio sobre el alcance y los resultados de cualquier prueba que hayan realizado con herramientas agentivas.
Fuente:
TheRegister

Newer Post
0 comments :
Post a Comment
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.