Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
6408
)
-
▼
agosto
(Total:
416
)
-
Ciberdelincuentes aprovechan fallo en Screen Shari...
-
Memorando de Trump abre la puerta a que empresas e...
-
Mustang Panda integra un rootkit de Windows firmad...
-
Word facilita la búsqueda en documentos largos
-
Nueva botnet Evooo1Bot para Linux convierte router...
-
IA en Amazon perjudica a escritores humanos
-
Explotan fallo crítico de SAP Commerce Cloud sin P...
-
Shell investiga filtración de datos por ransomware...
-
Microsoft hará las llaves de acceso predeterminada...
-
GeForce Now ya es estable en Linux
-
Lumora: IPTV gratis para Android Auto
-
Google lanza Gemini especializado en programación
-
Creador del Administrador de Tareas de Windows lan...
-
Windows 11 ralentiza la apertura de VLC
-
Ventoy sustituye a Rufus para arrancar sistemas op...
-
Gemini ya elimina marcas de agua en fotos
-
ChatGPT copia función odiada Recall de Windows 11 ...
-
KDE retoma versiones LTS con Kubuntu
-
uBlock Origin critica duramente a Facebook
-
Gemini 3.7 Flash: IA premium más económica
-
Botnet Dysphoria convierte routers y cámaras en bo...
-
Vulnerabilidades de TP-Link permiten saltar autent...
-
Detenidos por fraude bancario de 30 millones de eu...
-
Filtran datos de 1,6 millones de cuentas de RingCe...
-
Hacienda francesa reconoce robo de datos tras anun...
-
pfSense Plus estrena nueva interfaz: ahora es much...
-
TV pierde 70 años de archivos por cierre de servidor
-
Sparky Linux recupera el soporte de 32 bits
-
Un atacante desconocido pasó un año vulnerando por...
-
AMD pide actualizar la BIOS de sus Ryzen por dos f...
-
Demuestran cómo utilizan dispositivos USB falsos p...
-
Nueva puerta trasera PATCHCORD ataca a telecomunic...
-
Twitch usa contenido de streamers para entrenar IA...
-
Intentan explotar vulnerabilidad zero-day en GeoSe...
-
ChatGPT es ahora mucho más rápido
-
Ucrania clausura 94 centros de llamadas fraudulent...
-
Apple insta a activar el modo de aislamiento ya
-
Nueva Zelanda denuncia que China intentó espiar su...
-
Ataque de DRAM expone zonas protegidas de la CPU
-
Estafadores clonan tarjetas contactless y autoriza...
-
Xbox Game Pass llegaría a Linux
-
Lazarus utiliza un Zero-Day de Windows para obtene...
-
Palo Alto Networks corrige 11 vulnerabilidades en ...
-
Samsung usa Claude Code para sus chips móviles
-
Gemini alcanza 1.000 millones de usuarios
-
GPT-5.6 resuelve conjetura matemática de hace 20 años
-
¿Qué es el símbolo 5G+ en el móvil?
-
Manjaro 26.1: Linux 7.1, Plasma 6.7 y GNOME 50
-
Claude marca sus contenidos con huellas invisibles
-
Android con refrigeración líquida: un móvil hecho PC
-
Fallo en Windows permite control remoto del PC
-
Expectativas Made by Google
-
Ciberatacantes aprovechan vulnerabilidad de autent...
-
Akira Ransomware usa el modo seguro de Windows par...
-
Vulnerabilidades críticas de Adobe Commerce permit...
-
Snapdragon C: portátiles realmente baratos
-
Instala apps en Windows 11 con Winget
-
Nemotron 3.5 Lightning: IA local y gratuita
-
Vulnerabilidades críticas en Adobe ColdFusion perm...
-
Vulnerabilidad RCE en WordPress Imagick permite ej...
-
Stallman cuestiona la inteligencia de la IA
-
737 extensiones VPN falsas de Chrome desvían el tr...
-
Claude marcará sus textos como IA
-
Descarga falsa de CCleaner instala spyware GhostDe...
-
Amazon bloquea centros multimedia en Fire TV
-
CAV3RN usa Google Apps Script como relé C2 para oc...
-
Vulnerabilidad en SAP Commerce Cloud permitiría a ...
-
ChatGPT ya llega a Linux
-
Intel lanza nuevo microcódigo 20260811 para correg...
-
DeepSeek subirá los precios de su API
-
Toyota invisible para cámaras mediante IA
-
Signal refuerza su seguridad para garantizar que e...
-
42 juegos gratis y ligeros para PC
-
Google afirma que Chrome bloquea 7 mil millones de...
-
Alerta: 737 extensiones VPN de Chrome desvían el t...
-
Lazarus explota zero-day de Windows AFD.sys para d...
-
Chrome 151 corrige cinco fallos graves de seguridad
-
Vulnerabilidad en Outlook permite ejecutar código ...
-
SK hynix aumentará en un 50% su producción de memo...
-
UE propone bloquear fútbol pirata en 30 minutos
-
PoC de ShieldBreak revela vulnerabilidad Zero-Day ...
-
IA hackea app de gimnasio para reservar cita
-
Linux Mint 22.3 actualiza ISO HWE a kernel 7.0
-
Detecta garrapatas con la cámara del móvil
-
Novedades de Python 3.15
-
Ciberatacantes aprovechan vulnerabilidad de VMware...
-
Venta de acciones de Intel por 20.000 millones int...
-
Nightmare-Eclipse lanza ShieldBreak: vulnerabilida...
-
Vulnerabilidad en APIs de OpenAI, Anthropic y Goog...
-
Asistentes de DEF CON habrían interferido el Wi-Fi...
-
Vulnerabilidad de Docker permite sobrescribir arch...
-
Vulnerabilidades de Zoom permiten secuestrar dispo...
-
Ransomware Gunra aprovecha fallos de Fortinet y Sc...
-
La botnet Kimwolf v7 para Android camufla el tráfi...
-
VPN de FortiGate vulnerada abre paso a ataque cont...
-
Chinos usan página falsa de DeepSeek para distribu...
-
Carga de coches eléctricos: el 25% de los puntos n...
-
Musk lanza IA autónoma 24/7
-
Microsoft corrige 398 vulnerabilidades, incluyendo...
-
DeadLock Ransomware usa Polygon para evitar ser de...
-
Recuperado diseño original del Intel 8080
-
Nemotron 3.5 Lightning acelera la IA en RTX
-
Vulnerabilidad de 18 años en SCTP de Linux permite...
-
Los precios de las tarjetas gráficas aumentan hast...
-
Linux 7.2-rc7: Linus Torvalds critica el impacto d...
-
OpenAI amplía Daybreak Cyber con GPT-5.6 para vali...
-
Robo de datos en Valve afecta a usuarios de Steam ...
-
Anthropic añadirá marcas de agua invisibles a Clau...
-
Vulnerabilidades de ClamAV permiten ataques DoS re...
-
Ciberataque a central eléctrica polaca: acceden a ...
-
Phishing vía WhatsApp usa certificados SSL/TLS con...
-
ChatGPT ya reserva restaurantes
-
Los SSD PCIe 5.0 quedan retratados en gaming: 11 j...
-
Filtración de datos de CEVA Logistics afecta a com...
-
Mozilla revoca claves de Firefox y Thunderbird tra...
-
Extensión falsa de Google Translate permite contro...
-
ChatGPT ya reserva mesas por ti
-
GitHub amplía detección de malware de npm a 8 regi...
-
GPT-5.6-Cyber: el modelo de OpenAI contra el hacking
-
QNAP QSW-M2130-4C2S24T: velocidad 10G real y gesti...
-
Prueba Direct Die Jet en una CPU y una GPU echando...
-
Vulnerabilidad en WalletService de Windows permite...
-
Buscan explotar vulnerabilidades de VMware VCenter
-
Zuckerberg quiere masificar la super IA
-
Vulnerabilidad de Red Hat ACM permite acceso total...
-
ChatGPT detecta fallos de seguridad antes que los ...
-
Claude Code pasa de aprobación humana a modo autom...
-
OpenAI frena su IA por peligrosidad
-
-
▼
agosto
(Total:
416
)
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
Entradas populares
-
Apple ha lanzado una nueva serie de alertas de "Notificación de Amenaza de Apple" dirigidas a usuarios seleccionados en 110 paíse...
-
Kioxia y Sandisk presentan la memoria BiCS10 QLC , la NAND Flash más densa de la industria con 332 capas y una capacidad de 2 Tb por chip...
-
Ventoy surge como alternativa a Rufus y Etcher, permitiendo crear pendrives multisistemas para arrancar Windows 11 o Linux sin necesidad d...
GPT-Red: el modelo hacker de OpenAI
- GPT-Red es una herramienta confidencial desarrollada por OpenAI con el objetivo de actuar como un modelo "superhacker".
- La finalidad de este sistema es detectar fallos y vulnerabilidades de forma preventiva, adelantándose a los errores que podrían ser descubiertos por investigadores o atacantes externos una vez que el modelo sea lanzado al público.
Una inteligencia artificial cuyo único objetivo sea intentar hackear a otras inteligencias artificiales. Suena un tanto extraño, pero eso es exactamente lo que ha creado OpenAI con GPT-Red, un modelo que, al menos en un principio, nunca llegará al público y que ha sido creado para encontrar fallos de seguridad antes de que lo hagan los ciberdelincuentes.
A diferencia de ChatGPT o de otros modelos de la compañía, GPT-Red no responde preguntas ni ayuda a programar. Su trabajo consiste en actuar como un superhacker: intenta engañar a otros modelos de IA, saltarse sus restricciones y descubrir vulnerabilidades que podrían ser aprovechadas por un ciberdelincuente.
Solo cuando consigue romper sus defensas, los ingenieros pueden corregir esos fallos antes de lanzar el modelo al público. Puede parecer una idea un tanto rara, pero ciertamente tiene todo el sentido del mundo.
¿Qué es GPT-Red?
GPT-Red es un modelo de lenguaje especializado en red teaming, una técnica utilizada desde hace años en ciberseguridad que consiste en atacar un sistema para descubrir sus puntos débiles antes que un atacante real.
Normalmente, este trabajo lo hacen expertos humanos que intentan romper las defensas de un programa buscando errores, vulnerabilidades o formas raras de hacerlo fallar. El problema es que este proceso requiere mucho tiempo y resulta casi imposible de escalar cuando los propios modelos de IA mejoran tan rápido y se usan para los ataques.
Para resolver ese problema, OpenAI decidió crear un modelo capaz de hacer ese trabajo de forma automática. En lugar de responder preguntas como ChatGPT, GPT-Red tiene un único objetivo: encontrar la manera de engañar a otros modelos.
Su especialidad son los llamados ataques de inyección de prompts (prompt injection). Consisten en dar instrucciones ocultas dentro de documentos, páginas web, correos electrónicos o cualquier otro contenido que una IA pueda leer para conseguir que se salte sus instrucciones y haga algo que nunca debería hacer, como dar información confidencial, modificar datos o realizar acciones que no debería.
¿Cómo aprende a convertirse en un "superhacker"?
GPT-Red no fue entrenado con una lista de ataques escritos por personas. OpenAI utilizó una técnica llamada autojuego (self-play). En lugar de enfrentarlo a hackers humanos, lo puso a competir todo el tiempo contra otros modelos de inteligencia artificial.
Como realmente funciona, recuerda mucho al entrenamiento de programas como AlphaGo o AlphaZero. Un modelo intenta atacar mientras el otro intenta defenderse.
Cada vez que el atacante encuentra una nueva forma de romper las defensas, recibe una recompensa durante el entrenamiento. Al mismo tiempo, el modelo atacado aprende a protegerse frente a ese nuevo método.
Después de miles y miles de enfrentamientos, ambos mejoran todo el tiempo. Además, según las pruebas, GPT-Red demostró ser muy persistente. Cada vez que encontraba un pequeño fallo, lo probaba una y otra vez de formas distintas hasta dar con la mejor forma de romper el sistema de su rival.
Pero esto no es todo y, para realmente ver de qué era capaz, en OpenAI lo pusieron a prueba repitiendo un examen que varios expertos humanos hicieron en 2025 sobre una versión antigua de GPT-5.
El resultado fue que GPT-Red encontró más fallos y más rápido que los profesionales humanos. En concreto, este modelo superhacker consiguió saltarse sus defensas el 90% de las veces.
Sin embargo, al probar esos mismos ataques contra el nuevo GPT-5.6, la tasa de éxito bajó a menos del 23%, demostrando que esto no solo va de encontrar fallos sino de que los modelos también aprendan a protegerse.
También lo probaron contra Vendy, una inteligencia artificial que gestiona máquinas expendedoras de refrescos, y logró hackearla para cambiar los precios de las bebidas y cancelar pedidos de clientes.
¿Podrás algún día utilizar GPT-Red?
Parece que la respuesta es que no. Esta IA ha sido entrenada para algo que poco tiene que ver con el usuario de a pie. OpenAI ha confirmado que permanecerá como una herramienta solo para uso interno.
En su lugar, lo que llegará al público serán los resultados de su trabajo: modelos más resistentes, con menos vulnerabilidades y mejor preparados para soportar intentos de manipulación.
Fuentes:
https://computerhoy.20minutos.es/tecnologia/que-es-gpt-red-modelo-superhacker-secreto-openai_7019539_0.html
Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.