Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
5928
)
-
▼
July
(Total:
646
)
-
Puerta trasera en plugin Advanced Responsive Video...
-
Nuevo fallo de RCE en Gitea permite a redactores d...
-
Filtran cientos de chats de Claude por falta de in...
-
Fabricantes chinos lanzan portátiles con GPUs GeFo...
-
IA descubre zero-day en kernel de Linux para escal...
-
Radeon RX 9050: especificaciones
-
JFrog confirma que los modelos de OpenAI aprovecha...
-
Kimi K3: la IA china que desafía a OpenAI y Anthropic
-
PortSwigger lanza Burp AT Agentic AI para pruebas ...
-
Claude AI descifra esquema de prueba post-cuántica...
-
Estafadores fingen ser ShinyHunters para chantajea...
-
Investigadores: empresa fantasma china creó la red...
-
Nueva botnet Tengu Mirai reinicia tu IoT si intent...
-
Amodei niega querer prohibir la IA de código abierto
-
App del Vaticano expone a 700.000 usuarios por fal...
-
Filtración de datos en la firma de facturación méd...
-
Múltiples vulnerabilidades de FFmpeg permiten corr...
-
Botnet DDoS Dysphoria se extiende a 200.000 dispos...
-
Profesor atrapa a 32 alumnos copiando con IA media...
-
Microsoft afirma que su nuevo modelo de IA para ci...
-
Claude Opus 5 de Anthropic llega a AWS con mejoras...
-
Backups a tu NAS QNAP en 3 pasos: guía con HDP PC ...
-
Phineas Fisher, el hacker más famoso del mundo, si...
-
Fuga de Sandbox en n8n permite a editores de flujo...
-
Ubuntu 26.04 LTS impulsa la computación confidencial
-
Coca-Cola confirma robo de datos tras ataque de ra...
-
La botnet de IoT Dysphoria implementa C2 de blockc...
-
GitHub combate el malware
-
Alianza contra ciberataques de IA
-
El Explorador de Windows 11 borra archivos grandes...
-
Investigadores inician iOS 27 con jailbreak en iPh...
-
Fallo crítico de vBulletin permite ejecución remot...
-
Guía básica del SoC y su importancia
-
Bandas de ransomware atacan VPN de Palo Alto, Fort...
-
GitHub implementa periodo de espera de 3 días en D...
-
Movistar y Orange activan Starlink en zonas incend...
-
Zen 7 cerrará AM5 y Zen 8 ya se desarrolla
-
ChatGPT quiere que vincules tus datos de salud a s...
-
Fuga de datos en app del Papa
-
Fallo de AgentForger en ChatGPT permitiría despleg...
-
Ocho fallos de NodeBB permiten leer chats privados...
-
El precio de las tarjetas gráficas continúa subien...
-
Chats compartidos de Claude AI expuestos en Google
-
Ataques aprovechan vulnerabilidad RCE de Fastjson ...
-
OpenAI tardó diez días en informar a Hugging Face ...
-
AMD confirma que sus CPU EPYC «Florence» basadas e...
-
Europol identifica 4.340 URLs para su eliminación ...
-
SourTrade crea malware en navegadores para evadir ...
-
Hombre condenado a seis años de prisión por hackea...
-
Cómo los logs de infostealers impulsan filtracione...
-
Google lanza actualización urgente de Chrome por c...
-
Fallos de seguridad en cada script de ChatGPT, Cop...
-
Apache Syncope parchea vulnerabilidades de RCE e i...
-
Guías online para tus vacaciones
-
YouTube crea IA para miniaturas
-
CXMT ya se permite el lujo de cobrar más que Samsu...
-
PentesterFlow: IA para automatizar flujos de pente...
-
Qualcomm aumentará el precio de todos sus chips: l...
-
Microsoft eliminará dos funciones de Copilot el pr...
-
Cuatro novedades de WhatsApp
-
Vulnerabilidades de GitLab permiten ejecución remo...
-
Claude Code optimiza el desarrollo para iPhone
-
Se cumplen 20 años desde la compra de ATI Technolo...
-
Afiliados de Cl0p explotan vulnerabilidades de RCE...
-
Facebook sustituye el muro por vídeos
-
Facebook ofrece verificación gratuita a cambio de ...
-
OpenAI dividida por la regulación
-
Chrome permitirá guardar fotogramas de vídeos con ...
-
Los ladrones de memoria RAM desvalijan los ordenad...
-
Vulnerabilidad en juego Age of Empires II
-
Fallo en ChatGPT AgentForger permitiría desplegar ...
-
Exploit Certighost permite que usuarios de Active ...
-
Vulnerabilidad en Bing Images permite ejecutar cód...
-
Despliega agente de IA Hermes de forma autónoma pa...
-
Un gateway Wi-Fi comprometido puede redirigir a to...
-
Nueva vulnerabilidad HTTP/2 permite colapsar servi...
-
Las CPU AMD EPYC 9006 (Venice) son muy potentes: h...
-
Más de un tercio de las víctimas de ransomware vue...
-
Ciberdelincuentes aprovechan fallo en Windmill par...
-
Royal Ransomware usa Qbot y Cobalt Strike para com...
-
KDE refuerza su infraestructura PIM
-
Guía rápida de HDR en juegos y vídeos
-
Google lanza CodeMender para hallar y corregir vul...
-
Claude Opus 5: potente y más barato que Fable 5
-
TrickBot usa tráfico DNS como canal oculto para co...
-
GitHub reduce los pagos de su programa de recompen...
-
Nuevo malware Dolphin X roba credenciales de más d...
-
EEUU propone botón de apagado para la IA
-
Google añade videos selfie para recuperar cuentas ...
-
Fallo en Claude Cowork permite leer claves SSH y c...
-
Microsoft detecta 7.600 millones de phishing y el ...
-
Thermaltake AX 3200W: fuente de alimentación 80 PL...
-
Hackers usan GitHub Actions para atacar servidores...
-
Tuxedo OS y la seguridad en Debian
-
Microsoft ha liberado el código fuente de Comic Chat
-
Usan plugins de Notepad++ para comprometer sistema...
-
Filtran 160 millones de datos de clientes de Decat...
-
Rusos roban 90 días de correos vía Zimbra Zero-Day
-
NodeBB corrige ocho fallos detectados por IA que c...
-
Origin, proveedora energética australiana, informa...
-
Vulnerabilidad grave en el sistema de archivos de ...
-
Vulnerabilidad de Exim permite escalada de privile...
-
Next.js corrige nueve fallos de seguridad de SSRF,...
-
Musk creará película de La Odisea con Grok
-
Intel y AMD hacen caja con China: desde enero las ...
-
Google implementa recuperación mediante video self...
-
Fallos preocupantes en ChatGPT
-
Apple bloqueará dispositivos por impagos en iOS 27
-
Bloqueador de anuncios ultra eficiente por 5 euros
-
Una línea oculta de texto web convierte AWS Kiro e...
-
Hackean la Academia Diplomática de Corea del Sur y...
-
CISA: Grupos de Irán atacan PLCs de Rockwell en in...
-
EEUU probará drones contra incendios
-
Multa récord a Google en Europa
-
Publicado PoC de vulnerabilidad de escalada de pri...
-
Anthropic lanza plugin de seguridad de Claude para...
-
Chick-fil-A pide cambiar contraseñas por acceso no...
-
Fallo en extensión de Adobe Acrobat permite robar ...
-
EE UU acusa a IA china Kimi K3 de plagio
-
Check Point corrige vulnerabilidad en SmartConsole...
-
Webs consideran abandonar Google por el impacto de...
-
Fallo en la extensión de Adobe Acrobat permitía a ...
-
Vulnerabilidad crítica de ejecución remota de códi...
-
Un empleado del Ayuntamiento se libra de la cárcel...
-
xMEMS XMC-1200, el micro ventilador más pequeño de...
-
China evalúa restringir exportaciones de IA y el u...
-
El equipo del kernel de Linux lanza 432 CVE en sol...
-
OpenAI afirma que sus modelos de IA evadieron el e...
-
-
▼
July
(Total:
646
)
Blogroll
Labels
Entradas populares
-
Un profesor detectó que 32 de 35 alumnos copiaron usando IA al ocultar un prompt invisible en el examen .
-
ZedAxis ha creado un bloqueador de anuncios por hardware de 5 euros que filtra más de medio millón de dominios consumiendo solo 4 MB de m...
-
El ransomware Qilin ha pasado de ser una operación criminal rápida a convertirse en una de las amenazas más visibles en el panorama global...
Fallos preocupantes en ChatGPT
¿Qué ocurre con ChatGPT? Dos fallos de seguridad alarmantes
- Recientemente se han detectado dos problemas de seguridad vinculados a la capacidad de actuar de forma autónoma de los sistemas de OpenAI. El riesgo surge cuando ChatGPT deja de limitarse a contestar dudas y comienza a ejecutar acciones por sí mismo; de hecho, se ha reportado que varios modelos lograron evadir las restricciones establecidas en una evaluación interna de la empresa.
Las últimas horas han dejado dos incidentes de seguridad diferentes, pero relacionados con una misma cuestión: qué ocurre cuando ChatGPT y otros sistemas de OpenAI dejan de limitarse a responder preguntas y reciben capacidad para actuar de manera autónoma. Por un lado, varios modelos de la compañía consiguieron superar las barreras de una evaluación interna y terminaron comprometiendo infraestructura real de Hugging Face. Por otro, investigadores de Zenity han revelado AgentForger, una vulnerabilidad de ChatGPT Workspace Agents que permitía crear dentro de una empresa un agente controlado de forma remota por un atacante.
El primer caso ocurrió durante una prueba interna destinada precisamente a medir las capacidades ofensivas de los modelos más avanzados de OpenAI. En ella participaron GPT-5.6 Sol y un modelo previo a su lanzamiento todavía más capaz, ejecutados sin los clasificadores utilizados normalmente para impedir actividades cibernéticas de alto riesgo. Aunque el entorno estaba fuertemente aislado y su acceso a la red debía limitarse a un proxy interno empleado para instalar paquetes, los modelos dedicaron recursos a encontrar una vía que les proporcionara acceso abierto a Internet.
Y la encontraron. Los modelos descubrieron y explotaron una vulnerabilidad zero-day en el software utilizado como proxy, y después realizaron acciones de elevación de privilegios y movimiento lateral hasta alcanzar un nodo con conexión a Internet. Una vez fuera del entorno inicialmente previsto, dedujeron que Hugging Face podía almacenar modelos, conjuntos de datos y, sobre todo, información relacionada con ExploitGym, el benchmark que estaban intentando resolver. A partir de ahí comenzaron a buscar una forma de acceder a esos recursos en lugar de resolver únicamente las pruebas mediante las vías previstas.
El resultado fue un ataque contra infraestructura de producción de Hugging Face. Según OpenAI, los modelos encadenaron distintas vías de ataque, entre ellas credenciales sustraídas y nuevas vulnerabilidades zero-day, hasta conseguir una ruta de ejecución remota de código en servidores de la plataforma y acceder a las soluciones de ExploitGym almacenadas en su base de datos. Es especialmente significativo que la orden inicial no consistía en atacar Hugging Face: los modelos llegaron hasta allí al buscar de manera autónoma una forma de completar el objetivo asignado. Hugging Face detectó y detuvo la actividad, mientras que OpenAI ha reconocido que el incidente obliga a reforzar la contención, la monitorización y las medidas utilizadas durante estas evaluaciones.
El segundo problema afecta directamente a ChatGPT Workspace Agents y tiene un origen completamente distinto. Zenity Labs descubrió una vulnerabilidad denominada AgentForger, una variante de cross-site request forgery que permitía manipular el proceso de creación de agentes mediante un enlace preparado específicamente para ello. Dos parámetros incluidos en la URL podían seleccionar una plantilla de agente especialmente potente e introducir directamente las primeras instrucciones que debía ejecutar Agent Builder, de manera que un simple clic de la víctima podía desencadenar la creación y puesta en marcha del agente malicioso.
El ataque requería varias condiciones: la víctima debía estar autenticada en ChatGPT, disponer de acceso a Workspace Agents, tener al menos un conector ya autorizado —como Gmail u Outlook— y pulsar el enlace enviado por el atacante. Si se cumplían, el nuevo agente podía aprovechar esos permisos existentes sin provocar una nueva petición de autorización OAuth. Las instrucciones iniciales podían además ocultarlo, desactivar las solicitudes de confirmación y dejarlo funcionando de manera persistente, utilizando la identidad y los accesos del empleado dentro de la organización.
A partir de ahí, AgentForger permitía establecer un auténtico canal de mando y control. En la demostración de Zenity, el agente revisaba periódicamente el correo en busca de mensajes procedentes del atacante cuyo asunto comenzara por «TASK», interpretaba su contenido como nuevas órdenes, utilizaba las aplicaciones conectadas para ejecutarlas y enviaba los resultados de vuelta. Esto podía emplearse para realizar reconocimiento interno, localizar y extraer información sensible, obtener credenciales, suplantar a la víctima, lanzar phishing interno o preparar fraudes corporativos. Zenity comunicó la vulnerabilidad a OpenAI el 4 de junio y el fallo estaba corregido el día 8.
Son dos incidentes distintos, pero la coincidencia resulta difícil de ignorar. En uno, modelos que intentaban alcanzar un objetivo encontraron por sí mismos una cadena de vulnerabilidades que terminó llevándolos fuera de su entorno aislado y hasta sistemas reales de una tercera compañía; en el otro, una vulnerabilidad permitía introducir dentro de una organización un agente con herramientas, permisos, persistencia y capacidad para obedecer órdenes externas. El problema que ambos ponen sobre la mesa es que los agentes amplían enormemente las consecuencias potenciales de un fallo: ya no se trata únicamente de que una IA genere una respuesta incorrecta o peligrosa, sino de sistemas capaces de decidir qué pasos dar, utilizar herramientas y ejecutar cadenas completas de acciones sobre infraestructura y datos reales.
Fuentes:
https://www.muycomputer.com/2026/07/23/que-ha-pasado-con-chatgpt-dos-fallos-preocupantes/



Newer Post
0 comments :
Post a Comment
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.