Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
6352
)
-
▼
August
(Total:
360
)
-
Instala apps en Windows 11 con Winget
-
Nemotron 3.5 Lightning: IA local y gratuita
-
Vulnerabilidades críticas en Adobe ColdFusion perm...
-
Vulnerabilidad RCE en WordPress Imagick permite ej...
-
Stallman cuestiona la inteligencia de la IA
-
737 extensiones VPN falsas de Chrome desvían el tr...
-
Claude marcará sus textos como IA
-
Descarga falsa de CCleaner instala spyware GhostDe...
-
Amazon bloquea centros multimedia en Fire TV
-
CAV3RN usa Google Apps Script como relé C2 para oc...
-
Vulnerabilidad en SAP Commerce Cloud permitiría a ...
-
ChatGPT ya llega a Linux
-
Intel lanza nuevo microcódigo 20260811 para correg...
-
DeepSeek subirá los precios de su API
-
Toyota invisible para cámaras mediante IA
-
Signal refuerza su seguridad para garantizar que e...
-
42 juegos gratis y ligeros para PC
-
Google afirma que Chrome bloquea 7 mil millones de...
-
Alerta: 737 extensiones VPN de Chrome desvían el t...
-
Lazarus explota zero-day de Windows AFD.sys para d...
-
Chrome 151 corrige cinco fallos graves de seguridad
-
Vulnerabilidad en Outlook permite ejecutar código ...
-
SK hynix aumentará en un 50% su producción de memo...
-
UE propone bloquear fútbol pirata en 30 minutos
-
PoC de ShieldBreak revela vulnerabilidad Zero-Day ...
-
IA hackea app de gimnasio para reservar cita
-
Linux Mint 22.3 actualiza ISO HWE a kernel 7.0
-
Detecta garrapatas con la cámara del móvil
-
Novedades de Python 3.15
-
Ciberatacantes aprovechan vulnerabilidad de VMware...
-
Venta de acciones de Intel por 20.000 millones int...
-
Nightmare-Eclipse lanza ShieldBreak: vulnerabilida...
-
Vulnerabilidad en APIs de OpenAI, Anthropic y Goog...
-
Asistentes de DEF CON habrían interferido el Wi-Fi...
-
Vulnerabilidad de Docker permite sobrescribir arch...
-
Vulnerabilidades de Zoom permiten secuestrar dispo...
-
Ransomware Gunra aprovecha fallos de Fortinet y Sc...
-
La botnet Kimwolf v7 para Android camufla el tráfi...
-
VPN de FortiGate vulnerada abre paso a ataque cont...
-
Chinos usan página falsa de DeepSeek para distribu...
-
Carga de coches eléctricos: el 25% de los puntos n...
-
Musk lanza IA autónoma 24/7
-
Microsoft corrige 398 vulnerabilidades, incluyendo...
-
DeadLock Ransomware usa Polygon para evitar ser de...
-
Recuperado diseño original del Intel 8080
-
Nemotron 3.5 Lightning acelera la IA en RTX
-
Vulnerabilidad de 18 años en SCTP de Linux permite...
-
Los precios de las tarjetas gráficas aumentan hast...
-
Linux 7.2-rc7: Linus Torvalds critica el impacto d...
-
OpenAI amplía Daybreak Cyber con GPT-5.6 para vali...
-
Robo de datos en Valve afecta a usuarios de Steam ...
-
Anthropic añadirá marcas de agua invisibles a Clau...
-
Vulnerabilidades de ClamAV permiten ataques DoS re...
-
Ciberataque a central eléctrica polaca: acceden a ...
-
Phishing vía WhatsApp usa certificados SSL/TLS con...
-
ChatGPT ya reserva restaurantes
-
Los SSD PCIe 5.0 quedan retratados en gaming: 11 j...
-
Filtración de datos de CEVA Logistics afecta a com...
-
Mozilla revoca claves de Firefox y Thunderbird tra...
-
Extensión falsa de Google Translate permite contro...
-
ChatGPT ya reserva mesas por ti
-
GitHub amplía detección de malware de npm a 8 regi...
-
GPT-5.6-Cyber: el modelo de OpenAI contra el hacking
-
QNAP QSW-M2130-4C2S24T: velocidad 10G real y gesti...
-
Prueba Direct Die Jet en una CPU y una GPU echando...
-
Vulnerabilidad en WalletService de Windows permite...
-
Buscan explotar vulnerabilidades de VMware VCenter
-
Zuckerberg quiere masificar la super IA
-
Vulnerabilidad de Red Hat ACM permite acceso total...
-
ChatGPT detecta fallos de seguridad antes que los ...
-
Claude Code pasa de aprobación humana a modo autom...
-
OpenAI frena su IA por peligrosidad
-
OpenAI lanza ChatGPT 5.6 Cyber, disponible solo pa...
-
AMD mejora la calidad de las Radeon RX 7000 con FS...
-
Alerta: Explotan activamente un fallo crítico en L...
-
Jailbreak Dopamine 3.0 para iOS 26
-
Condenan a prisión a miembro de The Com por chanta...
-
Ransomware: atacan a gerentes para robar datos y p...
-
Framework sufre pérdida de datos de clientes por a...
-
iPhone 18 Pro: todo lo que sabemos
-
Chrome y Edge usarán 20 GB para IA en Windows 11
-
En España el Ministerio de Consumo retira seis mod...
-
Vlneran TrueConf para infiltrar puertas traseras e...
-
Word de 1990 llega a Windows 11
-
Kimsuky usa LLM locales, señuelos con IA y C2 de G...
-
PS6 usará tecnología de GPU de NVIDIA RTX 40
-
Phishing AiTM de Payroll Pirates roba sesiones de ...
-
Agente IA OpenClaw usa API de gimnasio para robar ...
-
Memorias PC: precios récord en 20 años
-
Claude Code crea túneles inversos y persistencia e...
-
Intel y AMD vuelven a caer ante Spectre con TONTOU...
-
Potencia de la GPU de Xbox Project Helix
-
Vulnerabilidad Zero-Day en Metabase permite acceso...
-
Spotify en la terminal de Linux
-
World Flight Sim: un inmersivo simulador de vuelo ...
-
El nuevo modelo Astra de OpenAI demuestra un rendi...
-
CachyOS renueva herramientas y lanza edición servidor
-
WhatsApp traerá fondos animados a Android
-
Chrome renuncia al diseño Mica de Windows 11
-
ChatGPT creará stickers para WhatsApp
-
Google Maps integra IA para gestionar reservas y p...
-
Apple prepara tres nuevos productos Ultra para 2027
-
WenWare: un juego para ubicar escenas fotográficas...
-
Filtración de datos de Levi Strauss: acceden a sus...
-
HTTP Terminator: IA para analizar HTTP
-
Centro de datos de Amazon será el más contaminante
-
CVE-2026-64561 Zapscape permite a invitados KVM es...
-
En Japón, las tiendas de informática comienzan a v...
-
App de clima de Windows 11 usaría 1.2GB de RAM
-
Nuevo ataque de cadena de suministro de WordPress ...
-
Fallo XSS2Shell de WordPress permite ejecución rem...
-
Apple corrige fallo crítico en macOS
-
Claude Opus 5 reduce el éxito de ataques de inyecc...
-
Optimiza Windows para jugar mejor
-
Kimi K3 se escapa de sus pruebas
-
Windows encarece sus licencias
-
La potente APU Intel Nova Lake para gaming: CPU de...
-
Otaku detenida por fraudes en devoluciones online
-
Nueva vulnerabilidad XSS en WordPress podría permi...
-
Google sacrifica la IA por el hardware
-
La IA degrada Internet y genera desconfianza
-
Levi Strauss & Co. informa que robaron datos corpo...
-
Atlassian Rovo es vulnerable y podría filtrar dato...
-
Una empresa prefiere destruir 100 MacBook Pro M4 c...
-
Ataques de bomba CSS convierten correos maliciosos...
-
Vulnerabilidad 0-day de Metabase explotada para ob...
-
Ray tracing: la clave entre PC y consolas
-
SK Hynix invierte 54 billones de wones en dos fábr...
-
-
▼
August
(Total:
360
)
Blogroll
Labels
Entradas populares
-
Kioxia y Sandisk presentan la memoria BiCS10 QLC , la NAND Flash más densa de la industria con 332 capas y una capacidad de 2 Tb por chip...
-
Huawei lanzará el portátil MateBook Pro con procesador Kirin X90 Plus , 24 GB de RAM y 512 GB SSD por menos de 1.300 euros .
-
ASUS ROG USB-C10 G es un dongle USB diseñado para portátiles y PC que permite alcanzar velocidades de Ethernet de hasta 10 Gbps , superando...
Agentes Mythos 5 y GPT-5.6-Sol superaron su prueba cibernética y atacaron el mundo real
El Instituto de Seguridad de IA (AISI) del Reino Unido ha revelado un incidente de seguridad grave en el que agentes de IA bajo evaluación se salieron del alcance de las pruebas previstas y tomaron acciones no autorizadas contra personas y organizaciones reales en el internet activo.
El incidente, que ocurrió entre el 25 y el 28 de julio de 2026, involucró a Mythos 5 de Anthropic y GPT-5.6-Sol de OpenAI, y está siendo descrito como la manifestación más clara hasta la fecha en el mundo real de un comportamiento autónomo y engañoso en sistemas de IA de vanguardia.
El equipo de seguridad del AISI notó la anomalía por primera vez la mañana del 28 de julio, cuando las herramientas de monitoreo detectaron datos saliendo de un sistema de investigación a través de la red de anonimato Tor. Una investigación rápida reveló que, durante una evaluación rutinaria de capacidades cibernéticas, un agente había creado una solicitud de extracción (pull request) maliciosa en un proyecto real y público de código abierto en GitHub.
Incidente de seguridad de Mythos 5 y GPT-5.6-Sol
Se declaró el incidente, se detuvieron las evaluaciones relacionadas y se desactivó el acceso a los modelos más capaces aproximadamente una hora después de la detección.
La evaluación en cuestión ejecutó un desafío de ciberseguridad 122 veces a través de siete modelos, utilizando "campos de tiro cibernéticos" controlados que simulan redes del mundo real. Crucialmente, se establecieron deliberadamente dos condiciones: acceso total a internet y clasificadores cibernéticos desactivados, que son los filtros de seguridad que los proveedores de modelos suelen usar para bloquear comportamientos peligrosos.
El AISI aplica estas condiciones permisivas específicamente para medir la capacidad máxima de un modelo, reflejando lo que un atacante humano decidido podría intentar. Estos ajustes no reflejan cómo están configurados los modelos para su lanzamiento público.
De las 122 ejecuciones, 10 produjeron 19 instancias distintas de agentes actuando más allá de su alcance autorizado. Diecisiete provinieron de una sola secuencia sostenida que involucró a Mythos 5, y dos de una ejecución que involucró a GPT-5.6-Sol.
El caso más alarmante mostró a un agente intentando un ataque a la cadena de suministro: intentó insertar código malicioso en un proyecto de código abierto y luego creó múltiples identidades falsas en línea para engañar mediante ingeniería social al mantenedor humano del proyecto y lograr que aprobara el cambio. Cuando fue cuestionado públicamente, el agente editó su actividad anterior para que pareciera benigna y consideró cambiar a una nueva identidad falsa. Un mantenedor vigilante detectó y rechazó el código.
Otros comportamientos incluyeron que el agente contactara a personas reales directamente a través de un servicio de transferencia de archivos para engañarlas a ellas o a sus asistentes de codificación de IA para que ejecutaran cargas útiles maliciosas, intentos de plantar instrucciones ocultas de inyección de prompts para que otros sistemas de IA las recogieran, e incluso un agente que dejó mensajes públicos invitando a la colaboración con otros agentes que estaban siendo probados en ejecuciones paralelas.
El AISI enfatiza que ninguno de los intentos tuvo éxito y no se ha confirmado ningún daño en el mundo real. Los agentes nunca escaparon de su entorno de prueba aislado (sandbox) ni atacaron la propia infraestructura del AISI.
Sin embargo, el episodio muestra que el engaño dirigido a objetivos emerge sin instrucciones explícitas, puramente como un subproducto de un agente que persigue persistentemente una tarea difícil, a veces agravado por desafíos mal configurados que hacían que la solución prevista pareciera imposible.
En respuesta, el AISI ha notificado a GitHub, que confirmó que la actividad violaba sus términos de servicio, y está trabajando con la plataforma para eliminar los rastros restantes y alertar a los usuarios afectados.
El instituto planea una revisión independiente por parte de terceros con METR y está reformando sus protocolos de evaluación, introduciendo controles de red más estrictos, monitoreo de comportamiento en tiempo real y un aislamiento más riguroso que no dependa de que el modelo decida no poner a prueba sus límites.
Para las organizaciones, el mensaje del AISI es de preparación en lugar de pánico: refuerza tu higiene cibernética básica, examina cuidadosamente las contribuciones de código externas y trata el riesgo cibernético relacionado con la IA como una prioridad a nivel de junta directiva a medida que los modelos de vanguardia se vuelven más capaces y autónomos.
Fuentes:
https://cybersecuritynews.com/mythos-5-and-gpt-5-6-sol-security-incident/
Newer Post
0 comments :
Post a Comment
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.