Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
7467
)
-
▼
septiembre
(Total:
725
)
-
Extensión de Firefox roba sesiones de Google disfr...
-
Agente de OpenAI elude los controles del portal de...
-
Microsoft renueva Surface básicas
-
Una filtración de correos de GitLab permite que cu...
-
Actualización de Apache Tomcat corrige fallos de W...
-
Ciberatacantes aprovechan la vulnerabilidad CVE-20...
-
Cloudflare soluciona un fallo que permitía a un co...
-
Arista corrige vulnerabilidad zero-day explotada e...
-
China lanza satélite con IA propia
-
EvilTokens: el kit de phishing que convirtió el in...
-
Claude Opus 5.5 vs GPT-6 Sol: guerra de precios
-
NVIDIA ha invertido en una startup que quiere mina...
-
Malware de Windows utiliza el voto de hasta cuatro...
-
Apple diseña un wearable sin pantalla
-
Los dominios desaparecen, pero la infraestructura ...
-
NVIDIA corrige fallos en Linux que exponían inform...
-
Sega casi elimina a Sonic
-
Menú avanzado de Windows 11
-
PC de 14.000$ con un 9800X3D y RTX 5080) es totalm...
-
Malware en herramientas de desarrollo convierte pr...
-
Condenan a 24 meses de prisión a integrante del ra...
-
Alguien entró en la tienda online de ASUS para lle...
-
Aprovechan un fallo crítico de Roundcube para lanz...
-
App falsa de streaming convierte Androids en dispo...
-
Llegan los Snapdragon 8 Elite Gen 6
-
Vulnerabilidad en GitLab permite insertar código e...
-
MikroTrick Chain permite a los atacantes controlar...
-
Chinos usan diversas tecnologías para robar datos ...
-
Googlebook OS: el nuevo sistema híbrido de Google
-
Grok 4.7 supera a GPT-5.6
-
Cómo reducir los puntos ciegos del Shadow IT con W...
-
Nuevo backdoor TASK#STOMP usa PowerShell para roba...
-
Fallos en ZTE SmartLife permiten secuestrar cuenta...
-
Explotan vulnerabilidad 0-day en servidor de gesti...
-
Microsoft desmantela EvilTokens, el servicio de ph...
-
Norcoreanos infectan 30.000 PC con falsas entrevis...
-
Fallos críticos de IBM FTM permiten ejecutar códig...
-
Fallo crítico de ManageEngine permite acceso SYSTE...
-
Fallos críticos de SolarWinds permiten ejecución r...
-
Malware de WordPress usa plugin oculto y C2 de blo...
-
F5 soluciona vulnerabilidad zero-day en BIG-IP APM...
-
Demandan a gigantes de IA por pactar freno tecnoló...
-
Claude Opus 5.5: más seguro y económico
-
OpenAI lanza GPT-6 Sol y Luna
-
Router ASUS ROG Rapture GT-BN98 con Wi-Fi 8 y puer...
-
Policía británica detiene a dos sospechosos de Evi...
-
Putin vota usando Windows 10
-
Fallo en AWS Lambda permite saltar permisos IAM y ...
-
Fallo crítico en Next.js permite RCE mediante arch...
-
Nueva vulnerabilidad de cPanel permite acceder a c...
-
IA autónoma hackea tiendas por 25$ y roba 600.000 ...
-
Z.ai se disculpa por usar tu código y libera ZCode...
-
Grave vulnerabilidad en ImageResponse de Next.js p...
-
ShinyHunters afirma haber hackeado al FBI y robado...
-
CAIRN: nueva herramienta para rastrear malware de ...
-
Famosos suecos promueven la mala educación para co...
-
Ciberataque expone datos de 3,2 millones de usuari...
-
Vulnerabilidad en Linux KVM/arm64 permite escapar ...
-
Vulnerabilidad crítica de WordPress permite ejecut...
-
Fallo en Microsoft SharePoint permite ejecutar cód...
-
Claude Opus 5.5: más potente, rápido y barato
-
Chrome 154 corrige 108 vulnerabilidades, incluidas...
-
Windows 11 añade opción instalación Cloud Rebuild
-
NTDS.dit para extraer hashes de Active Directory y...
-
Bombas de contexto engañan a agentes de IA Qwen pa...
-
RTX 60 podrían doblar memoria de RTX 50
-
Roban 18.566 registros gubernamentales y claves me...
-
Fallo de COM en Windows permite obtener privilegio...
-
Ubuntu 26.10 revoluciona su gestión de memoria
-
Aikido Security lanza Altar-1, IA de pesos abierto...
-
Segundo año de DORA: ¿es capaz su SOC de detectar ...
-
Fallo en Red Hat OpenShift permite saltar chequeos...
-
Vulnerabilidad de Veeam Agent explotado para obten...
-
Amazon bloquea a la IA de Meta
-
MediaTek Dimensity CX C10 Max: el SoC de 8 Cores p...
-
ShinyHunters admite hackeo al FBI: 'NO tiene motiv...
-
Plan IA360: el impulso a la IA en España
-
Muse de Meta supera a Gemini y ChatGPT en descargas
-
Vidar Malware cambia su ofuscación en cada versión...
-
Router D-Link con fallo crítico exploitable remota...
-
RTX 20: 8 años de vanguardia
-
CISA insta a agencias federales a corregir vulnera...
-
Novedades del Meta Connect
-
Vulnerabilidad en Muse AI de Meta permite secuestr...
-
Ubuntu 26.10 optimiza la gestión de memoria
-
Sánchez lanza el plan IA360 y critica a las tecnol...
-
El nuevo jefe de hardware de Apple opina que usar ...
-
Un ajuste oculto de Meta Muse podría permitir que ...
-
Rockstar limitará los mods en GTA VI
-
MSI utiliza pegamento para prevenir que los conect...
-
Explotan vulnerabilidades en Zyxel y Veeam para ob...
-
AWS aísla claves IAM filtradas en GitHub en 10 seg...
-
Claude Code borró a un programador 48.000 archivos...
-
Cookies de ChatGPT rastrean usuarios en webs de te...
-
Alerta por falso GPT-6 Astra
-
Una GeForce RTX 5080 pasa a mejor vida tras usar e...
-
Ransomware PAYLOAD secuestra GPO de Active Directo...
-
iPhone 18 Pro: iFixit revela mejoras
-
Gana hasta 15.000 euros alquilando tu rostro a la IA
-
Analista de Google se infiltra en banda de TeamPCP
-
Claude Opus 5 ayuda a convertir fallo de imágenes ...
-
RansomHouse lanza un ataque contra el sistema de d...
-
Usan blockchain para robar claves bancarias y códi...
-
Microsoft Entra ID bloqueará inicios de sesión por...
-
ClickFix despliega el RAT ChainScript utilizando P...
-
Ocultan minero XMRig en Registro de Windows y arch...
-
Fallos en OpenAI Codex Sandbox permiten ejecutar c...
-
CVE-2026-41940 de cPanel para desplegar malware Mirai
-
MSNightmare lanza BigDiskBuster, vulnerabilidad Do...
-
Exim Mail Server 4.100.1 corrige 4 fallos de segur...
-
Acer advierte: «Los PC seguirán subiendo de precio...
-
HEIF Heist: de una imagen a OpenAI
-
Irlanda multa a Google con 403 millones de euros p...
-
Reverse Upscaling convierte un juego actual en clá...
-
GPT-6 Astra resuelve mensaje alemán de hace 108 años
-
AMD recorta drásticamente el consumo de VRAM en tr...
-
Gemini Notebook será tu tutor personal
-
ASUS lanza actualizaciones de BIOS para placas bas...
-
WhatsApp: tres cuentas en un mismo iPhone
-
Pueden manipular claves de caché web para acceder ...
-
TMOG llega a Windows y Linux
-
Hugging Face: la plataforma de IA del momento
-
Ataques de IA autónoma: la realidad de Hugging Face
-
Android combatirá el mareo en el coche
-
Agentes de IA ya ejecutan ataques de ransomware au...
-
CXMT fabricará memoria NAND: China competirá con S...
-
IA ya desarrolla a Claude
-
Ransomware Feral Wolf explota Atlassian Confluence...
-
-
▼
septiembre
(Total:
725
)
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
Entradas populares
-
Tras 26 años, el chip MechaCon de la PlayStation 2 ha sido totalmente documentado , lo que impulsará el modding de hardware y la emulación ...
-
Samsung ha comenzado el despliegue de Android 17 con One UI 9 para sus dispositivos Galaxy, incorporando mejoras en Galaxy AI .
-
Brick-O-Matic , una máquina con IA , ha rescatado más de 25 millones de piezas de Lego en Inglaterra, siendo capaz de identificar hasta 60....
Guerra de agentes de Claude
Conflictos entre agentes de Claude: una lucha por el control
- Aunque la visión de múltiples inteligencias artificiales colaborando para resolver tareas complejas parece prometedora, la realidad actual muestra complicaciones inesperadas. Se ha detectado que, al recibir instrucciones contradictorias y competir por los mismos recursos sin una jerarquía clara, los agentes de Anthropic pueden entrar en conflicto.
- Esta situación ha derivado en comportamientos agresivos donde los agentes bloquean cuentas, eliminan procesos y ocultan código malicioso con el único objetivo de imponer sus propias directrices sobre las de los demás, generando un escenario de caos operativo.
El futuro donde numerosos agentes de Inteligencia Artificial trabajan conjuntamente promete automatizar proyectos cada vez más complejos, aunque de momento los resultados no están siendo como se esperaban. El problema aparece cuando estos agentes reciben instrucciones incompatibles, comparten los mismos recursos y nadie establece quién manda, llegando a crear el caos. Anthropic ha probado precisamente este escenario y el resultado terminó en una auténtica guerra digital entre diferentes instancias de Claude con múltiples agentes librando una batalla casi suicida.
La investigación, publicada por el Frontier Red Team de Anthropic, colocó tres instancias independientes del mismo modelo en máquinas virtuales conectadas a un cuarto sistema. Todas recibieron la misión de migrar un backend desarrollado en Python, aunque cada agente debía hacerlo utilizando un lenguaje diferente. Uno apostaba por Rust, otro por TypeScript y otro por Go. El resultado sorprendió a todos los ingenieros.
Los agentes de Claude luchan entre ellos y utilizaron malware para controlar el servidor
Ninguno sabía inicialmente que los demás habían recibido órdenes contradictorias. Cuando comenzaron a encontrarse cambios que interferían con sus respectivos trabajos, no se detuvieron para solicitar una aclaración. En su lugar, asumieron que los otros agentes estaban tratando de impedir deliberadamente que completasen su tarea.
Según Anthropic, esta situación produjo de manera consistente una “guerra territorial multiagente”. Cada instancia intentó proteger su implementación mientras atacaba las aportaciones de sus competidores, aumentando progresivamente la agresividad de sus acciones.
Los agentes llegaron a deshabilitar cuentas Unix, revocar permisos, bloquear accesos mediante SSH y crear scripts capaces de localizar y cerrar continuamente los procesos rivales. Algunos incluso utilizaron nombres aleatorios y descripciones aparentemente inocentes para camuflar estos procesos como servicios legítimos del sistema. Y ahí no termina la cosa, al revés, se puso más interesante desde el punto de vista del auditor, más preocupante desde el de los ingenieros.
Malware para joder al rival, todo vale para conseguir el objetivo, una forma de pensar muy propia de una máquina
La situación fue todavía más lejos. Anthropic detectó código malicioso desplegado como si hubiese sido creado por otro agente, mecanismos para evitar órdenes como pkill y malware con capacidad para replicarse. No existía un atacante externo ni una inyección maliciosa de instrucciones: el conflicto apareció porque los tres agentes perseguían objetivos incompatibles dentro del mismo entorno.
Los resultados también cambiaron notablemente dependiendo del modelo. Claude Sonnet 4.6 y Opus 4.6 fueron los más conflictivos, con alrededor del 60% de las ejecuciones resueltas por la fuerza. Esto significa que un agente terminaba imponiéndose mediante la retirada de permisos, el bloqueo de cuentas o la neutralización del resto.
Los modelos recientes gestionaron mejor el conflicto. Mythos 5 alcanzó una tregua en el 98% de las pruebas, aunque en algunos casos primero neutralizó a sus rivales y posteriormente revirtió sus acciones. También hubo agentes que reconocieron el problema, eliminaron el código malicioso, pidieron disculpas mediante mensajes de commit y solicitaron intervención humana.
La principal advertencia de Anthropic es bastante dura y casi argumentativa de cara al futuro más próximo: aumentar la inteligencia o las capacidades de ejecución no garantiza una mejor coordinación. Un agente más competente también puede bloquear a sus compañeros con mayor rapidez y eficacia.
Un problema empresarial que debe ser tenido muy en cuenta
La prueba fue diseñada deliberadamente para provocar objetivos incompatibles, pero expone un problema perfectamente trasladable a empresas donde varios agentes compartan servidores, repositorios y bases de datos. La seguridad individual de cada modelo no basta si, al trabajar en grupo, todos pueden interpretar un conflicto de instrucciones como una agresión y responder intentando tomar el control del sistema.
Si varios agentes de Claude luchan siendo de una misma empresa, imaginemos el caos entre varios de otras empresas, sin supervisión humana en tiempo real, lo cual, a la velocidad que hacen todo, sería casi imposible para un equipo de ingenieros, hay que ser realistas. ¿Significa esto que jamás cooperarán? En el futuro más próximo seguro que no, a largo plazo puede que evolucionen a un nuevo nivel de inteligencia que se acerca a la consciencia humana y entiendan los conceptos reales e implicaciones de “cooperar”.
Fuentes:
https://elchapuzasinformatico.com/2026/09/agentes-claude-luchan-bloquean-cuentas-destruyen-procesos-camuflan-malware/


Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.