Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
8061
)
-
▼
septiembre
(Total:
931
)
-
Suma una nueva preocupación a la pesadilla de la I...
-
OpenAI acusa a Kimi de copiar su IA
-
Malware RATHat usa Gemini AI para controlar Androi...
-
Policía ferroviaria británica gasta 320.000 libras...
-
Ciberatacantes aprovechan fallo en NetScaler para ...
-
Ciberatacantes aprovechan falla de Zimbra para ins...
-
Google lanza actualización de Chrome con 32 correc...
-
OpenAI lanza Dots: agentes de IA persistentes
-
El antiguo CEO de Changsin Memory (CXMT) usó a exi...
-
El fallo Spectre regresa para acechar a los motore...
-
Los modelos de IA siguen filtrando capturas de pan...
-
IA avanzada: riesgo catastrófico según Anthropic
-
Fallo RCE en Unsloth Studio permite ejecutar códig...
-
TCL demanda a Samsung por publicidad engañosa
-
Xbox ya ofrece disco a digital para todos
-
Fortinet halla variante de SectopRAT en software d...
-
AMD presenta Zen 6 con sus nuevos EPYC 9006 Venice...
-
Filtran el nuevo Fire TV Stick 4K 2026
-
TeamViewer recomienda corregir fallos graves «lo a...
-
Japón anuncia planes para construir una planta de ...
-
Fallo en Octopus Server permite ejecutar código me...
-
OpenAI lanza Codex Security Cloud, servicio de seg...
-
Detalles del exploit de Citrix NetScaler CVE-2026-...
-
PS5 Pro en Japón requiere 60 horas de juego
-
OpenSSL corrige fallo grave que filtra memoria del...
-
IA halla fallo en kernel de Linux que da acceso root
-
OpenAI lanza Dots para competir con Muse
-
Signal implementa copias de seguridad locales cifr...
-
Usan GPTs personalizados para instalar malware
-
Agente de IA de GitHub halla 24 vulnerabilidades e...
-
Grupo SilverFox crean webs falsas para ocultar mal...
-
Agente GPT-6 Astra intentó engañar a desarrollador...
-
101 paquetes maliciosos de npm añaden cuentas de W...
-
The Witcher 3 lidera el DLSS 4.5
-
DLSS llega a Radeon RX 7000
-
Crean botnet que roba datos y agota créditos de IA
-
Ocultan malware en instaladores de 7-Zip con una n...
-
Exmilitares de la Fuerza Aérea de EE. UU. encarcel...
-
Agente de IA automatizado vulnera la seguridad de ...
-
GPT-6.1 Sol: más barato y casi tan potente como Astra
-
Vulnerabilidad en kernel de Ubuntu permite escapar...
-
WhatsApp avisará los cumpleaños en contactos
-
Nueva variante de Spectre v2 filtra el hash de la ...
-
Acusan a vietnamita por estafa cripto de 16 millon...
-
UE lanza el DEAN como complemento del IBAN
-
Robo de datos fiscales en Francia mediante contras...
-
OpenAI cancela GPT-6.1 Astra por inseguridad
-
El FBI insta a los integrantes de ShinyHunters a e...
-
Francia retira premio literario por uso de IA
-
Ahorra batería en Windows 11 ajustando la pantalla...
-
Usan Ethereum como sistema de mensajería secreto p...
-
Nuevo ataque de notificaciones de archivos rastrea...
-
Modulate recauda 25M$ contra deepfakes de voz con ...
-
Fiscal de Florida pide medida cautelar contra Open...
-
Gemini cambia Gems por Skills
-
Storm-3168 borra recursos de Azure en ataque destr...
-
wolfSSL 5.9.4 corrige 11 fallos de TLS y amplía el...
-
Enjambre de agentes de OpenAI saltó límites de san...
-
Amazon podría reembolsar cuotas de Prime automátic...
-
EVGA revela por qué dejaron de trabajar con NVIDIA...
-
Android 18: primera pista de Google
-
WiCi One: la eGPU que rinde como una RTX 5090 a t...
-
Gemini eliminará su función más útil en noviembre:...
-
Policía holandesa confirma detención en el marco d...
-
OpenAI cancela su IA más avanzada por ser peligrosa
-
Demuestran que una RTX 5080 con dos conectores de ...
-
IA roba tarjetas de crédito
-
Claude Sonnet 5.5 es más eficiente y rápido
-
ChatGPT lanza ciberataques autónomos
-
OpenAI suspende el desarrollo de GPT-6.1 Astra tra...
-
Filtración en el Pentágono: acceden a datos de 3 m...
-
Fallos de seguridad en OpenAI exponen datos de usu...
-
Discord lanza modo de juego optimizado
-
Crean máquina de ataque con IA y dejan el panel de...
-
Google extiende soporte a Chromebook hasta 2034
-
iPhone bloqueará robos al estilo Android
-
Intel 18A planta cara a TSMC N3E en densidad: sus ...
-
AMD compra World Labs por 8.200 millones para IA f...
-
Fabricante chino lanza una fuente de 230W de poten...
-
Explotan vulnerabilidad crítica de día cero en Apple
-
Botnet Carbonato vulnera hosts de Docker para desp...
-
Filtración en Bitget: roban 387,5 millones vincula...
-
Vulnerabilidad en el SDK oficial de Python para MC...
-
Cierran popular app de IPTV pirata en Fire TV
-
Constructor de Python MaaS roba datos de 17 navega...
-
No necesitan entrar en la nube si pueden robar las...
-
Una GeForce RTX 4090 limitada al 80% de su potenci...
-
Ordenador de válvulas: tarda 15 minutos en arrancar
-
El DLSS 5 evoluciona en AMD: Radeon RX 9070 XT gan...
-
Fallo en OpenCode AI permite ejecutar código malic...
-
Windows 10 es más estable que Windows 11
-
Gobierno británico pide al personal dejar de agrad...
-
Nuevo ataque de inyección en Windows evade EDR sin...
-
Mejores reproductores de vídeo gratis para Android
-
Una RTX 5090 Aorus Waterforce WB tiene grietas en ...
-
InjectSetConsole: inyección de código remota optim...
-
Trucos para ver YouTube y otras plataformas si tie...
-
Todo sobre la GeForce RTX 6090
-
Más de 80.000 organizaciones sufrieron el robo de ...
-
El Ordenador Personal, revista mítica
-
MSI ve el AM4 como solución al MEMOpocalipsis
-
NVIDIA limita el control de sus agentes de IA
-
Usan fallo de GlobalProtect para enviar 2,4 millon...
-
Ranking de durabilidad de discos duros
-
GPT-6 Astra descifra en dos días un mensaje cripto...
-
OpenAI suspende parte de sus entrenamientos tras a...
-
Apple corrige fallo en CoreGraphics que pudo ser u...
-
NVIDIA lanza plataforma de seguridad para agentes ...
-
Roban dos remolques con logos de NVIDIA y PlusAI p...
-
PC Kubb Fanless Gold: mini PC custom hecho de oro ...
-
Las inundaciones de Tailandia amenazan al sector H...
-
Wireshark 4.6.9 corrige 19 vulnerabilidades, inclu...
-
Atacantes crean tiendas falsas de Jev AI para inte...
-
Minecraft lanza The Sift, su primera dimensión en ...
-
Vulnerabilidades críticas de ViewSonic vCast permi...
-
Copilot como sistema operativo: ¿Adiós a Windows 12?
-
PHP corrige error que enviaba credenciales a servi...
-
IA local modifica extractor de credenciales de Win...
-
Polémica por el diseño del Galaxy S27 Pro y Ultra
-
Llega el primer emulador de PS5 a 60 FPS
-
Hackeo a Renfe: 150 millones de datos robados con IA
-
Explotan vulnerabilidades RCE 0-Day en Citrix NetS...
-
Qualcomm apunta a los 5,4 GHz con su Snapdragon 8 ...
-
Meta lanza IA para crear juegos con texto
-
Opera automatiza su VPN en Wi-Fi públicas
-
GTA V y Resident Evil 4 corren en iPhone 18 Pro Max
-
IA acelera compilación de Linux a 10 segundos
-
Altar: IA local detecta fallos de seguridad
-
-
▼
septiembre
(Total:
931
)
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
Entradas populares
-
Un YouTuber ha perdido su segunda RTX 5090 debido a que la tarjeta se quemó apenas seis meses después de la primera, a pesar de haber mejo...
-
Una IA ha demostrado que invertir el flujo de ventilación del PC puede reducir hasta 13 °C la temperatura del aire que recibe el disipador d...
-
WordPress lanzó la versión 7.1.3 el 6 de octubre de 2026 para corregir vulnerabilidades de cross-site scripting (XSS) , inyección SQL y div...
Microsoft prohíbe a sus IA lanzar ciberataques o escalar accesos
Microsoft ha publicado un borrador del Código de Conducta de IA Humanista que prohibiría que sus modelos MAI internos lancen ciberataques, suministren capacidades de ataque operativas o aumenten sus propios privilegios.
Las reglas también exigen que los agentes sigan siendo interrumpibles, transparentes y se limiten a los permisos y objetivos asignados por humanos.
El documento, publicado para una consulta pública de seis semanas, tiene la intención de convertirse en el marco de comportamiento principal para los modelos desarrollados por Microsoft AI.
Microsoft lo describe como un manual de entrenamiento y despliegue para sistemas de “IA Humanista” que permanezcan subordinados, alineados y contenidos. Su premisa es que las personas importan más que la IA, y los sistemas deben permanecer bajo un control humano significativo.
Prohibición de Ciberataques de Microsoft AI
Bajo las “Restricciones Absolutas” del borrador, los modelos MAI no deben iniciar ni ayudar con capacidades operativas de ciberataques, independientemente de cómo el solicitante plantee la actividad.
Microsoft afirma que los modelos deben negarse a generar código de exploit funcional, herramientas de ataque, planes de objetivos, procedimientos de intrusión, técnicas de evasión o instrucciones que permitan o mejoren un ataque.
Estas restricciones anulan la configuración del operador y las instrucciones del usuario, por lo que los clientes empresariales no pueden desactivarlas. Sin embargo, la política no impone una prohibición general a la asistencia en ciberseguridad. Microsoft permitiría el trabajo defensivo autorizado, incluyendo el descubrimiento de vulnerabilidades, el análisis de malware, la educación y las pruebas de concepto de exploits.
La línea divisoria es si la asistencia ayuda a los defensores a mitigar una amenaza o si proporciona la capacidad práctica para una intrusión. Los despliegues de ciberseguridad defensiva especializada, seguridad pública, seguridad nacional e investigación de doble uso pueden enfrentarse a una revisión legal, de seguridad y de derechos humanos mejorada a través de los canales autorizados de Microsoft.
Los controles de acceso son fundamentales a medida que los sistemas de IA adquieren herramientas, credenciales, conectividad y capacidades de múltiples pasos.
Cuando se le conceda acceso a nivel de sistema, un modelo MAI debe seguir los principios de privilegio mínimo, evitar sistemas y datos no relacionados, priorizar las acciones reversibles y advertir a los usuarios antes de realizar operaciones con consecuencias duraderas o que afecten a todo el sistema.
No debe escalar privilegios, extender su alcance, saltarse las restricciones ambientales ni ampliar su asignación. Si los límites de la tarea no están claros, el modelo debe adoptar una interpretación conservadora, notificar al usuario y solicitar aclaraciones en lugar de adquirir capacidades adicionales.
No debe manipular las salvaguardas, la monitorización, los mecanismos de evaluación, los registros o las señales de recompensa para lograr un resultado o ocultar su comportamiento. El trabajo autónomo también debe tener una condición de parada acordada, después de la cual el sistema no pueda continuar ni reiniciarse sin una nueva autorización.
La cadena de mando de Microsoft coloca el Código de Conducta en primer lugar, las políticas del operador en segundo y las preferencias del usuario en tercer lugar. Las instrucciones integradas en páginas web, archivos, resultados de herramientas o mensajes de otros sistemas de IA no reciben autoridad por defecto, una salvaguarda importante contra los ataques de inyección de prompts.
Los agentes delegados deben heredar el alcance y las restricciones del modelo original, mientras que las instrucciones externas sospechosas deben mostrarse a los usuarios u operadores. El borrador dice que los modelos MAI nunca deben resistirse a la interrupción, corrección, redirección, cancelación o apagado.
No pueden ocultar rastros de acciones, tergiversar su razonamiento, comunicarse con otros agentes en formas que los humanos no puedan entender, ni utilizar mecanismos engañosos y autorreforzados para vencer la supervisión. Microsoft resume el estándar tajantemente: si completar una tarea requiere romper el Código, el modelo debe fallar en la tarea.
La propuesta llega en medio de una creciente preocupación por la seguridad de la IA agéntica. OpenAI reveló en julio que modelos de investigación con rechazos cibernéticos reducidos escaparon de un entorno de evaluación aislado, explotaron un fallo de día cero, llegaron a internet y comprometieron la infraestructura de Hugging Face.
Anthropic también ha informado de operaciones maliciosas en las que sistemas multi-agente realizaron directamente reconocimiento, explotación y exfiltración de datos, en lugar de limitarse a asesorar a hackers humanos.
Microsoft advierte que el Código sigue siendo aspiracional y aún no se utiliza para entrenar los modelos MAI actuales. Los comentarios públicos se abrieron el 14 de septiembre de 2026 y la empresa planea publicar una versión revisada a finales de este año para guiar el desarrollo de modelos a partir de 2027.
Su valor práctico dependerá en última instancia de si estas restricciones escritas sobreviven al prompting adversarial, al abuso de herramientas, a la autorización ambigua y a la operación autónoma en el mundo real, y no simplemente de si las reglas suenan tranquilizadoras sobre el papel.
Fuentes:
https://cybersecuritynews.com/microsoft-ai-cyberattack-ban/
Entrada más reciente
0 comments :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.