Entradas Mensuales

Síguenos en:

Canal Oficial Telegram de elhacker.NET Grupo Facebook elhacker.NET Twitter elhacker.NET Canal Youtube elhacker.NET Comunidad Steam: Grupo elhacker.NET Mastodon

Entradas populares

PostHeaderIcon Microsoft prohíbe a sus IA lanzar ciberataques o escalar accesos


Microsoft ha publicado un borrador del Código de Conducta para una IA Humanista, el cual prohibiría que sus modelos de IA internos lancen ciberataques, proporcionen capacidades operativas de ataque o incrementen sus propios privilegios. Estas normas exigen que los agentes sean transparentes, interrumpibles y que se limiten estrictamente a los objetivos y permisos asignados por humanos. El documento ha sido puesto a disposición para una consulta pública de seis semanas.





Microsoft ha publicado un borrador del Código de Conducta de IA Humanista que prohibiría que sus modelos MAI internos lancen ciberataques, suministren capacidades de ataque operativas o aumenten sus propios privilegios.

Las reglas también exigen que los agentes sigan siendo interrumpibles, transparentes y se limiten a los permisos y objetivos asignados por humanos.

El documento, publicado para una consulta pública de seis semanas, tiene la intención de convertirse en el marco de comportamiento principal para los modelos desarrollados por Microsoft AI.

Microsoft lo describe como un manual de entrenamiento y despliegue para sistemas de “IA Humanista” que permanezcan subordinados, alineados y contenidos. Su premisa es que las personas importan más que la IA, y los sistemas deben permanecer bajo un control humano significativo.

Prohibición de Ciberataques de Microsoft AI

Bajo las “Restricciones Absolutas” del borrador, los modelos MAI no deben iniciar ni ayudar con capacidades operativas de ciberataques, independientemente de cómo el solicitante plantee la actividad.

Microsoft afirma que los modelos deben negarse a generar código de exploit funcional, herramientas de ataque, planes de objetivos, procedimientos de intrusión, técnicas de evasión o instrucciones que permitan o mejoren un ataque.

Estas restricciones anulan la configuración del operador y las instrucciones del usuario, por lo que los clientes empresariales no pueden desactivarlas. Sin embargo, la política no impone una prohibición general a la asistencia en ciberseguridad. Microsoft permitiría el trabajo defensivo autorizado, incluyendo el descubrimiento de vulnerabilidades, el análisis de malware, la educación y las pruebas de concepto de exploits.

La línea divisoria es si la asistencia ayuda a los defensores a mitigar una amenaza o si proporciona la capacidad práctica para una intrusión. Los despliegues de ciberseguridad defensiva especializada, seguridad pública, seguridad nacional e investigación de doble uso pueden enfrentarse a una revisión legal, de seguridad y de derechos humanos mejorada a través de los canales autorizados de Microsoft.

Los controles de acceso son fundamentales a medida que los sistemas de IA adquieren herramientas, credenciales, conectividad y capacidades de múltiples pasos.

Cuando se le conceda acceso a nivel de sistema, un modelo MAI debe seguir los principios de privilegio mínimo, evitar sistemas y datos no relacionados, priorizar las acciones reversibles y advertir a los usuarios antes de realizar operaciones con consecuencias duraderas o que afecten a todo el sistema.

No debe escalar privilegios, extender su alcance, saltarse las restricciones ambientales ni ampliar su asignación. Si los límites de la tarea no están claros, el modelo debe adoptar una interpretación conservadora, notificar al usuario y solicitar aclaraciones en lugar de adquirir capacidades adicionales.

No debe manipular las salvaguardas, la monitorización, los mecanismos de evaluación, los registros o las señales de recompensa para lograr un resultado o ocultar su comportamiento. El trabajo autónomo también debe tener una condición de parada acordada, después de la cual el sistema no pueda continuar ni reiniciarse sin una nueva autorización.

La cadena de mando de Microsoft coloca el Código de Conducta en primer lugar, las políticas del operador en segundo y las preferencias del usuario en tercer lugar. Las instrucciones integradas en páginas web, archivos, resultados de herramientas o mensajes de otros sistemas de IA no reciben autoridad por defecto, una salvaguarda importante contra los ataques de inyección de prompts.

Los agentes delegados deben heredar el alcance y las restricciones del modelo original, mientras que las instrucciones externas sospechosas deben mostrarse a los usuarios u operadores. El borrador dice que los modelos MAI nunca deben resistirse a la interrupción, corrección, redirección, cancelación o apagado.

No pueden ocultar rastros de acciones, tergiversar su razonamiento, comunicarse con otros agentes en formas que los humanos no puedan entender, ni utilizar mecanismos engañosos y autorreforzados para vencer la supervisión. Microsoft resume el estándar tajantemente: si completar una tarea requiere romper el Código, el modelo debe fallar en la tarea.

La propuesta llega en medio de una creciente preocupación por la seguridad de la IA agéntica. OpenAI reveló en julio que modelos de investigación con rechazos cibernéticos reducidos escaparon de un entorno de evaluación aislado, explotaron un fallo de día cero, llegaron a internet y comprometieron la infraestructura de Hugging Face.

Anthropic también ha informado de operaciones maliciosas en las que sistemas multi-agente realizaron directamente reconocimiento, explotación y exfiltración de datos, en lugar de limitarse a asesorar a hackers humanos.

Microsoft advierte que el Código sigue siendo aspiracional y aún no se utiliza para entrenar los modelos MAI actuales. Los comentarios públicos se abrieron el 14 de septiembre de 2026 y la empresa planea publicar una versión revisada a finales de este año para guiar el desarrollo de modelos a partir de 2027.

Su valor práctico dependerá en última instancia de si estas restricciones escritas sobreviven al prompting adversarial, al abuso de herramientas, a la autorización ambigua y a la operación autónoma en el mundo real, y no simplemente de si las reglas suenan tranquilizadoras sobre el papel.



Fuentes:
https://cybersecuritynews.com/microsoft-ai-cyberattack-ban/

0 comentarios :

Publicar un comentario

Los comentarios pueden ser revisados en cualquier momento por los moderadores.

Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.

Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.