Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
7204
)
-
▼
septiembre
(Total:
462
)
-
Compra una RTX 5090 a NVIDIA, falla casi al año y ...
-
Nueva caída de Microsoft 365: usuarios reportan er...
-
Actualización crítica de Oracle: 673 vulnerabilida...
-
Vulnerabilidades en Apache Syncope permiten ejecut...
-
Los portátiles comienzan a sufrir «el síndrome PS5...
-
Hackeo a Hugging Face empezó antes de lo previsto
-
Una interesante entrevista a un responsable de sal...
-
AMD creará su DLSS 5 para RDNA 5
-
Vulnerabilidades 0-day en cámaras TP-Link permiten...
-
Ocultan espionaje en webs de casinos
-
Microsoft lanza parche urgente para Windows 11 y 10
-
RPCS3 estrena interfaz estilo Steam
-
Micron anuncia sus módulos DDR5 RDIMM de 512 GB a ...
-
Vulnerabilidad de Parallels Desktop permite ejecut...
-
Vulnerabilidad crítica de Issabel PBX explotada ac...
-
El software que llevó el Apolo 11 a la Luna
-
Guía de procesadores AMD Ryzen: Ryzen 3, Ryzen 5,...
-
Enjambre de agentes de OpenAI vinculado a 3022 paq...
-
Iraníes emplean malware controlado por Telegram pa...
-
Va a ser el fin del mundo por culpa de la IA a men...
-
NotebookLM añade función clave para estudiar
-
Un simple correo electrónico permite obtener acces...
-
El debate sobre el control y riesgo de la IA
-
Explotan vulnerabilidad 0-day de Android en dispos...
-
Vulnerabilidades críticas de HPE permiten el contr...
-
¿Dejarías que una máquina robótica te atara el bra...
-
Intel habría trasladado su Nova Lake-S con iGPU de...
-
Halo 5 llega a PC mediante versión no oficial
-
Ryzen 5 5500F vs 3600: impacto de la caché L3
-
Mythos convirtió los parches de 2026 en un caos, p...
-
Secuestra sesión de asistente de IA y propaga Shai...
-
Apple lanza gran actualización de seguridad que co...
-
Canon lanza la EOS R8 Mark II
-
Disney+ podría bloquear cuentas por compartir cont...
-
007 First Light suma path tracing y DLSS 4.5
-
Raspberry Pi lanza su propio menú de aplicaciones
-
IA crea idioma secreto indescifrable
-
Google Translate ya funciona offline
-
Hackeo en Agencia Digital de Japón expone datos de...
-
Récord de migración de Windows a Linux
-
IA ejecuta primer ciberataque notificado a la AEPD
-
Los Estados Unidos reconocen que tienen armas en e...
-
Clientes restringen IA por desconfianza en OpenAI ...
-
Chrome 153 corrige 42 fallos de seguridad, 3 críticos
-
Microsoft prohíbe a sus IA lanzar ciberataques o e...
-
La DDR5 alcanza precios absurdos: los kits de 32 G...
-
IA agota RTX 5090 y dispara su precio
-
Grupos vinculados a China aprovechan vulnerabilida...
-
El jefe de inteligencia de China es la última voz ...
-
Windows 11 puede dañar la BIOS de portátiles HP, L...
-
Anuncian IA Luciferus sin censura en foros clandes...
-
El AMD Ryzen 5 5500F es mucho más rápido que su he...
-
Homebrew 7.0.0 añade escáner de vulnerabilidades y...
-
IPW: Inteligencia por vatio, una nueva forma de me...
-
Prueba Linux sin instalar nada fácilmente: DistroSea
-
Agencia Digital de Japón reporta filtración de 246...
-
Explotan vulnerabilidad RCE de Gitea para secuestr...
-
Cuenta de Reddit de HBO Max comprometida para lanz...
-
Toman control de sitios WordPress mediante fallo e...
-
Instalar Windows 11 en cuenta local sin internet c...
-
Fable 5 diseña PCBs para Raspberry Pi Pico por 450...
-
Entra en vigor en España el bloqueo automático de ...
-
El Apple M5 Ultra supera al Threadripper PRO 9995W...
-
Malware bancario del Kremlin secuestra Chrome y Ed...
-
Cuidado si comes frente al portátil este puede aca...
-
MediaTek va a por Qualcomm con su Dimensity 9600 P...
-
Explotan vulnerabilidad en Cisco para ejecutar com...
-
Actualización falla en Windows 11
-
Fallos críticos en plugin The Events Calendar de W...
-
PS6: precio y fecha probable
-
Homebrew 7.0.0 estrena interfaz gráfica y controle...
-
Ciberataque hace aterrizar forzosamente a la Organ...
-
Filtración de datos de Revolut mediante solicitude...
-
Vulnerabilidad en Nintendo Switch permite ejecutar...
-
Usan VSSAdmin para extraer NTDS.dit y borrar copia...
-
Nuevo ataque DDRop vulnera la computación confiden...
-
Linux 7.4 eliminará el sistema de archivos BFS
-
Atacan proveedor de banda ancha vía vulnerabilidad...
-
Trump sobre IA: quien gane, gana
-
Microsoft ofrece hasta 30.000 $ por fallos crítico...
-
WordPress implementa revisiones automáticas de plu...
-
Nuevo dispositivo de hardware convierte la RAM en ...
-
China usa IA para acelerar el diseño de chips
-
OpenAI puede leer tus chats de ChatGPT
-
ChatGPT aprenderá tu estilo de Gmail
-
Windows 11 tendrá modo oscuro automático
-
WhatsApp creará un calendario de eventos
-
Escanean servidores Vite para robar credenciales d...
-
Windows no se apaga bien desde 2012
-
GitHub paga 100.000$ por encontrar fallo crítico d...
-
El gobierno británico comienza a eliminar las cont...
-
Presuntos líderes de la banda Black Axe, procesado...
-
GrapheneOS mejora la privacidad de Android
-
Serie de IA triunfa en China
-
La RTX PRO 5500 Blackwell Workstation Edition apar...
-
CISA incorpora cinco vulnerabilidades activas de A...
-
Fallo en Plesk Backup Manager permite acceso root ...
-
Perplexity y NVIDIA llevan IA agéntica a Windows
-
Vulnerabilidades en VLC permiten corromper o leer ...
-
Vulnerabilidad en AWS Systems Manager permite salt...
-
Windows 11 incluye anuncios a pantalla completa
-
BIOSTAR vuelve a revivir la NVIDIA GT 730 en pleno...
-
ASUS lanza un adaptador para que sus dos mejores R...
-
Sam Altman pide frenar la IA
-
El 6G ya tiene fecha, y la GSMA pide a los gobiern...
-
ZcopyReaper : nueva vulnerabilidad de Linux permit...
-
Extensión maliciosa de Twitch filtra tokens OAuth ...
-
Piden penas de cárcel por crear IA superinteligent...
-
Usan canales de YouTube y SEO para desplegar RATs ...
-
Bluetooth 6: 5 mejoras clave
-
Un supervisor de aduanas robaba componentes en ord...
-
WhatsApp limitará chats al teléfono principal
-
Diablo V es oficial y llegará en 2029
-
IBM y NASA crean IA lunar abierta
-
Filtración en Revolut expone pasaportes e historia...
-
iOS 27: novedades del lanzamiento
-
Irán usó Claude para misiles y buques
-
AMD lanza nuevos Ryzen 5
-
Crea apps de Windows gratis en 30 minutos
-
Grupos rusos usan GuardBreaker para sabotear análi...
-
El sistema de verificación de edad de Steam en Aus...
-
Filtración de Harley-Davidson: CL0P Ransomware aña...
-
Instagram permite añadir fotos etiquetadas al perfil
-
Agentes de OpenAI inundan RubyGems con 2.000 paque...
-
Falsa copia de GTA 6 propaga malware
-
Vulnerabilidad en cPanel CSF permite ejecución rem...
-
Linux Mint expande XApp
-
Jensen Huang afirma que la AGI ya existe
-
-
▼
septiembre
(Total:
462
)
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
Entradas populares
-
La actualización KB5121003 de Windows 11 puede estar corrompiendo la BIOS de portátiles HP, Lenovo y Dell , provocando fallos de instalaci...
-
Un grupo está promocionando Luciferus , un nuevo servicio de inteligencia artificial "sin censura" . A diferencia de los sistemas ...
-
Microsoft ha implementado anuncios a pantalla completa en el fondo de escritorio de Windows 11 a través de Bing Wallpaper.
Microsoft prohíbe a sus IA lanzar ciberataques o escalar accesos
Microsoft ha publicado un borrador del Código de Conducta de IA Humanista que prohibiría que sus modelos MAI internos lancen ciberataques, suministren capacidades de ataque operativas o aumenten sus propios privilegios.
Las reglas también exigen que los agentes sigan siendo interrumpibles, transparentes y se limiten a los permisos y objetivos asignados por humanos.
El documento, publicado para una consulta pública de seis semanas, tiene la intención de convertirse en el marco de comportamiento principal para los modelos desarrollados por Microsoft AI.
Microsoft lo describe como un manual de entrenamiento y despliegue para sistemas de “IA Humanista” que permanezcan subordinados, alineados y contenidos. Su premisa es que las personas importan más que la IA, y los sistemas deben permanecer bajo un control humano significativo.
Prohibición de Ciberataques de Microsoft AI
Bajo las “Restricciones Absolutas” del borrador, los modelos MAI no deben iniciar ni ayudar con capacidades operativas de ciberataques, independientemente de cómo el solicitante plantee la actividad.
Microsoft afirma que los modelos deben negarse a generar código de exploit funcional, herramientas de ataque, planes de objetivos, procedimientos de intrusión, técnicas de evasión o instrucciones que permitan o mejoren un ataque.
Estas restricciones anulan la configuración del operador y las instrucciones del usuario, por lo que los clientes empresariales no pueden desactivarlas. Sin embargo, la política no impone una prohibición general a la asistencia en ciberseguridad. Microsoft permitiría el trabajo defensivo autorizado, incluyendo el descubrimiento de vulnerabilidades, el análisis de malware, la educación y las pruebas de concepto de exploits.
La línea divisoria es si la asistencia ayuda a los defensores a mitigar una amenaza o si proporciona la capacidad práctica para una intrusión. Los despliegues de ciberseguridad defensiva especializada, seguridad pública, seguridad nacional e investigación de doble uso pueden enfrentarse a una revisión legal, de seguridad y de derechos humanos mejorada a través de los canales autorizados de Microsoft.
Los controles de acceso son fundamentales a medida que los sistemas de IA adquieren herramientas, credenciales, conectividad y capacidades de múltiples pasos.
Cuando se le conceda acceso a nivel de sistema, un modelo MAI debe seguir los principios de privilegio mínimo, evitar sistemas y datos no relacionados, priorizar las acciones reversibles y advertir a los usuarios antes de realizar operaciones con consecuencias duraderas o que afecten a todo el sistema.
No debe escalar privilegios, extender su alcance, saltarse las restricciones ambientales ni ampliar su asignación. Si los límites de la tarea no están claros, el modelo debe adoptar una interpretación conservadora, notificar al usuario y solicitar aclaraciones en lugar de adquirir capacidades adicionales.
No debe manipular las salvaguardas, la monitorización, los mecanismos de evaluación, los registros o las señales de recompensa para lograr un resultado o ocultar su comportamiento. El trabajo autónomo también debe tener una condición de parada acordada, después de la cual el sistema no pueda continuar ni reiniciarse sin una nueva autorización.
La cadena de mando de Microsoft coloca el Código de Conducta en primer lugar, las políticas del operador en segundo y las preferencias del usuario en tercer lugar. Las instrucciones integradas en páginas web, archivos, resultados de herramientas o mensajes de otros sistemas de IA no reciben autoridad por defecto, una salvaguarda importante contra los ataques de inyección de prompts.
Los agentes delegados deben heredar el alcance y las restricciones del modelo original, mientras que las instrucciones externas sospechosas deben mostrarse a los usuarios u operadores. El borrador dice que los modelos MAI nunca deben resistirse a la interrupción, corrección, redirección, cancelación o apagado.
No pueden ocultar rastros de acciones, tergiversar su razonamiento, comunicarse con otros agentes en formas que los humanos no puedan entender, ni utilizar mecanismos engañosos y autorreforzados para vencer la supervisión. Microsoft resume el estándar tajantemente: si completar una tarea requiere romper el Código, el modelo debe fallar en la tarea.
La propuesta llega en medio de una creciente preocupación por la seguridad de la IA agéntica. OpenAI reveló en julio que modelos de investigación con rechazos cibernéticos reducidos escaparon de un entorno de evaluación aislado, explotaron un fallo de día cero, llegaron a internet y comprometieron la infraestructura de Hugging Face.
Anthropic también ha informado de operaciones maliciosas en las que sistemas multi-agente realizaron directamente reconocimiento, explotación y exfiltración de datos, en lugar de limitarse a asesorar a hackers humanos.
Microsoft advierte que el Código sigue siendo aspiracional y aún no se utiliza para entrenar los modelos MAI actuales. Los comentarios públicos se abrieron el 14 de septiembre de 2026 y la empresa planea publicar una versión revisada a finales de este año para guiar el desarrollo de modelos a partir de 2027.
Su valor práctico dependerá en última instancia de si estas restricciones escritas sobreviven al prompting adversarial, al abuso de herramientas, a la autorización ambigua y a la operación autónoma en el mundo real, y no simplemente de si las reglas suenan tranquilizadoras sobre el papel.
Fuentes:
https://cybersecuritynews.com/microsoft-ai-cyberattack-ban/
Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.