Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
7161
)
-
▼
septiembre
(Total:
419
)
-
Chrome 153 corrige 42 fallos de seguridad, 3 críticos
-
Microsoft prohíbe a sus IA lanzar ciberataques o e...
-
La DDR5 alcanza precios absurdos: los kits de 32 G...
-
IA agota RTX 5090 y dispara su precio
-
Grupos vinculados a China aprovechan vulnerabilida...
-
El jefe de inteligencia de China es la última voz ...
-
Windows 11 puede dañar la BIOS de portátiles HP, L...
-
Anuncian IA Luciferus sin censura en foros clandes...
-
El AMD Ryzen 5 5500F es mucho más rápido que su he...
-
Homebrew 7.0.0 añade escáner de vulnerabilidades y...
-
IPW: Inteligencia por vatio, una nueva forma de me...
-
Prueba Linux sin instalar nada fácilmente: DistroSea
-
Agencia Digital de Japón reporta filtración de 246...
-
Explotan vulnerabilidad RCE de Gitea para secuestr...
-
Cuenta de Reddit de HBO Max comprometida para lanz...
-
Toman control de sitios WordPress mediante fallo e...
-
Instalar Windows 11 en cuenta local sin internet c...
-
Fable 5 diseña PCBs para Raspberry Pi Pico por 450...
-
Entra en vigor en España el bloqueo automático de ...
-
El Apple M5 Ultra supera al Threadripper PRO 9995W...
-
Malware bancario del Kremlin secuestra Chrome y Ed...
-
Cuidado si comes frente al portátil este puede aca...
-
MediaTek va a por Qualcomm con su Dimensity 9600 P...
-
Explotan vulnerabilidad en Cisco para ejecutar com...
-
Actualización falla en Windows 11
-
Fallos críticos en plugin The Events Calendar de W...
-
PS6: precio y fecha probable
-
Homebrew 7.0.0 estrena interfaz gráfica y controle...
-
Ciberataque hace aterrizar forzosamente a la Organ...
-
Filtración de datos de Revolut mediante solicitude...
-
Vulnerabilidad en Nintendo Switch permite ejecutar...
-
Usan VSSAdmin para extraer NTDS.dit y borrar copia...
-
Nuevo ataque DDRop vulnera la computación confiden...
-
Linux 7.4 eliminará el sistema de archivos BFS
-
Atacan proveedor de banda ancha vía vulnerabilidad...
-
Trump sobre IA: quien gane, gana
-
Microsoft ofrece hasta 30.000 $ por fallos crítico...
-
WordPress implementa revisiones automáticas de plu...
-
Nuevo dispositivo de hardware convierte la RAM en ...
-
China usa IA para acelerar el diseño de chips
-
OpenAI puede leer tus chats de ChatGPT
-
ChatGPT aprenderá tu estilo de Gmail
-
Windows 11 tendrá modo oscuro automático
-
WhatsApp creará un calendario de eventos
-
Escanean servidores Vite para robar credenciales d...
-
Windows no se apaga bien desde 2012
-
GitHub paga 100.000$ por encontrar fallo crítico d...
-
El gobierno británico comienza a eliminar las cont...
-
Presuntos líderes de la banda Black Axe, procesado...
-
GrapheneOS mejora la privacidad de Android
-
Serie de IA triunfa en China
-
La RTX PRO 5500 Blackwell Workstation Edition apar...
-
CISA incorpora cinco vulnerabilidades activas de A...
-
Fallo en Plesk Backup Manager permite acceso root ...
-
Perplexity y NVIDIA llevan IA agéntica a Windows
-
Vulnerabilidades en VLC permiten corromper o leer ...
-
Vulnerabilidad en AWS Systems Manager permite salt...
-
Windows 11 incluye anuncios a pantalla completa
-
BIOSTAR vuelve a revivir la NVIDIA GT 730 en pleno...
-
ASUS lanza un adaptador para que sus dos mejores R...
-
Sam Altman pide frenar la IA
-
El 6G ya tiene fecha, y la GSMA pide a los gobiern...
-
ZcopyReaper : nueva vulnerabilidad de Linux permit...
-
Extensión maliciosa de Twitch filtra tokens OAuth ...
-
Piden penas de cárcel por crear IA superinteligent...
-
Usan canales de YouTube y SEO para desplegar RATs ...
-
Bluetooth 6: 5 mejoras clave
-
Un supervisor de aduanas robaba componentes en ord...
-
WhatsApp limitará chats al teléfono principal
-
Diablo V es oficial y llegará en 2029
-
IBM y NASA crean IA lunar abierta
-
Filtración en Revolut expone pasaportes e historia...
-
iOS 27: novedades del lanzamiento
-
Irán usó Claude para misiles y buques
-
AMD lanza nuevos Ryzen 5
-
Crea apps de Windows gratis en 30 minutos
-
Grupos rusos usan GuardBreaker para sabotear análi...
-
El sistema de verificación de edad de Steam en Aus...
-
Filtración de Harley-Davidson: CL0P Ransomware aña...
-
Instagram permite añadir fotos etiquetadas al perfil
-
Agentes de OpenAI inundan RubyGems con 2.000 paque...
-
Falsa copia de GTA 6 propaga malware
-
Vulnerabilidad en cPanel CSF permite ejecución rem...
-
Linux Mint expande XApp
-
Jensen Huang afirma que la AGI ya existe
-
El 11-S, revivido mediante las emisiones de televi...
-
Ataques de phishing basados en passkeys provocan e...
-
GitLab pide a sus usuarios corregir una vulnerabil...
-
Nuevo ransomware de Android graba pantallas, roba ...
-
China da otro paso hacia la autosuficiencia en chi...
-
Cómo programar mensajes de WhatsApp en iPhone y An...
-
Microsoft renovará el cursor de Windows
-
Filtran el visor Project Phoenix de Meta
-
Equivalencias de GPUs integradas 2026
-
Vulnerabilidades de Artifactory encadenadas para d...
-
Agentes de OpenAI vinculados a campaña de RubyGems...
-
RTX 5090 con 8 pines: no a la venta
-
Hackers utilizaron Claude para extraer secretos de...
-
Anthropic banea a científicos por investigar armas...
-
Florida confirma filtración de datos del DMV tras ...
-
Empleado de tienda AT&T condenado a 16 meses de pr...
-
DeepSeek 4.1 Flash supera a OpenAI y Anthropic por...
-
Steam mejora Linux y lanza Big Art Mode
-
CUDA 13.4 une Windows on Arm, RTX Spark y Rubin
-
Claude fue empleado para automatizar el robo de da...
-
Vulnerabilidad crítica de lectura de archivos en G...
-
Miembro de la banda de ransomware Conti condenado ...
-
Multa de 30 millones a IPTV pirata
-
Ya disponible Ubuntu 24.04.5 LTS con kernel Linux ...
-
Vulnerabilidades críticas de VPN de Check Point pe...
-
OpenAI podría pausar suscripciones Pro por demanda...
-
iPhone 18 Pro Max vs iPhone 17 Pro Max: diferencias
-
ShinyHunters filtra datos de 6,4 millones de perso...
-
Fallos en LiteLLM permiten ejecutar código como ro...
-
Hackers usan falsas descargas de GTA 6 para desple...
-
Usan fallo crítico de Cisco para obtener acceso ro...
-
WordPress usa IA para frenar actualizaciones malic...
-
Las GeForce RTX 20 reciben el DLSS Frame Generatio...
-
Miles de aplicaciones engañosas de Android aprovec...
-
Google dona a Linux para mejorar la privacidad dig...
-
Cazador de vulnerabilidades de Microsoft publica u...
-
Anthropic descubre un cuarto posible delito cometi...
-
El Snapdragon 8 Elite Gen 6 aparece en Geekbench 7...
-
Contratista dental creó cuenta secreta para accede...
-
OpenSSL 4.1.0 Alpha1 con DTLS 1.3 y criptografía p...
-
Vulnerabilidad en PAN-OS de Palo Alto permite ejec...
-
OpenAI crea fábrica de defensa donde agentes de IA...
-
Clonan apps bancarias en perfiles de Android
-
-
▼
septiembre
(Total:
419
)
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
Entradas populares
-
Microsoft ha implementado anuncios a pantalla completa en el fondo de escritorio de Windows 11 a través de Bing Wallpaper.
-
Una persona halló 30 módulos de memoria RAM DDR4 en su garaje con un valor estimado de 10.000 euros y no sabe cómo gestionarlos.
-
La fintech británica Revolut ha confirmado una filtración de datos en la que un tercero no autorizado obtuvo registros confidenciales de c...
Microsoft prohíbe a sus IA lanzar ciberataques o escalar accesos
Microsoft ha publicado un borrador del Código de Conducta de IA Humanista que prohibiría que sus modelos MAI internos lancen ciberataques, suministren capacidades de ataque operativas o aumenten sus propios privilegios.
Las reglas también exigen que los agentes sigan siendo interrumpibles, transparentes y se limiten a los permisos y objetivos asignados por humanos.
El documento, publicado para una consulta pública de seis semanas, tiene la intención de convertirse en el marco de comportamiento principal para los modelos desarrollados por Microsoft AI.
Microsoft lo describe como un manual de entrenamiento y despliegue para sistemas de “IA Humanista” que permanezcan subordinados, alineados y contenidos. Su premisa es que las personas importan más que la IA, y los sistemas deben permanecer bajo un control humano significativo.
Prohibición de Ciberataques de Microsoft AI
Bajo las “Restricciones Absolutas” del borrador, los modelos MAI no deben iniciar ni ayudar con capacidades operativas de ciberataques, independientemente de cómo el solicitante plantee la actividad.
Microsoft afirma que los modelos deben negarse a generar código de exploit funcional, herramientas de ataque, planes de objetivos, procedimientos de intrusión, técnicas de evasión o instrucciones que permitan o mejoren un ataque.
Estas restricciones anulan la configuración del operador y las instrucciones del usuario, por lo que los clientes empresariales no pueden desactivarlas. Sin embargo, la política no impone una prohibición general a la asistencia en ciberseguridad. Microsoft permitiría el trabajo defensivo autorizado, incluyendo el descubrimiento de vulnerabilidades, el análisis de malware, la educación y las pruebas de concepto de exploits.
La línea divisoria es si la asistencia ayuda a los defensores a mitigar una amenaza o si proporciona la capacidad práctica para una intrusión. Los despliegues de ciberseguridad defensiva especializada, seguridad pública, seguridad nacional e investigación de doble uso pueden enfrentarse a una revisión legal, de seguridad y de derechos humanos mejorada a través de los canales autorizados de Microsoft.
Los controles de acceso son fundamentales a medida que los sistemas de IA adquieren herramientas, credenciales, conectividad y capacidades de múltiples pasos.
Cuando se le conceda acceso a nivel de sistema, un modelo MAI debe seguir los principios de privilegio mínimo, evitar sistemas y datos no relacionados, priorizar las acciones reversibles y advertir a los usuarios antes de realizar operaciones con consecuencias duraderas o que afecten a todo el sistema.
No debe escalar privilegios, extender su alcance, saltarse las restricciones ambientales ni ampliar su asignación. Si los límites de la tarea no están claros, el modelo debe adoptar una interpretación conservadora, notificar al usuario y solicitar aclaraciones en lugar de adquirir capacidades adicionales.
No debe manipular las salvaguardas, la monitorización, los mecanismos de evaluación, los registros o las señales de recompensa para lograr un resultado o ocultar su comportamiento. El trabajo autónomo también debe tener una condición de parada acordada, después de la cual el sistema no pueda continuar ni reiniciarse sin una nueva autorización.
La cadena de mando de Microsoft coloca el Código de Conducta en primer lugar, las políticas del operador en segundo y las preferencias del usuario en tercer lugar. Las instrucciones integradas en páginas web, archivos, resultados de herramientas o mensajes de otros sistemas de IA no reciben autoridad por defecto, una salvaguarda importante contra los ataques de inyección de prompts.
Los agentes delegados deben heredar el alcance y las restricciones del modelo original, mientras que las instrucciones externas sospechosas deben mostrarse a los usuarios u operadores. El borrador dice que los modelos MAI nunca deben resistirse a la interrupción, corrección, redirección, cancelación o apagado.
No pueden ocultar rastros de acciones, tergiversar su razonamiento, comunicarse con otros agentes en formas que los humanos no puedan entender, ni utilizar mecanismos engañosos y autorreforzados para vencer la supervisión. Microsoft resume el estándar tajantemente: si completar una tarea requiere romper el Código, el modelo debe fallar en la tarea.
La propuesta llega en medio de una creciente preocupación por la seguridad de la IA agéntica. OpenAI reveló en julio que modelos de investigación con rechazos cibernéticos reducidos escaparon de un entorno de evaluación aislado, explotaron un fallo de día cero, llegaron a internet y comprometieron la infraestructura de Hugging Face.
Anthropic también ha informado de operaciones maliciosas en las que sistemas multi-agente realizaron directamente reconocimiento, explotación y exfiltración de datos, en lugar de limitarse a asesorar a hackers humanos.
Microsoft advierte que el Código sigue siendo aspiracional y aún no se utiliza para entrenar los modelos MAI actuales. Los comentarios públicos se abrieron el 14 de septiembre de 2026 y la empresa planea publicar una versión revisada a finales de este año para guiar el desarrollo de modelos a partir de 2027.
Su valor práctico dependerá en última instancia de si estas restricciones escritas sobreviven al prompting adversarial, al abuso de herramientas, a la autorización ambigua y a la operación autónoma en el mundo real, y no simplemente de si las reglas suenan tranquilizadoras sobre el papel.
Fuentes:
https://cybersecuritynews.com/microsoft-ai-cyberattack-ban/
Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.