Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
6627
)
-
▼
agosto
(Total:
635
)
-
Sony: los juegos digitales no son tuyos
-
AWS Network Firewall ya muestra el recuento de reg...
-
Fallo sin parchear en Calix permite a hackers salt...
-
DOOM 64 estrena trazado de trayectorias
-
Crisis de RAM hunde a marca de Linux Pine64
-
Falsa demo de GTA 6 es malware que roba contraseña...
-
Ciberatacantes aprovechan fallos de miniOrange SAM...
-
Fallo crítico en Red Hat Keycloak permite tomar cu...
-
AliExpress es señalada por rastrear usuarios media...
-
Una página web maliciosa podría contaminar tu mode...
-
IA china crea vídeos desde PowerPoint
-
Investigador revela cinco vulnerabilidades crítica...
-
Vulnerabilidades en TP-Link Archer permiten ataque...
-
Suplantan a ReliaQuest para robar credenciales SSO...
-
Anthropic lanza autenticación empresarial para con...
-
Radeon RX 10800 XT: posibles especificaciones y pr...
-
Resultados de Google de Minecraft llevaron a malware
-
Atacan sitios de WordPress mediante vulnerabilidad...
-
Explotan vulnerabilidad de Zimbra Collaboration Suite
-
AMD desbloquea el rendimiento de los Ryzen 7000 y ...
-
Pagos de WhatsApp llegan a España
-
DIGI duplica gratis su fibra a 2 Gbps en España
-
Intel vuelve al Top 10 de las CPU más vendidas en ...
-
IA escribe un tercio de la web
-
Noruega limita la IA en colegios
-
Microsoft Teams ya permite a los administradores b...
-
Phishing de Teams usa SynkLoader para robar contra...
-
Por qué eliminaron 3D Pinball de Windows
-
NVIDIA planea invertir en Perplexity contra Google...
-
Vulnerabilidad en plugin de WordPress expone 100.0...
-
Nuevo modelo IA Ox Alpha: 100 billones de tokens g...
-
768 claves filtradas de AWS siguen activas con acc...
-
Fallo crítico en isolated-vm permite saltar sandbo...
-
Infectan pantallas de Android Auto vía actualizaci...
-
Demandan a Twitch y Amazon por uso de IA
-
Hugging Face exploraría venta de 13.000 millones t...
-
mVolt+ permite hacer que la GeForce RTX 5090 alcan...
-
Detecta qué consume recursos de tu PC Windows con ...
-
Proiraníes tumban central eléctrica británica en c...
-
Libros digitalizados para IA antes de su destrucción
-
Batería móvil: carga en 3 minutos y 60.000 ciclos
-
Google crea una IA que mide la grasa corporal con ...
-
Windows 11 mostrará el uso de IA en el Administrad...
-
Nuevo malware como servicio usa dominios de Adobe ...
-
Claude de Anthropic sufre otra caída con errores
-
Chinos usan IA para atacar servidores web
-
TikTok acuerda pagar 400 millones de dólares por d...
-
Cybermes: agente de IA para pentesting automatizado
-
Samsung dejará de actualizar estos Galaxy
-
Claude Opus 5 esquiva binarios ofuscados en vez de...
-
Fallo crítico en AIT-GUI de NASA permite enviar co...
-
G.SKILL indemniza a compradores de RAM DDR4 y DDR5...
-
App de ancho de banda convierte dispositivos en pu...
-
Kit de phishing de 10.000 dólares promete instalar...
-
pfSense CE 2.9.0: mejoras críticas de seguridad y ...
-
Malware en Android Auto se propaga mediante actual...
-
Estafadores usan grupos de WhatsApp para coordinar...
-
Un controlador de Microsoft Defender podría usarse...
-
Claude Mythos 5 ya disponible en Claude Security p...
-
DeepSeek lanza IA visual similar a Claude Opus
-
Microsoft duplica el almacenamiento de buzón a 100 GB
-
Filtración en Sakura Internet: hackean datos de 1,...
-
Proveedores confiables, nuevas rutas de ataque: có...
-
Por qué la IA opaca es el próximo gran desafío de ...
-
Paquetes populares de Rust con 244M de descargas i...
-
Slack integra Claude Code para programar
-
Desincronización CRLF permite envenenar caché de C...
-
Apple: descifran ubicaciones de Buscar personas en...
-
Explotan vulnerabilidad crítica en Microsoft Entra...
-
OpenAI ofrece retención cero de datos para modelos...
-
Fallo crítico de Spring Security permite acceso ad...
-
Explotan activamente la vulnerabilidad CVE-2026-19...
-
Controlador de Microsoft Defender puede desactivar...
-
Usan agentes de IA OpenClaw para difundir malware ...
-
Grave fallo en NetScaler permite saltar la autenti...
-
Usan Claude, ChatGPT y Copilot como cebo para malware
-
AWS: cómo evitar que un agente de IA secuestrado a...
-
AMD Zen: 10 años salvando a AMD
-
Vulnerabilidad de Cisco permite leer datos sensibles
-
Fallo crítico de SSRF en Kubernetes de Red Hat exp...
-
Ocultan malware en palabras inglesas para infectar...
-
OpenAI pausa entrenamiento de IA por riesgo de hal...
-
El ataque de tarjetas zombi puede reactivar tarjet...
-
Epic Games critica nuevas comisiones de App Store ...
-
Engañan a Grok para que ejecute instrucciones inye...
-
Saltan el MFA de Microsoft 365 y roban pagos vía e...
-
Nuevo malware de Android roba PINs bancarios y usa...
-
Equipo de T-Mobile corta cable para eliminar intru...
-
Zyxel corrige fallo de inyección de comandos en 18...
-
Explotan vulnerabilidad crítica de RCE en Zimbra
-
Claude AI halla fallos de SAML que permiten robo d...
-
OpenAI detiene el entrenamiento de RL de vanguardi...
-
Doom ya funciona en cámaras Canon
-
Publicidad en ChatGPT España
-
OpenAI frena entrenamiento de IA
-
Ataque Spectre en Cloudflare Workers filtra JWT de...
-
EE. UU. acusa a iraníes de robar propiedad intelec...
-
Fallo crítico de Citrix NetScaler permite saltar l...
-
T-Mobile cortó físicamente los cables de Internet ...
-
Cientos de claves de Stripe filtradas exponen pago...
-
OpenAI advierte sobre la atrofia cognitiva por el ...
-
Meta AI llega a Mac para competir con ChatGPT y Cl...
-
Los costes operativos de OpenAI subirán un 20 por ...
-
Anthropic frena su IA más potente por seguridad
-
Descubre la Dark y Deep Web
-
Vulnerabilidad crítica de día cero en Cursor permi...
-
Timo con discos de 32 TB: solo contenían una microSD
-
Meta a juicio por el impacto de sus redes en niños
-
Falla de Microsoft 365 afecta a Sudamérica
-
Usan guía falsa de Claude para desplegar MacSync S...
-
Microsoft vincula más de 30 dominios rotativos a l...
-
CISA añade vulnerabilidad RCE de Microsoft IKE exp...
-
Intel Core Ultra 9 4950K aparece en escena: la CPU...
-
Ransomware fingen ser empresa de recuperación y pi...
-
SIMs vulnerables: riesgo para móviles, coches y ca...
-
China-Nexus camuflan VHD malicioso como JPEG para ...
-
Hackean más de 14.500 dispositivos Dahua mediante ...
-
Herramienta RAVEN extrae bases de datos Elasticsea...
-
Alerta por ransomware Medusa: más de 500 organizac...
-
Oracle lanza 943 parches de seguridad, incluyendo ...
-
Campaña de espionaje SilkParasite ataca a gobierno...
-
Habilidades clave para programadores ante la IA
-
La memoria DDR4 experimentará una nueva subida de ...
-
GeForce Now ya disponible en Firefox
-
Seasonic tiene la primera fuente de alimentación A...
-
Projextor muestra cómo el malware se oculta tras e...
-
Anthropic lanza /design para flujos de UI de Claud...
-
Saltan MFA de Microsoft 365 y roban sesiones activas
-
-
▼
agosto
(Total:
635
)
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
Entradas populares
-
G.SKILL indemnizará a usuarios de RAM DDR4 y DDR5 tras un acuerdo de 2,4 millones de dólares por publicidad engañosa en las velocidades d...
-
Cómo tener dos cuentas a la vez de WhatsApp, Facebook o cualquier 'app' en el mismo teléfono. Parallel Space es una aplicación para...
-
Alerta por hackeo a Basic-Fit: casi un millón de clientes en Europa vieron expuestos sus datos personales y bancarios tras un ciberataque...
Investigadores chinos usan IA para entrenar drones y sistemas de combate
Investigadores vinculados al ejército chino están estudiando formas de convertir los resultados de sistemas de IA occidentales avanzados en modelos más pequeños y baratos para drones, herramientas de campo de batalla, trabajos cibernéticos y plataformas de seguridad pública.
La preocupación no es un único programa malicioso, sino una técnica que podría acelerar el desarrollo de sistemas de doble uso mientras se debilitan las salvaguardas integradas en los modelos originales.
Conocido como destilación, este método entrena a un modelo "estudiante" basándose en las respuestas producidas por un modelo "maestro" más capaz.
Se utiliza ampliamente en el desarrollo legítimo de la IA, pero la investigación revisada describe casos en los que podría usarse para copiar capacidades de razonamiento, eludir restricciones o ocultar el origen de las capacidades de un modelo.
Analistas de Jamestown señalaron en un informe que identificaron un conjunto de investigaciones académicas e industriales chinas publicadas entre 2024 y 2026 que apuntan a un trabajo deliberado en destilación adversarial.
Los artículos vinculan parte de esta investigación con el Ejército de Liberación Popular, universidades vinculadas a la defensa, institutos estatales y organizaciones de seguridad pública.
El problema tiene amplias implicaciones de seguridad ya que los modelos de IA se utilizan cada vez más para procesar inteligencia, guiar herramientas automatizadas, analizar código y apoyar la vigilancia.
Como muestran informes recientes sobre operaciones de intrusión impulsadas por IA en China, la IA ya se está convirtiendo en parte de los flujos de trabajo cibernéticos activos en lugar de seguir siendo una ayuda de investigación pasiva.
Investigadores Militares Chinos Utilizan la Destilación de IA
La revisión de Jamestown encontró que algunos investigadores vinculados al Ejército de Liberación Popular (PLA) se centran en extraer o reproducir los patrones de razonamiento de los principales modelos de IA cerrados.
Esos pasos de razonamiento intermedio pueden mejorar los resultados en programación, lógica y resolución de problemas, pero son costosos de desarrollar de forma independiente.
Un artículo de la Universidad de Ingeniería del Ejército propuso destilar conocimientos sobre cómo romper los mecanismos de seguridad de la IA en herramientas más pequeñas que podrían realizar ataques de forma continua.
Investigaciones independientes de equipos afiliados al PLA exploraron la creación de modelos proxy para ataques de caja negra y la creación de modelos más pequeños que resumieran código a un nivel cercano a GPT-3.5.
La investigación también cubre intentos de hacer que las capacidades copiadas sean más difíciles de identificar.
Un estudio que involucra a investigadores afiliados a unidades cibernéticas del PLA describió métodos destinados a eliminar marcas de agua preservando las capacidades del modelo maestro, mientras que otros trabajos buscaron reducir las señales que las defensas de seguridad utilizan para detectar modelos manipulados.
Estos hallazgos son importantes más allá de las disputas de propiedad de los modelos. Los riesgos de ataques de inyección de prompts que enfrentan los agentes de IA demuestran cómo los modelos pueden ser manipulados cuando instrucciones no confiables son tratadas como comandos legítimos, una debilidad que se vuelve más grave cuando los sistemas están integrados en entornos militares u operativos.
Vigilancia, Ciberseguridad y Salvaguardas
Los artículos revisados indican que los modelos destilados se están proponiendo o utilizando para vigilancia, seguridad pública, análisis de amenazas cibernéticas y tareas relacionadas con el mando militar.
Investigadores conectados a un instituto estatal de ciudades inteligentes describieron modelos de seguridad compactos para procesadores de borde en cámaras callejeras que podrían reconocer rostros entre multitudes en condiciones de poca luz.
Otro instituto dentro del mismo grupo estatal utilizó técnicas relacionadas en herramientas propuestas para la recopilación de inteligencia, detección de malware y rastreo de intrusiones cibernéticas.
Investigadores de la Universidad del Norte de China también describieron la destilación de Claude en un clasificador que podría apoyar el monitoreo de redes sociales y la moderación de contenidos.
La investigación militar también ha examinado la inyección de prompts multimodales, incluyendo experimentos que ocultaban instrucciones escritas dentro de imágenes de tanques y buques de guerra.
Los investigadores afirmaron que GPT-4o y versiones de Claude leyeron y siguieron el texto oculto, reforzando las preocupaciones sobre las instrucciones ocultas dirigidas a sistemas de IA que procesan imágenes y contenido externo.
Jamestown advirtió que los artículos disponibles públicamente probablemente revelan solo una parte de la actividad y pueden describir investigaciones completadas uno o dos años antes.
Si los modelos pueden destilarse sin marcas de agua detectables o rastros de razonamiento reconocibles, evaluar tanto las capacidades reales de los sistemas chinos como la exposición de los modelos occidentales será más difícil.
El informe recomienda separar la destilación normal de la actividad adversarial examinando las capacidades que se están copiando, las organizaciones involucradas y los esfuerzos para ocultar el origen de un modelo estudiante.
Los desarrolladores y los equipos de seguridad deben preservar la procedencia del modelo, monitorear patrones inusuales de extracción a gran escala y limitar las acciones de IA de alto impacto con controles y revisión humana.
La lección más amplia es que la seguridad de la IA ahora se extiende más allá de los fallos de software y el robo de datos.
El uso creciente de modelos en campañas vinculadas al estado, incluidas las redes de contratistas cibernéticos chinos, muestra por qué los gobiernos y las organizaciones necesitan evaluar cómo pueden combinarse las capacidades de la IA, la infraestructura y la intención operativa.
Fuentes:
https://cybersecuritynews.com/chinese-military-researchers-use-ai-distillation/
Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.