Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
6465
)
-
▼
August
(Total:
473
)
-
Publicado código de exploit para vulnerabilidad de...
-
Vulnerabilidad de Microsoft SCCM permite ejecutar ...
-
Dos empleados montaron su propia tienda de PC con ...
-
China abre bar geek con DeepSeek gratis
-
OpenAI elimina su equipo de riesgos catastróficos
-
Una IA vulneró el código de Snowflake y otro agent...
-
Vulnerabilidad en Forminator de WordPress permite ...
-
Conserva tu Fire TV pese a Vega OS
-
Caída de GitHub afecta a desarrolladores globales
-
Ya disponible nueva versión IA China: DeepSeek V4 Pro
-
Filtración de datos en Pokémon Center expone infor...
-
Ya disponible webmail Roundcube 1.6.18 y 1.7.3 con...
-
Amazon destruye libros para entrenar su IA
-
Philips, Shell y GE analizan posibles filtraciones...
-
Otro componente de PC subirá de precio: las placas...
-
Monit (monitorización completa) en OPNsense
-
Guía completa de Memoria RAM
-
Puerta trasera de Windows oculta dominio C2 en des...
-
Vulnerabilidad de Apple Screen Sharing permite eje...
-
Memoria DDR5 alcanza precio récord
-
Gusano ChainDrop de npm infecta 444 paquetes vía G...
-
Actor vinculado a China explota fallo de VMware vC...
-
Botnet Evooo1Bot usa 16 métodos DDoS y proxies SOC...
-
Linux 7.2 optimiza CPU, GPU, memoria y Btrfs
-
Microsoft prepara parche de Defender contra el zer...
-
Z.ai presenta GLM-5.3 con mejoras en programación ...
-
Microsoft refuerza Windows 11 con nuevo Defender
-
AMD prohibió enviar la Radeon RX 9050 para review ...
-
AWS dejará de validar certificados públicos por email
-
Microsoft fusiona Copilots en una superapp
-
GPMI: el rival chino del HDMI
-
Ataques DDoS a gran escala afectan el servicio de ...
-
IA de Microsoft supera a Claude Code en velocidad ...
-
LaLiga reactiva bloqueos a IPTV
-
Linus Torvalds critica duramente a Elon Musk
-
En China ya se ha vuelto común robar tarjetas gráf...
-
Robo de credenciales de Azure afecta a McDonald’s ...
-
EE. UU. obliga a elegir entre su IA o la de China
-
Google prueba IA en lugar del botón de búsqueda
-
Analista de datos condenado a prisión por robo de ...
-
Malware AmnesiaStealer roba sesiones de macOS medi...
-
Lip Bu-Tan pide el regreso de las memorias Intel
-
Malware HACKERAI usa GitHub Gists como canal de co...
-
Campaña de DCRat oculta malware en SVG mediante HT...
-
Microsoft cancela Mico
-
Los agentes de IA no se detienen si el malware fal...
-
Vulnerabilidad de pantalla compartida en macOS per...
-
SK hynix se queda sin SSD de remplazo para RMA: se...
-
Cuidado con esta falsa actualización de Chrome
-
Fallo desactiva WiFi de Chromecast con Google TV
-
Ataque Download More RAM evade VBS de Windows y de...
-
Empleados de OpenAI denuncian negligencia en segur...
-
Venden evasiones de Windows Defender, EDR y SmartS...
-
Vulneran correo gubernamental mientras ejecutan fr...
-
Botnet Aeternum usa contratos de Polygon para C2 r...
-
Usan MessiahGPT para crear ransomware y phishing
-
Steam en PS6: amenaza para Sony
-
Ciberdelincuentes aprovechan fallo en Screen Shari...
-
Memorando de Trump abre la puerta a que empresas e...
-
Mustang Panda integra un rootkit de Windows firmad...
-
Word facilita la búsqueda en documentos largos
-
Nueva botnet Evooo1Bot para Linux convierte router...
-
IA en Amazon perjudica a escritores humanos
-
Explotan fallo crítico de SAP Commerce Cloud sin P...
-
Shell investiga filtración de datos por ransomware...
-
Microsoft hará las llaves de acceso predeterminada...
-
GeForce Now ya es estable en Linux
-
Lumora: IPTV gratis para Android Auto
-
Google lanza Gemini especializado en programación
-
Creador del Administrador de Tareas de Windows lan...
-
Windows 11 ralentiza la apertura de VLC
-
Ventoy sustituye a Rufus para arrancar sistemas op...
-
Gemini ya elimina marcas de agua en fotos
-
ChatGPT copia función odiada Recall de Windows 11 ...
-
KDE retoma versiones LTS con Kubuntu
-
uBlock Origin critica duramente a Facebook
-
Gemini 3.7 Flash: IA premium más económica
-
Botnet Dysphoria convierte routers y cámaras en bo...
-
Vulnerabilidades de TP-Link permiten saltar autent...
-
Detenidos por fraude bancario de 30 millones de eu...
-
Filtran datos de 1,6 millones de cuentas de RingCe...
-
Hacienda francesa reconoce robo de datos tras anun...
-
pfSense Plus estrena nueva interfaz: ahora es much...
-
TV pierde 70 años de archivos por cierre de servidor
-
Sparky Linux recupera el soporte de 32 bits
-
Un atacante desconocido pasó un año vulnerando por...
-
AMD pide actualizar la BIOS de sus Ryzen por dos f...
-
Demuestran cómo utilizan dispositivos USB falsos p...
-
Nueva puerta trasera PATCHCORD ataca a telecomunic...
-
Twitch usa contenido de streamers para entrenar IA...
-
Intentan explotar vulnerabilidad zero-day en GeoSe...
-
ChatGPT es ahora mucho más rápido
-
Ucrania clausura 94 centros de llamadas fraudulent...
-
Apple insta a activar el modo de aislamiento ya
-
Nueva Zelanda denuncia que China intentó espiar su...
-
Ataque de DRAM expone zonas protegidas de la CPU
-
Estafadores clonan tarjetas contactless y autoriza...
-
Xbox Game Pass llegaría a Linux
-
Lazarus utiliza un Zero-Day de Windows para obtene...
-
Palo Alto Networks corrige 11 vulnerabilidades en ...
-
Samsung usa Claude Code para sus chips móviles
-
Gemini alcanza 1.000 millones de usuarios
-
GPT-5.6 resuelve conjetura matemática de hace 20 años
-
¿Qué es el símbolo 5G+ en el móvil?
-
Manjaro 26.1: Linux 7.1, Plasma 6.7 y GNOME 50
-
Claude marca sus contenidos con huellas invisibles
-
Android con refrigeración líquida: un móvil hecho PC
-
Fallo en Windows permite control remoto del PC
-
Expectativas Made by Google
-
Ciberatacantes aprovechan vulnerabilidad de autent...
-
Akira Ransomware usa el modo seguro de Windows par...
-
Vulnerabilidades críticas de Adobe Commerce permit...
-
Snapdragon C: portátiles realmente baratos
-
Instala apps en Windows 11 con Winget
-
Nemotron 3.5 Lightning: IA local y gratuita
-
Vulnerabilidades críticas en Adobe ColdFusion perm...
-
Vulnerabilidad RCE en WordPress Imagick permite ej...
-
Stallman cuestiona la inteligencia de la IA
-
737 extensiones VPN falsas de Chrome desvían el tr...
-
Claude marcará sus textos como IA
-
Descarga falsa de CCleaner instala spyware GhostDe...
-
Amazon bloquea centros multimedia en Fire TV
-
CAV3RN usa Google Apps Script como relé C2 para oc...
-
Vulnerabilidad en SAP Commerce Cloud permitiría a ...
-
ChatGPT ya llega a Linux
-
Intel lanza nuevo microcódigo 20260811 para correg...
-
DeepSeek subirá los precios de su API
-
Toyota invisible para cámaras mediante IA
-
-
▼
August
(Total:
473
)
Blogroll
Labels
seguridad
(
1691
)
vulnerabilidad
(
1681
)
software
(
992
)
hardware
(
890
)
google
(
764
)
Malware
(
708
)
privacidad
(
659
)
ransomware
(
529
)
Windows
(
521
)
android
(
462
)
exploit
(
456
)
linux
(
415
)
cve
(
374
)
tutorial
(
300
)
nvidia
(
298
)
manual
(
282
)
hacking
(
251
)
ssd
(
181
)
WhatsApp
(
173
)
ddos
(
139
)
Wifi
(
131
)
app
(
127
)
cifrado
(
121
)
twitter
(
121
)
programación
(
114
)
youtube
(
82
)
herramientas
(
80
)
firefox
(
77
)
firmware
(
74
)
Networking
(
73
)
sysadmin
(
72
)
adobe
(
68
)
office
(
62
)
hack
(
51
)
antivirus
(
50
)
Kernel
(
49
)
javascript
(
48
)
apache
(
46
)
juegos
(
42
)
contraseñas
(
39
)
multimedia
(
36
)
cms
(
35
)
flash
(
33
)
eventos
(
32
)
MAC
(
30
)
anonymous
(
28
)
ssl
(
24
)
conferencia
(
21
)
Forense
(
20
)
SeguridadWireless
(
17
)
documental
(
17
)
auditoría
(
15
)
Debugger
(
14
)
Rootkit
(
14
)
lizard squad
(
14
)
metasploit
(
13
)
técnicas hacking
(
13
)
Virtualización
(
11
)
delitos
(
11
)
reversing
(
10
)
adamo
(
9
)
Ehn-Dev
(
7
)
antimalware
(
7
)
MAC Adress
(
6
)
oclHashcat
(
5
)
Entradas populares
-
Un actor de amenazas apodado "TheHatman" está llevando a cabo una extensa campaña de exfiltración de datos de Azure en la dark w...
-
Apple ha lanzado una nueva serie de alertas de "Notificación de Amenaza de Apple" dirigidas a usuarios seleccionados en 110 paíse...
-
Linus Torvalds criticó duramente a Elon Musk , calificándolo de incompetente debido a su gestión y métodos de análisis de rendimiento de p...
La IA tiene dificultades para corregir vulnerabilidades sin supervisión humana
Friday, 7 August 2026
|
Posted by
el-brujo
|
Edit Post
Investigadores de 1Password descubrieron que los modelos de IA solo solucionan vulnerabilidades de seguridad correctamente en un 26% de los casos, a menudo introduciendo nuevos errores o alterando el comportamiento de las aplicaciones. El estudio concluye que los parches generados por IA requieren supervisión humana obligatoria, ya que el riesgo de fallos es alto. Además, advierten que revisar múltiples intentos incorrectos de la IA puede resultar más costoso y agotador que programar la solución manualmente.
Los modelos de IA puede que no sean tan buenos corrigiendo fallos de seguridad. Investigadores de Off-by-1 Labs de 1Password analizaron parches de seguridad generados por dos modelos punteros - ChatGPT 5.5 con un esfuerzo "medio" y Claude Opus 4.8 con un esfuerzo "alto" - y descubrieron que los parches autónomos corrigieron las vulnerabilidades de forma limpia solo aproximadamente una cuarta parte de las veces, mientras que la mayoría del resto no remediaron completamente el fallo o introdujeron otros problemas.
Keith Hoodlet, director de investigación de seguridad en 1Password, sostiene en una publicación de blog https://1password.com/blog/why-ai-generated-patches-still-require-human-review que los resultados muestran que la remediación de seguridad impulsada por LLM todavía necesita revisión humana.
"A través de seis CVE recientemente revelados, produjimos 6.080 parches utilizando dos modelos de razonamiento punteros con capacidades cibernéticas", dijo Hoodlet. "La tasa promedio de éxito para generar un parche que resolviera completamente la vulnerabilidad (sin cambiar materialmente el comportamiento de la aplicación) fue de solo el 26,0 por ciento".
De los parches generados por IA, el 20,1 por ciento corrigió el problema original pero alteró el comportamiento de la aplicación (por ejemplo, cambiando la lógica de "lista de permitidos" a "lista de denegados"). Alrededor del 2,3 por ciento de los parches corrigieron el problema mientras introducían nuevos problemas de seguridad. El 49,3 por ciento de los parches no lograron corregir al menos una ruta de explotación existente. Y el 2,2 por ciento falló tanto en corregir la vulnerabilidad como en introducir una nueva ruta de explotación.
Y entre los parches de las dos primeras categorías (exitosos y limpios; exitosos pero que cambian el comportamiento de la app), los investigadores calificaron más de un tercio de los resultados como frágiles, lo que significa que, aunque el código ajustado pudo haber protegido contra una vulnerabilidad particular (por ejemplo, escapando caracteres de entrada específicos), la reparación no abordó el problema subyacente.
En su documento de investigación [PDF], los autores Axel Mierczuk, Spencer Michaels y Keith Hoodlet proponen el acrónimo FLAWED para representar los parches automatizados de LLM: Fix-Like Artifacts With Embedded Defects (Artefactos similares a correcciones con defectos embebidos). Basándose en los parches generados, concluyen que "el valor esperado de un parche generado totalmente por LLM y no revisado por humanos es netamente negativo por un margen considerable".
El valor de los parches generados por LLM depende de la guía inicial de parcheo. El equipo de investigación afirma que, aunque tanto los desarrolladores humanos como los LLM suelen requerir cierta guía inicial para abordar una vulnerabilidad, los LLM son más propensos a desviarse cuando reciben consejos incorrectos.
Cuando los LLM reciben una guía correcta, su tasa de éxito en la corrección alcanza el 65,0 por ciento, en comparación con el 50,4 por ciento cuando no reciben ninguna guía. Y la guía incorrecta condena a los LLM, reduciendo su tasa de éxito en la corrección a aproximadamente el 15,2 por ciento.
Los desarrolladores humanos, argumentan los autores, tienen una buena oportunidad de detectar información engañosa mientras razonan sobre el código vulnerable.
Los autores han publicado un arnés de evaluación de parches bajo el nombre FLAWED https://github.com/Off-by-1-Labs/FLAWED que las organizaciones pueden utilizar para evaluar la eficacia de sus correcciones de seguridad.
En el documento queda claro por qué los parches generados por IA podrían resultar atractivos: considerados de forma aislada, son económicos en comparación con los ingenieros de software humanos. El parche exitoso y limpio promedio costó solo 6,74 dólares (una cifra que incluye el coste de los intentos fallidos).
No obstante, los autores argumentan que el análisis de coste-beneficio debe evaluar cuánta supervisión experta será necesaria para que el parcheo asistido por LLM sea útil.
"Basándonos en nuestra revisión manual de una muestra representativa de parches generados durante nuestra investigación, sospechamos que, en un gran número de casos, la carga cognitiva impuesta por revisar una montaña de parches de vulnerabilidades generados por LLM, mayoritariamente incorrectos y similares pero sutilmente diferentes, probablemente resultará en que los ingenieros dediquen más esfuerzo del necesario para comprender y parchear las vulnerabilidades ellos mismos utilizando técnicas de codificación asistidas por LLM estándar que mantengan al operador humano al volante", concluyen los autores.
"La alternativa, la rendición cognitiva a un proceso con una tasa de éxito de solo aproximadamente 1 de cada 4, plantea riesgos significativos a largo plazo para cualquier organización que considere el parcheo autónomo impulsado por LLM".
Fuente:
TheRegister
Los modelos de IA puede que no sean tan buenos corrigiendo fallos de seguridad. Investigadores de Off-by-1 Labs de 1Password analizaron parches de seguridad generados por dos modelos punteros - ChatGPT 5.5 con un esfuerzo "medio" y Claude Opus 4.8 con un esfuerzo "alto" - y descubrieron que los parches autónomos corrigieron las vulnerabilidades de forma limpia solo aproximadamente una cuarta parte de las veces, mientras que la mayoría del resto no remediaron completamente el fallo o introdujeron otros problemas.
Keith Hoodlet, director de investigación de seguridad en 1Password, sostiene en una publicación de blog https://1password.com/blog/why-ai-generated-patches-still-require-human-review que los resultados muestran que la remediación de seguridad impulsada por LLM todavía necesita revisión humana.
"A través de seis CVE recientemente revelados, produjimos 6.080 parches utilizando dos modelos de razonamiento punteros con capacidades cibernéticas", dijo Hoodlet. "La tasa promedio de éxito para generar un parche que resolviera completamente la vulnerabilidad (sin cambiar materialmente el comportamiento de la aplicación) fue de solo el 26,0 por ciento".
De los parches generados por IA, el 20,1 por ciento corrigió el problema original pero alteró el comportamiento de la aplicación (por ejemplo, cambiando la lógica de "lista de permitidos" a "lista de denegados"). Alrededor del 2,3 por ciento de los parches corrigieron el problema mientras introducían nuevos problemas de seguridad. El 49,3 por ciento de los parches no lograron corregir al menos una ruta de explotación existente. Y el 2,2 por ciento falló tanto en corregir la vulnerabilidad como en introducir una nueva ruta de explotación.
Y entre los parches de las dos primeras categorías (exitosos y limpios; exitosos pero que cambian el comportamiento de la app), los investigadores calificaron más de un tercio de los resultados como frágiles, lo que significa que, aunque el código ajustado pudo haber protegido contra una vulnerabilidad particular (por ejemplo, escapando caracteres de entrada específicos), la reparación no abordó el problema subyacente.
En su documento de investigación [PDF], los autores Axel Mierczuk, Spencer Michaels y Keith Hoodlet proponen el acrónimo FLAWED para representar los parches automatizados de LLM: Fix-Like Artifacts With Embedded Defects (Artefactos similares a correcciones con defectos embebidos). Basándose en los parches generados, concluyen que "el valor esperado de un parche generado totalmente por LLM y no revisado por humanos es netamente negativo por un margen considerable".
El valor de los parches generados por LLM depende de la guía inicial de parcheo. El equipo de investigación afirma que, aunque tanto los desarrolladores humanos como los LLM suelen requerir cierta guía inicial para abordar una vulnerabilidad, los LLM son más propensos a desviarse cuando reciben consejos incorrectos.
Cuando los LLM reciben una guía correcta, su tasa de éxito en la corrección alcanza el 65,0 por ciento, en comparación con el 50,4 por ciento cuando no reciben ninguna guía. Y la guía incorrecta condena a los LLM, reduciendo su tasa de éxito en la corrección a aproximadamente el 15,2 por ciento.
Los desarrolladores humanos, argumentan los autores, tienen una buena oportunidad de detectar información engañosa mientras razonan sobre el código vulnerable.
Los autores han publicado un arnés de evaluación de parches bajo el nombre FLAWED https://github.com/Off-by-1-Labs/FLAWED que las organizaciones pueden utilizar para evaluar la eficacia de sus correcciones de seguridad.
En el documento queda claro por qué los parches generados por IA podrían resultar atractivos: considerados de forma aislada, son económicos en comparación con los ingenieros de software humanos. El parche exitoso y limpio promedio costó solo 6,74 dólares (una cifra que incluye el coste de los intentos fallidos).
No obstante, los autores argumentan que el análisis de coste-beneficio debe evaluar cuánta supervisión experta será necesaria para que el parcheo asistido por LLM sea útil.
"Basándonos en nuestra revisión manual de una muestra representativa de parches generados durante nuestra investigación, sospechamos que, en un gran número de casos, la carga cognitiva impuesta por revisar una montaña de parches de vulnerabilidades generados por LLM, mayoritariamente incorrectos y similares pero sutilmente diferentes, probablemente resultará en que los ingenieros dediquen más esfuerzo del necesario para comprender y parchear las vulnerabilidades ellos mismos utilizando técnicas de codificación asistidas por LLM estándar que mantengan al operador humano al volante", concluyen los autores.
"La alternativa, la rendición cognitiva a un proceso con una tasa de éxito de solo aproximadamente 1 de cada 4, plantea riesgos significativos a largo plazo para cualquier organización que considere el parcheo autónomo impulsado por LLM".
Fuente:
TheRegister
Newer Post
0 comments :
Post a Comment
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.