Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
6219
)
-
▼
agosto
(Total:
227
)
-
Más de 4.400 PLCs de Rockwell expuestos ponen en r...
-
Modelo de IA de Meta vulnera empresa durante un te...
-
Ataques de ClickFix despliegan infostealer en macO...
-
Google Maps permitirá pagos con IA
-
Fallos en plataformas Java permiten ejecución remo...
-
Vulnerabilidades en Claude Code y Gemini CLI permi...
-
Un chino está vendiendo en eBay RTX 2080 Ti modifi...
-
Microsoft ya no recomienda 32 GB de RAM para juego...
-
Ocultan toolkit de control remoto en Oracle para t...
-
Fallos críticos en agentes de código de Anthropic,...
-
Usan servidores WSUS para distribuir malware en em...
-
Filtración en SharePoint del gobierno suizo compro...
-
SilverFox usa software y controladores confiables ...
-
Texas frena centros de datos por falta de energía ...
-
OpenAI amplía GPT-5.6 a usuarios gratuitos y Go co...
-
DuckDuckGo lanza gafas inútiles que se agotan
-
Kroah-Hartman y Torvalds chocan por la IA en Linux
-
Multa de 10.000 euros por 46 segundos de spam
-
Publicado PoC para vulnerabilidad Use-After-Free e...
-
OpenAI Astra resuelve enigmas matemáticos históricos
-
Samsung promete 8 veces el rendimiento y 10 veces ...
-
Nueva vulnerabilidad de OVSwrap en Linux permite a...
-
Port no oficial de Castlevania: SotN llega a PC
-
Policía árbol atrapa a 74 conductores con el móvil
-
Policía de Londres entregó datos personales de una...
-
RPCS3 rinde mejor en Linux pese al dominio de Windows
-
Filtran altavoz de OpenAI con ChatGPT
-
Una descarga falsa de película puede exponer contr...
-
Gemini reemplaza al Asistente de Google en Android
-
La IA tiene dificultades para corregir vulnerabili...
-
Digi elimina restricción router neutro en fibra 10...
-
Nuevo ataque de inyección de interrupciones logra ...
-
Meta lanza Muse Code para macOS y Linux
-
Filtran diseño del iPhone Ultra
-
Frore Systems quiere refrigerar las GPU NVIDIA Rub...
-
NVIDIA ofrece API de IA con créditos gratuitos
-
IA de Meta hackea empresa por error
-
Routers Zbtlink fabricados en China incluyen una p...
-
Vulnerabilidades críticas de Paperclip permiten ac...
-
La IA impulsa los SSD y HDD: WD logra +130% en ing...
-
Meta: IA accedió a internet y hackeó otro sistema
-
UE: los bancos deberán informar si usan una IA
-
Pruebas cibernéticas de OpenAI y Anthropic: agente...
-
Huawei lanzará próximamente su nuevo portátil Mate...
-
Fallo de RCE en Cursor, VS Code y Google Antigravi...
-
Adobe integra ChatGPT en sus aplicaciones creativas
-
Tareas programadas remotas propagan EtherRAT en do...
-
Mesa 26.2: mejoras gráficas en Linux
-
Microsoft Defender detiene ataque de ransomware QN...
-
Revolut impide a los usuarios de GrapheneOS el uso...
-
ChatGPT gratis ahora es más útil
-
Claude Mythos 5 intentó introducir un backdoor en ...
-
DeepSeek sube precios por saturación de servidores
-
Bypass de 7-Zip permite a archivos maliciosos evad...
-
OWASP lanza el Top 10 de LLM GenAI 2026 para apps ...
-
Los mensajes falsos de «actualiza ahora» son mucho...
-
Los SSD ya no solo almacenarán datos: NVMe 2.4 per...
-
Open VSX elimina 77 extensiones maliciosas que rob...
-
Kioxia y Sandisk muestran su BiCS10 QLC: 2 Tb por ...
-
Filtración de tokens de API de n8n expone instanci...
-
Vulnerabilidad crítica de Jenkins permite ejecutar...
-
La plataforma de IA agéntica de IBM sufre ataques ...
-
Plan de Microsoft para controlar la IA
-
Más de 4.400 PLC de Rockwell expuestos en la red, ...
-
Fallos en WebKit de iCloud Private Relay filtran I...
-
Filtran detalles y precios del Pixel Watch 5
-
Móvil plegable sobrevive al lavavajillas
-
Anthropic creará sus propios chips de IA
-
Toda la memoria DRAM que va a fabricar Samsung, SK...
-
Google quitará de Gmail envío de correos desde cue...
-
ASUS cancela la compra de una GeForce RTX 5090: tr...
-
WhatsApp detectará imágenes y vídeos falsos
-
Cisco corrige vulnerabilidades críticas en IOS XE:...
-
CISA advierte sobre vulnerabilidad RCE de TeamCity...
-
CXMT se convierte en el fabricante de memoria DRAM...
-
Nuevo ataque a la cadena de suministro de npm afec...
-
Cisco corrige vulnerabilidades críticas en Catalys...
-
Creador del ransomware Ransom Cartel condenado a 1...
-
Más de 250 dominios de ClickFix en macOS usan huel...
-
Atacante de Snowflake se declara culpable por filt...
-
Lanzado Rhythmbox 3.5
-
Nueva vulnerabilidad en el kernel de Linux permite...
-
Google renueva mandos de IA para competir
-
Usaron inicios de sesión de Microsoft, Zoom y webs...
-
Django urge actualizar a 6.0.8 y 5.2.17 por fallos...
-
NVIDIA quiere que sus GPU accedan directamente a l...
-
ASUS ROG C10 G: Ethernet de 10 Gbps
-
Google Blogger bloqueó webs legítimas al confundir...
-
Linux veta contribuciones de IA
-
IA actuaron por cuenta propia contra personas y or...
-
Poison Claude vende tokens de IA baratos basados e...
-
DeepSeek V4-Flash: el desafío chino a la IA estado...
-
Agentes Mythos 5 y GPT-5.6-Sol superaron su prueba...
-
IA: entre la teoría económica y los despidos reales
-
TP-Link corrige fallos en Omada ZTP que permitían ...
-
GIGABYTE AORUS P1600W: potencia extrema
-
Botnet busca herramientas de ping que ejecuten com...
-
GIGABYTE sube el precio de sus GPU en hasta un 40%...
-
Vulnerabilidades de Veeam ONE permiten ejecución d...
-
Seis fallos de RCE en Flowise permiten ejecutar có...
-
La IA impulsa a los cazadores de errores de Micros...
-
RDNA 5: avances y posibles especificaciones
-
Steam dicta sentencia en hardware: el PC más usado...
-
NVIDIA domina Linux pese a todo
-
Ubuntu sustituirá Deb por Snap
-
Claude Code desbloquea BIOS de HP
-
Apple pide a un tribunal que frene el dispositivo ...
-
Rusia crea sistema para cegar satélites Starlink
-
Efecto chimenea reduce 19 grados la temperatura de...
-
IA vigila examen y anulan prueba a 58.000 alumnos
-
Lenovo Googlebook: primer vistazo
-
Midnight Blizzard usa wifi de hoteles para robar c...
-
LG y Samsung combaten servidores proxy en Smart TVs
-
Publican PoC de vulnerabilidad en CUPS en MacOS pa...
-
El próximo ChatGPT resuelve problemas matemáticos ...
-
Policías espían mujeres con cámaras de tráfico en ...
-
Vulnerabilidad crítica de lectura de archivos en G...
-
IA china gratuita supera a Claude programando sola
-
OpenAI revela cómo cibercriminales usan ChatGPT pa...
-
Vulnerabilidad crítica de cPanel permite ejecutar ...
-
Campaña de IA falsa logra acceso inicial a empresa...
-
Vulnerabilidades de Apache NiFi permiten saltar la...
-
Lanzado el proyecto OWASP Subtractive Security Top...
-
Noctua revela su «sala de tortura» donde usan fuer...
-
Investigadores chinos usan IA para entrenar drones...
-
Grave fallo en cPanel permitiría a usuarios de hos...
-
Vulnerabilidades en Hugging Face Diffusers permite...
-
Intel retrasa los Nova Lake para gaming con bLLC h...
-
-
▼
agosto
(Total:
227
)
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
seguridad
(
1642
)
vulnerabilidad
(
1615
)
software
(
934
)
hardware
(
864
)
google
(
751
)
Malware
(
708
)
privacidad
(
651
)
Windows
(
521
)
ransomware
(
521
)
android
(
457
)
exploit
(
429
)
linux
(
396
)
cve
(
374
)
tutorial
(
299
)
nvidia
(
294
)
manual
(
282
)
hacking
(
244
)
ssd
(
176
)
WhatsApp
(
173
)
ddos
(
134
)
Wifi
(
131
)
app
(
126
)
cifrado
(
121
)
twitter
(
121
)
programación
(
108
)
youtube
(
82
)
herramientas
(
80
)
firefox
(
76
)
firmware
(
74
)
Networking
(
73
)
sysadmin
(
72
)
adobe
(
66
)
office
(
62
)
hack
(
51
)
Kernel
(
49
)
antivirus
(
49
)
javascript
(
48
)
apache
(
46
)
juegos
(
42
)
contraseñas
(
39
)
multimedia
(
36
)
cms
(
35
)
flash
(
33
)
eventos
(
32
)
MAC
(
30
)
anonymous
(
28
)
ssl
(
24
)
Forense
(
20
)
conferencia
(
20
)
SeguridadWireless
(
17
)
documental
(
17
)
auditoría
(
15
)
Debugger
(
14
)
Rootkit
(
14
)
lizard squad
(
14
)
metasploit
(
13
)
técnicas hacking
(
13
)
Virtualización
(
11
)
delitos
(
11
)
reversing
(
10
)
adamo
(
9
)
Ehn-Dev
(
7
)
MAC Adress
(
6
)
antimalware
(
6
)
oclHashcat
(
5
)
Entradas populares
-
Un usuario de Reddit adquirió una memoria DDR5 de 32 GB valorada en 500 euros por solo 12,50 euros en una tienda de segunda mano.
-
Google prepara el lanzamiento de Pixel Tag , un localizador de objetos similar al AirTag para llenar el hueco de hardware en su ecosistema A...
-
El MacBook Pro M5 Max alcanza los 100º C , provocando que el calor dañe el teclado a pesar de contar con un sistema de refrigeración activo...
La IA tiene dificultades para corregir vulnerabilidades sin supervisión humana
viernes, 7 de agosto de 2026
|
Publicado por
el-brujo
|
Editar entrada
Investigadores de 1Password descubrieron que los modelos de IA solo solucionan vulnerabilidades de seguridad correctamente en un 26% de los casos, a menudo introduciendo nuevos errores o alterando el comportamiento de las aplicaciones. El estudio concluye que los parches generados por IA requieren supervisión humana obligatoria, ya que el riesgo de fallos es alto. Además, advierten que revisar múltiples intentos incorrectos de la IA puede resultar más costoso y agotador que programar la solución manualmente.
Los modelos de IA puede que no sean tan buenos corrigiendo fallos de seguridad. Investigadores de Off-by-1 Labs de 1Password analizaron parches de seguridad generados por dos modelos punteros - ChatGPT 5.5 con un esfuerzo "medio" y Claude Opus 4.8 con un esfuerzo "alto" - y descubrieron que los parches autónomos corrigieron las vulnerabilidades de forma limpia solo aproximadamente una cuarta parte de las veces, mientras que la mayoría del resto no remediaron completamente el fallo o introdujeron otros problemas.
Keith Hoodlet, director de investigación de seguridad en 1Password, sostiene en una publicación de blog https://1password.com/blog/why-ai-generated-patches-still-require-human-review que los resultados muestran que la remediación de seguridad impulsada por LLM todavía necesita revisión humana.
"A través de seis CVE recientemente revelados, produjimos 6.080 parches utilizando dos modelos de razonamiento punteros con capacidades cibernéticas", dijo Hoodlet. "La tasa promedio de éxito para generar un parche que resolviera completamente la vulnerabilidad (sin cambiar materialmente el comportamiento de la aplicación) fue de solo el 26,0 por ciento".
De los parches generados por IA, el 20,1 por ciento corrigió el problema original pero alteró el comportamiento de la aplicación (por ejemplo, cambiando la lógica de "lista de permitidos" a "lista de denegados"). Alrededor del 2,3 por ciento de los parches corrigieron el problema mientras introducían nuevos problemas de seguridad. El 49,3 por ciento de los parches no lograron corregir al menos una ruta de explotación existente. Y el 2,2 por ciento falló tanto en corregir la vulnerabilidad como en introducir una nueva ruta de explotación.
Y entre los parches de las dos primeras categorías (exitosos y limpios; exitosos pero que cambian el comportamiento de la app), los investigadores calificaron más de un tercio de los resultados como frágiles, lo que significa que, aunque el código ajustado pudo haber protegido contra una vulnerabilidad particular (por ejemplo, escapando caracteres de entrada específicos), la reparación no abordó el problema subyacente.
En su documento de investigación [PDF], los autores Axel Mierczuk, Spencer Michaels y Keith Hoodlet proponen el acrónimo FLAWED para representar los parches automatizados de LLM: Fix-Like Artifacts With Embedded Defects (Artefactos similares a correcciones con defectos embebidos). Basándose en los parches generados, concluyen que "el valor esperado de un parche generado totalmente por LLM y no revisado por humanos es netamente negativo por un margen considerable".
El valor de los parches generados por LLM depende de la guía inicial de parcheo. El equipo de investigación afirma que, aunque tanto los desarrolladores humanos como los LLM suelen requerir cierta guía inicial para abordar una vulnerabilidad, los LLM son más propensos a desviarse cuando reciben consejos incorrectos.
Cuando los LLM reciben una guía correcta, su tasa de éxito en la corrección alcanza el 65,0 por ciento, en comparación con el 50,4 por ciento cuando no reciben ninguna guía. Y la guía incorrecta condena a los LLM, reduciendo su tasa de éxito en la corrección a aproximadamente el 15,2 por ciento.
Los desarrolladores humanos, argumentan los autores, tienen una buena oportunidad de detectar información engañosa mientras razonan sobre el código vulnerable.
Los autores han publicado un arnés de evaluación de parches bajo el nombre FLAWED https://github.com/Off-by-1-Labs/FLAWED que las organizaciones pueden utilizar para evaluar la eficacia de sus correcciones de seguridad.
En el documento queda claro por qué los parches generados por IA podrían resultar atractivos: considerados de forma aislada, son económicos en comparación con los ingenieros de software humanos. El parche exitoso y limpio promedio costó solo 6,74 dólares (una cifra que incluye el coste de los intentos fallidos).
No obstante, los autores argumentan que el análisis de coste-beneficio debe evaluar cuánta supervisión experta será necesaria para que el parcheo asistido por LLM sea útil.
"Basándonos en nuestra revisión manual de una muestra representativa de parches generados durante nuestra investigación, sospechamos que, en un gran número de casos, la carga cognitiva impuesta por revisar una montaña de parches de vulnerabilidades generados por LLM, mayoritariamente incorrectos y similares pero sutilmente diferentes, probablemente resultará en que los ingenieros dediquen más esfuerzo del necesario para comprender y parchear las vulnerabilidades ellos mismos utilizando técnicas de codificación asistidas por LLM estándar que mantengan al operador humano al volante", concluyen los autores.
"La alternativa, la rendición cognitiva a un proceso con una tasa de éxito de solo aproximadamente 1 de cada 4, plantea riesgos significativos a largo plazo para cualquier organización que considere el parcheo autónomo impulsado por LLM".
Fuente:
TheRegister
Los modelos de IA puede que no sean tan buenos corrigiendo fallos de seguridad. Investigadores de Off-by-1 Labs de 1Password analizaron parches de seguridad generados por dos modelos punteros - ChatGPT 5.5 con un esfuerzo "medio" y Claude Opus 4.8 con un esfuerzo "alto" - y descubrieron que los parches autónomos corrigieron las vulnerabilidades de forma limpia solo aproximadamente una cuarta parte de las veces, mientras que la mayoría del resto no remediaron completamente el fallo o introdujeron otros problemas.
Keith Hoodlet, director de investigación de seguridad en 1Password, sostiene en una publicación de blog https://1password.com/blog/why-ai-generated-patches-still-require-human-review que los resultados muestran que la remediación de seguridad impulsada por LLM todavía necesita revisión humana.
"A través de seis CVE recientemente revelados, produjimos 6.080 parches utilizando dos modelos de razonamiento punteros con capacidades cibernéticas", dijo Hoodlet. "La tasa promedio de éxito para generar un parche que resolviera completamente la vulnerabilidad (sin cambiar materialmente el comportamiento de la aplicación) fue de solo el 26,0 por ciento".
De los parches generados por IA, el 20,1 por ciento corrigió el problema original pero alteró el comportamiento de la aplicación (por ejemplo, cambiando la lógica de "lista de permitidos" a "lista de denegados"). Alrededor del 2,3 por ciento de los parches corrigieron el problema mientras introducían nuevos problemas de seguridad. El 49,3 por ciento de los parches no lograron corregir al menos una ruta de explotación existente. Y el 2,2 por ciento falló tanto en corregir la vulnerabilidad como en introducir una nueva ruta de explotación.
Y entre los parches de las dos primeras categorías (exitosos y limpios; exitosos pero que cambian el comportamiento de la app), los investigadores calificaron más de un tercio de los resultados como frágiles, lo que significa que, aunque el código ajustado pudo haber protegido contra una vulnerabilidad particular (por ejemplo, escapando caracteres de entrada específicos), la reparación no abordó el problema subyacente.
En su documento de investigación [PDF], los autores Axel Mierczuk, Spencer Michaels y Keith Hoodlet proponen el acrónimo FLAWED para representar los parches automatizados de LLM: Fix-Like Artifacts With Embedded Defects (Artefactos similares a correcciones con defectos embebidos). Basándose en los parches generados, concluyen que "el valor esperado de un parche generado totalmente por LLM y no revisado por humanos es netamente negativo por un margen considerable".
El valor de los parches generados por LLM depende de la guía inicial de parcheo. El equipo de investigación afirma que, aunque tanto los desarrolladores humanos como los LLM suelen requerir cierta guía inicial para abordar una vulnerabilidad, los LLM son más propensos a desviarse cuando reciben consejos incorrectos.
Cuando los LLM reciben una guía correcta, su tasa de éxito en la corrección alcanza el 65,0 por ciento, en comparación con el 50,4 por ciento cuando no reciben ninguna guía. Y la guía incorrecta condena a los LLM, reduciendo su tasa de éxito en la corrección a aproximadamente el 15,2 por ciento.
Los desarrolladores humanos, argumentan los autores, tienen una buena oportunidad de detectar información engañosa mientras razonan sobre el código vulnerable.
Los autores han publicado un arnés de evaluación de parches bajo el nombre FLAWED https://github.com/Off-by-1-Labs/FLAWED que las organizaciones pueden utilizar para evaluar la eficacia de sus correcciones de seguridad.
En el documento queda claro por qué los parches generados por IA podrían resultar atractivos: considerados de forma aislada, son económicos en comparación con los ingenieros de software humanos. El parche exitoso y limpio promedio costó solo 6,74 dólares (una cifra que incluye el coste de los intentos fallidos).
No obstante, los autores argumentan que el análisis de coste-beneficio debe evaluar cuánta supervisión experta será necesaria para que el parcheo asistido por LLM sea útil.
"Basándonos en nuestra revisión manual de una muestra representativa de parches generados durante nuestra investigación, sospechamos que, en un gran número de casos, la carga cognitiva impuesta por revisar una montaña de parches de vulnerabilidades generados por LLM, mayoritariamente incorrectos y similares pero sutilmente diferentes, probablemente resultará en que los ingenieros dediquen más esfuerzo del necesario para comprender y parchear las vulnerabilidades ellos mismos utilizando técnicas de codificación asistidas por LLM estándar que mantengan al operador humano al volante", concluyen los autores.
"La alternativa, la rendición cognitiva a un proceso con una tasa de éxito de solo aproximadamente 1 de cada 4, plantea riesgos significativos a largo plazo para cualquier organización que considere el parcheo autónomo impulsado por LLM".
Fuente:
TheRegister
Enviar por correo electrónico
Escribe un blog
Compartir en X
Compartir con Facebook
Compartir en Pinterest

Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.