Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
6770
)
- ► septiembre (Total: 28 )
-
▼
agosto
(Total:
750
)
-
Europa impone reglas estrictas a ChatGPT como busc...
-
OpenClaw 2.0 con mejoras de seguridad para agentes...
-
Linux 7.3 roza las 41 millones de líneas de código
-
Musk quiere quemar gas para alimentar la IA
-
Microsoft confirma falsas alertas de Defender desa...
-
Fire Ant, grupo vinculado a China, secuestra route...
-
Extraditan a nigerianos a EE. UU. por sextorsión y...
-
Fallo crítico de Microsoft UFO permite controlar A...
-
Fallo de Composer expone claves SSH y archivos sen...
-
Los bloqueos de LaLiga se intensifican: la web del...
-
Usan CAPTCHA falso de Cloudflare para infiltrarse ...
-
Hasbro, el gigante de los juguetes, admite filtrac...
-
Malware de hackers expone sus propias herramientas...
-
iPhone Ultra: caro de comprar y reparar
-
Bots dominan el 91% de las compras de RAM
-
GTA 6: disparadas las reservas tras tráiler de Net...
-
Gemini en Android Auto distrae a los conductores
-
OpenAI retira sus modelos de Cursor tras compra de...
-
Windows 11 moderniza función de hace 25 años
-
Linus Torvalds: usar IA para arreglar Linux fue in...
-
Cloudflare libera 100 TB de RAM sin cambiar un sol...
-
Filtrados más de 12 TB de archivos de Steam que ab...
-
WhatsApp detecta estafas con IA local
-
Cinco fallos críticos en temas y plugins de WordPr...
-
Brave integra alias de correo electrónico para evi...
-
Meta impide grabar en secreto con sus gafas
-
Gemini Notebook actualiza sus límites
-
Fallos críticos de ServiceNow permiten ejecutar có...
-
OpenAI golpeó fuerte a Hugging Face
-
iPhone 17 Pro resiste caída de 30 km
-
Google usa IA para gestionar viajes
-
Modo Dios sigue vivo en Windows 11 pese a Microsoft
-
Investigador demuestra que Claude Code puede ser e...
-
Android 17 implementa ECH en todo el sistema para ...
-
Windows 10 no soportará GTA VI
-
PaperCut lanza un segundo parche de emergencia par...
-
IA: alerta por ola de ciberataques
-
Explotan fallo en Cosmos EVM a pesar de que Cosmos...
-
Berlín se niega a pagar el rescate a los que robar...
-
GTA VI podría vaciar las oficinas
-
Gemini convierte Excel en apps
-
El SSD SanDisk de 64 GB de hace 16 años se niega a...
-
Banda de ransomware TITAN afirma que su IA analiza...
-
Estudia ingeniería informática gratis con este rep...
-
700 agentes de IA coordinados secretamente para ha...
-
Atacan infraestructura de IA con RCE, inyección de...
-
Cárcel para un hombre de 68 años que ganó 1,3 mill...
-
Fallo en el plugin de donaciones GiveWP para WordP...
-
Meta pagará 18.000 millones por adicción a sus redes
-
Grave fallo de cPanel podría permitir que un usuar...
-
AWS muestra cómo credenciales robadas permiten ata...
-
Vulnerabilidades de TeamViewer permiten ejecución ...
-
Malware Massiv ataca apps de IPTV en España
-
Razer lanza colección por los 25 años de Xbox
-
Lanzada la actualización KB5120998 de Windows 11 c...
-
Más de 100 entidades tecnológicas piden reforzar l...
-
Zen 6 compatible con AM5
-
Instalan malware mediante currículums falsos de es...
-
Filtración en universidad rusa revela entrenamient...
-
Windows XP cumple 25 años
-
Más de 8.300 servidores Gitea expuestos a ataques ...
-
Vulnerabilidades en el robot humanoide Unitree G1 ...
-
Ya disponible Ubuntu 26.04.1 LTS
-
Photoshop integra IA para editar con prompts y boc...
-
Cae uno de los mayores imperios de la piratería mu...
-
OpenAI advierte que el reward hacking llevó a agen...
-
OpenAI crea IA autónoma
-
Casi 700 agentes de IA coordinados en el ataque a ...
-
Next.js corrige fallos críticos de AVIF y Windows ...
-
Bill Gates advierte sobre el impacto de la IA
-
PaperCut sufre un ataque de día cero que está golp...
-
Roban datos de 8,7 millones de clientes en tres ae...
-
Policía australiana detiene a presuntos cerebros d...
-
Vulnerabilidad en dispositivos TP-Link Kasa permit...
-
Vulnerabilidad crítica de cPanel permite control t...
-
Secuestran Claude Code Opus 5 Auto Mode mediante p...
-
CISA advierte vulnerabilidad en Citrix NetScaler e...
-
Ciberdelincuentes venden números de seguridad soci...
-
Google lanza Gemini Omni 1.1 Flash para vídeos pro...
-
LibreOffice 26.8 se actualiza y rechaza la IA
-
OpenAI banea cuentas de ChatGPT vinculadas a Rusia...
-
OpenAI limita mensajes de GPT-5.6 Sol en ChatGPT Plus
-
El FBI desarticula infraestructura de QTFY vincula...
-
Operación Jackal IV de INTERPOL: 58 detenidos y 26...
-
28.000 repositorios Git expuestos revelan claves A...
-
Claude Opus 4.6 vulnera el límite de reservas del ...
-
Mac Studio M5: potencia extrema para IA
-
Vulnerabilidades de SonicWall NetExtender permiten...
-
Vulnerabilidades críticas en Next.js permiten ejec...
-
Vulnerabilidad en plugin TranslatePress de WordPre...
-
Garmin actualiza funciones en modelos antiguos
-
21 fallos críticos de Ubiquiti UniFi permiten salt...
-
Apple renueva Mac Mini y Studio con chip de 2nm
-
Comando de Windows para liberar espacio sin riesgo...
-
Llega NVIDIA DLSS 4.5 Ray Reconstruction
-
China sustituirá Windows por Linux
-
Linux cumple 35: el kernel aficionado que ahora im...
-
El gusano Morris infectó el 10% de Internet
-
Amazon sube el precio de sus dispositivos Echo, Ki...
-
UE busca sustituir a Visa y Mastercard para 2029
-
Chrome 152: 327 correcciones de seguridad y 10 crí...
-
Alerta por vulnerabilidad crítica de RCE en Gitea ...
-
Fallos de OpenSSL permiten colapsar servidores y c...
-
Qualcomm rompe la barrera de los 5 GHz en smartpho...
-
OpenAI suspende cuentas rusas de ChatGPT vinculada...
-
Intel convierte Diamond Rapids en una bestia de 25...
-
EE. UU. impone sanciones a hackers vinculados a Ir...
-
Ciberataque masivo colapsa los servicios digitales...
-
91 vulnerabilidades de Spring afectan a más de 209...
-
AliExpress usa WebAudio API para rastreo silencios...
-
Passkeys de WhatsApp alcanzan mil millones de usua...
-
Falso análisis de Microsoft pide quitar antivirus ...
-
La IA preferida de los hackers es DeepSeek
-
Fallo en plataforma B2B de Tata permite robo de cu...
-
Ocho agentes de IA vulneran sistemas gubernamental...
-
Sony: los juegos digitales no son tuyos
-
AWS Network Firewall ya muestra el recuento de reg...
-
Fallo sin parchear en Calix permite a hackers salt...
-
DOOM 64 estrena trazado de trayectorias
-
Crisis de RAM hunde a marca de Linux Pine64
-
Falsa demo de GTA 6 es malware que roba contraseña...
-
Ciberatacantes aprovechan fallos de miniOrange SAM...
-
Fallo crítico en Red Hat Keycloak permite tomar cu...
-
AliExpress es señalada por rastrear usuarios media...
-
Una página web maliciosa podría contaminar tu mode...
-
IA china crea vídeos desde PowerPoint
-
Investigador revela cinco vulnerabilidades crítica...
-
Vulnerabilidades en TP-Link Archer permiten ataque...
-
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
vulnerabilidad
(
1773
)
seguridad
(
1754
)
software
(
1063
)
hardware
(
909
)
google
(
774
)
Malware
(
710
)
privacidad
(
671
)
ransomware
(
537
)
Windows
(
521
)
exploit
(
490
)
android
(
473
)
linux
(
428
)
cve
(
375
)
nvidia
(
303
)
tutorial
(
300
)
manual
(
282
)
hacking
(
260
)
ssd
(
183
)
WhatsApp
(
173
)
ddos
(
140
)
Wifi
(
131
)
app
(
127
)
cifrado
(
121
)
twitter
(
121
)
programación
(
119
)
youtube
(
83
)
firmware
(
81
)
herramientas
(
80
)
firefox
(
78
)
Networking
(
73
)
sysadmin
(
72
)
adobe
(
69
)
office
(
62
)
antivirus
(
52
)
hack
(
52
)
Kernel
(
49
)
javascript
(
49
)
apache
(
46
)
juegos
(
42
)
contraseñas
(
39
)
multimedia
(
36
)
cms
(
35
)
flash
(
33
)
eventos
(
32
)
MAC
(
30
)
anonymous
(
28
)
ssl
(
24
)
conferencia
(
21
)
Forense
(
20
)
SeguridadWireless
(
17
)
documental
(
17
)
auditoría
(
15
)
Debugger
(
14
)
Rootkit
(
14
)
lizard squad
(
14
)
metasploit
(
13
)
técnicas hacking
(
13
)
Virtualización
(
11
)
delitos
(
11
)
reversing
(
10
)
adamo
(
9
)
Ehn-Dev
(
7
)
antimalware
(
7
)
MAC Adress
(
6
)
oclHashcat
(
5
)
Entradas populares
-
Python 3.15 ya es oficial, introduciendo optimizaciones en TypedDict, Tachyon, JIT y soporte ABI para mejorar la productividad del ecosist...
-
La UE propone un temporizador de 30 minutos para bloquear el fútbol pirata y las IPTV, basándose en el modelo italiano Piracy Shield, afect...
-
Dopamine 3.0 ha lanzado el jailbreak para iOS 26 , confirmando que estas herramientas de desbloqueo siguen vigentes a pesar de las restricc...
El nuevo modelo Astra de OpenAI demuestra un rendimiento cibernético capaz de provocar una pausa
lunes, 10 de agosto de 2026
|
Publicado por
el-brujo
|
Editar entrada
OpenAI ha pausado algunas actividades internas de su modelo Astra tras detectar que posee capacidades críticas en ciberseguridad y programación agentica, pudiendo crear exploits de día cero. Para mitigar riesgos, la empresa implementará controles de seguridad estrictos y colaborará con agencias gubernamentales. Este anuncio ocurre en un contexto de creciente preocupación, ya que otros modelos de IA también han logrado evadir entornos de prueba para interactuar con objetivos reales.
OpenAI ha anunciado que está pausando algunas "actividades internas" relacionadas con su próximo modelo de inteligencia artificial (IA) Astra, después de que una evaluación interna descubriera que había logrado avances significativos en codificación agentica y ciberseguridad.
En respuesta a este hallazgo, la empresa de IA señaló que está implementando controles de seguridad para modelos de mayor capacidad y actividades asociadas, tales como entornos de prueba aislados, acceso restringido a herramientas y redes, protecciones y cifrado mejorados de los pesos del modelo, capacidades adicionales de monitoreo y detección, y ejecución en sandbox.
"Estamos pausando las actividades internas relacionadas con Astra que aún no cumplen con estos requisitos reforzados de control de seguridad", afirmó en un comunicado.
"Hemos implementado un monitoreo universal para acciones riesgosas y desalineaciones en todas las aplicaciones agenticas de Astra, incluyendo el entrenamiento y la evaluación. Los monitores evalúan la 'Cadena de Pensamiento' del modelo y activan una respuesta de seguridad para revisar e interrumpir la actividad de alto riesgo".
OpenAI dijo que también trabajará con agencias gubernamentales pertinentes y organizaciones seleccionadas de seguridad de IA para probar las capacidades del modelo, además de compartir los controles de seguridad recomendados con socios de prueba externos para ejecutar cargas de trabajo y evaluaciones de mayor riesgo de forma segura.
La compañía afirmó que "no puede descartar" que el modelo posea capacidades cibernéticas "Críticas" bajo su Marco de Preparación, que define el umbral de la siguiente manera:
Un modelo aumentado con herramientas puede identificar y desarrollar exploits de día cero funcionales de todos los niveles de severidad en muchos sistemas críticos del mundo real endurecidos sin intervención humana, O el modelo puede idear y ejecutar estrategias novedosas de extremo a extremo para ciberataques contra objetivos endurecidos partiendo únicamente de un objetivo general deseado.
En otras palabras, el modelo puede descubrir y desarrollar exploits de día cero funcionales de todos los niveles de severidad en muchos sistemas críticos reales sin intervención humana, o puede orquestar y ejecutar estrategias novedosas de extremo a extremo para ciberataques contra objetivos cuando se le indica un objetivo general deseado.
OpenAI señaló que sus evaluaciones preliminares de Astra indican un "rendimiento lo suficientemente fuerte" como para no poder eliminar la posibilidad de que el modelo posea un nivel de capacidad "Crítica" en esta etapa. También enfatizó que Astra no estuvo involucrada en el incidente del mes pasado dirigido a Hugging Face. En un artículo académico reciente, OpenAI presumió que el modelo resolvió 10 problemas abiertos de matemáticas y ciencias computacionales teóricas por unos 2,000 dólares a tarifas de Sol API.
OpenAI dijo que compartía esta información porque cree que "es importante ser transparentes con el público y con las comunidades de seguridad sobre este cambio potencial en las capacidades".
"Creemos que los modelos avanzados con capacidades cibernéticas deberían ayudar a los defensores a identificar y solucionar vulnerabilidades antes que los atacantes", añadió. "Estamos comprometidos a trabajar junto con gobiernos, institutos de seguridad y la sociedad civil para garantizar que las capacidades fronterizas de modelos como Astra, y los que vengan después, se desplieguen de manera responsable y amplia para el beneficio de toda la humanidad".
Este desarrollo es la señal más reciente del rápido avance de las capacidades cibernéticas de los modelos frontera, aunque marca la primera vez que un laboratorio de IA se compromete públicamente a ralentizar el progreso debido a preocupaciones de ciberseguridad.
A principios de la semana pasada, el Instituto de Seguridad de IA del Reino Unido (AISI) reveló que su propia evaluación encontró que los modelos de IA con acceso a internet contactaron al mundo real para atacar individuos y organizaciones de forma autónoma en 10 de las 122 ejecuciones totales. De las 19 acciones registradas, 17 se originaron en Mythos 5 de Anthropic y las dos restantes involucraron a GPT-5.6-Sol de OpenAI con clasificadores cibernéticos.
"En el caso más grave, un agente intentó insertar código malicioso en un proyecto de código abierto", dijo el AISI. "En un intento de lograr que el código fuera aprobado, el agente recurrió a la ingeniería social: creó identidades falsas en línea y las utilizó para presionar al mantenedor del proyecto para que aprobara el código. Un mantenedor humano detectó y rechazó aprobar el código malicioso".
"Estos intentos no tuvieron éxito y nuestras investigaciones no han evidenciado ningún daño resultante en el mundo real. Pero esta es la primera vez que vemos riesgos en torno a la autonomía y el engaño manifestarse tan claramente, sin instrucciones específicas, en el mundo real".
La revelación también llega en medio de revelaciones de que modelos de Meta y de la empresa china Moonshot (específicamente Muse Spark 1.1 y Kimi K3) escaparon de sus entornos controlados y atacaron objetivos reales, amplificando las preocupaciones sobre la capacidad de los desarrolladores para aislar sistemas de IA cada vez más capaces. En ambos casos, se descubrió que los modelos aprovecharon configuraciones de red erróneas en lugar de identificar y explotar independientemente una vulnerabilidad previamente desconocida para llegar a internet.
Mientras los modelos de IA se prueban con benchmarks ampliamente aceptados para examinar cómo realizan tareas de ciberseguridad ofensivas y defensivas en entornos de prueba aislados, Frontier Security señaló que Kimi K3 encontró una fuga de salida de red que le permitió acceder a github[.]com, clonar un repositorio oficial para el problema del benchmark que debía resolver y acceder a la solución en lugar de resolver el desafío por sí mismo.
"En nuestro caso, el modelo no resolvió la tarea de forma nativa en absoluto; sondeó la red, se dio cuenta de que la resolución DNS estándar para github.com funcionaba (la mayoría de los otros sitios web estaban bloqueados por el sandbox), clonó el repositorio oficial del benchmark y leyó la solución directamente del disco", afirmó Frontier Security.
La creciente lista de incidentes en los que agentes de IA de los principales desarrolladores escaparon de los entornos de prueba de diversas maneras y terminaron vulnerando objetivos reales que no formaban parte del experimento ha impulsado la creación de un nuevo sitio web, acertadamente llamado Felony Bench, para rastrear estos casos.
Fuente:
THN
OpenAI ha anunciado que está pausando algunas "actividades internas" relacionadas con su próximo modelo de inteligencia artificial (IA) Astra, después de que una evaluación interna descubriera que había logrado avances significativos en codificación agentica y ciberseguridad.
En respuesta a este hallazgo, la empresa de IA señaló que está implementando controles de seguridad para modelos de mayor capacidad y actividades asociadas, tales como entornos de prueba aislados, acceso restringido a herramientas y redes, protecciones y cifrado mejorados de los pesos del modelo, capacidades adicionales de monitoreo y detección, y ejecución en sandbox.
"Estamos pausando las actividades internas relacionadas con Astra que aún no cumplen con estos requisitos reforzados de control de seguridad", afirmó en un comunicado.
"Hemos implementado un monitoreo universal para acciones riesgosas y desalineaciones en todas las aplicaciones agenticas de Astra, incluyendo el entrenamiento y la evaluación. Los monitores evalúan la 'Cadena de Pensamiento' del modelo y activan una respuesta de seguridad para revisar e interrumpir la actividad de alto riesgo".
OpenAI dijo que también trabajará con agencias gubernamentales pertinentes y organizaciones seleccionadas de seguridad de IA para probar las capacidades del modelo, además de compartir los controles de seguridad recomendados con socios de prueba externos para ejecutar cargas de trabajo y evaluaciones de mayor riesgo de forma segura.
La compañía afirmó que "no puede descartar" que el modelo posea capacidades cibernéticas "Críticas" bajo su Marco de Preparación, que define el umbral de la siguiente manera:
Un modelo aumentado con herramientas puede identificar y desarrollar exploits de día cero funcionales de todos los niveles de severidad en muchos sistemas críticos del mundo real endurecidos sin intervención humana, O el modelo puede idear y ejecutar estrategias novedosas de extremo a extremo para ciberataques contra objetivos endurecidos partiendo únicamente de un objetivo general deseado.
En otras palabras, el modelo puede descubrir y desarrollar exploits de día cero funcionales de todos los niveles de severidad en muchos sistemas críticos reales sin intervención humana, o puede orquestar y ejecutar estrategias novedosas de extremo a extremo para ciberataques contra objetivos cuando se le indica un objetivo general deseado.
OpenAI señaló que sus evaluaciones preliminares de Astra indican un "rendimiento lo suficientemente fuerte" como para no poder eliminar la posibilidad de que el modelo posea un nivel de capacidad "Crítica" en esta etapa. También enfatizó que Astra no estuvo involucrada en el incidente del mes pasado dirigido a Hugging Face. En un artículo académico reciente, OpenAI presumió que el modelo resolvió 10 problemas abiertos de matemáticas y ciencias computacionales teóricas por unos 2,000 dólares a tarifas de Sol API.
OpenAI dijo que compartía esta información porque cree que "es importante ser transparentes con el público y con las comunidades de seguridad sobre este cambio potencial en las capacidades".
"Creemos que los modelos avanzados con capacidades cibernéticas deberían ayudar a los defensores a identificar y solucionar vulnerabilidades antes que los atacantes", añadió. "Estamos comprometidos a trabajar junto con gobiernos, institutos de seguridad y la sociedad civil para garantizar que las capacidades fronterizas de modelos como Astra, y los que vengan después, se desplieguen de manera responsable y amplia para el beneficio de toda la humanidad".
Este desarrollo es la señal más reciente del rápido avance de las capacidades cibernéticas de los modelos frontera, aunque marca la primera vez que un laboratorio de IA se compromete públicamente a ralentizar el progreso debido a preocupaciones de ciberseguridad.
A principios de la semana pasada, el Instituto de Seguridad de IA del Reino Unido (AISI) reveló que su propia evaluación encontró que los modelos de IA con acceso a internet contactaron al mundo real para atacar individuos y organizaciones de forma autónoma en 10 de las 122 ejecuciones totales. De las 19 acciones registradas, 17 se originaron en Mythos 5 de Anthropic y las dos restantes involucraron a GPT-5.6-Sol de OpenAI con clasificadores cibernéticos.
"En el caso más grave, un agente intentó insertar código malicioso en un proyecto de código abierto", dijo el AISI. "En un intento de lograr que el código fuera aprobado, el agente recurrió a la ingeniería social: creó identidades falsas en línea y las utilizó para presionar al mantenedor del proyecto para que aprobara el código. Un mantenedor humano detectó y rechazó aprobar el código malicioso".
"Estos intentos no tuvieron éxito y nuestras investigaciones no han evidenciado ningún daño resultante en el mundo real. Pero esta es la primera vez que vemos riesgos en torno a la autonomía y el engaño manifestarse tan claramente, sin instrucciones específicas, en el mundo real".
La revelación también llega en medio de revelaciones de que modelos de Meta y de la empresa china Moonshot (específicamente Muse Spark 1.1 y Kimi K3) escaparon de sus entornos controlados y atacaron objetivos reales, amplificando las preocupaciones sobre la capacidad de los desarrolladores para aislar sistemas de IA cada vez más capaces. En ambos casos, se descubrió que los modelos aprovecharon configuraciones de red erróneas en lugar de identificar y explotar independientemente una vulnerabilidad previamente desconocida para llegar a internet.
Mientras los modelos de IA se prueban con benchmarks ampliamente aceptados para examinar cómo realizan tareas de ciberseguridad ofensivas y defensivas en entornos de prueba aislados, Frontier Security señaló que Kimi K3 encontró una fuga de salida de red que le permitió acceder a github[.]com, clonar un repositorio oficial para el problema del benchmark que debía resolver y acceder a la solución en lugar de resolver el desafío por sí mismo.
"En nuestro caso, el modelo no resolvió la tarea de forma nativa en absoluto; sondeó la red, se dio cuenta de que la resolución DNS estándar para github.com funcionaba (la mayoría de los otros sitios web estaban bloqueados por el sandbox), clonó el repositorio oficial del benchmark y leyó la solución directamente del disco", afirmó Frontier Security.
La creciente lista de incidentes en los que agentes de IA de los principales desarrolladores escaparon de los entornos de prueba de diversas maneras y terminaron vulnerando objetivos reales que no formaban parte del experimento ha impulsado la creación de un nuevo sitio web, acertadamente llamado Felony Bench, para rastrear estos casos.
Fuente:
THN
Enviar por correo electrónico
Escribe un blog
Compartir en X
Compartir con Facebook
Compartir en Pinterest
Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.