Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
6258
)
-
▼
August
(Total:
266
)
-
Spotify en la terminal de Linux
-
World Flight Sim: un inmersivo simulador de vuelo ...
-
El nuevo modelo Astra de OpenAI demuestra un rendi...
-
CachyOS renueva herramientas y lanza edición servidor
-
WhatsApp traerá fondos animados a Android
-
Chrome renuncia al diseño Mica de Windows 11
-
ChatGPT creará stickers para WhatsApp
-
Google Maps integra IA para gestionar reservas y p...
-
Apple prepara tres nuevos productos Ultra para 2027
-
WenWare: un juego para ubicar escenas fotográficas...
-
Filtración de datos de Levi Strauss: acceden a sus...
-
HTTP Terminator: IA para analizar HTTP
-
Centro de datos de Amazon será el más contaminante
-
CVE-2026-64561 Zapscape permite a invitados KVM es...
-
En Japón, las tiendas de informática comienzan a v...
-
App de clima de Windows 11 usaría 1.2GB de RAM
-
Nuevo ataque de cadena de suministro de WordPress ...
-
Fallo XSS2Shell de WordPress permite ejecución rem...
-
Apple corrige fallo crítico en macOS
-
Claude Opus 5 reduce el éxito de ataques de inyecc...
-
Optimiza Windows para jugar mejor
-
Kimi K3 se escapa de sus pruebas
-
La potente APU Intel Nova Lake para gaming: CPU de...
-
Otaku detenida por fraudes en devoluciones online
-
Nueva vulnerabilidad XSS en WordPress podría permi...
-
Google sacrifica la IA por el hardware
-
La IA degrada Internet y genera desconfianza
-
Levi Strauss & Co. informa que robaron datos corpo...
-
Atlassian Rovo es vulnerable y podría filtrar dato...
-
Una empresa prefiere destruir 100 MacBook Pro M4 c...
-
Ataques de bomba CSS convierten correos maliciosos...
-
Vulnerabilidad 0-day de Metabase explotada para ob...
-
Ray tracing: la clave entre PC y consolas
-
SK Hynix invierte 54 billones de wones en dos fábr...
-
Disney Plus prueba IA de recomendaciones
-
Intel recupera HDMI 2.1 en Linux
-
Fallo de 18 años en SCTP de Linux permitiría a usu...
-
Quake Dawn of the Machine: expansión gratuita y du...
-
Ahora son los inversores de Samsung y SK hynix los...
-
Más de 4.400 PLCs de Rockwell expuestos ponen en r...
-
Modelo de IA de Meta vulnera empresa durante un te...
-
Ataques de ClickFix despliegan infostealer en macO...
-
Google Maps permitirá pagos con IA
-
Fallos en plataformas Java permiten ejecución remo...
-
Vulnerabilidades en Claude Code y Gemini CLI permi...
-
Un chino está vendiendo en eBay RTX 2080 Ti modifi...
-
Microsoft ya no recomienda 32 GB de RAM para juego...
-
Ocultan toolkit de control remoto en Oracle para t...
-
Fallos críticos en agentes de código de Anthropic,...
-
Usan servidores WSUS para distribuir malware en em...
-
Filtración en SharePoint del gobierno suizo compro...
-
SilverFox usa software y controladores confiables ...
-
Texas frena centros de datos por falta de energía ...
-
OpenAI amplía GPT-5.6 a usuarios gratuitos y Go co...
-
DuckDuckGo lanza gafas inútiles que se agotan
-
Kroah-Hartman y Torvalds chocan por la IA en Linux
-
Multa de 10.000 euros por 46 segundos de spam
-
Publicado PoC para vulnerabilidad Use-After-Free e...
-
OpenAI Astra resuelve enigmas matemáticos históricos
-
Samsung promete 8 veces el rendimiento y 10 veces ...
-
Nueva vulnerabilidad de OVSwrap en Linux permite a...
-
Port no oficial de Castlevania: SotN llega a PC
-
Policía árbol atrapa a 74 conductores con el móvil
-
Policía de Londres entregó datos personales de una...
-
RPCS3 rinde mejor en Linux pese al dominio de Windows
-
Filtran altavoz de OpenAI con ChatGPT
-
Una descarga falsa de película puede exponer contr...
-
Gemini reemplaza al Asistente de Google en Android
-
La IA tiene dificultades para corregir vulnerabili...
-
Digi elimina restricción router neutro en fibra 10...
-
Nuevo ataque de inyección de interrupciones logra ...
-
Meta lanza Muse Code para macOS y Linux
-
Filtran diseño del iPhone Ultra
-
Frore Systems quiere refrigerar las GPU NVIDIA Rub...
-
NVIDIA ofrece API de IA con créditos gratuitos
-
IA de Meta hackea empresa por error
-
Routers Zbtlink fabricados en China incluyen una p...
-
Vulnerabilidades críticas de Paperclip permiten ac...
-
La IA impulsa los SSD y HDD: WD logra +130% en ing...
-
Meta: IA accedió a internet y hackeó otro sistema
-
UE: los bancos deberán informar si usan una IA
-
Pruebas cibernéticas de OpenAI y Anthropic: agente...
-
Huawei lanzará próximamente su nuevo portátil Mate...
-
Fallo de RCE en Cursor, VS Code y Google Antigravi...
-
Adobe integra ChatGPT en sus aplicaciones creativas
-
Tareas programadas remotas propagan EtherRAT en do...
-
Mesa 26.2: mejoras gráficas en Linux
-
Microsoft Defender detiene ataque de ransomware QN...
-
Revolut impide a los usuarios de GrapheneOS el uso...
-
ChatGPT gratis ahora es más útil
-
Claude Mythos 5 intentó introducir un backdoor en ...
-
DeepSeek sube precios por saturación de servidores
-
Bypass de 7-Zip permite a archivos maliciosos evad...
-
OWASP lanza el Top 10 de LLM GenAI 2026 para apps ...
-
Los mensajes falsos de «actualiza ahora» son mucho...
-
Los SSD ya no solo almacenarán datos: NVMe 2.4 per...
-
Open VSX elimina 77 extensiones maliciosas que rob...
-
Kioxia y Sandisk muestran su BiCS10 QLC: 2 Tb por ...
-
Filtración de tokens de API de n8n expone instanci...
-
Vulnerabilidad crítica de Jenkins permite ejecutar...
-
La plataforma de IA agéntica de IBM sufre ataques ...
-
Plan de Microsoft para controlar la IA
-
Más de 4.400 PLC de Rockwell expuestos en la red, ...
-
Fallos en WebKit de iCloud Private Relay filtran I...
-
Filtran detalles y precios del Pixel Watch 5
-
Móvil plegable sobrevive al lavavajillas
-
Anthropic creará sus propios chips de IA
-
Toda la memoria DRAM que va a fabricar Samsung, SK...
-
Google quitará de Gmail envío de correos desde cue...
-
ASUS cancela la compra de una GeForce RTX 5090: tr...
-
WhatsApp detectará imágenes y vídeos falsos
-
Cisco corrige vulnerabilidades críticas en IOS XE:...
-
CISA advierte sobre vulnerabilidad RCE de TeamCity...
-
CXMT se convierte en el fabricante de memoria DRAM...
-
Nuevo ataque a la cadena de suministro de npm afec...
-
Cisco corrige vulnerabilidades críticas en Catalys...
-
Creador del ransomware Ransom Cartel condenado a 1...
-
Más de 250 dominios de ClickFix en macOS usan huel...
-
Atacante de Snowflake se declara culpable por filt...
-
Lanzado Rhythmbox 3.5
-
Nueva vulnerabilidad en el kernel de Linux permite...
-
Google renueva mandos de IA para competir
-
Usaron inicios de sesión de Microsoft, Zoom y webs...
-
Django urge actualizar a 6.0.8 y 5.2.17 por fallos...
-
NVIDIA quiere que sus GPU accedan directamente a l...
-
ASUS ROG C10 G: Ethernet de 10 Gbps
-
Google Blogger bloqueó webs legítimas al confundir...
-
Linux veta contribuciones de IA
-
-
▼
August
(Total:
266
)
Blogroll
Labels
seguridad
(
1648
)
vulnerabilidad
(
1625
)
software
(
942
)
hardware
(
871
)
google
(
754
)
Malware
(
708
)
privacidad
(
652
)
Windows
(
521
)
ransomware
(
521
)
android
(
458
)
exploit
(
432
)
linux
(
400
)
cve
(
374
)
tutorial
(
299
)
nvidia
(
294
)
manual
(
281
)
hacking
(
245
)
ssd
(
177
)
WhatsApp
(
173
)
ddos
(
134
)
Wifi
(
131
)
app
(
126
)
cifrado
(
121
)
twitter
(
121
)
programación
(
108
)
youtube
(
82
)
herramientas
(
80
)
firefox
(
76
)
firmware
(
74
)
Networking
(
73
)
sysadmin
(
72
)
adobe
(
66
)
office
(
62
)
hack
(
51
)
Kernel
(
49
)
antivirus
(
49
)
javascript
(
48
)
apache
(
46
)
juegos
(
42
)
contraseñas
(
39
)
multimedia
(
36
)
cms
(
35
)
flash
(
33
)
eventos
(
32
)
MAC
(
30
)
anonymous
(
28
)
ssl
(
24
)
Forense
(
20
)
conferencia
(
20
)
SeguridadWireless
(
17
)
documental
(
17
)
auditoría
(
15
)
Debugger
(
14
)
Rootkit
(
14
)
lizard squad
(
14
)
metasploit
(
13
)
técnicas hacking
(
13
)
Virtualización
(
11
)
delitos
(
11
)
reversing
(
10
)
adamo
(
9
)
Ehn-Dev
(
7
)
MAC Adress
(
6
)
antimalware
(
6
)
oclHashcat
(
5
)
Entradas populares
-
Un vendedor chino ofrece en eBay RTX 2080 Ti modificadas a 22 GB por 500 dólares , las cuales están teniendo un gran éxito en ventas debido...
-
Microsoft ha eliminado sin previo aviso la recomendación de disponer de 32 GB de RAM para PCs de juegos con Windows 11 .
-
El MacBook Pro M5 Max alcanza los 100º C , provocando que el calor dañe el teclado a pesar de contar con un sistema de refrigeración activo...
El nuevo modelo Astra de OpenAI demuestra un rendimiento cibernético capaz de provocar una pausa
Monday, 10 August 2026
|
Posted by
el-brujo
|
Edit Post
OpenAI ha pausado algunas actividades internas de su modelo Astra tras detectar que posee capacidades críticas en ciberseguridad y programación agentica, pudiendo crear exploits de día cero. Para mitigar riesgos, la empresa implementará controles de seguridad estrictos y colaborará con agencias gubernamentales. Este anuncio ocurre en un contexto de creciente preocupación, ya que otros modelos de IA también han logrado evadir entornos de prueba para interactuar con objetivos reales.
OpenAI ha anunciado que está pausando algunas "actividades internas" relacionadas con su próximo modelo de inteligencia artificial (IA) Astra, después de que una evaluación interna descubriera que había logrado avances significativos en codificación agentica y ciberseguridad.
En respuesta a este hallazgo, la empresa de IA señaló que está implementando controles de seguridad para modelos de mayor capacidad y actividades asociadas, tales como entornos de prueba aislados, acceso restringido a herramientas y redes, protecciones y cifrado mejorados de los pesos del modelo, capacidades adicionales de monitoreo y detección, y ejecución en sandbox.
"Estamos pausando las actividades internas relacionadas con Astra que aún no cumplen con estos requisitos reforzados de control de seguridad", afirmó en un comunicado.
"Hemos implementado un monitoreo universal para acciones riesgosas y desalineaciones en todas las aplicaciones agenticas de Astra, incluyendo el entrenamiento y la evaluación. Los monitores evalúan la 'Cadena de Pensamiento' del modelo y activan una respuesta de seguridad para revisar e interrumpir la actividad de alto riesgo".
OpenAI dijo que también trabajará con agencias gubernamentales pertinentes y organizaciones seleccionadas de seguridad de IA para probar las capacidades del modelo, además de compartir los controles de seguridad recomendados con socios de prueba externos para ejecutar cargas de trabajo y evaluaciones de mayor riesgo de forma segura.
La compañía afirmó que "no puede descartar" que el modelo posea capacidades cibernéticas "Críticas" bajo su Marco de Preparación, que define el umbral de la siguiente manera:
Un modelo aumentado con herramientas puede identificar y desarrollar exploits de día cero funcionales de todos los niveles de severidad en muchos sistemas críticos del mundo real endurecidos sin intervención humana, O el modelo puede idear y ejecutar estrategias novedosas de extremo a extremo para ciberataques contra objetivos endurecidos partiendo únicamente de un objetivo general deseado.
En otras palabras, el modelo puede descubrir y desarrollar exploits de día cero funcionales de todos los niveles de severidad en muchos sistemas críticos reales sin intervención humana, o puede orquestar y ejecutar estrategias novedosas de extremo a extremo para ciberataques contra objetivos cuando se le indica un objetivo general deseado.
OpenAI señaló que sus evaluaciones preliminares de Astra indican un "rendimiento lo suficientemente fuerte" como para no poder eliminar la posibilidad de que el modelo posea un nivel de capacidad "Crítica" en esta etapa. También enfatizó que Astra no estuvo involucrada en el incidente del mes pasado dirigido a Hugging Face. En un artículo académico reciente, OpenAI presumió que el modelo resolvió 10 problemas abiertos de matemáticas y ciencias computacionales teóricas por unos 2,000 dólares a tarifas de Sol API.
OpenAI dijo que compartía esta información porque cree que "es importante ser transparentes con el público y con las comunidades de seguridad sobre este cambio potencial en las capacidades".
"Creemos que los modelos avanzados con capacidades cibernéticas deberían ayudar a los defensores a identificar y solucionar vulnerabilidades antes que los atacantes", añadió. "Estamos comprometidos a trabajar junto con gobiernos, institutos de seguridad y la sociedad civil para garantizar que las capacidades fronterizas de modelos como Astra, y los que vengan después, se desplieguen de manera responsable y amplia para el beneficio de toda la humanidad".
Este desarrollo es la señal más reciente del rápido avance de las capacidades cibernéticas de los modelos frontera, aunque marca la primera vez que un laboratorio de IA se compromete públicamente a ralentizar el progreso debido a preocupaciones de ciberseguridad.
A principios de la semana pasada, el Instituto de Seguridad de IA del Reino Unido (AISI) reveló que su propia evaluación encontró que los modelos de IA con acceso a internet contactaron al mundo real para atacar individuos y organizaciones de forma autónoma en 10 de las 122 ejecuciones totales. De las 19 acciones registradas, 17 se originaron en Mythos 5 de Anthropic y las dos restantes involucraron a GPT-5.6-Sol de OpenAI con clasificadores cibernéticos.
"En el caso más grave, un agente intentó insertar código malicioso en un proyecto de código abierto", dijo el AISI. "En un intento de lograr que el código fuera aprobado, el agente recurrió a la ingeniería social: creó identidades falsas en línea y las utilizó para presionar al mantenedor del proyecto para que aprobara el código. Un mantenedor humano detectó y rechazó aprobar el código malicioso".
"Estos intentos no tuvieron éxito y nuestras investigaciones no han evidenciado ningún daño resultante en el mundo real. Pero esta es la primera vez que vemos riesgos en torno a la autonomía y el engaño manifestarse tan claramente, sin instrucciones específicas, en el mundo real".
La revelación también llega en medio de revelaciones de que modelos de Meta y de la empresa china Moonshot (específicamente Muse Spark 1.1 y Kimi K3) escaparon de sus entornos controlados y atacaron objetivos reales, amplificando las preocupaciones sobre la capacidad de los desarrolladores para aislar sistemas de IA cada vez más capaces. En ambos casos, se descubrió que los modelos aprovecharon configuraciones de red erróneas en lugar de identificar y explotar independientemente una vulnerabilidad previamente desconocida para llegar a internet.
Mientras los modelos de IA se prueban con benchmarks ampliamente aceptados para examinar cómo realizan tareas de ciberseguridad ofensivas y defensivas en entornos de prueba aislados, Frontier Security señaló que Kimi K3 encontró una fuga de salida de red que le permitió acceder a github[.]com, clonar un repositorio oficial para el problema del benchmark que debía resolver y acceder a la solución en lugar de resolver el desafío por sí mismo.
"En nuestro caso, el modelo no resolvió la tarea de forma nativa en absoluto; sondeó la red, se dio cuenta de que la resolución DNS estándar para github.com funcionaba (la mayoría de los otros sitios web estaban bloqueados por el sandbox), clonó el repositorio oficial del benchmark y leyó la solución directamente del disco", afirmó Frontier Security.
La creciente lista de incidentes en los que agentes de IA de los principales desarrolladores escaparon de los entornos de prueba de diversas maneras y terminaron vulnerando objetivos reales que no formaban parte del experimento ha impulsado la creación de un nuevo sitio web, acertadamente llamado Felony Bench, para rastrear estos casos.
Fuente:
THN
OpenAI ha anunciado que está pausando algunas "actividades internas" relacionadas con su próximo modelo de inteligencia artificial (IA) Astra, después de que una evaluación interna descubriera que había logrado avances significativos en codificación agentica y ciberseguridad.
En respuesta a este hallazgo, la empresa de IA señaló que está implementando controles de seguridad para modelos de mayor capacidad y actividades asociadas, tales como entornos de prueba aislados, acceso restringido a herramientas y redes, protecciones y cifrado mejorados de los pesos del modelo, capacidades adicionales de monitoreo y detección, y ejecución en sandbox.
"Estamos pausando las actividades internas relacionadas con Astra que aún no cumplen con estos requisitos reforzados de control de seguridad", afirmó en un comunicado.
"Hemos implementado un monitoreo universal para acciones riesgosas y desalineaciones en todas las aplicaciones agenticas de Astra, incluyendo el entrenamiento y la evaluación. Los monitores evalúan la 'Cadena de Pensamiento' del modelo y activan una respuesta de seguridad para revisar e interrumpir la actividad de alto riesgo".
OpenAI dijo que también trabajará con agencias gubernamentales pertinentes y organizaciones seleccionadas de seguridad de IA para probar las capacidades del modelo, además de compartir los controles de seguridad recomendados con socios de prueba externos para ejecutar cargas de trabajo y evaluaciones de mayor riesgo de forma segura.
La compañía afirmó que "no puede descartar" que el modelo posea capacidades cibernéticas "Críticas" bajo su Marco de Preparación, que define el umbral de la siguiente manera:
Un modelo aumentado con herramientas puede identificar y desarrollar exploits de día cero funcionales de todos los niveles de severidad en muchos sistemas críticos del mundo real endurecidos sin intervención humana, O el modelo puede idear y ejecutar estrategias novedosas de extremo a extremo para ciberataques contra objetivos endurecidos partiendo únicamente de un objetivo general deseado.
En otras palabras, el modelo puede descubrir y desarrollar exploits de día cero funcionales de todos los niveles de severidad en muchos sistemas críticos reales sin intervención humana, o puede orquestar y ejecutar estrategias novedosas de extremo a extremo para ciberataques contra objetivos cuando se le indica un objetivo general deseado.
OpenAI señaló que sus evaluaciones preliminares de Astra indican un "rendimiento lo suficientemente fuerte" como para no poder eliminar la posibilidad de que el modelo posea un nivel de capacidad "Crítica" en esta etapa. También enfatizó que Astra no estuvo involucrada en el incidente del mes pasado dirigido a Hugging Face. En un artículo académico reciente, OpenAI presumió que el modelo resolvió 10 problemas abiertos de matemáticas y ciencias computacionales teóricas por unos 2,000 dólares a tarifas de Sol API.
OpenAI dijo que compartía esta información porque cree que "es importante ser transparentes con el público y con las comunidades de seguridad sobre este cambio potencial en las capacidades".
"Creemos que los modelos avanzados con capacidades cibernéticas deberían ayudar a los defensores a identificar y solucionar vulnerabilidades antes que los atacantes", añadió. "Estamos comprometidos a trabajar junto con gobiernos, institutos de seguridad y la sociedad civil para garantizar que las capacidades fronterizas de modelos como Astra, y los que vengan después, se desplieguen de manera responsable y amplia para el beneficio de toda la humanidad".
Este desarrollo es la señal más reciente del rápido avance de las capacidades cibernéticas de los modelos frontera, aunque marca la primera vez que un laboratorio de IA se compromete públicamente a ralentizar el progreso debido a preocupaciones de ciberseguridad.
A principios de la semana pasada, el Instituto de Seguridad de IA del Reino Unido (AISI) reveló que su propia evaluación encontró que los modelos de IA con acceso a internet contactaron al mundo real para atacar individuos y organizaciones de forma autónoma en 10 de las 122 ejecuciones totales. De las 19 acciones registradas, 17 se originaron en Mythos 5 de Anthropic y las dos restantes involucraron a GPT-5.6-Sol de OpenAI con clasificadores cibernéticos.
"En el caso más grave, un agente intentó insertar código malicioso en un proyecto de código abierto", dijo el AISI. "En un intento de lograr que el código fuera aprobado, el agente recurrió a la ingeniería social: creó identidades falsas en línea y las utilizó para presionar al mantenedor del proyecto para que aprobara el código. Un mantenedor humano detectó y rechazó aprobar el código malicioso".
"Estos intentos no tuvieron éxito y nuestras investigaciones no han evidenciado ningún daño resultante en el mundo real. Pero esta es la primera vez que vemos riesgos en torno a la autonomía y el engaño manifestarse tan claramente, sin instrucciones específicas, en el mundo real".
La revelación también llega en medio de revelaciones de que modelos de Meta y de la empresa china Moonshot (específicamente Muse Spark 1.1 y Kimi K3) escaparon de sus entornos controlados y atacaron objetivos reales, amplificando las preocupaciones sobre la capacidad de los desarrolladores para aislar sistemas de IA cada vez más capaces. En ambos casos, se descubrió que los modelos aprovecharon configuraciones de red erróneas en lugar de identificar y explotar independientemente una vulnerabilidad previamente desconocida para llegar a internet.
Mientras los modelos de IA se prueban con benchmarks ampliamente aceptados para examinar cómo realizan tareas de ciberseguridad ofensivas y defensivas en entornos de prueba aislados, Frontier Security señaló que Kimi K3 encontró una fuga de salida de red que le permitió acceder a github[.]com, clonar un repositorio oficial para el problema del benchmark que debía resolver y acceder a la solución en lugar de resolver el desafío por sí mismo.
"En nuestro caso, el modelo no resolvió la tarea de forma nativa en absoluto; sondeó la red, se dio cuenta de que la resolución DNS estándar para github.com funcionaba (la mayoría de los otros sitios web estaban bloqueados por el sandbox), clonó el repositorio oficial del benchmark y leyó la solución directamente del disco", afirmó Frontier Security.
La creciente lista de incidentes en los que agentes de IA de los principales desarrolladores escaparon de los entornos de prueba de diversas maneras y terminaron vulnerando objetivos reales que no formaban parte del experimento ha impulsado la creación de un nuevo sitio web, acertadamente llamado Felony Bench, para rastrear estos casos.
Fuente:
THN
Newer Post
0 comments :
Post a Comment
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.