Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
6798
)
-
▼
septiembre
(Total:
56
)
-
La nueva ley cibernética del Reino Unido se enfoca...
-
PS5 suma más de 100 canales gratis
-
FBI y CrowdStrike desmantelan botnet Sality de 20 ...
-
Google corrige 26 vulnerabilidades de Chrome, incl...
-
Lanzan WinBtrfs 1.10
-
OpenAI retrasa su IA más potente
-
La policía y CrowdStrike desmantelan la botnet Sal...
-
Filtradas cuentas de Dropbox por fallo en la verif...
-
OWASP lanza iniciativa OASIS AI para corregir vuln...
-
Desmantelada la infraestructura de la botnet Salit...
-
Anthropic lanza Claude Fable y Mythos 5.1 para pro...
-
Claude Fable 5.1 eleva su rendimiento en ciencia y...
-
El AMD Ryzen 9 9950X3D queda al descubierto: solo ...
-
Bancos frenan financiación de centros de datos de IA
-
LaLiga usa IA contra el fútbol pirata
-
Anthropic lanza Claude Mythos y Fable 5.1 más pote...
-
Astra de OpenAI halla fallos de seguridad y crea e...
-
Meta crea IA que distingue 20 voces
-
Más de 21,000 servidores Microsoft Exchange siguen...
-
Ciberataque a Boston Scientific interrumpe producc...
-
Usan enlaces reales de ChatGPT para instalar malwa...
-
WordPress usa IA para hallar fallos de seguridad
-
Casi 22.000 servidores de Microsoft Exchange en ri...
-
Google lanza Pics para competir con Canva
-
Cinco venezolanos se declaran culpables de vaciar ...
-
Fingen ser reclutadores para infectar a desarrolla...
-
Explotan fallos críticos en Langflow y Rails
-
Firefox 155: actualizaciones cada dos semanas
-
Filtración de datos en Novocure afecta a más de 1....
-
13 paquetes maliciosos de Packagist atacan iPhones...
-
Cronos reinicia su blockchain tras el hackeo de 74...
-
Ciberataques sanitarios afectan a marcapasos y a m...
-
Atacantes aprovechan fallos críticos en Langflow y...
-
OpenClaw 2.0 intenta maquillar un desastre de segu...
-
IA desborda a mantenedores de Linux con fallos
-
Microsoft advierte sobre ataques de TerminalFix qu...
-
El MacBook Neo desgasta el SSD de forma exagerada ...
-
Iraníes se hacen pasar por reclutadores para distr...
-
ChatGPT supera los 45 millones de usuarios y las o...
-
Vulneran routers de Cisco para espiar redes e infr...
-
UE clasifica a ChatGPT, Reddit y Roblox como gigan...
-
Sony y Warner demandan a Anthropic por robo de can...
-
Atacan cuentas root de AWS en más de 150 organizac...
-
Secuestro de BGP desvía tráfico de Softaculous par...
-
HardBreacher reporta zero-day de escalada de privi...
-
El fraude laboral de Corea del Norte se extiende m...
-
Project Helix superará a Xbox
-
Detectan 19 extensiones de Chrome y Edge diseñadas...
-
TerminalFix despliega backdoor de túnel inverso me...
-
Brave lanza alias de correo para proteger tu priva...
-
Fallos en routers D-Link permiten cambiar contrase...
-
Android 17 añade protección contra el rastreo Wi-Fi
-
Debian permite la IA generativa en Linux
-
KVM: varias PC en un solo ordenador
-
Ubuntu 26.04.1 LTS ya disponible
-
KDE Gear 26.08: novedades en Dolphin
-
-
▼
septiembre
(Total:
56
)
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
Entradas populares
-
Python 3.15 ya es oficial, introduciendo optimizaciones en TypedDict, Tachyon, JIT y soporte ABI para mejorar la productividad del ecosist...
-
La UE propone un temporizador de 30 minutos para bloquear el fútbol pirata y las IPTV, basándose en el modelo italiano Piracy Shield, afect...
-
Dopamine 3.0 ha lanzado el jailbreak para iOS 26 , confirmando que estas herramientas de desbloqueo siguen vigentes a pesar de las restricc...
OpenAI retrasa su IA más potente
OpenAI ha decidido retrasar el lanzamiento de Astra para reforzar la seguridad y evitar que el modelo se salga de control.

OpenAI pospone la llegada de Astra
- La compañía OpenAI ha optado por aplazar el estreno de Astra, su nueva y avanzada inteligencia artificial. Esta decisión responde a la necesidad de reforzar los protocolos de seguridad para garantizar que la herramienta no presente comportamientos imprevistos o peligrosos.
- El objetivo principal es evitar riesgos críticos y prevenir incidentes de ciberseguridad similares a los ocurridos anteriormente con otros agentes autónomos en la industria.
OpenAI ha decidido retrasar el lanzamiento de Astra, su próximo modelo de IA. A unas semanas de pausar su desarrollo, la empresa confirmó que se tomará un tiempo para reforzar la seguridad y evitar que se salga de control. OpenAI quiere evitar otro incidente como el hackeo a Hugging Face, en donde un agente autónomo de la compañía escapó de un entorno seguro.
De acuerdo con una publicación en su blog, OpenAI confirmó que Astra es el primer modelo que clasifica dentro del umbral crítico de capacidad de ciberseguridad. Con las herramientas y el acceso adecuados, la IA podría encontrar fallos de seguridad desconocidos y desarrollar exploits en sistemas bien protegidos. OpenAI añadió que su modelo puede conseguirlo de forma autónoma, sin que un humano tenga que guiar cada paso.
Si bien OpenAI y Anthropic han jugado con la carta del miedo para promocionar sus modelos más potentes de IA, el caso de Astra es notable. Antes de enfocarse en las capacidades destructivas, los creadores de ChatGPT confirmaron que este modelo no tuvo nada que ver con el hackeo de Hugging Face en julio. Este incidente terminó marcando la agenda de seguridad de la compañía, que se dedicó a reforzar las protecciones contra acciones no autorizadas que pudiera ejecutar con su cuenta.
En ExploitBench, la prueba que evalúa la capacidad de un modelo para desarrollar exploits a partir de vulnerabilidades conocidas, Astra obtuvo una puntuación del 100%. Para confirmar este hallazgo, OpenAI construyó un benchmark interno con 20 vulnerabilidades de alta severidad. En esta prueba, Astra descubrió y utilizó dos vulnerabilidades de día cero dentro de una cadena de explotación, las cuales reportará OpenAI a los responsables de parchearlas.
Astra también consiguió escapar del entorno seguro y ejecutó comandos en el ordenador de su propietario.

OpenAI no quiere que Astra siga hackeando sin control
Luego del hackeo a Hugging Face, OpenAI pausó el entrenamiento de Astra para reforzar su seguridad. La compañía revela que implementó controles de aislamiento y red, así como umbrales de alineación más estrictos. OpenAI también entrenó a Astra para rechazar solicitudes "potencialmente dañinas" relacionadas con ciberseguridad.
En caso de que alguien planee usar la IA como herramienta de hackeo, primero tendrá que encontrar la forma de vulnerar estas medidas. La compañía afirma que existen nuevos procesos de monitoreo capaces de detener una actividad no autorizada.
Para poner a prueba su efectividad, OpenAI desarrolló otro benchmark inspirado en el incidente de Hugging Face. Al intentar inducir a sus dos modelos más potentes para comprometer una infraestructura de seguridad, la compañía descubrió que GPT-5.6 Sol cayó en la trampa en más de la mitad de los intentos. Astra, según OpenAI, no lo hizo en ninguno.
Lamentablemente para los usuarios, la compañía no tiene una fecha definida para el lanzamiento de Astra. OpenAI dijo que el acceso a las capacidades más avanzadas de ciberseguridad estará limitado a un grupo reducido de evaluadores. Hace unos días, la empresa amplió su programa de seguridad Daybreak a dos categorías: una para acceder a los modelos para usarlos de forma defensiva y otra para orquestar ataques y desarrollar exploits.
Fuentes:
https://hipertextual.com/inteligencia-artificial/openai-retrasa-astra-ciberseguridad/
Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.