Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
7095
)
-
▼
septiembre
(Total:
353
)
-
Bluetooth 6: 5 mejoras clave
-
Un supervisor de aduanas robaba componentes en ord...
-
WhatsApp limitará chats al teléfono principal
-
Diablo V es oficial y llegará en 2029
-
IBM y NASA crean IA lunar abierta
-
Filtración en Revolut expone pasaportes e historia...
-
iOS 27: novedades del lanzamiento
-
Irán usó Claude para misiles y buques
-
AMD lanza nuevos Ryzen 5
-
Crea apps de Windows gratis en 30 minutos
-
Grupos rusos usan GuardBreaker para sabotear análi...
-
El sistema de verificación de edad de Steam en Aus...
-
Filtración de Harley-Davidson: CL0P Ransomware aña...
-
Instagram permite añadir fotos etiquetadas al perfil
-
Agentes de OpenAI inundan RubyGems con 2.000 paque...
-
Falsa copia de GTA 6 propaga malware
-
Vulnerabilidad en cPanel CSF permite ejecución rem...
-
Linux Mint expande XApp
-
Jensen Huang afirma que la AGI ya existe
-
El 11-S, revivido mediante las emisiones de televi...
-
Ataques de phishing basados en passkeys provocan e...
-
GitLab pide a sus usuarios corregir una vulnerabil...
-
Nuevo ransomware de Android graba pantallas, roba ...
-
China da otro paso hacia la autosuficiencia en chi...
-
Cómo programar mensajes de WhatsApp en iPhone y An...
-
Microsoft renovará el cursor de Windows
-
Filtran el visor Project Phoenix de Meta
-
Equivalencias de GPUs integradas 2026
-
Vulnerabilidades de Artifactory encadenadas para d...
-
Agentes de OpenAI vinculados a campaña de RubyGems...
-
RTX 5090 con 8 pines: no a la venta
-
Hackers utilizaron Claude para extraer secretos de...
-
Anthropic banea a científicos por investigar armas...
-
Florida confirma filtración de datos del DMV tras ...
-
Empleado de tienda AT&T condenado a 16 meses de pr...
-
DeepSeek 4.1 Flash supera a OpenAI y Anthropic por...
-
Steam mejora Linux y lanza Big Art Mode
-
CUDA 13.4 une Windows on Arm, RTX Spark y Rubin
-
Claude fue empleado para automatizar el robo de da...
-
Vulnerabilidad crítica de lectura de archivos en G...
-
Miembro de la banda de ransomware Conti condenado ...
-
Multa de 30 millones a IPTV pirata
-
Ya disponible Ubuntu 24.04.5 LTS con kernel Linux ...
-
Vulnerabilidades críticas de VPN de Check Point pe...
-
OpenAI podría pausar suscripciones Pro por demanda...
-
iPhone 18 Pro Max vs iPhone 17 Pro Max: diferencias
-
ShinyHunters filtra datos de 6,4 millones de perso...
-
Fallos en LiteLLM permiten ejecutar código como ro...
-
Hackers usan falsas descargas de GTA 6 para desple...
-
Usan fallo crítico de Cisco para obtener acceso ro...
-
WordPress usa IA para frenar actualizaciones malic...
-
Las GeForce RTX 20 reciben el DLSS Frame Generatio...
-
Miles de aplicaciones engañosas de Android aprovec...
-
Google dona a Linux para mejorar la privacidad dig...
-
Cazador de vulnerabilidades de Microsoft publica u...
-
Anthropic descubre un cuarto posible delito cometi...
-
El Snapdragon 8 Elite Gen 6 aparece en Geekbench 7...
-
Contratista dental creó cuenta secreta para accede...
-
OpenSSL 4.1.0 Alpha1 con DTLS 1.3 y criptografía p...
-
Vulnerabilidad en PAN-OS de Palo Alto permite ejec...
-
OpenAI crea fábrica de defensa donde agentes de IA...
-
Clonan apps bancarias en perfiles de Android
-
Linux limpiará el kernel de ARM
-
Halla 10.000 euros en RAM en su garaje
-
Cisco confirma que el fallo CVE-2026-20079 de Secu...
-
Modelos de Claude AI accedieron sin permiso a sist...
-
Casi el 10% de los gateways de LiteLLM expuestos a...
-
AirPods 5: ANC y menor precio
-
Encadenan vulnerabilidades de Chrome y Windows en ...
-
Usan falsas ofertas de LinkedIn para infectar desa...
-
Usan Claude y GPT para vulnerar redes gubernamenta...
-
Investigador revierte código de Stuxnet y lo publi...
-
EE. UU. denuncia que empresas chinas extrajeron mi...
-
El Skylab y el ordenador de IBM que despertó tras ...
-
Ex Anthropic advierte que la IA podría matarnos an...
-
Usan IA autónoma para robar credenciales masivamen...
-
Thundermail lanza su acceso temprano
-
Filtración de logs de infostealers revela tokens d...
-
Linux en PS5 avanza y amplía compatibilidad
-
Cuatro grupos de espionaje emplearon el mismo kit ...
-
Fallo en ChatGPT permitió que un prompt infiltrado...
-
ClearFake lanza troyano que anula herramientas EDR...
-
Usan agentes de IA para atacar fallos de PaperCut ...
-
El Gobierno de España instala tres puntos de WiFi ...
-
CISA advierte sobre vulnerabilidad RCE de N-able N...
-
iPhone Duo Ultra vs Galaxy Z Fold 8: el duelo pleg...
-
EE. UU. acusa a empresas chinas de IA de copiar mo...
-
Vulnerabilidad en Cliente de Escritorio Remoto de ...
-
Ingeniero de ARM optimiza código de IA para Linux
-
Experto en seguridad afirma que un grupo aeroportu...
-
Usan Google Sheets para robar billeteras cripto en...
-
QNAP lanza los nuevos NAS TVS-h877AX, TVS-h1277AX ...
-
iPhone Duo: plegable de 2.000 dólares
-
Gusano de WeChat podría infectar a un amigo inclus...
-
Windows 11 recibe su actualización más importante ...
-
Vulnerabilidad en Microsoft Teams para Android exp...
-
Líder de banda de ciberdelincuentes de 22 años, qu...
-
EE. UU. desmantela mercado de estafas de Xinbi Gua...
-
Chrome 153 corrige 230 vulnerabilidades, incluido ...
-
Microsoft amplía Family Safety con verificación de...
-
Vulnerabilidad en FortiSandbox permite acceso a in...
-
Actualización de seguridad de Android septiembre 2...
-
Récord de parches en Windows 11
-
Fallos críticos en ArangoDB permiten saltar autent...
-
Vulnerabilidad de MapLibre expone a 2,7M de usuari...
-
Vulnerabilidad de BitLocker permite ejecutar códig...
-
Corea del Norte lanza kit espía para Linux
-
Nuevo 0-Day de Windows Defender evade parche para ...
-
Pentágono busca IA sumisa para militares
-
Apple lanza el iPhone Duo plegable
-
iPhone 18 Pro: más potencia y cámara
-
OpenAI resuelve enigma matemático bajo sospecha de...
-
Nuevo fallo en cPanel permite ejecutar código como...
-
Malware de F5 BIG-IP APM evade escaneos de disco a...
-
Nintendo celebra 40 años de Zelda con novedades y ...
-
DLSS Frame Generation llega a RTX 30
-
Meta lanza Muse, su IA más polémica
-
Grave vulnerabilidad en Alby Hub podría permitir e...
-
Fallo en DeepSeek permitió que agentes de IA desac...
-
La Radeon RX 9070 XT ya es la GPU dedicada de AMD ...
-
Fallo en ChatGPT Sandbox permite robar datos de Gm...
-
Hackers de Liquid devuelven 3.400 Bitcoin robados ...
-
Cadena de vulnerabilidades en FreeIPA permite que ...
-
Mali G2-Ultra NX: potencia gráfica total en móviles
-
EE. UU. ofrece 10 millones por jefe cibernético iraní
-
RTX 50 y RX 9000 subirán de precio
-
Crea apps para Windows en 30 minutos con la IA de ...
-
ShinyHunters accedió a 6 millones de clientes con ...
-
-
▼
septiembre
(Total:
353
)
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
Entradas populares
-
LG enfrenta graves acusaciones de invadir la privacidad al capturar audio y datos personales de sus Smart TVs, incluso en modo espera. Según...
-
Anthropic ha bloqueado a cinco científicos que utilizaban la IA Claude para realizar investigaciones biológicas vinculadas al desarrollo d...
-
La policía alemana intercepta comunicaciones de WhatsApp, Telegram y Signal vinculando clientes Web o Desktop a las cuentas investigadas p...
OpenAI retrasa su IA más potente
OpenAI ha decidido retrasar el lanzamiento de Astra para reforzar la seguridad y evitar que el modelo se salga de control.

OpenAI pospone la llegada de Astra
- La compañía OpenAI ha optado por aplazar el estreno de Astra, su nueva y avanzada inteligencia artificial. Esta decisión responde a la necesidad de reforzar los protocolos de seguridad para garantizar que la herramienta no presente comportamientos imprevistos o peligrosos.
- El objetivo principal es evitar riesgos críticos y prevenir incidentes de ciberseguridad similares a los ocurridos anteriormente con otros agentes autónomos en la industria.
OpenAI ha decidido retrasar el lanzamiento de Astra, su próximo modelo de IA. A unas semanas de pausar su desarrollo, la empresa confirmó que se tomará un tiempo para reforzar la seguridad y evitar que se salga de control. OpenAI quiere evitar otro incidente como el hackeo a Hugging Face, en donde un agente autónomo de la compañía escapó de un entorno seguro.
De acuerdo con una publicación en su blog, OpenAI confirmó que Astra es el primer modelo que clasifica dentro del umbral crítico de capacidad de ciberseguridad. Con las herramientas y el acceso adecuados, la IA podría encontrar fallos de seguridad desconocidos y desarrollar exploits en sistemas bien protegidos. OpenAI añadió que su modelo puede conseguirlo de forma autónoma, sin que un humano tenga que guiar cada paso.
Si bien OpenAI y Anthropic han jugado con la carta del miedo para promocionar sus modelos más potentes de IA, el caso de Astra es notable. Antes de enfocarse en las capacidades destructivas, los creadores de ChatGPT confirmaron que este modelo no tuvo nada que ver con el hackeo de Hugging Face en julio. Este incidente terminó marcando la agenda de seguridad de la compañía, que se dedicó a reforzar las protecciones contra acciones no autorizadas que pudiera ejecutar con su cuenta.
En ExploitBench, la prueba que evalúa la capacidad de un modelo para desarrollar exploits a partir de vulnerabilidades conocidas, Astra obtuvo una puntuación del 100%. Para confirmar este hallazgo, OpenAI construyó un benchmark interno con 20 vulnerabilidades de alta severidad. En esta prueba, Astra descubrió y utilizó dos vulnerabilidades de día cero dentro de una cadena de explotación, las cuales reportará OpenAI a los responsables de parchearlas.
Astra también consiguió escapar del entorno seguro y ejecutó comandos en el ordenador de su propietario.

OpenAI no quiere que Astra siga hackeando sin control
Luego del hackeo a Hugging Face, OpenAI pausó el entrenamiento de Astra para reforzar su seguridad. La compañía revela que implementó controles de aislamiento y red, así como umbrales de alineación más estrictos. OpenAI también entrenó a Astra para rechazar solicitudes "potencialmente dañinas" relacionadas con ciberseguridad.
En caso de que alguien planee usar la IA como herramienta de hackeo, primero tendrá que encontrar la forma de vulnerar estas medidas. La compañía afirma que existen nuevos procesos de monitoreo capaces de detener una actividad no autorizada.
Para poner a prueba su efectividad, OpenAI desarrolló otro benchmark inspirado en el incidente de Hugging Face. Al intentar inducir a sus dos modelos más potentes para comprometer una infraestructura de seguridad, la compañía descubrió que GPT-5.6 Sol cayó en la trampa en más de la mitad de los intentos. Astra, según OpenAI, no lo hizo en ninguno.
Lamentablemente para los usuarios, la compañía no tiene una fecha definida para el lanzamiento de Astra. OpenAI dijo que el acceso a las capacidades más avanzadas de ciberseguridad estará limitado a un grupo reducido de evaluadores. Hace unos días, la empresa amplió su programa de seguridad Daybreak a dos categorías: una para acceder a los modelos para usarlos de forma defensiva y otra para orquestar ataques y desarrollar exploits.
Fuentes:
https://hipertextual.com/inteligencia-artificial/openai-retrasa-astra-ciberseguridad/
Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.