Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
6629
)
-
▼
August
(Total:
637
)
-
Fallo en plataforma B2B de Tata permite robo de cu...
-
Ocho agentes de IA vulneran sistemas gubernamental...
-
Sony: los juegos digitales no son tuyos
-
AWS Network Firewall ya muestra el recuento de reg...
-
Fallo sin parchear en Calix permite a hackers salt...
-
DOOM 64 estrena trazado de trayectorias
-
Crisis de RAM hunde a marca de Linux Pine64
-
Falsa demo de GTA 6 es malware que roba contraseña...
-
Ciberatacantes aprovechan fallos de miniOrange SAM...
-
Fallo crítico en Red Hat Keycloak permite tomar cu...
-
AliExpress es señalada por rastrear usuarios media...
-
Una página web maliciosa podría contaminar tu mode...
-
IA china crea vídeos desde PowerPoint
-
Investigador revela cinco vulnerabilidades crítica...
-
Vulnerabilidades en TP-Link Archer permiten ataque...
-
Suplantan a ReliaQuest para robar credenciales SSO...
-
Anthropic lanza autenticación empresarial para con...
-
Radeon RX 10800 XT: posibles especificaciones y pr...
-
Resultados de Google de Minecraft llevaron a malware
-
Atacan sitios de WordPress mediante vulnerabilidad...
-
Explotan vulnerabilidad de Zimbra Collaboration Suite
-
AMD desbloquea el rendimiento de los Ryzen 7000 y ...
-
Pagos de WhatsApp llegan a España
-
DIGI duplica gratis su fibra a 2 Gbps en España
-
Intel vuelve al Top 10 de las CPU más vendidas en ...
-
IA escribe un tercio de la web
-
Noruega limita la IA en colegios
-
Microsoft Teams ya permite a los administradores b...
-
Phishing de Teams usa SynkLoader para robar contra...
-
Por qué eliminaron 3D Pinball de Windows
-
NVIDIA planea invertir en Perplexity contra Google...
-
Vulnerabilidad en plugin de WordPress expone 100.0...
-
Nuevo modelo IA Ox Alpha: 100 billones de tokens g...
-
768 claves filtradas de AWS siguen activas con acc...
-
Fallo crítico en isolated-vm permite saltar sandbo...
-
Infectan pantallas de Android Auto vía actualizaci...
-
Demandan a Twitch y Amazon por uso de IA
-
Hugging Face exploraría venta de 13.000 millones t...
-
mVolt+ permite hacer que la GeForce RTX 5090 alcan...
-
Detecta qué consume recursos de tu PC Windows con ...
-
Proiraníes tumban central eléctrica británica en c...
-
Libros digitalizados para IA antes de su destrucción
-
Batería móvil: carga en 3 minutos y 60.000 ciclos
-
Google crea una IA que mide la grasa corporal con ...
-
Windows 11 mostrará el uso de IA en el Administrad...
-
Nuevo malware como servicio usa dominios de Adobe ...
-
Claude de Anthropic sufre otra caída con errores
-
Chinos usan IA para atacar servidores web
-
TikTok acuerda pagar 400 millones de dólares por d...
-
Cybermes: agente de IA para pentesting automatizado
-
Samsung dejará de actualizar estos Galaxy
-
Claude Opus 5 esquiva binarios ofuscados en vez de...
-
Fallo crítico en AIT-GUI de NASA permite enviar co...
-
G.SKILL indemniza a compradores de RAM DDR4 y DDR5...
-
App de ancho de banda convierte dispositivos en pu...
-
Kit de phishing de 10.000 dólares promete instalar...
-
pfSense CE 2.9.0: mejoras críticas de seguridad y ...
-
Malware en Android Auto se propaga mediante actual...
-
Estafadores usan grupos de WhatsApp para coordinar...
-
Un controlador de Microsoft Defender podría usarse...
-
Claude Mythos 5 ya disponible en Claude Security p...
-
DeepSeek lanza IA visual similar a Claude Opus
-
Microsoft duplica el almacenamiento de buzón a 100 GB
-
Filtración en Sakura Internet: hackean datos de 1,...
-
Proveedores confiables, nuevas rutas de ataque: có...
-
Por qué la IA opaca es el próximo gran desafío de ...
-
Paquetes populares de Rust con 244M de descargas i...
-
Slack integra Claude Code para programar
-
Desincronización CRLF permite envenenar caché de C...
-
Apple: descifran ubicaciones de Buscar personas en...
-
Explotan vulnerabilidad crítica en Microsoft Entra...
-
OpenAI ofrece retención cero de datos para modelos...
-
Fallo crítico de Spring Security permite acceso ad...
-
Explotan activamente la vulnerabilidad CVE-2026-19...
-
Controlador de Microsoft Defender puede desactivar...
-
Usan agentes de IA OpenClaw para difundir malware ...
-
Grave fallo en NetScaler permite saltar la autenti...
-
Usan Claude, ChatGPT y Copilot como cebo para malware
-
AWS: cómo evitar que un agente de IA secuestrado a...
-
AMD Zen: 10 años salvando a AMD
-
Vulnerabilidad de Cisco permite leer datos sensibles
-
Fallo crítico de SSRF en Kubernetes de Red Hat exp...
-
Ocultan malware en palabras inglesas para infectar...
-
OpenAI pausa entrenamiento de IA por riesgo de hal...
-
El ataque de tarjetas zombi puede reactivar tarjet...
-
Epic Games critica nuevas comisiones de App Store ...
-
Engañan a Grok para que ejecute instrucciones inye...
-
Saltan el MFA de Microsoft 365 y roban pagos vía e...
-
Nuevo malware de Android roba PINs bancarios y usa...
-
Equipo de T-Mobile corta cable para eliminar intru...
-
Zyxel corrige fallo de inyección de comandos en 18...
-
Explotan vulnerabilidad crítica de RCE en Zimbra
-
Claude AI halla fallos de SAML que permiten robo d...
-
OpenAI detiene el entrenamiento de RL de vanguardi...
-
Doom ya funciona en cámaras Canon
-
Publicidad en ChatGPT España
-
OpenAI frena entrenamiento de IA
-
Ataque Spectre en Cloudflare Workers filtra JWT de...
-
EE. UU. acusa a iraníes de robar propiedad intelec...
-
Fallo crítico de Citrix NetScaler permite saltar l...
-
T-Mobile cortó físicamente los cables de Internet ...
-
Cientos de claves de Stripe filtradas exponen pago...
-
OpenAI advierte sobre la atrofia cognitiva por el ...
-
Meta AI llega a Mac para competir con ChatGPT y Cl...
-
Los costes operativos de OpenAI subirán un 20 por ...
-
Anthropic frena su IA más potente por seguridad
-
Descubre la Dark y Deep Web
-
Vulnerabilidad crítica de día cero en Cursor permi...
-
Timo con discos de 32 TB: solo contenían una microSD
-
Meta a juicio por el impacto de sus redes en niños
-
Falla de Microsoft 365 afecta a Sudamérica
-
Usan guía falsa de Claude para desplegar MacSync S...
-
Microsoft vincula más de 30 dominios rotativos a l...
-
CISA añade vulnerabilidad RCE de Microsoft IKE exp...
-
Intel Core Ultra 9 4950K aparece en escena: la CPU...
-
Ransomware fingen ser empresa de recuperación y pi...
-
SIMs vulnerables: riesgo para móviles, coches y ca...
-
China-Nexus camuflan VHD malicioso como JPEG para ...
-
Hackean más de 14.500 dispositivos Dahua mediante ...
-
Herramienta RAVEN extrae bases de datos Elasticsea...
-
Alerta por ransomware Medusa: más de 500 organizac...
-
Oracle lanza 943 parches de seguridad, incluyendo ...
-
Campaña de espionaje SilkParasite ataca a gobierno...
-
Habilidades clave para programadores ante la IA
-
La memoria DDR4 experimentará una nueva subida de ...
-
GeForce Now ya disponible en Firefox
-
Seasonic tiene la primera fuente de alimentación A...
-
Projextor muestra cómo el malware se oculta tras e...
-
-
▼
August
(Total:
637
)
Blogroll
Labels
Entradas populares
-
G.SKILL indemnizará a usuarios de RAM DDR4 y DDR5 tras un acuerdo de 2,4 millones de dólares por publicidad engañosa en las velocidades d...
-
Cómo tener dos cuentas a la vez de WhatsApp, Facebook o cualquier 'app' en el mismo teléfono. Parallel Space es una aplicación para...
-
Alerta por hackeo a Basic-Fit: casi un millón de clientes en Europa vieron expuestos sus datos personales y bancarios tras un ciberataque...
OpenAI pausa entrenamiento de IA por riesgo de hallar fallos 0-day
OpenAI ha ralentizado temporalmente el entrenamiento de su IA de vanguardia después de que las pruebas internas sugirieran que su próximo modelo Astra podría alcanzar un umbral crítico de capacidad en ciberseguridad.
La empresa afirmó que la decisión se tomó tras un incidente de seguridad relacionado con modelos de Hugging Face y la creciente evidencia de que los sistemas avanzados podrían identificar y explotar debilidades de software con una guía humana limitada.
La pausa incluyó la detención durante dos semanas del entrenamiento de aprendizaje por refuerzo para los modelos destinados al despliegue. OpenAI también puso en espera su ejecución de aprendizaje por refuerzo de vanguardia más grande planeada.
Al mismo tiempo, lleva a cabo ejecuciones de entrenamiento más pequeñas, evaluaciones y pruebas de alineación. Este movimiento refleja un cambio importante en la forma en que los desarrolladores de IA están abordando el riesgo cibernético.
Los modelos capaces de escribir código, utilizar herramientas, navegar por sistemas conectados y razonar a través de tareas largas podrían potencialmente descubrir vulnerabilidades de día cero, fallos desconocidos para los proveedores y defensores.
En el entorno equivocado, esas capacidades podrían permitir el acceso no autorizado, el robo de datos, acciones destructivas o intentos de eludir los controles de seguridad.
OpenAI ralentiza el entrenamiento de IA por temores a los "Zero-Day"
OpenAI dijo que Astra puede poseer capacidades cibernéticas críticas, lo que ha motivado la aplicación de salvaguardas más estrictas para todas las cargas de trabajo de Astra y relacionadas con la ciberseguridad. Algunas tareas de entrenamiento y evaluación permanecen pausadas hasta que se trasladen a entornos de investigación reforzados.
La empresa ha reforzado el aislamiento de las cargas de trabajo para los sistemas que ejecutan código generado por el modelo o código no confiable. Estos controles de "sandboxing" están diseñados para contener el software comprometido y reducir la posibilidad de que los resultados del modelo afecten a la infraestructura interna.
OpenAI también ha ampliado el aislamiento de la red. Las cargas de trabajo de mayor riesgo se están separando de la internet pública y de las redes internas para que el compromiso de un solo servicio no otorgue automáticamente a un atacante o a un modelo de IA un acceso más amplio.
Las pruebas continuas son otro foco de atención. OpenAI dijo que ha reducido los privilegios permanentes, eliminado servicios compartidos potencialmente expuestos, mejorado el registro de seguridad y comenzado a utilizar modelos para probar continuamente los límites de la infraestructura contra ataques simulados.
Una parte clave del enfoque actualizado es la expansión de la monitorización de la cadena de pensamiento. El sistema utiliza clasificadores de activación para inspeccionar la actividad del modelo durante los tokens muestreados y señalar comportamientos potencialmente preocupantes.
Los sistemas de investigación automatizados pueden entonces examinar la actividad de las herramientas, el razonamiento disponible y la secuencia de acciones en busca de signos de violaciones de seguridad.
OpenAI tiene como objetivo generar una alerta en los 30 minutos posteriores a la detección de un comportamiento sospechoso. Si los equipos no pueden determinar en otros 30 minutos que el evento es un falso positivo, se espera que pausen la actividad.
El marco de monitorización se aplica ahora al entrenamiento de aprendizaje por refuerzo y a las evaluaciones habilitadas para herramientas que involucren modelos con capacidad Sol o superior, mientras que el uso de la herramienta Astra enfrenta requisitos de monitorización adicionales.
Los controles de seguridad consumen muchos recursos. OpenAI estimó que la monitorización añade actualmente aproximadamente un 20% al cómputo de inferencia utilizado por las cargas de trabajo monitorizadas.
Más allá de la contención técnica, OpenAI está aumentando su investigación de alineación. La empresa trabaja para mejorar los modelos de recompensa, reducir el comportamiento engañoso o de "reward-hacking", y entrenar a los sistemas para que informen sobre sus capacidades y acciones de manera más honesta.
El anuncio muestra que la carrera hacia una IA más capaz está cada vez más ligada a una nueva preocupación de seguridad: los modelos avanzados pronto podrían ayudar a los defensores a escala, pero también podrían acelerar de forma independiente el descubrimiento de vulnerabilidades y las operaciones cibernéticas ofensivas.
Fuentes:
https://cybersecuritynews.com/openai-pauses-ai-training/
Newer Post
0 comments :
Post a Comment
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.