Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
5830
)
-
▼
July
(Total:
548
)
-
NodeBB corrige ocho fallos detectados por IA que c...
-
Origin, proveedora energética australiana, informa...
-
Vulnerabilidad grave en el sistema de archivos de ...
-
Vulnerabilidad de Exim permite escalada de privile...
-
Next.js corrige nueve fallos de seguridad de SSRF,...
-
Musk creará película de La Odisea con Grok
-
Intel y AMD hacen caja con China: desde enero las ...
-
Google implementa recuperación mediante video self...
-
Fallos preocupantes en ChatGPT
-
Apple bloqueará dispositivos por impagos en iOS 27
-
Bloqueador de anuncios ultra eficiente por 5 euros
-
Una línea oculta de texto web convierte AWS Kiro e...
-
Hackean la Academia Diplomática de Corea del Sur y...
-
CISA: Grupos de Irán atacan PLCs de Rockwell en in...
-
EEUU probará drones contra incendios
-
Multa récord a Google en Europa
-
Publicado PoC de vulnerabilidad de escalada de pri...
-
Anthropic lanza plugin de seguridad de Claude para...
-
Chick-fil-A pide cambiar contraseñas por acceso no...
-
Fallo en extensión de Adobe Acrobat permite robar ...
-
EE UU acusa a IA china Kimi K3 de plagio
-
Check Point corrige vulnerabilidad en SmartConsole...
-
Webs consideran abandonar Google por el impacto de...
-
Fallo en la extensión de Adobe Acrobat permitía a ...
-
Vulnerabilidad crítica de ejecución remota de códi...
-
Un empleado del Ayuntamiento se libra de la cárcel...
-
xMEMS XMC-1200, el micro ventilador más pequeño de...
-
China evalúa restringir exportaciones de IA y el u...
-
El equipo del kernel de Linux lanza 432 CVE en sol...
-
OpenAI afirma que sus modelos de IA evadieron el e...
-
Datos de Cloudflare revelan qué selecciones del Mu...
-
Roban sesiones de Microsoft 365 tras el MFA
-
Atacantes de Qilin Ransomware aprovechan vulnerabi...
-
Usan GitHub Actions para insertar RAT Miasma en pa...
-
El gigante ferroviario suizo Stadler rechaza pagar...
-
Usan juegos falsos para robar contraseñas y cripto...
-
Ransomware Qilin: récord de 1.358 víctimas globales
-
FluentCleaner Classic: Windows ligero y open source
-
Actualización de Chrome corrige 12 vulnerabilidades
-
Instagram permitirá cambiar el audio de las public...
-
ASUS corrige vulnerabilidad crítica en routers que...
-
Nueva herramienta NULLZEREPTOOL usa Telegram para ...
-
Vulnerabilidad en Microsoft Azure DevOps permite q...
-
Francia prohíbe redes sociales a menores de 15 años
-
LaLiga pierde el juicio: el TJUE dice que el uso d...
-
EE. UU. clausura más de 1.000 webs en ofensiva con...
-
OpenAI reconoce haber originado el ataque de agent...
-
Fallo en Azure DevOps permite que comentarios ocul...
-
Vulnerabilidad de Meta expuso correos, chats y arc...
-
La policía desmantela la plataforma de phishing Kr...
-
La Steam Deck se hunde en ventas tras la subida de...
-
SolarWinds corrige 15 fallos críticos de Serv-U qu...
-
Agencia gubernamental británica detecta trampas co...
-
DLSS 5 optimiza rendimiento y arte
-
La policía desarticula el kit de phishing Kratos d...
-
Gemini 3.5 Flash Cyber detecta y parchea vulnerabi...
-
OpenAI revela que sus modelos de IA lograron vulne...
-
Renuncia el jefe de seguridad de IA de Trump a los...
-
Secuestran más de 20 webs gubernamentales para dis...
-
Investigador anónimo filtra 204 exploits 0-day ant...
-
Google presenta Gemini 3.5 Flash Cyber AI para det...
-
España multa a 23andMe con 2,4 millones de euros p...
-
Los fabricantes de Estados Unidos, Japón y Corea d...
-
Fallo en AWS Kiro permitía que páginas web malicio...
-
Firefox lanza contenedores globales y nuevas funci...
-
FRITZ!OS 8.20: sistema operativo inteligente
-
Trabajos de entrenamiento de IA contra la red eléc...
-
Taiwán obligará a TSMC a generar su propia energía
-
GTX 1060: 10 años de un icono gama media
-
Filtración de datos de Craneware: hackers robaron ...
-
Estafadores se hacen pasar por el FBI en redes soc...
-
Microsoft crea cristal que almacena datos por 10.0...
-
Usan vulnerabilidad de PAN-OS de Palo Alto para de...
-
Ciberatacantes aprovechan vulnerabilidad crítica d...
-
Optimiza la seguridad de Windows desactivando esta...
-
Parches no oficiales y gratuitos para la vulnerabi...
-
Los 10 malware más activos la semana pasada
-
Nuevo ransomware ENCFORGE ataca archivos de modelo...
-
Cómo conectar tu móvil gratis a Starlink: requisit...
-
Trump busca prohibir la IA china Kimi K3
-
Zimbra corrige vulnerabilidades críticas de inyecc...
-
Grave vulnerabilidad en Gitea permite escribir en ...
-
Anthropic pagará a autores por usar sus libros sin...
-
Robots de Xiaomi logran 98% de precisión en fábric...
-
PentDEM: frameworks de pentesting inteligentes
-
Un análisis del SoC Kirin 9030 demuestra que China...
-
Más de 55 millones de cuentas comprometidas en el ...
-
Furtex: kit de Linux para post-explotación y evasi...
-
Rumanía se quedó sin registro de la propiedad porq...
-
OVH desvela un plan semicubierto para solucionar u...
-
Memoria DDR5 alcanza precio récord en julio
-
Detenido por robar 200.000 euros con malware en Steam
-
Punto ciego de Microsoft Defender XDR puede oculta...
-
Un modder hace una PS4 V2 portátil con pantalla OL...
-
Microsoft lanza actualización KB5121767 para corre...
-
Usan bots de Telegram como puertas traseras en sis...
-
Líderes tecnológicos felicitan a España campeona d...
-
UE multa a AliExpress con 550 millones por product...
-
Linux corrige más de 400 vulnerabilidades del kern...
-
Adobe lanza una IA revolucionaria para fotografía
-
Aumentan los ataques de wp2shell en WordPress impu...
-
Robotaxi de Tesla choca siendo conducido remotamente
-
Fallo crítico en la plataforma de IA de ServiceNow...
-
Fallo en Kimai Docker permite robo de cuentas medi...
-
LG instalaría adware en Windows mediante una app
-
Microsoft recreó cabina de avión para probar sonid...
-
Caviar vende un Z Fold 8 de oro con Messi por 11.0...
-
3 herramientas gratuitas para monitorizar tu red d...
-
Nueva vulnerabilidad en 7-Zip permitiría la ejecuc...
-
Publicado PoC para vulnerabilidad crítica de RCE e...
-
Publican datos de Starbucks en foros
-
Siete paquetes maliciosos de Vite en npm emplean C...
-
En España los Hospitales y empresas tendrán su pro...
-
1Password integrará Claude para usar tus credenciales
-
Abuso de Windows Bind Link permite cegar EDR y eva...
-
PentestCode: nuevo agente de IA que automatiza pru...
-
Caos en Amazon Web Services por facturas millonarias
-
Vulnerabilidad crítica RCE wp2shell: cobertura, Po...
-
Servidor expuesto revela kit de phishing basado en...
-
Google crea chip para potenciar su IA
-
Acelera el arranque de Windows sin programas
-
Vulnerabilidad de 15 años en NGINX permite ejecuta...
-
Apple Music sube precios en España
-
NVIDIA lanza los primeros drivers para RTX Spark e...
-
Avances en las pruebas para clasificar a las IAs s...
-
Inteligencia rusa hackea cámaras IP para espiar lo...
-
Grave vulnerabilidad en F5 NGINX podría provocar c...
-
Explotan vulnerabilidades de Microsoft SharePoint ...
-
-
▼
July
(Total:
548
)
Blogroll
Labels
Entradas populares
-
Se publicaron 432 CVE del kernel de Linux en solo dos días, generando preocupación entre los administradores de sistemas por la dificultad d...
-
Acelerar el arranque de Windows es posible utilizando las herramientas propias del sistema operativo , evitando así el uso de software exte...
-
ZedAxis ha creado un bloqueador de anuncios por hardware de 5 euros que filtra más de medio millón de dominios consumiendo solo 4 MB de m...
Anthropic reactiva Claude Fable 5 tras el levantamiento de controles de exportación por jailbreak en EE. UU
Anthropic restableció el acceso global a Claude Fable 5 luego de que el gobierno de EE. UU. levantara controles de exportación impuestos por un fallo de seguridad. Para solucionar el problema, la empresa implementó un nuevo filtro de seguridad y acordó coordinar futuros lanzamientos con las autoridades. El incidente resalta la tensión entre la innovación de la IA y el riesgo de que estas herramientas sean usadas para ciberataques.
Anthropic está reactivando Claude Fable 5 en todo el mundo. El 30 de junio enlace, el Departamento de Comercio de los EE. UU. levantó los controles de exportación que había impuesto a Fable y a su hermano más controlado, Mythos 5, hace unas dos semanas y media.
Fable 5 vuelve a los usuarios el miércoles 1 de julio en Claude.ai, la Plataforma Claude, Claude Code y Claude Cowork.
Los controles de exportación restringen quién puede recibir o utilizar una tecnología. La orden del 12 de junio indicó a Anthropic que cortara ambos modelos para cualquier ciudadano extranjero, dentro o fuera de los Estados Unidos, incluido su propio personal no ciudadano.
La norma entró en vigor de inmediato y la empresa no tenía una forma fiable de comprobar la nacionalidad de cada usuario en tiempo real, por lo que cerró ambos modelos para todo el mundo.
El detonante fue un jailbreak: un prompt que consigue que un modelo ignore sus reglas de seguridad. Investigadores de Amazon encontraron uno en Fable 5. Según Anthropic, el prompt logró que el modelo señalara algunos fallos de software y, en un caso, que escribiera código mostrando cómo podría abusarse de un fallo.
Anthropic minimizó el hallazgo. Afirma que las mismas solicitudes funcionan en muchos modelos más débiles, incluidos su propio Claude Opus 4.8, el GPT-5.5 de OpenAI y el Kimi K2.7 de China. La empresa califica el comportamiento detectado como un trabajo de seguridad defensiva rutinario, no como una supercapacidad oculta.
El gobierno y el socio que informó del jailbreak lo consideraron lo suficientemente grave como para justificar controles de emergencia.
Para solucionar la preocupación, Anthropic entrenó un nuevo filtro de seguridad, llamado clasificador, que vigila la técnica exacta del informe y la bloquea. La empresa afirma que ahora detiene esa técnica en más del 99% de los intentos, según la redacción del 30 de junio. Las solicitudes bloqueadas se derivan al Opus 4.8, que es más débil, y se le informa al usuario. La desventaja es que hay más falsas alarmas en la codificación y depuración normales.
Mythos 5, el mismo modelo base pero con menos barreras de seguridad, permanece bajo una vigilancia más estrecha. El acceso regresó el 26 de junio para aproximadamente 100 empresas y agencias federales de EE. UU. que defienden infraestructuras críticas. Anthropic dice que sigue trabajando con el gobierno para ampliar el acceso.
El Secretario de Comercio, Howard Lutnick, quien aprobó la reversión, dijo que su departamento había pasado dos semanas revisando los modelos con Anthropic. En su carta, la empresa acordó buscar problemas de seguridad por su cuenta, coordinar futuros lanzamientos e informar de cualquier uso malicioso que detecte.
Según se informa, las negociaciones fueron dirigidas por el cofundador Tom Brown en lugar del CEO Dario Amodei, quien ha chocado con la administración durante gran parte del año.
La pelea fue caótica desde el principio. Varios informes, incluido el del Wall Street Journal, dijeron que la investigación de Amazon y las preocupaciones del CEO Andy Jassy ayudaron a impulsar la orden original. El antiguo zar de la IA David Sacks enlace acusó a Anthropic de haber "priorizado la oferta continua del modelo de consumo sobre la seguridad". Otros lo interpretaron como una sobrecorrección.
Francesco Bailo, investigador de gobernanza de IA de la Universidad de Sydney, dijo a Al Jazeera que la reversión parecía una concesión del gobierno admitiendo que había ido demasiado lejos, y un grupo de líderes de seguridad había firmado una carta abierta pidiendo que se levantaran los controles.
Sobre todo esto planeaba la competencia. La pausa llegó justo cuando los modelos chinos de código abierto, baratos y capaces, estaban ganando terreno, y varios ejecutivos advirtieron que congelar los modelos estadounidenses daba tiempo libre a los rivales para ponerse al día.
Anthropic también propone algo de lo que la industria carecía: una forma compartida de clasificar qué tan peligroso es realmente un jailbreak. Con Amazon, Microsoft, Google y otros socios, quiere puntuar cada uno en cuatro aspectos:
* Ganancia de capacidad: cuánto más lejos lleva el jailbreak al usuario más allá de las herramientas que ya posee.
* Amplitud: cuántos ataques diferentes desbloquea el mismo truco.
* Facilidad de armamentización: cuánta habilidad y esfuerzo se requiere para convertirlo en un ataque real.
* Descubribilidad: qué tan fácil es encontrar o copiar el truco.
Para los peores casos, como un jailbreak que permita ataques a redes eléctricas o bancos, Anthropic dice que empezará a desplegar correcciones en el momento en que se confirme la gravedad, y está creando un equipo para vigilar los informes de jailbreak las 24 horas del día.
También abrió un programa de HackerOne enlace para que los investigadores informen de nuevos jailbreaks de Fable 5, y prometió al gobierno de EE. UU. acceso anticipado para probar futuros modelos frontera antes de su lanzamiento.
Anthropic no es el único laboratorio en esta posición. Días antes, OpenAI presentó GPT-5.6 a un grupo pequeño aprobado por el gobierno en lugar de al público, citando la misma preocupación de doble uso: un modelo lo suficientemente bueno para ayudar a los defensores a parchear errores también es lo suficientemente bueno para ayudar a los atacantes a encontrarlos.
El riesgo no es hipotético. A principios de esta primavera, Anthropic probó un modelo Mythos anterior que encontró y explotó errores de día cero en todos los sistemas operativos y navegadores principales bajo mandato, incluido un fallo de 27 años en OpenBSD. Su "equipo rojo" convirtió errores recién revelados en exploits funcionales en menos de un día.
La crisis inmediata ha terminado. La pregunta más grande no. Una orden ejecutiva del 2 de junio enlace creó una vía voluntaria para que las empresas sometan los modelos frontera a revisión antes de su lanzamiento. También estableció un punto de referencia clasificado para decidir qué modelos se consideran "cubiertos", descartando cualquier licencia obligatoria para lanzar uno. Fable 5 nunca pasó por esa vía.
El gobierno recurrió en su lugar a los controles de exportación. Esa es la señal: cuando Washington quiere actuar rápido con un modelo frontera, todavía no tiene un proceso vinculante, solo procesos improvisados.
Fuente:
THN



Newer Post
0 comments :
Post a Comment
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.