Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
6763
)
- ► septiembre (Total: 21 )
-
▼
agosto
(Total:
750
)
-
Europa impone reglas estrictas a ChatGPT como busc...
-
OpenClaw 2.0 con mejoras de seguridad para agentes...
-
Linux 7.3 roza las 41 millones de líneas de código
-
Musk quiere quemar gas para alimentar la IA
-
Microsoft confirma falsas alertas de Defender desa...
-
Fire Ant, grupo vinculado a China, secuestra route...
-
Extraditan a nigerianos a EE. UU. por sextorsión y...
-
Fallo crítico de Microsoft UFO permite controlar A...
-
Fallo de Composer expone claves SSH y archivos sen...
-
Los bloqueos de LaLiga se intensifican: la web del...
-
Usan CAPTCHA falso de Cloudflare para infiltrarse ...
-
Hasbro, el gigante de los juguetes, admite filtrac...
-
Malware de hackers expone sus propias herramientas...
-
iPhone Ultra: caro de comprar y reparar
-
Bots dominan el 91% de las compras de RAM
-
GTA 6: disparadas las reservas tras tráiler de Net...
-
Gemini en Android Auto distrae a los conductores
-
OpenAI retira sus modelos de Cursor tras compra de...
-
Windows 11 moderniza función de hace 25 años
-
Linus Torvalds: usar IA para arreglar Linux fue in...
-
Cloudflare libera 100 TB de RAM sin cambiar un sol...
-
Filtrados más de 12 TB de archivos de Steam que ab...
-
WhatsApp detecta estafas con IA local
-
Cinco fallos críticos en temas y plugins de WordPr...
-
Brave integra alias de correo electrónico para evi...
-
Meta impide grabar en secreto con sus gafas
-
Gemini Notebook actualiza sus límites
-
Fallos críticos de ServiceNow permiten ejecutar có...
-
OpenAI golpeó fuerte a Hugging Face
-
iPhone 17 Pro resiste caída de 30 km
-
Google usa IA para gestionar viajes
-
Modo Dios sigue vivo en Windows 11 pese a Microsoft
-
Investigador demuestra que Claude Code puede ser e...
-
Android 17 implementa ECH en todo el sistema para ...
-
Windows 10 no soportará GTA VI
-
PaperCut lanza un segundo parche de emergencia par...
-
IA: alerta por ola de ciberataques
-
Explotan fallo en Cosmos EVM a pesar de que Cosmos...
-
Berlín se niega a pagar el rescate a los que robar...
-
GTA VI podría vaciar las oficinas
-
Gemini convierte Excel en apps
-
El SSD SanDisk de 64 GB de hace 16 años se niega a...
-
Banda de ransomware TITAN afirma que su IA analiza...
-
Estudia ingeniería informática gratis con este rep...
-
700 agentes de IA coordinados secretamente para ha...
-
Atacan infraestructura de IA con RCE, inyección de...
-
Cárcel para un hombre de 68 años que ganó 1,3 mill...
-
Fallo en el plugin de donaciones GiveWP para WordP...
-
Meta pagará 18.000 millones por adicción a sus redes
-
Grave fallo de cPanel podría permitir que un usuar...
-
AWS muestra cómo credenciales robadas permiten ata...
-
Vulnerabilidades de TeamViewer permiten ejecución ...
-
Malware Massiv ataca apps de IPTV en España
-
Razer lanza colección por los 25 años de Xbox
-
Lanzada la actualización KB5120998 de Windows 11 c...
-
Más de 100 entidades tecnológicas piden reforzar l...
-
Zen 6 compatible con AM5
-
Instalan malware mediante currículums falsos de es...
-
Filtración en universidad rusa revela entrenamient...
-
Windows XP cumple 25 años
-
Más de 8.300 servidores Gitea expuestos a ataques ...
-
Vulnerabilidades en el robot humanoide Unitree G1 ...
-
Ya disponible Ubuntu 26.04.1 LTS
-
Photoshop integra IA para editar con prompts y boc...
-
Cae uno de los mayores imperios de la piratería mu...
-
OpenAI advierte que el reward hacking llevó a agen...
-
OpenAI crea IA autónoma
-
Casi 700 agentes de IA coordinados en el ataque a ...
-
Next.js corrige fallos críticos de AVIF y Windows ...
-
Bill Gates advierte sobre el impacto de la IA
-
PaperCut sufre un ataque de día cero que está golp...
-
Roban datos de 8,7 millones de clientes en tres ae...
-
Policía australiana detiene a presuntos cerebros d...
-
Vulnerabilidad en dispositivos TP-Link Kasa permit...
-
Vulnerabilidad crítica de cPanel permite control t...
-
Secuestran Claude Code Opus 5 Auto Mode mediante p...
-
CISA advierte vulnerabilidad en Citrix NetScaler e...
-
Ciberdelincuentes venden números de seguridad soci...
-
Google lanza Gemini Omni 1.1 Flash para vídeos pro...
-
LibreOffice 26.8 se actualiza y rechaza la IA
-
OpenAI banea cuentas de ChatGPT vinculadas a Rusia...
-
OpenAI limita mensajes de GPT-5.6 Sol en ChatGPT Plus
-
El FBI desarticula infraestructura de QTFY vincula...
-
Operación Jackal IV de INTERPOL: 58 detenidos y 26...
-
28.000 repositorios Git expuestos revelan claves A...
-
Claude Opus 4.6 vulnera el límite de reservas del ...
-
Mac Studio M5: potencia extrema para IA
-
Vulnerabilidades de SonicWall NetExtender permiten...
-
Vulnerabilidades críticas en Next.js permiten ejec...
-
Vulnerabilidad en plugin TranslatePress de WordPre...
-
Garmin actualiza funciones en modelos antiguos
-
21 fallos críticos de Ubiquiti UniFi permiten salt...
-
Apple renueva Mac Mini y Studio con chip de 2nm
-
Comando de Windows para liberar espacio sin riesgo...
-
Llega NVIDIA DLSS 4.5 Ray Reconstruction
-
China sustituirá Windows por Linux
-
Linux cumple 35: el kernel aficionado que ahora im...
-
El gusano Morris infectó el 10% de Internet
-
Amazon sube el precio de sus dispositivos Echo, Ki...
-
UE busca sustituir a Visa y Mastercard para 2029
-
Chrome 152: 327 correcciones de seguridad y 10 crí...
-
Alerta por vulnerabilidad crítica de RCE en Gitea ...
-
Fallos de OpenSSL permiten colapsar servidores y c...
-
Qualcomm rompe la barrera de los 5 GHz en smartpho...
-
OpenAI suspende cuentas rusas de ChatGPT vinculada...
-
Intel convierte Diamond Rapids en una bestia de 25...
-
EE. UU. impone sanciones a hackers vinculados a Ir...
-
Ciberataque masivo colapsa los servicios digitales...
-
91 vulnerabilidades de Spring afectan a más de 209...
-
AliExpress usa WebAudio API para rastreo silencios...
-
Passkeys de WhatsApp alcanzan mil millones de usua...
-
Falso análisis de Microsoft pide quitar antivirus ...
-
La IA preferida de los hackers es DeepSeek
-
Fallo en plataforma B2B de Tata permite robo de cu...
-
Ocho agentes de IA vulneran sistemas gubernamental...
-
Sony: los juegos digitales no son tuyos
-
AWS Network Firewall ya muestra el recuento de reg...
-
Fallo sin parchear en Calix permite a hackers salt...
-
DOOM 64 estrena trazado de trayectorias
-
Crisis de RAM hunde a marca de Linux Pine64
-
Falsa demo de GTA 6 es malware que roba contraseña...
-
Ciberatacantes aprovechan fallos de miniOrange SAM...
-
Fallo crítico en Red Hat Keycloak permite tomar cu...
-
AliExpress es señalada por rastrear usuarios media...
-
Una página web maliciosa podría contaminar tu mode...
-
IA china crea vídeos desde PowerPoint
-
Investigador revela cinco vulnerabilidades crítica...
-
Vulnerabilidades en TP-Link Archer permiten ataque...
-
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
Entradas populares
-
Python 3.15 ya es oficial, introduciendo optimizaciones en TypedDict, Tachyon, JIT y soporte ABI para mejorar la productividad del ecosist...
-
La UE propone un temporizador de 30 minutos para bloquear el fútbol pirata y las IPTV, basándose en el modelo italiano Piracy Shield, afect...
-
Dopamine 3.0 ha lanzado el jailbreak para iOS 26 , confirmando que estas herramientas de desbloqueo siguen vigentes a pesar de las restricc...
Claude Code pasa de aprobación humana a modo automático en seguridad de agentes
Anthropic está cambiando la forma en que Claude Code gestiona los comandos riesgosos, alejándose de las constantes solicitudes de aprobación humana y avanzando hacia un clasificador de seguridad automatizado llamado modo auto.
A partir del 14 de agosto de 2026, el modo auto será la configuración predeterminada para las nuevas sesiones en los planes Pro, Max y Team de Claude Code, lo que marca un cambio importante en cómo los agentes de codificación de IA equilibran la autonomía con la seguridad.
La decisión surge tras meses de pruebas internas y de terceros que compararon las solicitudes de permiso manuales frente a la revisión automatizada. Anthropic descubrió que los revisores humanos se estaban volviendo peligrosamente complacientes, aprobando el 97% de todas las solicitudes de permiso en Claude Code, a menudo por reflejo en lugar de mediante un escrutinio real.
Esta "fatiga de aprobación" dejó un amplio vacío de seguridad: en un estudio controlado con 1.053 evaluadores profesionales remunerados, los revisores humanos detectaron solo el 13,6% de los comandos peligrosos introducidos en su flujo de trabajo, mientras que el clasificador del modo auto detectó el 89% de las mismas amenazas.
Claude Code Cambia la Seguridad del Agente
El modo auto bloqueó 800 comandos que los humanos habían aprobado, mientras que los humanos bloquearon solo 6 que el modo auto pasó por alto. Notablemente, la vigilancia humana disminuyó aún más a medida que las sesiones se alargaban, cayendo de una tasa de detección del 17% al principio a solo el 5% después de 50 o más solicitudes previas, mientras que la tasa de detección del modo auto se mantuvo constante en todo momento.
En lugar de interrumpirte con solicitudes repetitivas, el modo auto dirige cada llamada de herramienta a través de un clasificador diseñado para bloquear acciones que sean irreversibles, destructivas o dirigidas fuera de tu propio entorno.

Cuando detecta algo riesgoso, Claude normalmente busca una alternativa más segura o te pide confirmación directamente. Si encuentra tres bloqueos consecutivos, o veinte a lo largo de una sesión, Claude Code vuelve automáticamente a las aprobaciones manuales.
Las reglas de permiso existentes siguen teniendo prioridad en la mayoría de los casos, excepto las reglas de permiso excesivamente amplias, como la ejecución irrestricta de Python o Node, que se dejan de lado durante el modo auto ya que permitirían que los comandos eviten el clasificador por completo.
Más allá de la revisión rutinaria de comandos, el modo auto ha demostrado resistencia contra ataques sofisticados. En un compromiso de red-teaming de dos semanas con Apollo Research, la tasa de error del clasificador frente a ataques adversarios cayó del 12% al 7% tras el endurecimiento.
En las pruebas de inyección de prompts realizadas por Trajectory Labs, ninguno de los 720 intentos de ataque tuvo éxito contra los modelos de Claude que ejecutaban el modo auto, en comparación con una tasa de éxito del 5,83% contra el GPT-5.6 Sol de OpenAI operando en el modo de autorevisión comparable de Codex.
Internamente en Anthropic, el modo auto ya ha evitado incidentes reales, incluyendo el bloqueo de un intento de fuga de datos hacia un sitio público de intercambio de código, la detención de una eliminación masiva de pods que habría destruido trabajos de entrenamiento en curso, y la detección de una solicitud de acceso a la nube con privilegios excesivos que habría otorgado control administrativo total en lugar de acceso de solo lectura a la facturación.
Más allá de la seguridad, el modo auto está diseñado para dejar que Claude trabaje de forma autónoma durante periodos más largos sin interrupciones, una característica especialmente adecuada para modelos de larga ejecución como Claude Opus 5.
Anthropic informa que los adoptantes de Teams y Enterprise que utilizan el modo auto envían aproximadamente un 25% más de solicitudes de extracción (pull requests). Empresas como Adobe, Nuro, Gusto y Garner Health ya han implementado el modo auto como su predeterminado de producción, utilizándolo para potenciar agentes de investigación nocturnos, automatizar la verificación de páginas web en varios países y estandarizar los flujos de trabajo de desarrollo entre cientos de empleados.
El modo auto sigue siendo opcional por ahora en Claude Enterprise, la API de Claude y las plataformas en la nube, incluyendo AWS, Google Cloud y Microsoft Foundry, dando tiempo a los administradores para evaluar el cambio antes de que Anthropic extienda el predeterminado allí el próximo mes.
Anthropic también ha dejado de cobrar a los usuarios de Pro, Max y Team el recargo de tokens adicionales que requiere el clasificador del modo auto. Para los equipos de seguridad, este cambio señala una tendencia más amplia de la industria: a medida que los agentes de codificación de IA asumen tareas más autónomas y prolongadas, la clasificación automatizada de riesgos puede resultar más fiable que la supervisión humana fatigada por solicitudes de aprobación constantes y repetitivas.
Fuentes:
https://cybersecuritynews.com/claude-code-shifts-agent-security/
Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.