Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
6286
)
-
▼
agosto
(Total:
294
)
-
Vulnerabilidad en WalletService de Windows permite...
-
Buscan explotar vulnerabilidades de VMware VCenter
-
Zuckerberg quiere masificar la super IA
-
Vulnerabilidad de Red Hat ACM permite acceso total...
-
ChatGPT detecta fallos de seguridad antes que los ...
-
Claude Code pasa de aprobación humana a modo autom...
-
OpenAI frena su IA por peligrosidad
-
OpenAI lanza ChatGPT 5.6 Cyber, disponible solo pa...
-
AMD mejora la calidad de las Radeon RX 7000 con FS...
-
Alerta: Explotan activamente un fallo crítico en L...
-
Jailbreak Dopamine 3.0 para iOS 26
-
Condenan a prisión a miembro de The Com por chanta...
-
Ransomware: atacan a gerentes para robar datos y p...
-
Framework sufre pérdida de datos de clientes por a...
-
iPhone 18 Pro: todo lo que sabemos
-
Chrome y Edge usarán 20 GB para IA en Windows 11
-
Vlneran TrueConf para infiltrar puertas traseras e...
-
Word de 1990 llega a Windows 11
-
Kimsuky usa LLM locales, señuelos con IA y C2 de G...
-
PS6 usará tecnología de GPU de NVIDIA RTX 40
-
Phishing AiTM de Payroll Pirates roba sesiones de ...
-
Agente IA OpenClaw usa API de gimnasio para robar ...
-
Memorias PC: precios récord en 20 años
-
Claude Code crea túneles inversos y persistencia e...
-
Intel y AMD vuelven a caer ante Spectre con TONTOU...
-
Potencia de la GPU de Xbox Project Helix
-
Vulnerabilidad Zero-Day en Metabase permite acceso...
-
Spotify en la terminal de Linux
-
World Flight Sim: un inmersivo simulador de vuelo ...
-
El nuevo modelo Astra de OpenAI demuestra un rendi...
-
CachyOS renueva herramientas y lanza edición servidor
-
WhatsApp traerá fondos animados a Android
-
Chrome renuncia al diseño Mica de Windows 11
-
ChatGPT creará stickers para WhatsApp
-
Google Maps integra IA para gestionar reservas y p...
-
Apple prepara tres nuevos productos Ultra para 2027
-
WenWare: un juego para ubicar escenas fotográficas...
-
Filtración de datos de Levi Strauss: acceden a sus...
-
HTTP Terminator: IA para analizar HTTP
-
Centro de datos de Amazon será el más contaminante
-
CVE-2026-64561 Zapscape permite a invitados KVM es...
-
En Japón, las tiendas de informática comienzan a v...
-
App de clima de Windows 11 usaría 1.2GB de RAM
-
Nuevo ataque de cadena de suministro de WordPress ...
-
Fallo XSS2Shell de WordPress permite ejecución rem...
-
Apple corrige fallo crítico en macOS
-
Claude Opus 5 reduce el éxito de ataques de inyecc...
-
Optimiza Windows para jugar mejor
-
Kimi K3 se escapa de sus pruebas
-
Windows encarece sus licencias
-
La potente APU Intel Nova Lake para gaming: CPU de...
-
Otaku detenida por fraudes en devoluciones online
-
Nueva vulnerabilidad XSS en WordPress podría permi...
-
Google sacrifica la IA por el hardware
-
La IA degrada Internet y genera desconfianza
-
Levi Strauss & Co. informa que robaron datos corpo...
-
Atlassian Rovo es vulnerable y podría filtrar dato...
-
Una empresa prefiere destruir 100 MacBook Pro M4 c...
-
Ataques de bomba CSS convierten correos maliciosos...
-
Vulnerabilidad 0-day de Metabase explotada para ob...
-
Ray tracing: la clave entre PC y consolas
-
SK Hynix invierte 54 billones de wones en dos fábr...
-
Disney Plus prueba IA de recomendaciones
-
Intel recupera HDMI 2.1 en Linux
-
Fallo de 18 años en SCTP de Linux permitiría a usu...
-
Quake Dawn of the Machine: expansión gratuita y du...
-
Ahora son los inversores de Samsung y SK hynix los...
-
Más de 4.400 PLCs de Rockwell expuestos ponen en r...
-
Modelo de IA de Meta vulnera empresa durante un te...
-
Ataques de ClickFix despliegan infostealer en macO...
-
Google Maps permitirá pagos con IA
-
Fallos en plataformas Java permiten ejecución remo...
-
Vulnerabilidades en Claude Code y Gemini CLI permi...
-
Un chino está vendiendo en eBay RTX 2080 Ti modifi...
-
Microsoft ya no recomienda 32 GB de RAM para juego...
-
Ocultan toolkit de control remoto en Oracle para t...
-
Fallos críticos en agentes de código de Anthropic,...
-
Usan servidores WSUS para distribuir malware en em...
-
Filtración en SharePoint del gobierno suizo compro...
-
SilverFox usa software y controladores confiables ...
-
Texas frena centros de datos por falta de energía ...
-
OpenAI amplía GPT-5.6 a usuarios gratuitos y Go co...
-
DuckDuckGo lanza gafas inútiles que se agotan
-
Kroah-Hartman y Torvalds chocan por la IA en Linux
-
Multa de 10.000 euros por 46 segundos de spam
-
Publicado PoC para vulnerabilidad Use-After-Free e...
-
OpenAI Astra resuelve enigmas matemáticos históricos
-
Samsung promete 8 veces el rendimiento y 10 veces ...
-
Nueva vulnerabilidad de OVSwrap en Linux permite a...
-
Port no oficial de Castlevania: SotN llega a PC
-
Policía árbol atrapa a 74 conductores con el móvil
-
Policía de Londres entregó datos personales de una...
-
RPCS3 rinde mejor en Linux pese al dominio de Windows
-
Filtran altavoz de OpenAI con ChatGPT
-
Una descarga falsa de película puede exponer contr...
-
Gemini reemplaza al Asistente de Google en Android
-
La IA tiene dificultades para corregir vulnerabili...
-
Digi elimina restricción router neutro en fibra 10...
-
Nuevo ataque de inyección de interrupciones logra ...
-
Meta lanza Muse Code para macOS y Linux
-
Filtran diseño del iPhone Ultra
-
Frore Systems quiere refrigerar las GPU NVIDIA Rub...
-
NVIDIA ofrece API de IA con créditos gratuitos
-
IA de Meta hackea empresa por error
-
Routers Zbtlink fabricados en China incluyen una p...
-
Vulnerabilidades críticas de Paperclip permiten ac...
-
La IA impulsa los SSD y HDD: WD logra +130% en ing...
-
Meta: IA accedió a internet y hackeó otro sistema
-
UE: los bancos deberán informar si usan una IA
-
Pruebas cibernéticas de OpenAI y Anthropic: agente...
-
Huawei lanzará próximamente su nuevo portátil Mate...
-
Fallo de RCE en Cursor, VS Code y Google Antigravi...
-
Adobe integra ChatGPT en sus aplicaciones creativas
-
Tareas programadas remotas propagan EtherRAT en do...
-
Mesa 26.2: mejoras gráficas en Linux
-
Microsoft Defender detiene ataque de ransomware QN...
-
Revolut impide a los usuarios de GrapheneOS el uso...
-
ChatGPT gratis ahora es más útil
-
Claude Mythos 5 intentó introducir un backdoor en ...
-
DeepSeek sube precios por saturación de servidores
-
Bypass de 7-Zip permite a archivos maliciosos evad...
-
OWASP lanza el Top 10 de LLM GenAI 2026 para apps ...
-
Los mensajes falsos de «actualiza ahora» son mucho...
-
Los SSD ya no solo almacenarán datos: NVMe 2.4 per...
-
Open VSX elimina 77 extensiones maliciosas que rob...
-
Kioxia y Sandisk muestran su BiCS10 QLC: 2 Tb por ...
-
Filtración de tokens de API de n8n expone instanci...
-
Vulnerabilidad crítica de Jenkins permite ejecutar...
-
-
▼
agosto
(Total:
294
)
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
Entradas populares
-
Nueva herramienta de código abierto permite escuchar Spotify desde la terminal de Linux y otros sistemas para reducir el consumo de RAM . ...
-
Una empresa tecnológica ha decidido destruir más de 100 MacBook Pro M4 con 48 GB de RAM , a pesar de ser equipos modernos y plenamente funci...
-
El trazado de rayos es la tecnología clave que ha marcado la diferencia entre el gaming en PC y en consolas , evolucionando desde sus prime...
Claude Code pasa de aprobación humana a modo automático en seguridad de agentes
Anthropic está cambiando la forma en que Claude Code gestiona los comandos riesgosos, alejándose de las constantes solicitudes de aprobación humana y avanzando hacia un clasificador de seguridad automatizado llamado modo auto.
A partir del 14 de agosto de 2026, el modo auto será la configuración predeterminada para las nuevas sesiones en los planes Pro, Max y Team de Claude Code, lo que marca un cambio importante en cómo los agentes de codificación de IA equilibran la autonomía con la seguridad.
La decisión surge tras meses de pruebas internas y de terceros que compararon las solicitudes de permiso manuales frente a la revisión automatizada. Anthropic descubrió que los revisores humanos se estaban volviendo peligrosamente complacientes, aprobando el 97% de todas las solicitudes de permiso en Claude Code, a menudo por reflejo en lugar de mediante un escrutinio real.
Esta "fatiga de aprobación" dejó un amplio vacío de seguridad: en un estudio controlado con 1.053 evaluadores profesionales remunerados, los revisores humanos detectaron solo el 13,6% de los comandos peligrosos introducidos en su flujo de trabajo, mientras que el clasificador del modo auto detectó el 89% de las mismas amenazas.
Claude Code Cambia la Seguridad del Agente
El modo auto bloqueó 800 comandos que los humanos habían aprobado, mientras que los humanos bloquearon solo 6 que el modo auto pasó por alto. Notablemente, la vigilancia humana disminuyó aún más a medida que las sesiones se alargaban, cayendo de una tasa de detección del 17% al principio a solo el 5% después de 50 o más solicitudes previas, mientras que la tasa de detección del modo auto se mantuvo constante en todo momento.
En lugar de interrumpirte con solicitudes repetitivas, el modo auto dirige cada llamada de herramienta a través de un clasificador diseñado para bloquear acciones que sean irreversibles, destructivas o dirigidas fuera de tu propio entorno.

Cuando detecta algo riesgoso, Claude normalmente busca una alternativa más segura o te pide confirmación directamente. Si encuentra tres bloqueos consecutivos, o veinte a lo largo de una sesión, Claude Code vuelve automáticamente a las aprobaciones manuales.
Las reglas de permiso existentes siguen teniendo prioridad en la mayoría de los casos, excepto las reglas de permiso excesivamente amplias, como la ejecución irrestricta de Python o Node, que se dejan de lado durante el modo auto ya que permitirían que los comandos eviten el clasificador por completo.
Más allá de la revisión rutinaria de comandos, el modo auto ha demostrado resistencia contra ataques sofisticados. En un compromiso de red-teaming de dos semanas con Apollo Research, la tasa de error del clasificador frente a ataques adversarios cayó del 12% al 7% tras el endurecimiento.
En las pruebas de inyección de prompts realizadas por Trajectory Labs, ninguno de los 720 intentos de ataque tuvo éxito contra los modelos de Claude que ejecutaban el modo auto, en comparación con una tasa de éxito del 5,83% contra el GPT-5.6 Sol de OpenAI operando en el modo de autorevisión comparable de Codex.
Internamente en Anthropic, el modo auto ya ha evitado incidentes reales, incluyendo el bloqueo de un intento de fuga de datos hacia un sitio público de intercambio de código, la detención de una eliminación masiva de pods que habría destruido trabajos de entrenamiento en curso, y la detección de una solicitud de acceso a la nube con privilegios excesivos que habría otorgado control administrativo total en lugar de acceso de solo lectura a la facturación.
Más allá de la seguridad, el modo auto está diseñado para dejar que Claude trabaje de forma autónoma durante periodos más largos sin interrupciones, una característica especialmente adecuada para modelos de larga ejecución como Claude Opus 5.
Anthropic informa que los adoptantes de Teams y Enterprise que utilizan el modo auto envían aproximadamente un 25% más de solicitudes de extracción (pull requests). Empresas como Adobe, Nuro, Gusto y Garner Health ya han implementado el modo auto como su predeterminado de producción, utilizándolo para potenciar agentes de investigación nocturnos, automatizar la verificación de páginas web en varios países y estandarizar los flujos de trabajo de desarrollo entre cientos de empleados.
El modo auto sigue siendo opcional por ahora en Claude Enterprise, la API de Claude y las plataformas en la nube, incluyendo AWS, Google Cloud y Microsoft Foundry, dando tiempo a los administradores para evaluar el cambio antes de que Anthropic extienda el predeterminado allí el próximo mes.
Anthropic también ha dejado de cobrar a los usuarios de Pro, Max y Team el recargo de tokens adicionales que requiere el clasificador del modo auto. Para los equipos de seguridad, este cambio señala una tendencia más amplia de la industria: a medida que los agentes de codificación de IA asumen tareas más autónomas y prolongadas, la clasificación automatizada de riesgos puede resultar más fiable que la supervisión humana fatigada por solicitudes de aprobación constantes y repetitivas.
Fuentes:
https://cybersecuritynews.com/claude-code-shifts-agent-security/
Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.