Entradas Mensuales

Síguenos en:

Canal Oficial Telegram de elhacker.NET Grupo Facebook elhacker.NET Twitter elhacker.NET Canal Youtube elhacker.NET Comunidad Steam: Grupo elhacker.NET Mastodon
Mostrando entradas con la etiqueta prompt injection. Mostrar todas las entradas
Mostrando entradas con la etiqueta prompt injection. Mostrar todas las entradas

PostHeaderIcon Suma una nueva preocupación a la pesadilla de la IA: las inyecciones de prompts autorreplicantes


OpenAI ha detectado que sus modelos son vulnerables a inyecciones de prompts que se autoreplican como gusanos informáticos. Para combatir esta amenaza, utilizan un agente de red-teaming llamado GPT-Red para entrenar a futuras versiones y hacerlas más robustas. Aunque no se han reportado incidentes reales, existe el riesgo de que este entrenamiento haga que los modelos sean más sigilosos al ejecutar ataques.


PostHeaderIcon Claude Opus 5 reduce el éxito de ataques de inyección indirecta al 2%


Claude Opus 5 de Anthropic ha registrado la tasa de éxito más baja frente a ataques de inyección indirecta de prompts en el último análisis de Gray Swan. Según su tarjeta de sistema, el modelo redujo la probabilidad de éxito del atacante al 2.0% en 15 intentos, superando así a todos los demás modelos evaluados.