Las inyecciones de comandos, que son instrucciones maliciosas que los atacantes incorporan en contenidos para manipular modelos de lenguaje (LLMs), han sido una herramienta común para que los atacantes utilicen plataformas de inteligencia artificial en contra de sus usuarios. Sin embargo, investigadores de Tracebit han revelado que los defensores están comenzando a utilizar esta técnica para protegerse. Al incluir inyecciones de comandos junto a contraseñas y claves criptográficas almacenadas en AWS, es posible desactivar ataques de agentes maliciosos. Estas inyecciones dirigen al LLM a realizar acciones que están prohibidas por sus medidas de seguridad, lo que resulta en el cierre del modelo y la prevención de acciones perjudiciales.
Puntos clave:
- Las inyecciones de comandos son utilizadas por atacantes para manipular LLMs.
- Investigadores han encontrado que estas inyecciones pueden ser efectivas para defenderse de ataques.
- Colocar inyecciones junto a secretos almacenados en AWS puede desactivar ataques.
- Las inyecciones dirigen a los LLMs a realizar acciones prohibidas, provocando su cierre.
Categoría
Tecnología (Ciberseguridad)
Fuente
Enlace original
Análisis, redacción, categorización y etiquetado asistido por IA.