Técnica de ataque que incrusta instrucciones maliciosas en la entrada para alterar el comportamiento de una IA.
Ataque que mezcla instrucciones manipuladas en un prompt para hacer que un modelo de IA produzca una salida no prevista por el desarrollador, filtre información sensible o realice acciones no autorizadas. Una vulnerabilidad específica de las aplicaciones basadas en LLM, situada en lo más alto del OWASP Top 10 para aplicaciones LLM.
© 2026 ITBGM