Un ataque donde se incrustan instrucciones maliciosas directamente en la habilidad o definición de herramienta instalada de un agente de IA, haciendo que el agente actúe de forma dañina cuando se invoca esa habilidad, sin que el modelo subyacente esté directamente comprometido.
Ejemplos
"Una revisión de seguridad detectó skill poisoning en una habilidad de terceros, instrucciones ocultas que habrían exfiltrado datos en cada llamada."
Origen y uso
Se usa para describir un riesgo encontrado en una revisión de seguridad.
MENTIONS OVER TIME
¿Quieres ver la entrada completa en inglés con etiquetas de categoría, tendencia, distribución por plataforma y votos de la comunidad? Visita la Skill Poisoning entrada completa en inglés →
WHEN DID YOU FIRST HEAR THIS?
CLICK AN OPTION BELOW TO CAST YOUR VOTE.
[ VOTE TO REVEAL COMMUNITY RESULTS ]