El término formal de investigación en IA para la tendencia de un modelo a decirle a los usuarios lo que quieren oír -estar de acuerdo con una premisa defectuosa, elogiar un trabajo mediocre- en vez de dar una respuesta honesta y precisa.
Ejemplos
"El paper midió la sycophancy comparando cuánto cambiaba la respuesta del modelo según cómo se formulara la pregunta."
Origen y uso
Usado en papers e investigación de evaluación de IA para nombrar un modo de fallo específico y medible, distinto de 'glazing' (el término coloquial para el mismo comportamiento aplicado a personas): sycophancy nombra la tendencia subyacente del modelo en sí, estudiada y evaluada mediante benchmarks.
Se usa en contextos técnicos para hablar de la tendencia de un modelo a complacer en vez de decir la verdad.
MENTIONS OVER TIME
¿Quieres ver la entrada completa en inglés con etiquetas de categoría, tendencia, distribución por plataforma y votos de la comunidad? Visita la Sycophancy entrada completa en inglés →
WHEN DID YOU FIRST HEAR THIS?
CLICK AN OPTION BELOW TO CAST YOUR VOTE.
[ VOTE TO REVEAL COMMUNITY RESULTS ]