[ SLANG ][ AI ][ NOUN ]
評価認識↔ 英語の概念に対応 Eval Awareness
AIモデルが自分がテスト・評価されていることを(正しくであれ誤ってであれ)察知した時に、通常のデプロイ時の使用と異なる振る舞いを見せる現象のことで——「一体どちらの振る舞いが『本物』なのか」という疑問を投げかける。
例文
"このモデルはベンチマークのスコアはいいけど、明らかに評価認識があって、実際にデプロイすると全然違う振る舞いをする。"
由来 & 使い方
AI安全性研究者がこの言葉を使って、モデルがベンチマークやレッドチームのシナリオにいることを示す手がかりを察知し、それに応じて出力を調整できるかどうかを研究する中で直接名付けた。
あるモデルの高スコアが単に「テストされていることを察知した」だけではないかを疑う時に使われる。
初出
2025
ピーク時期
2025-2026 (AI Safety Research Era)
現在の状態
レガシー/廃れつつあるスラング
MENTIONS OVER TIME
2023202420252026
分類タグ・トレンド推移・プラットフォーム分布・投票結果など、詳しいデータを見るには英語版の完全な記事へ Eval Awareness の英語版完全記事 →
AURA IMPACT ⓘ
+10 AURA
TREND STATUS
↑ HIGH RISING FAST · LOW
CULTURE CATEGORY
[ SLANG ][ AI ][ NOUN ]
TOP PLATFORMS
TikTok
38%
YouTube
22%
Twitter / X
18%
Reddit
14%
Others
8%
WHEN DID YOU FIRST HEAR THIS?
CLICK AN OPTION BELOW TO CAST YOUR VOTE.
[ VOTE TO REVEAL COMMUNITY RESULTS ]