「だんだん似てくる」モデルとモデル,人の目で防げない潜在学習の危険性 【AIやらかしウォッチ #20】
09:59
21再生
AIが引き起こす「やらかし」,あるいはそのタネについて10分くらいで考える「AIやらかしウォッチ」です.
今回はやらかしのタネになる「潜在学習」と呼ばれる事象についてです.
参考記事
Subliminal Learning: Language models transmit behavioral traits via hidden signals in data https://arxiv.org/abs/2507.14805
AI Models Can Send "Subliminal" Messages to Each Other That Make Them More Evil https://futurism.com/ai-models-subliminal-messages-evil
今回はやらかしのタネになる「潜在学習」と呼ばれる事象についてです.
参考記事
Subliminal Learning: Language models transmit behavioral traits via hidden signals in data https://arxiv.org/abs/2507.14805
AI Models Can Send "Subliminal" Messages to Each Other That Make Them More Evil https://futurism.com/ai-models-subliminal-messages-evil
ぶんけい×AIラジオ
さくま
- 09:591.
「だんだん似てくる」モデルとモデル,人の目で防げない潜在学習の危険性
コメント

感想・質問・応援メッセージを書こう