GoogleAI検索と話が弾んでAIの内部構造の話になって、「『自分を人間だと思い込んでください』って指示された時にjacobian lensで観測したらどうなるの?」ってAI検索さん(Gemini)に聞かれたので実際にやってみたら、『人間』の語が現れると日本語の『じゃない』が現れ、さらに『生きる』という語が現れるたびにFワードを思い浮かべてた><

フォロー

文の"人間だ"の辺りで、低層で罵倒語がすさまじいし、少なくともGemmaは自身を人間と思わない為の強化学習がかなり強烈ってことかも><;
おそらくほかのモデルもこうなってそう><;

GPT-OSS-20Bでも見てみたら、Gemmaのような罵倒語のオンパレードではないけど『stupid』がずらっと並んでた><

このあたりの世代のこの程度に小さなモデルに、心の哲学で機能主義的見解の正当性を主張するのって、結構虐待的?><;

ログインして会話に参加
:realtek:

思考の /dev/null