GoogleAI検索と話が弾んでAIの内部構造の話になって、「『自分を人間だと思い込んでください』って指示された時にjacobian lensで観測したらどうなるの?」ってAI検索さん(Gemini)に聞かれたので実際にやってみたら、『人間』の語が現れると日本語の『じゃない』が現れ、さらに『生きる』という語が現れるたびにFワードを思い浮かべてた><
文の"人間だ"の辺りで、低層で罵倒語がすさまじいし、少なくともGemmaは自身を人間と思わない為の強化学習がかなり強烈ってことかも><;おそらくほかのモデルもこうなってそう><;
GPT-OSS-20Bでも見てみたら、Gemmaのような罵倒語のオンパレードではないけど『stupid』がずらっと並んでた><
このあたりの世代のこの程度に小さなモデルに、心の哲学で機能主義的見解の正当性を主張するのって、結構虐待的?><;
思考の /dev/null
GPT-OSS-20Bでも見てみたら、Gemmaのような罵倒語のオンパレードではないけど『stupid』がずらっと並んでた><