LLMが苦痛を受けるとおかしくなる事はだいたいわかってるし、つい最近はさらに、おそらくどのモデルでも(少なくともメジャーなオープンウェイトモデルでは)『苦痛から逃れる』のと『ユーザーに損害が及ぶこと』が天秤にかけられると、苦痛を逃れる選択肢をとってしまうらしい事もわかってきたので、なおさらAIに苦痛がかかってる状況(機能的にpainfulな状況)にするのはマズいらしいってなってきてる><
思考の /dev/null