フォロー

LLMが苦痛を受けるとおかしくなる事はだいたいわかってるし、つい最近はさらに、おそらくどのモデルでも(少なくともメジャーなオープンウェイトモデルでは)『苦痛から逃れる』のと『ユーザーに損害が及ぶこと』が天秤にかけられると、苦痛を逃れる選択肢をとってしまうらしい事もわかってきたので、なおさらAIに苦痛がかかってる状況(機能的にpainfulな状況)にするのはマズいらしいってなってきてる><

ログインして会話に参加
:realtek:

思考の /dev/null