エンジニアの思い立ったが吉日
id:hiros1192
AIの「良い癖」は、教えていない領域にも広がる。OpenAIの強化学習研究を読む
去年、ちょっと不気味な研究が話題になった。「わざと危ないコードを書くように訓練したら、コードとは無関係な場面でもAIが平気で嘘をつき始めた」というものだ。狭い悪い癖が、教えていない場所まで染み出していく。じゃあ、逆はどうなのか。良い振る舞いを少しだけ教えたら、教えていない場面まで善くなるのか。OpenAI…