モードコラプスとは?AI検出ツールがChatGPTの文章を見破れる本当の理由
AI文章検出ツールPangramのCTOブラッドリー・エミ氏は、LLMの文章が検出できるのは能力の限界ではなく、事後学習(ポストトレーニング)と安全ガードレールが表現の幅を狭める「モードコラプス」のせいだとブログで論じました。事後学習前のベースモデルはPangramの検出に引っかからない、というのが主張の核心です。
AI文章検出ツールPangramのCTOブラッドリー・エミ氏は、LLMの文章が検出できるのは能力の限界ではなく、事後学習(ポストトレーニング)と安全ガードレールが表現の幅を狭める「モードコラプス」のせいだとブログで論じました。事後学習前のベースモデルはPangramの検出に引っかからない、というのが主張の核心です。