SEALとは?MITが発表したLLMが自分の重みを書き換える自己適応フレームワークを解説
MITが発表した「SEAL(Self-Adapting LLMs)」は、大規模言語モデルが自ら訓練データを生成し、強化学習を通じて自身の重みを更新する枠組みです。少数事例での適応タスクでは72.5%の成功率を記録し、未学習状態の0%、強化学習なしの20%を大きく上回りました。
MITが発表した「SEAL(Self-Adapting LLMs)」は、大規模言語モデルが自ら訓練データを生成し、強化学習を通じて自身の重みを更新する枠組みです。少数事例での適応タスクでは72.5%の成功率を記録し、未学習状態の0%、強化学習なしの20%を大きく上回りました。