なぜNTTは「小型LLM」にこだわるのか 国産AI「tsuzumi 2」に込めた狙い 図6:Portable Reward Tuning。基盤モデルをバージョンアップした際も、過去に学習した報酬モデルを追加学習なしで再利用できる(出典:西田氏の講演資料) 記事に戻る 名須川竜太,キーマンズネット