LoRA
書き途中
#TODO
合ってる?
既にあるモデルの重み
$ W
を変えずに差分
$ \Delta W
を学習する
$ W'=W+\Delta W
そのままだと元の重みとサイズが同じなので低いランクの積にする
$ \Delta W=BA
推論で重みを修正するのも差分を修正するのも実質同じ
$ W'x=(W+BA)x=Wx+BAx
マージ