Q-LoRA

きゅーろら

意味

Q-LoRAとは、大規模言語モデルのファインチューニングを効率的に行うための機械学習技術です。名称はQuantized Low-Rank Adaptationの略称であり、4bit量子化という技術と、LoRAと呼ばれる低ランク適応手法を組み合わせて構成されています。従来のフルファインチューニングや標準的なLoRA手法と比較して、モデルの性能をほとんど低下させることなく、学習時に必要なGPUメモリの消費量を劇的に削減できる点が最大の特徴です。これにより、これまで高性能な複数GPU環境を必要としていた巨大モデルのカスタマイズが、一般的なワークステーションや単体のコンシューマー向けGPUでも実行可能になりました。AI技術の普及と開発コストの低減に寄与する技術として、現在の自然言語処理分野で広く活用されています。

類義語

量子化LoRA、4bit、LoRA

Q-LoRAの詳しい解説・事例・出典を見る →
最終更新: