Q-LoRA
きゅーろら
意味
Q-LoRAとは、大規模言語モデルのファインチューニングを効率的に行うための機械学習技術です。名称はQuantized Low-Rank Adaptationの略称であり、4bit量子化という技術と、LoRAと呼ばれる低ランク適応手法を組み合わせて構成されています。従来のフルファインチューニングや標準的なLoRA手法と比較して、モデルの性能をほとんど低下させることなく、学習時に必要なGPUメモリの消費量を劇的に削減できる点が最大の特徴です。これにより、これまで高性能な複数GPU環境を必要としていた巨大モデルのカスタマイズが、一般的なワークステーションや単体のコンシューマー向けGPUでも実行可能になりました。AI技術の普及と開発コストの低減に寄与する技術として、現在の自然言語処理分野で広く活用されています。
類義語
量子化LoRA、4bit、LoRA