仕事の段取りをひとつの会話で任せやすくなりますClaudeの使い方ルールを最新の危険に合わせて見直せます防御用途で使う人向けの支援が広がりますGPT-6のIntelligent UIで会話が視覚的・操作的になりますClaude Haiku 5.5で低コスト高性能AIが手軽に会話だけで見やすい画面や操作を作れるようになります安く速い小型モデルで大量処理しやすくなります数学の新成果をGitHubで公開し研究を加速できますセキュリティ業務で高度Claudeモデルを使いやすくなりますデバイス上で画像・音声検索が1モデルで可能になりますAtlassian連携で社内知識をそのまま業務に使いやすくなります画像や文章の判定を速く返せるDecisions betaが使いやすくなります高度なサイバー機能を資格者向けに安全運用しやすくするAnthropicの拡張EU規制対応でテキスト透かしをAPIで有効化できますClaudeを使う実務人材を社内で育てやすくなりますAnthropicが企業導入を後押しする人材育成に投資企業導入と人材育成を同時に進めやすくなります重い推論や長文作業を任せやすくなりますGoogleのGemini 4 Argonで重い作業を任せやすく長時間の専門作業を任せやすいGemini 4 Argonが見えました仕事の段取りをひとつの会話で任せやすくなりますClaudeの使い方ルールを最新の危険に合わせて見直せます防御用途で使う人向けの支援が広がりますGPT-6のIntelligent UIで会話が視覚的・操作的になりますClaude Haiku 5.5で低コスト高性能AIが手軽に会話だけで見やすい画面や操作を作れるようになります安く速い小型モデルで大量処理しやすくなります数学の新成果をGitHubで公開し研究を加速できますセキュリティ業務で高度Claudeモデルを使いやすくなりますデバイス上で画像・音声検索が1モデルで可能になりますAtlassian連携で社内知識をそのまま業務に使いやすくなります画像や文章の判定を速く返せるDecisions betaが使いやすくなります高度なサイバー機能を資格者向けに安全運用しやすくするAnthropicの拡張EU規制対応でテキスト透かしをAPIで有効化できますClaudeを使う実務人材を社内で育てやすくなりますAnthropicが企業導入を後押しする人材育成に投資企業導入と人材育成を同時に進めやすくなります重い推論や長文作業を任せやすくなりますGoogleのGemini 4 Argonで重い作業を任せやすく長時間の専門作業を任せやすいGemini 4 Argonが見えました
公式発表のみ掲載。噂・リーク・情報商材は除外します。
← 用語集に戻る
用語集AI用語

LoRA

LoRA (Low-Rank Adaptation)

ろおら

解説

LoRAとは、重み全体を更新せず小さな追加行列だけを学習し、少ない計算でモデルを適応させる手法です。理解すると調整がしやすくなります。

7Bパラメータのモデルをフルでファインチューニングするには数十GBのGPUメモリが必要で、個人や小規模チームには手が届かない技術でした。この壁を劇的に低くしたのがLoRAです。LoRA(Low-Rank Adaptation)とは、モデルの元のパラメータを固定したまま、小さな追加行列(アダプター)のみを学習させることで効率的にファインチューニングを行う手法です。

低ランク行列という着想

LoRAの核心は、ファインチューニングで変化するパラメータの差分は低ランクの行列で十分に近似できるという発見にあります。元のモデルの重み行列がd×dのサイズだとすると、LoRAはd×rとr×dの2つの小さな行列を追加します。rは「ランク」と呼ばれるハイパーパラメータで、通常8〜64程度に設定します。ランクが大きいほど表現力は増しますが、メモリ使用量も増えます。実務ではr=16前後から試して効果を見るのが定石です。学習パラメータ数は元の1%未満で済みます。

アダプター切り替えの柔軟性

LoRAの実用上の大きな利点は、学習済みアダプターが数十MB程度の小さなファイルとして保存できる点です。1つのベースモデルを共有しながら、用途ごとに異なるアダプターを切り替える運用が可能になります。たとえば同じLlamaモデルに対して、カスタマーサポート用・翻訳用・コード生成用のアダプターを用意し、リクエストに応じて瞬時に切り替えるといった運用ができます。

QLoRAでさらに省メモリ化

LoRAをさらに進化させたQLoRAは、ベースモデルを4ビットに量子化した状態でLoRAアダプターを学習させる手法です。これにより、70Bクラスの大規模モデルでも単一GPUでファインチューニングが可能になりました。フルファインチューニングでは7Bモデルに約56GBのGPUメモリが必要ですが、QLoRAなら消費者向けGPU(RTX 4090の24GB)でも十分対応できます。

ツールとエコシステム

LoRA/QLoRAの実装は、エコシステムの充実により非常に手軽になっています。Hugging FaceのPEFTライブラリはLoRA適用を数行のコードで実現でき、Unslothは学習速度を最大2倍に高速化するツールとして人気です。Axolotlやtrlといったライブラリも広く使われており、オープンソースLLMのカスタマイズが誰でもできる環境が整っています。トランスフォーマーベースのモデルであれば、ほぼすべてにLoRAを適用できます。