GPT-5.6 SolのAPI・クレジット価格を20%以上引き下げClaude SecurityがMythos 5でGitHubリポジトリをスキャンZero Data Retention継続とPrivate Safety Processingプレビューで安全性を強化ClaudeがGmailでメールを送信しGoogle Driveのファイルを管理できます高リスク訓練の監視を強化しRL訓練を一時停止できます承認済み防御者がGPT-5.6-Cyberで高度な脆弱性調査を進めやすくなりますサイクロン予測で1日以上の余裕を持った対策が可能になります声で話しながら推論やツールを使っても会話が途切れませんAIが長年の数学難問10件に新結果、証明書を公開GPT-5.6 LunaとTerraの価格が80%・20%下がり、高速オプションも追加されますOpus 5が全有料プランとAPIで即利用可能に健康記録を安全に連携し、症状変化や検査結果を文脈で把握できますノートにコードを入れて調べ物と分析を一つにできますGPT-Redでプロンプトインジェクション耐性が大幅向上授業準備をAIで短くしやすくなります会話から資料作成まで、仕事をひと通り速く進めやすくなりますブラウザだけでAI推論を動かして待ち時間を減らせますClaudeの使い方を振り返って無駄を減らせます長い作業を下書きから資料化まで一気に進めやすくなります大きくなるモデルの安全確認ルールを最新版で追えますGPT-5.6 SolのAPI・クレジット価格を20%以上引き下げClaude SecurityがMythos 5でGitHubリポジトリをスキャンZero Data Retention継続とPrivate Safety Processingプレビューで安全性を強化ClaudeがGmailでメールを送信しGoogle Driveのファイルを管理できます高リスク訓練の監視を強化しRL訓練を一時停止できます承認済み防御者がGPT-5.6-Cyberで高度な脆弱性調査を進めやすくなりますサイクロン予測で1日以上の余裕を持った対策が可能になります声で話しながら推論やツールを使っても会話が途切れませんAIが長年の数学難問10件に新結果、証明書を公開GPT-5.6 LunaとTerraの価格が80%・20%下がり、高速オプションも追加されますOpus 5が全有料プランとAPIで即利用可能に健康記録を安全に連携し、症状変化や検査結果を文脈で把握できますノートにコードを入れて調べ物と分析を一つにできますGPT-Redでプロンプトインジェクション耐性が大幅向上授業準備をAIで短くしやすくなります会話から資料作成まで、仕事をひと通り速く進めやすくなりますブラウザだけでAI推論を動かして待ち時間を減らせますClaudeの使い方を振り返って無駄を減らせます長い作業を下書きから資料化まで一気に進めやすくなります大きくなるモデルの安全確認ルールを最新版で追えます
公式発表のみ掲載。噂・リーク・情報商材は除外します。
← 用語集に戻る
用語集AI用語

LoRA

LoRA (Low-Rank Adaptation)

ろおら

解説

LoRAとは、重み全体を更新せず小さな追加行列だけを学習し、少ない計算でモデルを適応させる手法です。理解すると調整がしやすくなります。

7Bパラメータのモデルをフルでファインチューニングするには数十GBのGPUメモリが必要で、個人や小規模チームには手が届かない技術でした。この壁を劇的に低くしたのがLoRAです。LoRA(Low-Rank Adaptation)とは、モデルの元のパラメータを固定したまま、小さな追加行列(アダプター)のみを学習させることで効率的にファインチューニングを行う手法です。

低ランク行列という着想

LoRAの核心は、ファインチューニングで変化するパラメータの差分は低ランクの行列で十分に近似できるという発見にあります。元のモデルの重み行列がd×dのサイズだとすると、LoRAはd×rとr×dの2つの小さな行列を追加します。rは「ランク」と呼ばれるハイパーパラメータで、通常8〜64程度に設定します。ランクが大きいほど表現力は増しますが、メモリ使用量も増えます。実務ではr=16前後から試して効果を見るのが定石です。学習パラメータ数は元の1%未満で済みます。

アダプター切り替えの柔軟性

LoRAの実用上の大きな利点は、学習済みアダプターが数十MB程度の小さなファイルとして保存できる点です。1つのベースモデルを共有しながら、用途ごとに異なるアダプターを切り替える運用が可能になります。たとえば同じLlamaモデルに対して、カスタマーサポート用・翻訳用・コード生成用のアダプターを用意し、リクエストに応じて瞬時に切り替えるといった運用ができます。

QLoRAでさらに省メモリ化

LoRAをさらに進化させたQLoRAは、ベースモデルを4ビットに量子化した状態でLoRAアダプターを学習させる手法です。これにより、70Bクラスの大規模モデルでも単一GPUでファインチューニングが可能になりました。フルファインチューニングでは7Bモデルに約56GBのGPUメモリが必要ですが、QLoRAなら消費者向けGPU(RTX 4090の24GB)でも十分対応できます。

ツールとエコシステム

LoRA/QLoRAの実装は、エコシステムの充実により非常に手軽になっています。Hugging FaceのPEFTライブラリはLoRA適用を数行のコードで実現でき、Unslothは学習速度を最大2倍に高速化するツールとして人気です。Axolotlやtrlといったライブラリも広く使われており、オープンソースLLMのカスタマイズが誰でもできる環境が整っています。トランスフォーマーベースのモデルであれば、ほぼすべてにLoRAを適用できます。