NVIDIA、RTX AI ToolkitでMulti-LoRAをサポート—微調整LLMが最大6倍高速化
NVIDIAはRTX AI Toolkitの最新アップデートでMulti-LoRAサポートを追加し、RTX搭載AI PCやワークステーション上で微調整済みLLMを実行する際の性能を最大6倍向上させた。
NVIDIAは「RTX AI Toolkit」の最新アップデートにおいて、複数のLoRA(Low-Rank Adaptation)アダプタを同時にサポートする「Multi-LoRA」機能を追加したことを発表した。これにより、RTX搭載のAI PCやワークステーション上で微調整済みの大規模言語モデル(LLM)を動かす際の性能が、最大6倍高速化するという。
LoRAとMulti-LoRAの意義
LoRAは、大規模モデル全体を再学習することなく、少数の追加パラメータのみを学習することで特定タスクに適応させる効率的な微調整手法として広く利用されている。Multi-LoRA対応により、複数の異なる用途向けにカスタマイズされたアダプタを、ベースモデルを共有しつつ切り替えながら利用できるようになり、メモリ効率と推論速度の両立が図られる。
RTX AI PCでのローカル推論の強化
RTX AI Toolkitは、開発者がRTX搭載PCやワークステーション上でLLMをカスタマイズ・最適化し、ローカル環境で高速に推論できるようにするためのツール群である。今回のアップデートにより、クラウドに依存せずデバイス上で複数のタスク特化型モデルを効率的に切り替えて利用するアプリケーション開発が容易になる。NVIDIAはこの機能強化が、AI PC上でのパーソナライズされたAI体験の実現を後押しするとしている。
原文ソース
NVIDIA