AI Flow
記事一覧へ
半導体

NVIDIA、RTX AI ToolkitでMulti-LoRAをサポート—微調整LLMが最大6倍高速化

NVIDIAはRTX AI Toolkitの最新アップデートでMulti-LoRAサポートを追加し、RTX搭載AI PCやワークステーション上で微調整済みLLMを実行する際の性能を最大6倍向上させた。

NVIDIAは「RTX AI Toolkit」の最新アップデートにおいて、複数のLoRA(Low-Rank Adaptation)アダプタを同時にサポートする「Multi-LoRA」機能を追加したことを発表した。これにより、RTX搭載のAI PCやワークステーション上で微調整済みの大規模言語モデル(LLM)を動かす際の性能が、最大6倍高速化するという。

LoRAとMulti-LoRAの意義

LoRAは、大規模モデル全体を再学習することなく、少数の追加パラメータのみを学習することで特定タスクに適応させる効率的な微調整手法として広く利用されている。Multi-LoRA対応により、複数の異なる用途向けにカスタマイズされたアダプタを、ベースモデルを共有しつつ切り替えながら利用できるようになり、メモリ効率と推論速度の両立が図られる。

RTX AI PCでのローカル推論の強化

RTX AI Toolkitは、開発者がRTX搭載PCやワークステーション上でLLMをカスタマイズ・最適化し、ローカル環境で高速に推論できるようにするためのツール群である。今回のアップデートにより、クラウドに依存せずデバイス上で複数のタスク特化型モデルを効率的に切り替えて利用するアプリケーション開発が容易になる。NVIDIAはこの機能強化が、AI PC上でのパーソナライズされたAI体験の実現を後押しするとしている。

#NVIDIA #RTX AI Toolkit #LoRA #LLM #AI PC
シェア

原文ソース

NVIDIA

関連記事

半導体

NVIDIA、次世代AIプラットフォーム「Vera Rubin」の量産を開始

NVIDIAは次世代GPUプラットフォーム「Vera Rubin NVL72」の量産をCoreWeave、Google Cloud、Microsoft Azure、Oracle Cloud Infrastructureなどのパートナーと共に開始した。30カ国350以上の工場からなる大規模なサプライチェーンを構築し、電力あたり性能とトークン処理コストの改善を目指す。

NVIDIA
#NVIDIA #Vera Rubin #GPU
半導体

NVIDIA、次世代Vera Rubin向けネットワーキング「Spectrum-6」を発表 ― ギガスケールAIファクトリー時代に対応

NVIDIAは、数十万規模のGPU・CPUを束ねる「ギガスケールAIファクトリー」向けに新世代イーサネットスイッチ「Spectrum-6」を発表した。次世代アーキテクチャ「Vera Rubin」向けに設計されており、大規模AI学習・推論におけるネットワーク性能のボトルネック解消を狙う。

NVIDIA
#NVIDIA #Spectrum-6 #Vera Rubin
半導体

Wistron、NVIDIA向けAIシステムを製造する米国初工場をテキサス州フォートワースに開設

台湾のWistronが米国初となる製造拠点をテキサス州フォートワースに開設し、NVIDIAのAIシステムの中核となる「スーパーチップ」搭載機器の生産を開始した。AIインフラの製造拠点を米国内に構築する動きの一環となる。

NVIDIA
#NVIDIA #Wistron #AIインフラ