AI Flow
記事一覧へ
半導体

ArmのKleidiAI、Google AI EdgeのMediaPipeに統合されLLM推論を高速化

ArmはXNNPACKを介してKleidiAIライブラリをGoogle AI EdgeのMediaPipeフレームワークに統合し、多数のLLMをサポートするオンデバイスAI性能の向上を実現した。

Armは、AI推論向けに最適化された演算カーネル群「KleidiAI」を、Google AI Edgeのモデル推論フレームワーク「MediaPipe」に統合したことを発表した。統合は、MediaPipeが内部で利用する高速な行列演算ライブラリ「XNNPACK」を経由して行われ、Armベースのモバイル・エッジデバイス上での大規模言語モデル(LLM)推論の性能向上を狙うものだ。

KleidiAIとMediaPipeの役割

KleidiAIは、Armアーキテクチャ上でのAIワークロード実行を高速化するために設計された、オープンソースのソフトウェアライブラリ群である。行列積演算などAI推論の中核処理をArm CPUの命令セットに合わせて最適化することで、開発者が個別にチューニングを行わずとも性能向上を得られるようにすることを目的としている。

一方のMediaPipeは、Googleが提供するオンデバイスAI・機械学習パイプライン構築フレームワークで、画像認識や自然言語処理を含む多様なモデルの推論をエッジデバイス上で実行するために広く利用されている。今回、MediaPipeが依存するXNNPACKにKleidiAIが組み込まれたことで、MediaPipe上で動作する数多くのLLMがArmデバイス上でより高速に推論できるようになるという。

エッジAIへの波及効果

この統合により、開発者側で追加の作業をすることなく、Arm搭載のスマートフォンやIoT機器などで動作するAIアプリケーションの応答速度や効率が向上することが期待される。生成AIモデルのオンデバイス実行が急速に広がる中、ハードウェアベンダーとフレームワーク開発元の連携によるソフトウェアスタック全体での最適化が、エッジAIの実用性を左右する重要な要素となっている。

#Arm #KleidiAI #MediaPipe #エッジAI #Google
シェア

原文ソース

Arm

関連記事

半導体

NVIDIA、次世代AIプラットフォーム「Vera Rubin」の量産を開始

NVIDIAは次世代GPUプラットフォーム「Vera Rubin NVL72」の量産をCoreWeave、Google Cloud、Microsoft Azure、Oracle Cloud Infrastructureなどのパートナーと共に開始した。30カ国350以上の工場からなる大規模なサプライチェーンを構築し、電力あたり性能とトークン処理コストの改善を目指す。

NVIDIA
#NVIDIA #Vera Rubin #GPU
半導体

NVIDIA、次世代Vera Rubin向けネットワーキング「Spectrum-6」を発表 ― ギガスケールAIファクトリー時代に対応

NVIDIAは、数十万規模のGPU・CPUを束ねる「ギガスケールAIファクトリー」向けに新世代イーサネットスイッチ「Spectrum-6」を発表した。次世代アーキテクチャ「Vera Rubin」向けに設計されており、大規模AI学習・推論におけるネットワーク性能のボトルネック解消を狙う。

NVIDIA
#NVIDIA #Spectrum-6 #Vera Rubin
半導体

Wistron、NVIDIA向けAIシステムを製造する米国初工場をテキサス州フォートワースに開設

台湾のWistronが米国初となる製造拠点をテキサス州フォートワースに開設し、NVIDIAのAIシステムの中核となる「スーパーチップ」搭載機器の生産を開始した。AIインフラの製造拠点を米国内に構築する動きの一環となる。

NVIDIA
#NVIDIA #Wistron #AIインフラ