AI Flow
記事一覧へ
半導体

Contextual AI、企業向けRAGを刷新する「RAG 2.0」プラットフォームを発表

スタートアップのContextual AIが、検索拡張生成(RAG)技術を高度化した「RAG 2.0」プラットフォームを発表。同社によれば、既存の競合サービスと比較して精度・性能で約10倍の向上を実現したという。

スタートアップのContextual AIが、企業向けの検索拡張生成(RAG: Retrieval-Augmented Generation)技術を刷新した新プラットフォーム「RAG 2.0」を発表した。同社の発表によれば、既存の競合サービスと比較して、パラメータ精度や全体的な性能において約10倍の向上を達成しているという。

RAGとは何か、なぜ刷新が必要なのか

RAGは、大規模言語モデル(LLM)が外部のドキュメントやデータベースから関連情報を検索し、その内容を踏まえて回答を生成する手法。企業が自社の内部データや専門知識をLLMに組み込む際に広く使われている技術だが、従来の実装は検索コンポーネントと生成コンポーネントを別々に構築・接続する方式が中心で、精度や一貫性に課題があるとされてきた。

RAG 2.0のアプローチ

Contextual AIは、検索と生成のプロセスを個別のモジュールとして組み合わせるのではなく、エンドツーエンドで統合的に最適化する設計を採用しているとする。これにより、企業が自社データに基づいた質問応答や情報抽出を行う際の精度と効率を大幅に高めることを狙っている。同社は、この統合的なアプローチによって既存のRAGソリューションを大きく上回る性能を実現したと主張している。

企業がLLMを実務に活用する上で、正確性や信頼性の担保は依然として大きな課題となっており、RAG技術の高度化はエンタープライズAI導入における重要な要素として注目されている。

#RAG #Contextual AI #エンタープライズAI #LLM #NVIDIA
シェア

原文ソース

NVIDIA

関連記事

半導体

NVIDIA、次世代AIプラットフォーム「Vera Rubin」の量産を開始

NVIDIAは次世代GPUプラットフォーム「Vera Rubin NVL72」の量産をCoreWeave、Google Cloud、Microsoft Azure、Oracle Cloud Infrastructureなどのパートナーと共に開始した。30カ国350以上の工場からなる大規模なサプライチェーンを構築し、電力あたり性能とトークン処理コストの改善を目指す。

NVIDIA
#NVIDIA #Vera Rubin #GPU
半導体

NVIDIA、次世代Vera Rubin向けネットワーキング「Spectrum-6」を発表 ― ギガスケールAIファクトリー時代に対応

NVIDIAは、数十万規模のGPU・CPUを束ねる「ギガスケールAIファクトリー」向けに新世代イーサネットスイッチ「Spectrum-6」を発表した。次世代アーキテクチャ「Vera Rubin」向けに設計されており、大規模AI学習・推論におけるネットワーク性能のボトルネック解消を狙う。

NVIDIA
#NVIDIA #Spectrum-6 #Vera Rubin
半導体

Wistron、NVIDIA向けAIシステムを製造する米国初工場をテキサス州フォートワースに開設

台湾のWistronが米国初となる製造拠点をテキサス州フォートワースに開設し、NVIDIAのAIシステムの中核となる「スーパーチップ」搭載機器の生産を開始した。AIインフラの製造拠点を米国内に構築する動きの一環となる。

NVIDIA
#NVIDIA #Wistron #AIインフラ