半導体
半導体の記事一覧
インテル、AI PC向け初のデスクトップ向けCore Ultraプロセッサー「200Sシリーズ」を発表
インテルはAI PC向けとして初となるデスクトップ向けプロセッサー「インテル® Core™ Ultra 200Sシリーズ」を発表した。消費電力の大幅な削減とゲーミング性能の向上、業界をリードするコンピューティング能力を特徴とする。
NVIDIA Research、2024年のAI研究成果を総括 ― 3Dシミュレーション・気候科学・音響工学で進展
NVIDIAは2024年におけるAI研究部門の成果を振り返るブログ記事を公開し、3Dシミュレーション、気候科学、音響工学など幅広い分野でのブレークスルーを紹介した。技術革新のペースがこの1年で加速したとしている。
NVIDIA、生成AIからエージェントAIへ—AI Decodedシリーズが1年間の進化を総括
NVIDIAの解説シリーズ「AI Decoded」が、この1年間のAI技術の進化を振り返る特集記事を公開。LLMの基礎解説からRTX AI PC・ワークステーションの活用まで、生成AIからエージェントAIへのトレンド変化を総括している。
Arm、2024年を「AI向けコンピュートプラットフォームの年」と総括
Armは公式ブログで、2024年を通じてAI向けコンピュートプラットフォームとしての地位を確立した1年だったと振り返り、関連する発表や製品、取り組みを紹介した。
Arm、Neoverse CPU上でLlama 3.3 70Bが効率的に推論可能とベンチマーク結果を公表
Armは、大規模言語モデルLlama 3.3 70BがArm Neoverseベースのクラウド向けCPU上で効率的に推論を実行できることを示す5つのベンチマーク結果を発表しました。GPUに依存しないCPU推論の実用性を訴求する内容です。
NVIDIA、RTX AI PC向けAnythingLLMに「Community Hub」を追加 AIエージェント機能を強化
NVIDIAはRTXアクセラレーション対応のローカルLLMアプリ「AnythingLLM」に、プロンプトやスラッシュコマンド、AIエージェントのスキルを共有できる「Community Hub」を追加した。ローカルPC上で自律的にタスクを解決するAIエージェントの構築・共有を容易にする狙いがある。
Arm、アジア各国でTech Symposiaを開催 AI技術の転換にはエコシステム協業が不可欠と強調
Armは中国・日本・韓国・台湾で開催した2024年Tech Symposiaの基調講演で、AI技術の進展には業界全体での前例のないエコシステム協業が必要だと訴えた。半導体設計からソフトウェア、クラウドまで幅広いパートナーとの連携強化がテーマとなった。
MicrosoftのCobalt 100、Arm Neoverse CSSでAI向けクラウド基盤を強化
MicrosoftはArmのNeoverse Compute Subsystems(CSS)を活用した独自CPU「Cobalt 100」により、AIワークロードに対応したクラウドコンピューティングの新時代を目指すと発表した。
NVIDIA、AIファクトリー構築を支援する「エンタープライズ・リファレンス・アーキテクチャ」を発表
NVIDIAは、企業がAIファクトリーを自社構築する際の指針となる「エンタープライズ・リファレンス・アーキテクチャ」を発表した。システムパートナーや共同顧客がNVIDIA製システムを活用して標準化されたAIインフラを構築できるようにすることが狙い。
金融大手がNVIDIAの生成AI技術を採用、不正検知や資産運用を高速化
Ntropy、Contextual AI、NayaOne、SecuritiなどのフィンテックがNVIDIAのNIMマイクロサービスとアクセラレーテッドコンピューティングを活用し、不正検知や財務計画など金融サービス向けAIアプリケーションを強化している。
Intel、AI PC向け次世代Core Ultraプロセッサファミリーを韓国市場に投入
IntelはAI PC向けとして開発した次世代Core Ultraプロセッサファミリーを韓国で正式発表し、現地市場への展開を開始した。
Arm、OCP Global Summit 2024でAIスケーラビリティ課題への取り組みを発表
ArmはOCP Global Summit 2024において、AIインフラの設計・開発における摩擦を減らすことでスケーラビリティ課題に取り組む姿勢を示した。データセンター向けチップ設計の標準化・効率化がテーマとなった。
IntelがPyTorch 2.5に貢献、Intel GPU向けサポートを拡充
IntelはPyTorch 2.5への貢献を発表し、データセンター・クライアント向けIntel GPUのサポートを強化する新機能を追加した。AI開発者向けのプログラミング体験の向上を目指す内容となっている。
NVIDIA、RTX搭載PCでpandasを最大100倍高速化する「RAPIDS cuDF」を発表
NVIDIAはRAPIDS cuDFにより、データサイエンスで広く使われるPythonライブラリpandasの処理をRTX搭載AI PCやワークステーション上で最大100倍高速化できるとしている。GPUアクセラレーションによってデータサイエンスワークフロー全体の効率化が期待される。
Azure機密仮想マシン向けNVIDIA H100 GPUが一般提供開始
Microsoft AzureがNVIDIA H100 NVL Tensor Core GPUを搭載した機密仮想マシンの一般提供を開始し、GPUを使うAIワークロードをよりセキュアに実行できるようになった。
Intel、次世代AI向けチップ「Xeon 6」と「Gaudi 3」を発表
Intelはエンタープライズ向けAIシステムの性能向上を狙い、新型サーバーCPU「Xeon 6」とAIアクセラレータ「Gaudi 3」を発表した。データセンターでの高性能AI処理とコスト効率の両立を目指す。
Contextual AI、企業向けRAGを刷新する「RAG 2.0」プラットフォームを発表
スタートアップのContextual AIが、検索拡張生成(RAG)技術を高度化した「RAG 2.0」プラットフォームを発表。同社によれば、既存の競合サービスと比較して精度・性能で約10倍の向上を実現したという。
IntelとIBM、Gaudi 3 AIアクセラレータをIBM Cloudに展開へ
IntelとIBMは、Intel製AIアクセラレータ「Gaudi 3」をIBM Cloud上に展開し、企業のAI活用を後押しする取り組みを発表した。両社はクラウド経由でエンタープライズ向けAI基盤の選択肢を広げる狙いがある。
NVIDIA、RTX AI ToolkitでMulti-LoRAをサポート—微調整LLMが最大6倍高速化
NVIDIAはRTX AI Toolkitの最新アップデートでMulti-LoRAサポートを追加し、RTX搭載AI PCやワークステーション上で微調整済みLLMを実行する際の性能を最大6倍向上させた。
インテル、Xeon 6のAI推論性能が4年間で最大17倍に向上とMLPerf結果で発表
インテルは最新のMLPerfベンチマーク結果を公開し、Xeon 6プロセッサがAI推論を含む汎用AIワークロードにおいて過去4年間のXeon世代と比較して最大17倍の性能向上を達成したと発表した。
NVIDIA、SIGGRAPHでChatRTX刷新とLlama 3対応を発表 RTX搭載PCでのAI活用を強化
NVIDIAはSIGGRAPHにおいて、RTX搭載PCおよびワークステーション向けのAIツール・アプリの最新アップデートを発表した。ChatRTXの刷新とLlama 3対応により、AIコンテンツ制作や開発の効率化を図る。
MetaのザッカーバーグCEO、NVIDIAフアンCEOとの対談でクリエイター向けAIアシスタント構想を語る
SIGGRAPH 2024の対談で、Meta CEOマーク・ザッカーバーグ氏とNVIDIA CEOジェンスン・フアン氏がオープンソースAIとAIアシスタントの可能性について議論した。ザッカーバーグ氏はユーザーが独自のAIキャラクターを作成・共有・利用できる新プラットフォーム「AI Studio」の立ち上げも発表した。
ArmのKleidiAI、Google AI EdgeのMediaPipeに統合されLLM推論を高速化
ArmはXNNPACKを介してKleidiAIライブラリをGoogle AI EdgeのMediaPipeフレームワークに統合し、多数のLLMをサポートするオンデバイスAI性能の向上を実現した。
Roblox、生成AIでユーザー体験の安全性と包括性を強化
RobloxのAI・成長エンジニアリング担当VPであるAnupam Singh氏が、生成AIを活用してバーチャル空間での体験を向上させ、包括性とユーザーの安全性を高める取り組みについて語った。