NVIDIA GTC Taipei — 2026年6月1日 — 高性能GPUクラウドとAI推論サービスを提供し、本番環境でのAI活用を支えるAIネイティブクラウドプロバイダーのGMI Cloudは、本日、GTC 2026 Taipeiで注目を集めたNVIDIA Vera Rubinプラットフォームを基盤に、次世代のエージェント型AIファクトリーを支援していくことを発表しました。
AIワークロードが単一モデルへのプロンプトから、マルチモーダルかつ長時間稼働する自律型システムへと進化する中、企業や開発者には、リアルタイム推論、セキュアなオーケストレーション、高スループット推論、継続的なAI運用を大規模に支えられるインフラが求められています。
GMI Cloudは、モデルからアプリケーションまでのライフサイクル全体にわたり、パフォーマンス、柔軟性、セキュリティを確保しながら、本番AIワークロードのデプロイ、スケーリング、運用を支援する、推論ネイティブなクラウドプラットフォームを構築しています。
次世代のAIアプリケーションは、単に回答を生成するだけではありません。推論や計画、ツールの呼び出し、ワークフローの連携、マルチモーダルコンテキストの処理を行い、企業や開発者の環境全体で継続的に稼働するインテリジェントシステムへと進化していきます。
こうした新しいワークロードには、従来とは根本的に異なるインフラ要件が求められます。
リアルタイムAIアプリケーション向けの高スループット・低レイテンシ推論
テキスト、画像、動画、音声、エージェント型ワークフローに対応する、スケーラブルなマルチモーダルモデルのデプロイ
自律型AIエージェントに必要な長いコンテキストでの推論、メモリ、オーケストレーション
企業および規制対象のAIワークロードに対応するセキュアなマルチテナントインフラ
継続的に稼働するAIシステム向けの動的なスケーリング
トークンコストの削減とリソース利用率の向上を実現する、最適化されたAIインフラのオーケストレーション
AIが実験段階から本番環境へと移行するにつれ、推論インフラはAIファクトリーの運用基盤になりつつあります。
GMI Cloudは、大規模推論、エージェント型ワークロード、本番AIのデプロイ向けに設計された、最も包括的なフルスタックのエンドツーエンドAIファクトリープラットフォームとしてNVIDIAを採用しています。
GMI Cloudプラットフォームは、以下の機能を統合しています。
AIのトレーニング、推論、本番デプロイに対応する高性能AIインフラ
最適化された低レイテンシのモデルサービングを実現するPrime Inference
プロプライエタリモデルとオープンソースモデルに統一的にアクセスできるMaaS API
エンタープライズグレードの本番推論を実現するDedicated Endpoint
スケーラブルなAI運用を支えるAIインフラのオーケストレーションおよび最適化レイヤー
サンドボックス環境でツールを利用しながら自律的に動作するAIシステム向けのエージェント型ワークフロー基盤
次世代AIアプリケーション向けのマルチモーダルネイティブなデプロイ環境
最適化されたコンピューティングのオーケストレーション、本番環境向け推論、開発者が利用しやすいAPIを組み合わせることで、GMI Cloudは、実環境のAIシステムに求められるパフォーマンスと信頼性を維持しながら、プロトタイプから本番環境への移行を加速します。
AIファクトリーでプロプライエタリデータ、規制対象コンテンツ、モデルコンテキスト、エージェントのメモリが扱われる機会が増えるにつれ、セキュリティはAIインフラスタックにおける重要な要素となります。
GMI Cloudは、セキュアかつ高性能なAIファクトリーを目指すNVIDIAのビジョンに賛同し、モデルとデータの両方に高度なセキュリティとプライバシーが求められる次世代AIワークロード向けの信頼できる実行環境を実現するため、NVIDIA Confidential Computingの導入を進めています。
エンタープライズAIの開発者にとって、これは機密データ、マルチテナント環境、推論パイプライン、自律型AIエージェントの運用をより強固に保護しながらAIワークロードを展開するための重要な一歩となります。また、モデルプロバイダーにとっては、モデルのセキュリティを損なうことなく新たな市場へ参入する機会につながります。
企業がAIを社内での試験運用から本番環境へと拡大していく中、セキュアなインフラはAIのさらなる普及を支える不可欠な基盤となります。
NVIDIA Vera Rubinは、次世代のコンピューティング、ネットワーキング、セキュリティ、ラックスケールのシステム設計を統合し、エージェント型AIの要求に応えるAIファクトリーインフラの進化における大きなマイルストーンです。
GMI Cloudは、プロバイダーと顧客の双方に優れた経済性をもたらすNVIDIAエコシステムとの連携をさらに強化しています。具体的には、ワット当たりの高いコンピューティング性能、低いトークンコスト、幅広い顧客需要、そして長期にわたる有効活用が可能というメリットがあります。両社は、マルチモーダル推論やモデルAPIからDedicated Endpoint、エージェント型インフラまで、開発者や企業による高度なAIワークロードのグローバル展開を支援していきます。
AI開発者の間で、パフォーマンスと本番運用への対応力の両方に最適化されたインフラへの需要が高まる中、GMI Cloudは次世代のインテリジェントアプリケーションを支えるクラウド基盤の提供に注力しています。
AI業界は、新たな運用時代を迎えています。自律型AIエージェント、マルチモーダル推論システム、継続的に稼働するAIワークフローが、今後のソフトウェアの構築、デプロイ、スケーリングのあり方を形作っていきます。
GMI Cloudは、本番環境で信頼性、安全性、効率性を確保しながら稼働できるインテリジェントシステムを構築する開発者が、AIの未来を切り拓いていくと考えています。
GMI Cloudは、AIネイティブな推論インフラを通じて、開発者、スタートアップ、企業が、高性能かつセキュアでスケーラブルなクラウドインフラ上に次世代AIアプリケーションを構築できるよう支援していきます。
次世代のAIファクトリーは、すでに構築が始まっています。その原動力となるのが、推論です。
GMI Cloudの高性能GPUクラウドおよびAI推論プラットフォームの詳細は、こちらをご覧ください。
GMI Team
GMI Cloud helps you architect, deploy, optimize, and scale your AI strategies
