1つのエンドポイントで、
200以上のモデル

コードはそのまま、モデルIDを変えるだけ。H200 GPU上でチャット、ビジョン、推論を実行

APIキーを取得
curl https://api.gmi-serving.com/v1/chat/completions \
  -H "Authorization: Bearer $GMI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-ai/DeepSeek-V4-Pro",
    "stream": true,
    "messages": [{"role": "user", "content": "Hello"}]
  }'
利用可能なモデル
200+

利用可能なモデル

データセンターのカバレッジ
Global

データセンターのカバレッジ

稼働率目標
99.9%

稼働率目標

4つの始め方

必要なものから始めてください。それぞれリファレンスにリンクしています

Inference API

OpenAI互換の単一エンドポイントでチャット、ビジョン、推論を実行

APIリファレンス

SDK

PythonとTypeScriptのクライアント。OpenAI SDKとそのまま置き換え可能

SDKドキュメント

AgentBox

マネージドなコンピュート上でエージェントをデプロイ・実行

AgentBoxを開く

Docs

クイックスタート、リファレンス、コードサンプル

ドキュメントを読む

最初のリクエスト

キーを作成し、モデルを選び、ストリームを受け取る

  1. 01

    キーを作成する

    コンソールでAPIキーを生成します

  2. 02

    モデルを選ぶ

    モデルIDをコピーするか、GET /v1/modelsで一覧を取得します

  3. 03

    リクエストを送る

    エンドポイントを呼び出し、ストリームを受け取ります

  4. 04

    スケールする

    レイテンシを安定させたい場合は専用エンドポイントに切り替えます

python · openai client

# pip install openai
from openai import OpenAI
client = OpenAI(base_url="https://api.gmi-serving.com/v1",
                api_key=GMI_API_KEY)  # from console.gmicloud.ai

stream = client.chat.completions.create(
    model="deepseek-ai/DeepSeek-V4-Pro",  # any id from /v1/models
    stream=True,
    messages=[{"role":"user",
               "content":"Summarize this paragraph."}])

for chunk in stream:
    print(chunk.choices[0].delta.content or "", end="")

エンドポイント

1つのベースURLと1つのキー、すべてのルートで同じリクエスト形式

Base URLhttps://api.gmi-serving.com
POST/v1/chat/completionsチャット、ビジョン、ツール。ストリーミングにも一括レスポンスにも対応
POST/v1/responsesOpenAI Responses API
POST/v1/messagesAnthropic Messages API
GET/v1/modelsお使いのキーで利用できるモデルの一覧

GMI Cloudで構築

同じAPIとコンピュートで動作しているアプリです。開いて動作を確かめてみてください

すべてのデモを見る
Model Arena
DeepSeek V4 Pro, GPT 5.5

Model Arena

Compare top LLMs like DeepSeek V4 Pro and GPT 5.5 side by side on real coding, math, and system design prompts, benchmarked live on GMI Cloud's inference API for speed, cost, and output quality.

デモを開く
Music Memory
Text and image

Music Memory

Your Spotify year, sorted into chapters. Claude names your eras, roasts your top songs, and recommends what's missing. Gemini paints each chapter.

デモを開く
Picture Compose
Image generation

Picture Compose

Photorealistic image compositing. Gemini 3.1 Pro reads the scene's light and perspective; Nano Banana 2 paints your objects in subtly and naturally.

デモを開く

モデル

1つのAPIの背後に200以上のオープンモデルとフロンティアモデル。/v1/modelsのIDをmodelフィールドに指定するだけで、再デプロイも新しいSDKも不要です

すべてのモデルを見る
AnthropicFRONTIER

anthropic/claude-opus-4.8

Anthropic flagship

OpenAIFRONTIER

openai/gpt-5.6

OpenAI flagship

GoogleMultimodal

google/gemini-3.1-pro-preview

Text + vision

OpenAIVideo

openai/sora-2

Text + image to video

MoonshotAIImage

moonshotai/kimi-k3

Open flagship, text-to-image

MoonshotAIReasoning

moonshotai/Kimi-K2-Thinking

Long-horizon agentic

トークン単位の料金、100万トークンあたり$0.05から

料金はモデルごとに設定されています。お使いのキーで利用できるモデルはモデルセクションをご覧ください

料金を見る

APIキーから始めましょう

キーを作成し、スニペットをコピーすれば、トークンが返ってきます