一個端點,
200+ 個模型

程式碼不用改,只換 model ID。在 H200 GPU 上執行對話、視覺與推理任務

取得 API 金鑰
curl https://api.gmi-serving.com/v1/chat/completions \
  -H "Authorization: Bearer $GMI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-ai/DeepSeek-V4-Pro",
    "stream": true,
    "messages": [{"role": "user", "content": "Hello"}]
  }'
可用模型
200+

可用模型

資料中心覆蓋範圍
Global

資料中心覆蓋範圍

可用性目標
99.9%

可用性目標

四種上手方式

從你需要的部分開始。每一項都連到對應的參考文件

Inference API

在單一個相容 OpenAI 的端點上執行對話、視覺與推理

API 參考文件

SDK

Python 與 TypeScript 用戶端。可直接替換 OpenAI SDK

SDK 文件

AgentBox

在受管運算資源上部署並執行 agent

開啟 AgentBox

Docs

快速上手指南、參考文件與程式碼範例

閱讀文件

第一個請求

建立金鑰、挑一個模型、讀取串流回應

  1. 01

    建立金鑰

    在 console 中產生 API 金鑰

  2. 02

    挑一個模型

    複製 model id,或用 GET /v1/models 列出所有模型

  3. 03

    送出請求

    呼叫端點並讀取串流回應

  4. 04

    擴展規模

    改用專用端點以取得穩定的延遲表現

python · openai client

# pip install openai
from openai import OpenAI
client = OpenAI(base_url="https://api.gmi-serving.com/v1",
                api_key=GMI_API_KEY)  # from console.gmicloud.ai

stream = client.chat.completions.create(
    model="deepseek-ai/DeepSeek-V4-Pro",  # any id from /v1/models
    stream=True,
    messages=[{"role":"user",
               "content":"Summarize this paragraph."}])

for chunk in stream:
    print(chunk.choices[0].delta.content or "", end="")

端點

同一組 base URL 與金鑰,各路由的請求格式完全一致

Base URLhttps://api.gmi-serving.com
POST/v1/chat/completions對話、視覺、工具呼叫,支援串流或一次性回應
POST/v1/responsesOpenAI Responses API
POST/v1/messagesAnthropic Messages API
GET/v1/models列出你的金鑰可用的模型

以 GMI Cloud 打造

這些應用運行在同一組 API 與運算資源上。開啟其中一個看看實際運作

查看所有示範
Model Arena
DeepSeek V4 Pro, GPT 5.5

Model Arena

Compare top LLMs like DeepSeek V4 Pro and GPT 5.5 side by side on real coding, math, and system design prompts, benchmarked live on GMI Cloud's inference API for speed, cost, and output quality.

開啟示範
Music Memory
Text and image

Music Memory

Your Spotify year, sorted into chapters. Claude names your eras, roasts your top songs, and recommends what's missing. Gemini paints each chapter.

開啟示範
Picture Compose
Image generation

Picture Compose

Photorealistic image compositing. Gemini 3.1 Pro reads the scene's light and perspective; Nano Banana 2 paints your objects in subtly and naturally.

開啟示範

模型

單一 API 背後有 200+ 個開源與前沿模型。把 /v1/models 中的任一 id 當作 model 欄位傳入即可,不需重新部署,也不用換 SDK

瀏覽所有模型
AnthropicFRONTIER

anthropic/claude-opus-4.8

Anthropic flagship

OpenAIFRONTIER

openai/gpt-5.6

OpenAI flagship

GoogleMultimodal

google/gemini-3.1-pro-preview

Text + vision

OpenAIVideo

openai/sora-2

Text + image to video

MoonshotAIImage

moonshotai/kimi-k3

Open flagship, text-to-image

MoonshotAIReasoning

moonshotai/Kimi-K2-Thinking

Long-horizon agentic

依 token 計價,每 100 萬 token 最低 $0.05

價格依模型而定,可用模型請見「模型」區塊

查看價格

從一組 API 金鑰開始

建立金鑰、複製程式碼片段,就能收到回傳的 token