Gemini API
チャット、コード生成、推論、長文脈タスク向けにGoogleのマルチモーダルLLMへGemini APIでアクセスできます。
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.7-flash",
"messages": [
{
"role": "user",
"content": "このコードベースを分析し、Before/Afterの例を示しながら3つのパフォーマンス改善案を提案してください。"
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="gemini-3.7-flash",
messages=[{"role": "user", "content": "このコードベースを分析し、Before/Afterの例を示しながら3つのパフォーマンス改善案を提案してください。"}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "gemini-3.7-flash",
messages: [{ role: "user", content: "このコードベースを分析し、Before/Afterの例を示しながら3つのパフォーマンス改善案を提案してください。" }]
});
Geminiはテキスト、画像、音声、コード理解をサポートするGoogleのマルチモーダル大規模言語モデルファミリーです。FlashとProバリアントがあり、クイックな要約から深い推論や複雑なコーディングまで対応します。
- 品質とレイテンシ目標に合わせたモデルバリアント
- 統合 API key
- Model skill に docs、schema、セットアップメモを同梱
- 失敗した生成は課金されません
バリアント
| Variant | Billing | Pricing | |
|---|---|---|---|
| gemini-2.5-flash | 1K tokens | Input $0.30 / 1M tokens | Output $2.50 / 1M tokens | 見る → |
| gemini-2.5-pro | 1K tokens | Input $1.25-$2.50 / 1M tokens | Output $10.00-$15.00 / 1M tokens | 見る → |
| gemini-3-flash-preview | 1K tokens | Input $0.50 / 1M tokens | Output $3.00 / 1M tokens · Input $0.30 / 1M tokens | Output $1.80 / 1M tokens | 見る → |
| gemini-3.1-pro-preview | 1K tokens | Input $1.00-$2.00 / 1M tokens | Output $7.00-$10.50 / 1M tokens | 見る → |
| gemini-3.5-flash | 1K tokens | Input $1.50 / 1M tokens | Output $9.00 / 1M tokens · Input $0.90 / 1M tokens | Output $5.40 / 1M tokens | 見る → |
| gemini-3.6-flash | 1K tokens | Input $1.50 / 1M tokens | Output $7.50 / 1M tokens · Input $0.90 / 1M tokens | Output $4.50 / 1M tokens | 見る → |
| gemini-3.7-flash | 1K tokens | Input $0.45 / 1M tokens | Output $2.25 / 1M tokens | 見る → |
Gemini API エンドポイント
OpenAI または Anthropic SDK を RunAPI キーで利用できます。追加 SDK は不要です。
| Endpoint | Protocol |
|---|---|
| /v1/chat/completions | OpenAI compatible |
| /v1/responses | OpenAI Responses |
| /v1/messages | Anthropic compatible |
| /v1beta/models/{model}:generateContent | Gemini generateContent |
| /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
この model skill で構築する方法
モデルを選ぶ
出力タイプ、品質基準、レイテンシ目標に合うモデルとバリアントを選びます。
一度だけ認証
対応するすべてのモデルに RunAPI key を使います。
skill をインストール
機能実装の前に model skill をコード作業環境へ追加します。
出力を受け取る
task ID でポーリングするか、生成完了時の callback を処理します。
Gemini の位置づけ
GeminiはGoogleのフラッグシップマルチモーダルLLMで、Flash(高速)とPro(最上位推論)バリアントがあります。RunAPI経由では、すべてのGeminiモデルが同じAPIの形式と課金を共有します。
RunAPI 経由で Gemini を使う理由
1つの API key
モデルやプロバイダーをまたいで同じ認証情報を使えます。
Skill-ready
model skill に schema、セットアップメモ、料金コンテキスト、モデル ID が含まれます。
予測しやすい請求
呼び出し前に従量料金を確認できます。
よくある質問
Geminiのコンテキストウィンドウサイズはどれくらいですか?
すべてのバリアントで最大100万トークンに対応しています。コードベース全体、長文書、複数ターンの会話を切り捨てなしで処理できます。
Geminiはどの入力モダリティを受け付けますか?
テキスト、画像、音声、動画に対応しています。クロスモーダル推論のために1つのリクエストでマルチモーダル入力を渡せます。
Google検索グラウンディングとは何ですか?
GeminiはリアルタイムのGoogle検索結果に基づいて回答をグラウンディングでき、事実確認が必要なクエリや時間的感度の高いクエリのハルシネーションを低減します。
FlashとProはどう違いますか?
Flashは速度とコストに最適化されており、大量タスクに最適です。Proはより深い推論を提供し、複雑な多段階分析に適しています。
Geminiはファンクションコーリングをサポートしていますか?
はい — Geminiは型付きJSONスキーマによる構造化ファンクションコーリングをサポートしており、エージェントワークフローとツール使用に適しています。
このモデルはどう呼び出しますか?
model skill をインストールし、RunAPI key とセットアップメモに従ってください。
失敗した生成は課金されますか?
失敗した生成は課金されません
アプリケーションから呼び出せますか?
はい。コード作業環境に model skill をインストールし、モデル機能を追加するときに利用してください。