Endpoint カバレッジ
1 個の公開 endpoint を提供しています: chat_completion。
Gemini 3.1 Flash-Lite;1Mコンテキスト、調整可能な思考;OpenAI互換Chat Completionsでテキストを送信
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-3.1-flash-lite:generateContent
POST /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-lite",
"messages": [
{
"role": "user",
"content": "このコードベースを分析し、Before/Afterの例を示しながら3つのパフォーマンス改善案を提案してください。"
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="gemini-3.1-flash-lite",
messages=[{"role": "user", "content": "このコードベースを分析し、Before/Afterの例を示しながら3つのパフォーマンス改善案を提案してください。"}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "gemini-3.1-flash-lite",
messages: [{ role: "user", content: "このコードベースを分析し、Before/Afterの例を示しながら3つのパフォーマンス改善案を提案してください。" }]
});
11 個のバージョンを利用可能
Gemini 3.1 Flash-Liteは、GoogleのGemini 3シリーズにおける低レイテンシ・低コストのモデルです。Googleは、翻訳、分類、エンティティ抽出、ドキュメントの振り分け、モデル間のリクエストルーティングなど、大量の単純なタスク向けに設計しています。安定版のgemini-3.1-flash-liteは2026年5月7日に一般提供が始まりました。コンテキストウィンドウは1,048,576トークン、出力は最大65,536トークンです。
思考は調整可能です。Googleはminimalからhighまでの4段階の思考レベルを用意しており、思考トークンは出力として数えられます。Googleはこのモデルで関数呼び出しと構造化出力をサポートしています。
Googleのモデルはテキスト、画像、動画、音声、PDFの入力を受け付けます。RunAPIでは、gemini-3.1-flash-liteが受け付ける入力はテキストのみです。OpenAI互換のChat Completionsエンドポイント(/v1/chat/completions)、OpenAI Responses、Anthropic Messages、Gemini generateContentのいずれかでリクエストを送ってください。Googleは後継としてGemini 3.5 Flash-Liteを挙げており、RunAPIではgemini-3.5-flash-liteとして提供しています。
モデルを選んで、数秒で生成できます。
| プロバイダー | |
| モデル ID | gemini-3.1-flash-lite |
| モダリティ | テキスト |
| タスク種別 | Synchronous |
| API エンドポイント | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/gemini-3.1-flash-lite:generateContent | |
| /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent | |
| 請求単位 | 1,000 トークン |
| カタログ状態 | 稼働中 |
無料で登録し、ダッシュボードから gemini-3.1-flash-lite 用の API キーを作成します。
/v1/chat/completions に gemini-3.1-flash-lite のモデル ID とパラメータを指定して POST リクエストを送信します。
エンドポイントから完了した gemini-3.1-flash-lite のレスポンスを直接読み取ります。
1 個の公開 endpoint を提供しています: chat_completion。
1,000 トークン に基づいて計量課金されます。サブスクリプション不要。
このエンドポイントに公開されたリクエストパラメータはありません。
LLM をチャットや推論に利用します。
実装作業の生成とレビューに使います。
モデルを backend タスクに接続します。
このモデルの確認済み顧客フィードバックはまだありません。
Googleは、3.1 Flash-Liteの後継としてGemini 3.5 Flash-Liteを挙げています。新しいプロジェクトはgemini-3.5-flash-liteで始め、既存のワークロード、プロンプト群、評価がgemini-3.1-flash-liteを前提に作られている場合はこちらを選んでください。RunAPIでは両方のモデルを同じAPIキーで使えます。
Googleは、gemini-3.1-flash-liteの最短の提供終了日を2027年5月7日としています。プレビュー版のモデルは2026年5月に終了しているため、安定版のモデルIDを使ってください。
呼び出せます。OpenAI SDKの接続先をhttps://runapi.ai/v1にしてRunAPIのAPIキーを設定し、modelをgemini-3.1-flash-liteにしたChat Completionsリクエストを送ってください。ツールは標準のOpenAI tools形式で渡します。
まだ送れません。Googleのモデルは画像、動画、音声、PDFを読み取れますが、RunAPIがgemini-3.1-flash-liteで受け付ける入力はテキストのみで、メディアパートを含むリクエストは拒否されます。
quickstart に表示されるモデル ID を渡してください。
はい。呼び出しまたは単位ごとの従量課金です。