It looks like you may prefer a different language. Switch anytime.

Text Google

Gemini API

通过 RunAPI 使用 Gemini API,配套 model skill、统一认证和按需计费。

runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.7-flash",
  "messages": [
    {
      "role": "user",
      "content": "分析这段代码库,给出三项性能优化建议,包含优化前后的对比示例。"
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-3.7-flash",
    messages=[{"role": "user", "content": "分析这段代码库,给出三项性能优化建议,包含优化前后的对比示例。"}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-3.7-flash",
  messages: [{ role: "user", content: "分析这段代码库,给出三项性能优化建议,包含优化前后的对比示例。" }]
});
https://runapi.ai 5 endpoints
概览

关于 Gemini

Gemini 是 Google 的多模态大语言模型系列,支持文本、图像、音频和代码理解。提供 Flash 和 Pro 两种规格,适用于快速摘要到深度推理及复杂编程等各类任务。

提供方
Google
模态
Text

Gemini API 端点

EndpointProtocol
POST /v1/chat/completionsOpenAI compatible
POST /v1/responsesOpenAI Responses
POST /v1/messagesAnthropic compatible
POST /v1beta/models/{model}:generateContentGemini generateContent
POST /v1beta/models/{model}:streamGenerateContentGemini streamGenerateContent

对比全部 API 变体

变体 计费方式 价格
gemini-2.5-flash 1K tokens Input $0.30 / 1M tokens | Output $2.50 / 1M tokens 查看 →
gemini-2.5-pro 1K tokens Input $1.25-$2.50 / 1M tokens | Output $10.00-$15.00 / 1M tokens 查看 →
gemini-3-flash-preview 1K tokens Input $0.50 / 1M tokens | Output $3.00 / 1M tokens · Input $0.30 / 1M tokens | Output $1.80 / 1M tokens 查看 →
gemini-3.1-pro-preview 1K tokens Input $1.00-$2.00 / 1M tokens | Output $7.00-$10.50 / 1M tokens 查看 →
gemini-3.5-flash 1K tokens Input $1.50 / 1M tokens | Output $9.00 / 1M tokens · Input $0.90 / 1M tokens | Output $5.40 / 1M tokens 查看 →
gemini-3.6-flash 1K tokens Input $1.50 / 1M tokens | Output $7.50 / 1M tokens · Input $0.90 / 1M tokens | Output $4.50 / 1M tokens 查看 →
gemini-3.7-flash 1K tokens Input $0.45 / 1M tokens | Output $2.25 / 1M tokens 查看 →
定价

Gemini 定价

Endpoint 分辨率 时长 价格
chat_completion Input $0.30 / 1M tokens | Output $2.50 / 1M tokens

当前价格适用于 gemini-2.5-flash。其他变体保留各自的 endpoint 定价。

Agent 集成

通过 Agent 运行 Gemini

工作流程

开始使用 Gemini

  1. 选择模型

    根据输出类型、质量要求和延迟目标选择模型与变体。

  2. 配置

    设置 RunAPI key,并在代码工作区安装对应 model skill。

  3. 调用

    按 skill 里的说明,把模型能力接入到你的应用里。

  4. 接收

    按 task ID 轮询、在支持时使用流式,或处理 webhook 回调。

背景

Gemini API 是什么?

Gemini 是 Google 的旗舰多模态 LLM,提供 Flash(快速)和 Pro(旗舰推理)变体。通过 RunAPI,所有 Gemini 模型共享相同的 API 接口和计费。

提供方
Google
查看全部 →
模态
Text
浏览模型 →

为什么用 RunAPI 调用 Gemini API

统一认证,接入所有提供方

一把 RunAPI key 解锁整个模型目录。无需为每家提供方单独建账户。

统一的定价与账单

USD 按次定价,按月结算。失败的生成不计费。

Schema 优先的 SDK

Typed schema 和接入说明已打包进 model skill,让实现从正确契约开始。

Gemini 常见问题

Gemini 的上下文窗口有多大?

所有变体均支持最多 100 万 token。可处理完整代码库、长文档和多轮对话,无需截断。

Gemini 接受哪些输入类型?

支持文本、图像、音频和视频。可在单个请求中传入多模态输入,进行跨模态推理。

什么是 Google 搜索接地(grounding)?

Gemini 可以将回答建立在实时 Google 搜索结果上,从而减少事实性和时效性问题的幻觉。

Flash 和 Pro 有什么区别?

Flash 针对速度和成本进行优化,适合高并发任务。Pro 具备更深的推理能力,更适合复杂的多步骤分析。

Gemini 支持函数调用吗?

支持——Gemini 支持使用 JSON Schema 定义参数类型的结构化函数调用,适用于智能体工作流和工具调用。

应该从哪个变体开始?

选满足质量要求的最便宜变体。多数团队从 fast 起步,生产时升级到 pro。

相似模型

如果喜欢 Gemini API,也可以试试这些

立即体验 Gemini API。