Text · Google

Gemini API

Gemini API 调用 Google 多模态大语言模型,支持对话、代码生成、推理和长上下文任务。

运行中 · 7 variants · 起价 $0.0003
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.7-flash",
  "messages": [
    {
      "role": "user",
      "content": "分析这段代码库,给出三项性能优化建议,包含优化前后的对比示例。"
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-3.7-flash",
    messages=[{"role": "user", "content": "分析这段代码库,给出三项性能优化建议,包含优化前后的对比示例。"}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-3.7-flash",
  messages: [{ role: "user", content: "分析这段代码库,给出三项性能优化建议,包含优化前后的对比示例。" }]
});
https://runapi.ai 5 endpoints
概览

Gemini 是 Google 的多模态大语言模型系列,支持文本、图像、音频和代码理解。提供 Flash 和 Pro 两种规格,适用于快速摘要到深度推理及复杂编程等各类任务。

  • 多变体覆盖不同速度/质量层级
  • Model skill 包含文档、schema 和接入说明
  • 适合面向应用的编码工作流
  • 失败的生成不计费
变体

对比全部 API 变体

Variant Billing Pricing
gemini-2.5-flash 1K tokens Input $0.30 / 1M tokens | Output $2.50 / 1M tokens 查看 →
gemini-2.5-pro 1K tokens Input $1.25-$2.50 / 1M tokens | Output $10.00-$15.00 / 1M tokens 查看 →
gemini-3-flash-preview 1K tokens Input $0.50 / 1M tokens | Output $3.00 / 1M tokens · Input $0.30 / 1M tokens | Output $1.80 / 1M tokens 查看 →
gemini-3.1-pro-preview 1K tokens Input $1.00-$2.00 / 1M tokens | Output $7.00-$10.50 / 1M tokens 查看 →
gemini-3.5-flash 1K tokens Input $1.50 / 1M tokens | Output $9.00 / 1M tokens · Input $0.90 / 1M tokens | Output $5.40 / 1M tokens 查看 →
gemini-3.6-flash 1K tokens Input $1.50 / 1M tokens | Output $7.50 / 1M tokens · Input $0.90 / 1M tokens | Output $4.50 / 1M tokens 查看 →
gemini-3.7-flash 1K tokens Input $0.45 / 1M tokens | Output $2.25 / 1M tokens 查看 →
API

Gemini API 端点

使用 OpenAI 或 Anthropic SDK 配合 RunAPI key 调用,无需额外 SDK。

Endpoint Protocol
/v1/chat/completions OpenAI compatible
/v1/responses OpenAI Responses
/v1/messages Anthropic compatible
/v1beta/models/{model}:generateContent Gemini generateContent
/v1beta/models/{model}:streamGenerateContent Gemini streamGenerateContent
工作流程

四步从 model skill 到首次结果

01

选择模型

根据输出类型、质量要求和延迟目标选择模型与变体。

02

配置

设置 RunAPI key,并在代码工作区安装对应 model skill。

03

调用

按 skill 里的说明,把模型能力接入到你的应用里。

04

接收

按 task ID 轮询、在支持时使用流式,或处理 webhook 回调。

背景

Gemini API 是什么?

Gemini 是 Google 的旗舰多模态 LLM,提供 Flash(快速)和 Pro(旗舰推理)变体。通过 RunAPI,所有 Gemini 模型共享相同的 API 接口和计费。

Provider
Google
Modality
Text
为何选择 RunAPI

为什么用 RunAPI 调用 Gemini API

一把认证,覆盖所有提供方

一把 RunAPI key 解锁整个模型目录。无需为每家提供方单独建账户。

统一的定价与账单

USD 按次定价,按月结算。失败的生成不计费。

Schema 优先的 SDK

Typed schema 和接入说明已打包进 model skill,让实现从正确契约开始。

常见问题

常见问题

Gemini 的上下文窗口有多大?

所有变体均支持最多 100 万 token。可处理完整代码库、长文档和多轮对话,无需截断。

Gemini 接受哪些输入类型?

支持文本、图像、音频和视频。可在单个请求中传入多模态输入,进行跨模态推理。

什么是 Google 搜索接地(grounding)?

Gemini 可以将回答建立在实时 Google 搜索结果上,从而减少事实性和时效性问题的幻觉。

Flash 和 Pro 有什么区别?

Flash 针对速度和成本进行优化,适合高并发任务。Pro 具备更深的推理能力,更适合复杂的多步骤分析。

Gemini 支持函数调用吗?

支持——Gemini 支持带类型化 JSON schema 的结构化函数调用,适用于 agentic 工作流和工具调用。

应该从哪个变体开始?

选满足质量要求的最便宜变体。多数团队从 fast 起步,生产时升级到 pro。

有免费额度吗?

新账户每个模型都有免费调用额度,之后按次计费。

支持流式吗?

模型支持流式时,RunAPI 端到端流式。

失败怎么计费?

失败的生成不计费。

输出会缓存吗?

输出按任务 ID 存储在 R2 供回取。输入不缓存。

可以商用吗?

可以——所有变体默认含商用许可,除非模型许可明确限制;有例外会在变体页面注明。

速率限制?

Key 级限流随使用层级伸缩。当前限制见定价页。

在哪里报问题?

在公共 GitHub 仓库提 issue 或邮件联系 support。

立即开始

立即体验 Gemini API。