It looks like you may prefer a different language. Switch anytime.

Text · Google

Gemini API

채팅, 코드 생성, 추론, 긴 컨텍스트 작업을 위한 Google의 멀티모달 LLM Gemini API 액세스.

운영 중 · 6 variants · 최저 $0.0003
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.6-flash",
  "messages": [
    {
      "role": "user",
      "content": "이 코드베이스를 분석하고 이전/이후 예시와 함께 세 가지 성능 개선 방안을 제안해 주세요."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-3.6-flash",
    messages=[{"role": "user", "content": "이 코드베이스를 분석하고 이전/이후 예시와 함께 세 가지 성능 개선 방안을 제안해 주세요."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-3.6-flash",
  messages: [{ role: "user", content: "이 코드베이스를 분석하고 이전/이후 예시와 함께 세 가지 성능 개선 방안을 제안해 주세요." }]
});
https://runapi.ai 5 endpoints
개요

Gemini는 텍스트, 이미지, 오디오, 코드 이해를 지원하는 Google의 멀티모달 대형 언어 모델 패밀리입니다. Flash와 Pro 변형으로 제공되며, 빠른 요약부터 심층 추론 및 복잡한 코딩까지 다양한 작업을 처리합니다.

  • 품질과 지연 시간 목표에 맞춘 모델 변형
  • 통합 API key
  • Model skill에 docs, schema, 설정 메모 포함
  • 실패한 생성은 과금되지 않습니다
변형

변형

Variant Billing Pricing
gemini-2.5-flash 1K tokens Input $0.30 / 1M tokens | Output $2.50 / 1M tokens 보기 →
gemini-2.5-pro 1K tokens Input $1.25-$2.50 / 1M tokens | Output $10.00-$15.00 / 1M tokens 보기 →
gemini-3-flash-preview 1K tokens Input $0.50 / 1M tokens | Output $3.00 / 1M tokens · Input $0.30 / 1M tokens | Output $1.80 / 1M tokens 보기 →
gemini-3.1-pro-preview 1K tokens Input $1.00-$2.00 / 1M tokens | Output $7.00-$10.50 / 1M tokens 보기 →
gemini-3.5-flash 1K tokens Input $1.50 / 1M tokens | Output $9.00 / 1M tokens · Input $0.90 / 1M tokens | Output $5.40 / 1M tokens 보기 →
gemini-3.6-flash 1K tokens Input $1.50 / 1M tokens | Output $7.50 / 1M tokens · Input $0.90 / 1M tokens | Output $4.50 / 1M tokens 보기 →
API

Gemini API 엔드포인트

RunAPI 키로 OpenAI 또는 Anthropic SDK를 사용하세요. 추가 SDK가 필요 없습니다.

Endpoint Protocol
/v1/chat/completions OpenAI compatible
/v1/responses OpenAI Responses
/v1/messages Anthropic compatible
/v1beta/models/{model}:generateContent Gemini generateContent
/v1beta/models/{model}:streamGenerateContent Gemini streamGenerateContent
작동 방식

이 model skill로 구현하는 방법

01

모델 선택

출력 유형, 품질 기준, 지연 시간 목표에 맞는 모델과 변형을 고릅니다.

02

한 번 인증

모든 지원 모델에 RunAPI key를 사용합니다.

03

skill 설치

기능을 구현하기 전에 코딩 워크스페이스에 model skill을 추가합니다.

04

결과 받기

task ID로 조회하거나 생성 완료 시 callback을 처리합니다.

컨텍스트

Gemini의 위치

Gemini는 Flash(빠른) 및 Pro(프론티어 추론) 변형으로 제공되는 Google의 멀티모달 플래그십 LLM입니다. RunAPI를 통해 모든 Gemini 모델이 동일한 API 형태와 과금 방식을 공유합니다.

Provider
Google
Modality
Text
RUNAPI를 선택하는 이유

RunAPI로 Gemini을 쓰는 이유

하나의 API key

모델과 제공사를 넘나들며 같은 인증 정보를 사용합니다.

Skill-ready

model skill에 schema, 설정 메모, 가격 컨텍스트, 모델 ID가 포함됩니다.

예측 가능한 과금

호출 전에 사용량 기반 가격을 확인할 수 있습니다.

FAQ

자주 묻는 질문

Gemini의 컨텍스트 윈도우 크기는 얼마인가요?

모든 변형에서 최대 100만 토큰을 지원합니다. 전체 코드베이스, 긴 문서, 멀티턴 대화를 잘림 없이 처리할 수 있습니다.

Gemini가 지원하는 입력 모달리티는 무엇인가요?

텍스트, 이미지, 오디오, 비디오를 지원합니다. 단일 요청에서 멀티모달 입력을 전달하여 교차 모달 추론을 수행할 수 있습니다.

Google Search 그라운딩이란 무엇인가요?

Gemini는 실시간 Google 검색 결과를 기반으로 응답을 생성할 수 있어, 사실 확인이 필요하거나 시간에 민감한 쿼리에서 환각을 줄입니다.

Flash와 Pro는 어떻게 비교되나요?

Flash는 속도와 비용 최적화에 특화되어 대용량 작업에 적합합니다. Pro는 더 깊은 추론 능력을 제공하며 복잡한 다단계 분석에 더 적합합니다.

Gemini는 함수 호출을 지원하나요?

네 — Gemini는 타입이 지정된 JSON 스키마를 통한 구조화된 함수 호출을 지원하여 에이전트 워크플로우와 툴 사용에 적합합니다.

이 모델은 어떻게 호출하나요?

model skill을 설치하고 RunAPI key와 함께 설정 메모를 따르세요.

실패한 생성도 비용이 드나요?

실패한 생성은 과금되지 않습니다

애플리케이션에서 호출할 수 있나요?

네. 코딩 워크스페이스에 model skill을 설치하고 모델 기능을 추가할 때 사용하세요.

지금 시작

Gemini로 개발을 시작하세요.