---
title: 'Gemini 3.1 Flash-Lite API: 모델 ID, 1M 컨텍스트, OpenAI SDK | RunAPI'
description: RunAPI의 OpenAI 호환 Chat Completions API로 gemini-3.1-flash-lite 호출. 1M 토큰 컨텍스트, 65K 출력, 조절형 사고, 텍스트 입력을 지원합니다.
url: https://runapi.ai/ko/models/gemini/3.1-flash-lite.md
canonical: https://runapi.ai/ko/models/gemini/3.1-flash-lite
locale: ko
site: RunAPI
image: https://runapi.ai/assets/opengraph-bfaaa0f0.png
alternates:
  en: https://runapi.ai/models/gemini/3.1-flash-lite
  zh-CN: https://runapi.ai/zh-CN/models/gemini/3.1-flash-lite
  es: https://runapi.ai/es/models/gemini/3.1-flash-lite
  ja: https://runapi.ai/ja/models/gemini/3.1-flash-lite
  de: https://runapi.ai/de/models/gemini/3.1-flash-lite
  fr: https://runapi.ai/fr/models/gemini/3.1-flash-lite
  pt-BR: https://runapi.ai/pt-BR/models/gemini/3.1-flash-lite
  ko: https://runapi.ai/ko/models/gemini/3.1-flash-lite
  it: https://runapi.ai/it/models/gemini/3.1-flash-lite
  nl: https://runapi.ai/nl/models/gemini/3.1-flash-lite
  pl: https://runapi.ai/pl/models/gemini/3.1-flash-lite
  tr: https://runapi.ai/tr/models/gemini/3.1-flash-lite
  zh-TW: https://runapi.ai/zh-TW/models/gemini/3.1-flash-lite
  zh-HK: https://runapi.ai/zh-HK/models/gemini/3.1-flash-lite
  ar: https://runapi.ai/ar/models/gemini/3.1-flash-lite
  x-default: https://runapi.ai/models/gemini/3.1-flash-lite
model: Gemini
provider: Google
variant_id: gemini-3.1-flash-lite
sdk_model_id: gemini-3.1-flash-lite
modality: text
billing_unit: 1K 토큰
status: active
---

> HTML version: https://runapi.ai/ko/models/gemini/3.1-flash-lite
> Site index for agents: https://runapi.ai/llms.txt


# gemini-3.1-flash-lite  API

RunAPI로 Gemini 패밀리의 gemini-3.1-flash-lite를 호출하세요. 토큰당 요금, 구독 없음, 응답이 시작되기 전에 실패한 요청은 과금되지 않습니다.

**Google / [Gemini](https://runapi.ai/ko/models/gemini.md)**
**운영 중 · text · 상업적 사용 지원**

## Gemini 3.1 Flash-Lite는 어떤 작업에 맞나

Gemini 3.1 Flash-Lite는 Google Gemini 3 시리즈에서 지연 시간이 짧고 비용이 낮은 모델입니다. Google은 번역, 분류, 개체 추출, 문서 선별, 모델 간 요청 라우팅처럼 단순하지만 물량이 많은 작업을 위해 만들었습니다. 안정 버전 gemini-3.1-flash-lite는 2026년 5월 7일 정식 출시되었습니다. 컨텍스트 윈도우는 1,048,576토큰이고 출력은 최대 65,536토큰입니다.

사고는 조절할 수 있습니다. Google은 minimal부터 high까지 네 가지 사고 수준을 제공하며, 사고 토큰은 출력으로 계산됩니다. Google은 이 모델에서 함수 호출과 구조화된 출력을 지원합니다.

Google의 모델은 텍스트, 이미지, 비디오, 오디오, PDF 입력을 받습니다. RunAPI에서 gemini-3.1-flash-lite는 텍스트 입력만 받습니다. OpenAI 호환 Chat Completions 엔드포인트(/v1/chat/completions), OpenAI Responses, Anthropic Messages, Gemini generateContent로 요청을 보내세요. Google은 후속 모델로 Gemini 3.5 Flash-Lite를 안내하며, RunAPI에서는 gemini-3.5-flash-lite로 제공합니다.

**모델 ID:** gemini-3.1-flash-lite
**출시일:** 2026년 5월 7일(정식 출시)
**컨텍스트 윈도우:** 1,048,576 토큰
**최대 출력:** 65,536 토큰
**사고:** 조절형, minimal부터 high까지
**가장 이른 종료일(Google):** 2027년 5월 7일
**RunAPI 엔드포인트:** OpenAI Chat Completions, 텍스트 입력



<!-- catalog-model-detail-slot: model-playground -->

## Gemini 3.1 Flash-Lite 체험하기

원하는 모델을 선택하고 몇 초 만에 생성해보세요.


**모델:**
- **Chat completion** — `chat_completion` · `gemini-3.1-flash-lite` · 입력 $0.25 / 100만 토큰 | 출력 $1.50 / 100만 토큰

**프롬프트:** 만들고 싶은 것을 설명하세요...

**예상 금액:** 입력 $0.25 / 100만 토큰 | 출력 $1.50 / 100만 토큰

- [생성](https://runapi.ai/ko/login)
RunAPI로 생성하려면 로그인하세요.
<!-- /catalog-model-detail-slot: model-playground -->

### 변형 전환

- [gemini-2.5-flash](https://runapi.ai/ko/models/gemini/2.5-flash.md)
- [gemini-2.5-flash-lite](https://runapi.ai/ko/models/gemini/2.5-flash-lite.md)
- [gemini-2.5-pro](https://runapi.ai/ko/models/gemini/2.5-pro.md)
- [gemini-3-flash-preview](https://runapi.ai/ko/models/gemini/3-flash-preview.md)
- **gemini-3.1-flash-lite** (current)
- [gemini-3.1-pro-preview](https://runapi.ai/ko/models/gemini/3.1-pro-preview.md)
- [gemini-3.5-flash](https://runapi.ai/ko/models/gemini/3.5-flash.md)
- [gemini-3.5-flash-lite](https://runapi.ai/ko/models/gemini/3.5-flash-lite.md)
- [gemini-3.6-flash](https://runapi.ai/ko/models/gemini/3.6-flash.md)
- [gemini-3.7-flash](https://runapi.ai/ko/models/gemini/3.7-flash.md)
- [gemini-3.8-flash](https://runapi.ai/ko/models/gemini/3.8-flash.md)

사용 가능한 버전 11개





gemini-3.1-flash-lite는 RunAPI에서 제공하는 Gemini 패밀리 모델 중 하나입니다. 다른 모델과 같은 API key를 사용하며, 요청의 모델 ID만 바꾸면 전환됩니다. 각 호출은 동기식이고 입력, 출력, 캐시 토큰 기준으로 USD로 과금되며 구독이나 최소 사용액이 없습니다. 응답이 시작되기 전에 실패한 요청은 과금되지 않습니다. 스트리밍이 시작된 뒤에는 클라이언트 연결이 끊겨도 이미 생성된 토큰이 과금됩니다.

- 구독 없이 USD 토큰당 과금
- 응답 시작 전에 실패한 요청은 과금 없음
- 토큰 단위 스트리밍
- 모델 ID 하나만 바꿔 모델 전환
- 모든 모델과 공급자에 API key 하나, 청구서 하나

## 사용 지표

- **API 호출 / 일:** 6
- **성공률:** 100.0%
- **평균 생성 시간:** 1.9s

이 모델에 대한 검증된 고객 피드백이 아직 없습니다.



## 스펙

| 필드 | 값 |
|---|---|
| 제공자 | Google |
| 모델 ID | gemini-3.1-flash-lite |
| 모달리티 | 텍스트 |
| 작업 유형 | Synchronous |
| API 엔드포인트 | `/v1/chat/completions` |
|  | `/v1/responses` |
|  | `/v1/messages` |
|  | `/v1beta/models/gemini-3.1-flash-lite:generateContent` |
|  | `/v1beta/models/gemini-3.1-flash-lite:streamGenerateContent` |
| 청구 단위 | 1K 토큰 |
| 카탈로그 상태 | 운영 중 |



**사용 방법**

## 이 모델을 3단계로 사용하기

1. **키 받기** - 무료로 가입하고 대시보드에서 gemini-3.1-flash-lite용 API 키를 만드세요.
2. **요청 보내기** - /v1/chat/completions로 gemini-3.1-flash-lite 모델 ID와 매개변수를 포함한 POST 요청을 보내세요.
3. **결과 받기** - 엔드포인트에서 완료된 gemini-3.1-flash-lite 응답을 직접 읽으세요.



<!-- catalog-model-detail-slot: feature-cards -->

## 이 모델이 제공하는 것

- **endpoint 구성** — 1개의 공개 endpoint를 제공합니다: chat_completion.
- **사용량 기반 과금** — 1K 토큰 기준으로 측정되며 구독 없이 이용 가능합니다.
<!-- /catalog-model-detail-slot: feature-cards -->



## Gemini 3.1 Flash-Lite 요금

| 엔드포인트 | 가격 |
|---|---|
| `chat_completion` | 입력: $0.25 / 100만 토큰<br>출력: $1.50 / 100만 토큰<br>캐시 읽기: $0.03 / 100만 토큰 |



**API 레퍼런스**

## 엔드포인트 사양

| Field | Value |
|---|---|
| 엔드포인트 | `POST /v1/chat/completions` |
| 모델 ID | `gemini-3.1-flash-lite` |
| 작업 유형 | `chat_completion` |


<!-- catalog-model-detail-slot: request-parameters -->

## 요청 매개변수

이 엔드포인트에 게시된 요청 매개변수가 없습니다.
<!-- /catalog-model-detail-slot: request-parameters -->

**Request example**

```json
{
  "model": "gemini-3.1-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "이 코드베이스를 분석하고 이전/이후 예시와 함께 세 가지 성능 개선 방안을 제안해 주세요."
    }
  ]
}
```

### 모델 스킬 — gemini-3.1-flash-lite

스킬을 한 번 설치한 후, 이 페이지의 변형 ID를 사용해 개발을 시작하세요.

Base URL: `https://runapi.ai`

| Endpoint | Protocol |
|---|---|
| `POST /v1/chat/completions` | OpenAI compatible |
| `POST /v1/responses` | OpenAI Responses |
| `POST /v1/messages` | Anthropic compatible |
| `POST /v1beta/models/gemini-3.1-flash-lite:generateContent` | Gemini generateContent |
| `POST /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent` | Gemini streamGenerateContent |

RunAPI API key와 `model: "gemini-3.1-flash-lite"`를 지정해 OpenAI / Anthropic / Google Gen AI SDK를 사용하세요.

### gemini-3.1-flash-lite 사용 방법

1. **설치** — Gemini 라인용 model skill을 설치하세요. 문서, 요청 형식, 가격 안내가 코딩 작업 공간에 로드됩니다.
2. **설정** — SDK가 https://runapi.ai 를 가리키도록 하고 RunAPI API key를 설정하세요. 같은 key로 모든 모델과 공급자를 사용할 수 있습니다.
3. **호출** — 이 모델이 지원하는 API 형식으로 요청을 보내고, model 필드에 이 페이지의 모델 ID를 지정하세요. RunAPI가 공급자에게 전달합니다.
4. **수신** — 같은 호출에서 응답을 읽거나 생성되는 대로 스트리밍으로 받으세요. usage 필드에서 과금되는 토큰을 확인할 수 있습니다.

### gemini-3.1-flash-lite 비교

- **VS GEMINI-2.5-FLASH: Gemini 3.1 Flash-Lite; 1M 컨텍스트, 조절형 사고; OpenAI 호환 Chat Completions로 텍스트 요청** — 속도/비용 최적화; 1M 컨텍스트; 이전 세대 기준
- **VS GEMINI-2.5-FLASH-LITE: Gemini 3.1 Flash-Lite; 1M 컨텍스트, 조절형 사고; OpenAI 호환 Chat Completions로 텍스트 요청** — Gemini 2.5 Flash-Lite; 1M 컨텍스트, 사고 기본값 꺼짐; OpenAI 호환 Chat Completions
- **VS GEMINI-2.5-PRO: Gemini 3.1 Flash-Lite; 1M 컨텍스트, 조절형 사고; OpenAI 호환 Chat Completions로 텍스트 요청** — 2.5 세대 최고 추론; 1M 컨텍스트

## 사용 사례

**Chat**

LLM을 채팅과 추론에 사용합니다.

**코드**

구현 작업을 생성하고 리뷰합니다.

**자동화**

모델을 backend 작업에 연결합니다.



## Gemini 3.1 Flash-Lite 자주 묻는 질문

### Gemini 3.1 Flash-Lite와 Gemini 3.5 Flash-Lite 중 무엇을 써야 하나요?

Google은 3.1 Flash-Lite의 후속 모델로 Gemini 3.5 Flash-Lite를 안내합니다. 새 프로젝트는 gemini-3.5-flash-lite로 시작하고, 기존 워크로드, 프롬프트 세트, 평가가 gemini-3.1-flash-lite를 기준으로 만들어졌다면 이 모델을 고르세요. RunAPI에서는 두 모델을 같은 API 키로 쓸 수 있습니다.

### Gemini 3.1 Flash-Lite는 얼마나 오래 사용할 수 있나요?

Google은 gemini-3.1-flash-lite의 가장 이른 종료일을 2027년 5월 7일로 안내합니다. 프리뷰 모델은 2026년 5월에 종료되었으므로 안정 버전 모델 ID를 사용하세요.

### OpenAI SDK로 Gemini 3.1 Flash-Lite를 호출할 수 있나요?

네. OpenAI SDK의 연결 주소를 https://runapi.ai/v1로 지정하고 RunAPI API 키를 설정한 뒤, model을 gemini-3.1-flash-lite로 지정한 Chat Completions 요청을 보내세요. 도구는 표준 OpenAI tools 형식을 사용합니다.

### RunAPI에서 gemini-3.1-flash-lite에 이미지나 오디오를 보낼 수 있나요?

아직은 안 됩니다. Google의 모델은 이미지, 비디오, 오디오, PDF를 읽지만 RunAPI는 gemini-3.1-flash-lite에 텍스트 입력만 받으며, 미디어 파트가 포함된 요청은 거부됩니다.

### gemini-3.1-flash-lite는 어떻게 선택하나요?

quickstart에 표시된 모델 ID를 전달하세요.

### 가격은 사용량 기반인가요?

네. 호출 또는 단위 기준으로 측정됩니다.


### 관련

- [gemini-2.5-flash-lite](https://runapi.ai/ko/models/gemini/2.5-flash-lite.md) — Google 제공 · 입력 $0.10 / 100만 토큰 | 출력 $0.40 / 100만 토큰
- [gemini-3.5-flash-lite](https://runapi.ai/ko/models/gemini/3.5-flash-lite.md) — Google 제공 · 입력 $0.15 / 100만 토큰 | 출력 $1.25 / 100만 토큰
- [gemini-2.5-flash](https://runapi.ai/ko/models/gemini/2.5-flash.md) — Google 제공 · 입력 $0.30 / 100만 토큰 | 출력 $2.50 / 100만 토큰
- [gemini-3-flash-preview](https://runapi.ai/ko/models/gemini/3-flash-preview.md) — Google 제공 · 입력 $0.50 / 100만 토큰 | 출력 $3.00 / 100만 토큰 · 입력 $0.30 / 100만 토큰 | 출력 $1.80 / 100만 토큰

### 오늘 Gemini로 시작하세요.

- [무료 계정 만들기](https://runapi.ai/ko/login)
- [빠른 시작 읽기 →](https://runapi.ai/ko/docs/api/openai/chat-completions)
## 팀과 함께 구축하고 계신가요?

엔터프라이즈 설정, 통합, 기술 문의를 도와드립니다.

[문의하기](https://runapi.ai/ko/contact.md)



---

## More from RunAPI

- [Home](https://runapi.ai/ko/.md)
### 제품
- [모델 카탈로그](https://runapi.ai/ko/models.md)
- [요금](https://runapi.ai/ko/pricing.md)
- [제공사](https://runapi.ai/ko/models#all-models)
### 개발자
- [문서](https://runapi.ai/ko/docs/guides)
- [SDK](https://runapi.ai/ko/sdk.md)
- [CLI](https://runapi.ai/ko/cli.md)
- [MCP Server](https://runapi.ai/ko/mcp.md)
- [x402](https://runapi.ai/ko/x402.md)
### 가이드
- [Claude Code와 Cursor](https://runapi.ai/ko/claude-code-vs-cursor.md)
- [Cursor API 설정](https://runapi.ai/ko/cursor-api-setup.md)
- [RunAPI와 OpenRouter 비교](https://runapi.ai/ko/openrouter-alternative.md)
### 회사
- [엔터프라이즈](https://runapi.ai/ko/contact.md)
- [문의](https://runapi.ai/ko/contact.md)
### 법적 고지
- [약관](https://runapi.ai/ko/terms.md)
- [개인정보](https://runapi.ai/ko/privacy.md)
- [Site index for agents](https://runapi.ai/llms.txt)

Contact: contact@runapi.ai

## Structured data

```json
[
  {
    "@context": "https://schema.org",
    "inLanguage": "ko",
    "@type": "WebSite",
    "name": "RunAPI",
    "url": "https://runapi.ai/ko",
    "potentialAction": {
      "@type": "SearchAction",
      "target": {
        "@type": "EntryPoint",
        "urlTemplate": "https://runapi.ai/ko/models?q={search_term_string}"
      },
      "query-input": "required name=search_term_string"
    }
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "ko",
    "@type": "Organization",
    "name": "RunAPI",
    "url": "https://runapi.ai/ko",
    "logo": {
      "@type": "ImageObject",
      "url": "https://runapi.ai/koicon.svg"
    },
    "sameAs": [
      "https://github.com/runapi-ai"
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "ko",
    "@type": "SoftwareApplication",
    "name": "Gemini gemini-3.1-flash-lite",
    "applicationCategory": "DeveloperApplication"
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "ko",
    "@type": "BreadcrumbList",
    "itemListElement": [
      {
        "@type": "ListItem",
        "position": 1,
        "name": "Home",
        "item": "https://runapi.ai/ko"
      },
      {
        "@type": "ListItem",
        "position": 2,
        "name": "Models",
        "item": "https://runapi.ai/ko/models"
      },
      {
        "@type": "ListItem",
        "position": 3,
        "name": "Gemini",
        "item": "https://runapi.ai/ko/models/gemini"
      },
      {
        "@type": "ListItem",
        "position": 4,
        "name": "gemini-3.1-flash-lite",
        "item": "https://runapi.ai/ko/models/gemini/3.1-flash-lite"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "ko",
    "@type": "HowTo",
    "name": "gemini-3.1-flash-lite 사용 방법",
    "description": "RunAPI로 Gemini 패밀리의 gemini-3.1-flash-lite를 호출하세요. 토큰당 요금, 모델 ID, 지원하는 API 형식, 설정 가이드를 제공합니다.",
    "totalTime": "PT5M",
    "step": [
      {
        "@type": "HowToStep",
        "position": 1,
        "name": "설치",
        "text": "Gemini 라인용 model skill을 설치하세요. 문서, 요청 형식, 가격 안내가 코딩 작업 공간에 로드됩니다.",
        "url": "https://runapi.ai/ko/models/gemini/3.1-flash-lite#how-step-1"
      },
      {
        "@type": "HowToStep",
        "position": 2,
        "name": "설정",
        "text": "SDK가 https://runapi.ai 를 가리키도록 하고 RunAPI API key를 설정하세요. 같은 key로 모든 모델과 공급자를 사용할 수 있습니다.",
        "url": "https://runapi.ai/ko/models/gemini/3.1-flash-lite#how-step-2"
      },
      {
        "@type": "HowToStep",
        "position": 3,
        "name": "호출",
        "text": "이 모델이 지원하는 API 형식으로 요청을 보내고, model 필드에 이 페이지의 모델 ID를 지정하세요. RunAPI가 공급자에게 전달합니다.",
        "url": "https://runapi.ai/ko/models/gemini/3.1-flash-lite#how-step-3"
      },
      {
        "@type": "HowToStep",
        "position": 4,
        "name": "수신",
        "text": "같은 호출에서 응답을 읽거나 생성되는 대로 스트리밍으로 받으세요. usage 필드에서 과금되는 토큰을 확인할 수 있습니다.",
        "url": "https://runapi.ai/ko/models/gemini/3.1-flash-lite#how-step-4"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "ko",
    "@type": "FAQPage",
    "mainEntity": [
      {
        "@type": "Question",
        "name": "Gemini 3.1 Flash-Lite와 Gemini 3.5 Flash-Lite 중 무엇을 써야 하나요?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Google은 3.1 Flash-Lite의 후속 모델로 Gemini 3.5 Flash-Lite를 안내합니다. 새 프로젝트는 gemini-3.5-flash-lite로 시작하고, 기존 워크로드, 프롬프트 세트, 평가가 gemini-3.1-flash-lite를 기준으로 만들어졌다면 이 모델을 고르세요. RunAPI에서는 두 모델을 같은 API 키로 쓸 수 있습니다."
        }
      },
      {
        "@type": "Question",
        "name": "Gemini 3.1 Flash-Lite는 얼마나 오래 사용할 수 있나요?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Google은 gemini-3.1-flash-lite의 가장 이른 종료일을 2027년 5월 7일로 안내합니다. 프리뷰 모델은 2026년 5월에 종료되었으므로 안정 버전 모델 ID를 사용하세요."
        }
      },
      {
        "@type": "Question",
        "name": "OpenAI SDK로 Gemini 3.1 Flash-Lite를 호출할 수 있나요?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "네. OpenAI SDK의 연결 주소를 https://runapi.ai/v1로 지정하고 RunAPI API 키를 설정한 뒤, model을 gemini-3.1-flash-lite로 지정한 Chat Completions 요청을 보내세요. 도구는 표준 OpenAI tools 형식을 사용합니다."
        }
      },
      {
        "@type": "Question",
        "name": "RunAPI에서 gemini-3.1-flash-lite에 이미지나 오디오를 보낼 수 있나요?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "아직은 안 됩니다. Google의 모델은 이미지, 비디오, 오디오, PDF를 읽지만 RunAPI는 gemini-3.1-flash-lite에 텍스트 입력만 받으며, 미디어 파트가 포함된 요청은 거부됩니다."
        }
      },
      {
        "@type": "Question",
        "name": "gemini-3.1-flash-lite는 어떻게 선택하나요?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "quickstart에 표시된 모델 ID를 전달하세요."
        }
      },
      {
        "@type": "Question",
        "name": "가격은 사용량 기반인가요?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "네. 호출 또는 단위 기준으로 측정됩니다."
        }
      }
    ]
  }
]
```
