---
title: 'Gemini 2.5 Flash-Lite API: 모델 ID, 1M 컨텍스트, OpenAI SDK | RunAPI'
description: RunAPI의 OpenAI 호환 Chat Completions API로 gemini-2.5-flash-lite 호출. 1M 토큰 컨텍스트, 65K 출력, 기본적으로 꺼진 사고, 텍스트 입력을 지원합니다.
url: https://runapi.ai/ko/models/gemini/2.5-flash-lite.md
canonical: https://runapi.ai/ko/models/gemini/2.5-flash-lite
locale: ko
site: RunAPI
image: https://runapi.ai/assets/opengraph-bfaaa0f0.png
alternates:
  en: https://runapi.ai/models/gemini/2.5-flash-lite
  zh-CN: https://runapi.ai/zh-CN/models/gemini/2.5-flash-lite
  es: https://runapi.ai/es/models/gemini/2.5-flash-lite
  ja: https://runapi.ai/ja/models/gemini/2.5-flash-lite
  de: https://runapi.ai/de/models/gemini/2.5-flash-lite
  fr: https://runapi.ai/fr/models/gemini/2.5-flash-lite
  pt-BR: https://runapi.ai/pt-BR/models/gemini/2.5-flash-lite
  ko: https://runapi.ai/ko/models/gemini/2.5-flash-lite
  it: https://runapi.ai/it/models/gemini/2.5-flash-lite
  nl: https://runapi.ai/nl/models/gemini/2.5-flash-lite
  pl: https://runapi.ai/pl/models/gemini/2.5-flash-lite
  tr: https://runapi.ai/tr/models/gemini/2.5-flash-lite
  zh-TW: https://runapi.ai/zh-TW/models/gemini/2.5-flash-lite
  zh-HK: https://runapi.ai/zh-HK/models/gemini/2.5-flash-lite
  ar: https://runapi.ai/ar/models/gemini/2.5-flash-lite
  x-default: https://runapi.ai/models/gemini/2.5-flash-lite
model: Gemini
provider: Google
variant_id: gemini-2.5-flash-lite
sdk_model_id: gemini-2.5-flash-lite
modality: text
billing_unit: 1K 토큰
status: active
---

> HTML version: https://runapi.ai/ko/models/gemini/2.5-flash-lite
> Site index for agents: https://runapi.ai/llms.txt


# gemini-2.5-flash-lite  API

RunAPI로 Gemini 패밀리의 gemini-2.5-flash-lite를 호출하세요. 토큰당 요금, 구독 없음, 응답이 시작되기 전에 실패한 요청은 과금되지 않습니다.

**Google / [Gemini](https://runapi.ai/ko/models/gemini.md)**
**운영 중 · text · 상업적 사용 지원**

## Gemini 2.5 Flash-Lite는 어떤 작업에 맞나

Gemini 2.5 Flash-Lite는 Google Gemini 2.5 세대의 Flash-Lite 등급으로, 대량 분류, 추출처럼 지연 시간이 짧아야 하는 작업을 위한 모델입니다. 2025년 7월 22일 정식 출시되었고 지식 기준일은 2025년 1월입니다. 컨텍스트 윈도우는 1,048,576토큰이고 출력은 최대 65,536토큰입니다.

사고는 기본적으로 꺼져 있으며, Google은 어려운 프롬프트를 위해 선택형 사고 모드를 안내합니다. Google은 이 모델에서 함수 호출과 구조화된 출력을 지원합니다.

Google의 모델은 텍스트, 이미지, 비디오, 오디오, PDF 입력을 받습니다. RunAPI에서는 OpenAI 호환 Chat Completions 엔드포인트(/v1/chat/completions)로 텍스트를 보내세요. 이 모델에 대해 RunAPI는 텍스트 입력만 받습니다. Google은 새 프로젝트에 Gemini 3.5 Flash-Lite를 권장하며, RunAPI에서는 gemini-3.5-flash-lite로 제공합니다.

**모델 ID:** gemini-2.5-flash-lite
**출시일:** 2025년 7월 22일(정식 출시)
**지식 기준일:** 2025년 1월
**컨텍스트 윈도우:** 1,048,576 토큰
**최대 출력:** 65,536 토큰
**사고:** 선택형, 기본값 꺼짐
**RunAPI 엔드포인트:** OpenAI Chat Completions, 텍스트 입력



<!-- catalog-model-detail-slot: model-playground -->

## Gemini 2.5 Flash-Lite 체험하기

원하는 모델을 선택하고 몇 초 만에 생성해보세요.


**모델:**
- **Chat completion** — `chat_completion` · `gemini-2.5-flash-lite` · 입력 $0.10 / 100만 토큰 | 출력 $0.40 / 100만 토큰

**프롬프트:** 만들고 싶은 것을 설명하세요...

**예상 금액:** 입력 $0.10 / 100만 토큰 | 출력 $0.40 / 100만 토큰

- [생성](https://runapi.ai/ko/login)
RunAPI로 생성하려면 로그인하세요.
<!-- /catalog-model-detail-slot: model-playground -->

### 변형 전환

- [gemini-2.5-flash](https://runapi.ai/ko/models/gemini/2.5-flash.md)
- **gemini-2.5-flash-lite** (current)
- [gemini-2.5-pro](https://runapi.ai/ko/models/gemini/2.5-pro.md)
- [gemini-3-flash-preview](https://runapi.ai/ko/models/gemini/3-flash-preview.md)
- [gemini-3.1-flash-lite](https://runapi.ai/ko/models/gemini/3.1-flash-lite.md)
- [gemini-3.1-pro-preview](https://runapi.ai/ko/models/gemini/3.1-pro-preview.md)
- [gemini-3.5-flash](https://runapi.ai/ko/models/gemini/3.5-flash.md)
- [gemini-3.5-flash-lite](https://runapi.ai/ko/models/gemini/3.5-flash-lite.md)
- [gemini-3.6-flash](https://runapi.ai/ko/models/gemini/3.6-flash.md)
- [gemini-3.7-flash](https://runapi.ai/ko/models/gemini/3.7-flash.md)
- [gemini-3.8-flash](https://runapi.ai/ko/models/gemini/3.8-flash.md)

사용 가능한 버전 11개





gemini-2.5-flash-lite는 RunAPI에서 제공하는 Gemini 패밀리 모델 중 하나입니다. 다른 모델과 같은 API key를 사용하며, 요청의 모델 ID만 바꾸면 전환됩니다. 각 호출은 동기식이고 입력, 출력, 캐시 토큰 기준으로 USD로 과금되며 구독이나 최소 사용액이 없습니다. 응답이 시작되기 전에 실패한 요청은 과금되지 않습니다. 스트리밍이 시작된 뒤에는 클라이언트 연결이 끊겨도 이미 생성된 토큰이 과금됩니다.

- 구독 없이 USD 토큰당 과금
- 응답 시작 전에 실패한 요청은 과금 없음
- 토큰 단위 스트리밍
- 모델 ID 하나만 바꿔 모델 전환
- 모든 모델과 공급자에 API key 하나, 청구서 하나

## 사용 지표

- **API 호출 / 일:** 6
- **성공률:** 100.0%
- **평균 생성 시간:** 1.8s

이 모델에 대한 검증된 고객 피드백이 아직 없습니다.



## 스펙

| 필드 | 값 |
|---|---|
| 제공자 | Google |
| 모델 ID | gemini-2.5-flash-lite |
| 모달리티 | 텍스트 |
| 작업 유형 | Synchronous |
| API 엔드포인트 | `/v1/chat/completions` |
|  | `/v1/responses` |
|  | `/v1/messages` |
|  | `/v1beta/models/gemini-2.5-flash-lite:generateContent` |
|  | `/v1beta/models/gemini-2.5-flash-lite:streamGenerateContent` |
| 청구 단위 | 1K 토큰 |
| 카탈로그 상태 | 운영 중 |



**사용 방법**

## 이 모델을 3단계로 사용하기

1. **키 받기** - 무료로 가입하고 대시보드에서 gemini-2.5-flash-lite용 API 키를 만드세요.
2. **요청 보내기** - /v1/chat/completions로 gemini-2.5-flash-lite 모델 ID와 매개변수를 포함한 POST 요청을 보내세요.
3. **결과 받기** - 엔드포인트에서 완료된 gemini-2.5-flash-lite 응답을 직접 읽으세요.



<!-- catalog-model-detail-slot: feature-cards -->

## 이 모델이 제공하는 것

- **endpoint 구성** — 1개의 공개 endpoint를 제공합니다: chat_completion.
- **사용량 기반 과금** — 1K 토큰 기준으로 측정되며 구독 없이 이용 가능합니다.
<!-- /catalog-model-detail-slot: feature-cards -->



## Gemini 2.5 Flash-Lite 요금

| 엔드포인트 | 가격 |
|---|---|
| `chat_completion` | 입력: $0.10 / 100만 토큰<br>출력: $0.40 / 100만 토큰<br>캐시 읽기: $0.01 / 100만 토큰 |



**API 레퍼런스**

## 엔드포인트 사양

| Field | Value |
|---|---|
| 엔드포인트 | `POST /v1/chat/completions` |
| 모델 ID | `gemini-2.5-flash-lite` |
| 작업 유형 | `chat_completion` |


<!-- catalog-model-detail-slot: request-parameters -->

## 요청 매개변수

이 엔드포인트에 게시된 요청 매개변수가 없습니다.
<!-- /catalog-model-detail-slot: request-parameters -->

**Request example**

```json
{
  "model": "gemini-2.5-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "이 코드베이스를 분석하고 이전/이후 예시와 함께 세 가지 성능 개선 방안을 제안해 주세요."
    }
  ]
}
```

### 모델 스킬 — gemini-2.5-flash-lite

스킬을 한 번 설치한 후, 이 페이지의 변형 ID를 사용해 개발을 시작하세요.

Base URL: `https://runapi.ai`

| Endpoint | Protocol |
|---|---|
| `POST /v1/chat/completions` | OpenAI compatible |
| `POST /v1/responses` | OpenAI Responses |
| `POST /v1/messages` | Anthropic compatible |
| `POST /v1beta/models/gemini-2.5-flash-lite:generateContent` | Gemini generateContent |
| `POST /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent` | Gemini streamGenerateContent |

RunAPI API key와 `model: "gemini-2.5-flash-lite"`를 지정해 OpenAI / Anthropic / Google Gen AI SDK를 사용하세요.

### gemini-2.5-flash-lite 사용 방법

1. **설치** — Gemini 라인용 model skill을 설치하세요. 문서, 요청 형식, 가격 안내가 코딩 작업 공간에 로드됩니다.
2. **설정** — SDK가 https://runapi.ai 를 가리키도록 하고 RunAPI API key를 설정하세요. 같은 key로 모든 모델과 공급자를 사용할 수 있습니다.
3. **호출** — 이 모델이 지원하는 API 형식으로 요청을 보내고, model 필드에 이 페이지의 모델 ID를 지정하세요. RunAPI가 공급자에게 전달합니다.
4. **수신** — 같은 호출에서 응답을 읽거나 생성되는 대로 스트리밍으로 받으세요. usage 필드에서 과금되는 토큰을 확인할 수 있습니다.

### gemini-2.5-flash-lite 비교

- **VS GEMINI-2.5-FLASH: Gemini 2.5 Flash-Lite; 1M 컨텍스트, 사고 기본값 꺼짐; OpenAI 호환 Chat Completions** — 속도/비용 최적화; 1M 컨텍스트; 이전 세대 기준
- **VS GEMINI-2.5-PRO: Gemini 2.5 Flash-Lite; 1M 컨텍스트, 사고 기본값 꺼짐; OpenAI 호환 Chat Completions** — 2.5 세대 최고 추론; 1M 컨텍스트
- **VS GEMINI-3-FLASH-PREVIEW: Gemini 2.5 Flash-Lite; 1M 컨텍스트, 사고 기본값 꺼짐; OpenAI 호환 Chat Completions** — gemini-3-flash-preview

## 사용 사례

**Chat**

LLM을 채팅과 추론에 사용합니다.

**코드**

구현 작업을 생성하고 리뷰합니다.

**자동화**

모델을 backend 작업에 연결합니다.



## Gemini 2.5 Flash-Lite 자주 묻는 질문

### Gemini 2.5 Flash-Lite와 Gemini 3.5 Flash-Lite 중 무엇을 써야 하나요?

Google은 새 작업에 Gemini 3.5 Flash-Lite 또는 Gemini 3.8 Flash를 권장합니다. 기존 워크로드, 프롬프트 세트, 평가가 gemini-2.5-flash-lite를 기준으로 만들어졌다면 이 모델을 고르세요. RunAPI에서는 두 모델을 같은 API 키로 쓸 수 있습니다.

### Gemini 2.5 Flash-Lite를 지금도 쓸 수 있나요?

네. Google은 종료 날짜를 발표하지 않았습니다. 다만 Google 자체 API에서는 2.5 모델을 이전에 사용한 적이 있는 사용자만 쓸 수 있도록 제한하고 있습니다. RunAPI에서는 모든 계정이 gemini-2.5-flash-lite를 사용할 수 있습니다.

### OpenAI SDK로 Gemini 2.5 Flash-Lite를 호출할 수 있나요?

네. OpenAI SDK의 연결 주소를 https://runapi.ai/v1로 지정하고 RunAPI API 키를 설정한 뒤, model을 gemini-2.5-flash-lite로 지정한 Chat Completions 요청을 보내세요. 도구는 표준 OpenAI tools 형식을 사용합니다.

### Gemini 2.5 Flash-Lite는 답하기 전에 사고하나요?

기본적으로는 사고하지 않습니다. Google은 대량 처리와 짧은 지연 시간을 위해 사고를 끈 상태로 제공하며, 선택형 사고 모드를 안내합니다.

### gemini-2.5-flash-lite는 어떻게 선택하나요?

quickstart에 표시된 모델 ID를 전달하세요.

### 가격은 사용량 기반인가요?

네. 호출 또는 단위 기준으로 측정됩니다.


### 관련

- [gemini-3.5-flash-lite](https://runapi.ai/ko/models/gemini/3.5-flash-lite.md) — Google 제공 · 입력 $0.15 / 100만 토큰 | 출력 $1.25 / 100만 토큰
- [gemini-3.1-flash-lite](https://runapi.ai/ko/models/gemini/3.1-flash-lite.md) — Google 제공 · 입력 $0.25 / 100만 토큰 | 출력 $1.50 / 100만 토큰
- [gemini-2.5-flash](https://runapi.ai/ko/models/gemini/2.5-flash.md) — Google 제공 · 입력 $0.30 / 100만 토큰 | 출력 $2.50 / 100만 토큰
- [gemini-3-flash-preview](https://runapi.ai/ko/models/gemini/3-flash-preview.md) — Google 제공 · 입력 $0.50 / 100만 토큰 | 출력 $3.00 / 100만 토큰 · 입력 $0.30 / 100만 토큰 | 출력 $1.80 / 100만 토큰

### 오늘 Gemini로 시작하세요.

- [무료 계정 만들기](https://runapi.ai/ko/login)
- [빠른 시작 읽기 →](https://runapi.ai/ko/docs/api/openai/chat-completions)
## 팀과 함께 구축하고 계신가요?

엔터프라이즈 설정, 통합, 기술 문의를 도와드립니다.

[문의하기](https://runapi.ai/ko/contact.md)



---

## More from RunAPI

- [Home](https://runapi.ai/ko/.md)
### 제품
- [모델 카탈로그](https://runapi.ai/ko/models.md)
- [요금](https://runapi.ai/ko/pricing.md)
- [제공사](https://runapi.ai/ko/models#all-models)
### 개발자
- [문서](https://runapi.ai/ko/docs/guides)
- [SDK](https://runapi.ai/ko/sdk.md)
- [CLI](https://runapi.ai/ko/cli.md)
- [MCP Server](https://runapi.ai/ko/mcp.md)
- [x402](https://runapi.ai/ko/x402.md)
### 가이드
- [Claude Code와 Cursor](https://runapi.ai/ko/claude-code-vs-cursor.md)
- [Cursor API 설정](https://runapi.ai/ko/cursor-api-setup.md)
- [RunAPI와 OpenRouter 비교](https://runapi.ai/ko/openrouter-alternative.md)
### 회사
- [엔터프라이즈](https://runapi.ai/ko/contact.md)
- [문의](https://runapi.ai/ko/contact.md)
### 법적 고지
- [약관](https://runapi.ai/ko/terms.md)
- [개인정보](https://runapi.ai/ko/privacy.md)
- [Site index for agents](https://runapi.ai/llms.txt)

Contact: contact@runapi.ai

## Structured data

```json
[
  {
    "@context": "https://schema.org",
    "inLanguage": "ko",
    "@type": "WebSite",
    "name": "RunAPI",
    "url": "https://runapi.ai/ko",
    "potentialAction": {
      "@type": "SearchAction",
      "target": {
        "@type": "EntryPoint",
        "urlTemplate": "https://runapi.ai/ko/models?q={search_term_string}"
      },
      "query-input": "required name=search_term_string"
    }
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "ko",
    "@type": "Organization",
    "name": "RunAPI",
    "url": "https://runapi.ai/ko",
    "logo": {
      "@type": "ImageObject",
      "url": "https://runapi.ai/koicon.svg"
    },
    "sameAs": [
      "https://github.com/runapi-ai"
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "ko",
    "@type": "SoftwareApplication",
    "name": "Gemini gemini-2.5-flash-lite",
    "applicationCategory": "DeveloperApplication"
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "ko",
    "@type": "BreadcrumbList",
    "itemListElement": [
      {
        "@type": "ListItem",
        "position": 1,
        "name": "Home",
        "item": "https://runapi.ai/ko"
      },
      {
        "@type": "ListItem",
        "position": 2,
        "name": "Models",
        "item": "https://runapi.ai/ko/models"
      },
      {
        "@type": "ListItem",
        "position": 3,
        "name": "Gemini",
        "item": "https://runapi.ai/ko/models/gemini"
      },
      {
        "@type": "ListItem",
        "position": 4,
        "name": "gemini-2.5-flash-lite",
        "item": "https://runapi.ai/ko/models/gemini/2.5-flash-lite"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "ko",
    "@type": "HowTo",
    "name": "gemini-2.5-flash-lite 사용 방법",
    "description": "RunAPI로 Gemini 패밀리의 gemini-2.5-flash-lite를 호출하세요. 토큰당 요금, 모델 ID, 지원하는 API 형식, 설정 가이드를 제공합니다.",
    "totalTime": "PT5M",
    "step": [
      {
        "@type": "HowToStep",
        "position": 1,
        "name": "설치",
        "text": "Gemini 라인용 model skill을 설치하세요. 문서, 요청 형식, 가격 안내가 코딩 작업 공간에 로드됩니다.",
        "url": "https://runapi.ai/ko/models/gemini/2.5-flash-lite#how-step-1"
      },
      {
        "@type": "HowToStep",
        "position": 2,
        "name": "설정",
        "text": "SDK가 https://runapi.ai 를 가리키도록 하고 RunAPI API key를 설정하세요. 같은 key로 모든 모델과 공급자를 사용할 수 있습니다.",
        "url": "https://runapi.ai/ko/models/gemini/2.5-flash-lite#how-step-2"
      },
      {
        "@type": "HowToStep",
        "position": 3,
        "name": "호출",
        "text": "이 모델이 지원하는 API 형식으로 요청을 보내고, model 필드에 이 페이지의 모델 ID를 지정하세요. RunAPI가 공급자에게 전달합니다.",
        "url": "https://runapi.ai/ko/models/gemini/2.5-flash-lite#how-step-3"
      },
      {
        "@type": "HowToStep",
        "position": 4,
        "name": "수신",
        "text": "같은 호출에서 응답을 읽거나 생성되는 대로 스트리밍으로 받으세요. usage 필드에서 과금되는 토큰을 확인할 수 있습니다.",
        "url": "https://runapi.ai/ko/models/gemini/2.5-flash-lite#how-step-4"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "ko",
    "@type": "FAQPage",
    "mainEntity": [
      {
        "@type": "Question",
        "name": "Gemini 2.5 Flash-Lite와 Gemini 3.5 Flash-Lite 중 무엇을 써야 하나요?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Google은 새 작업에 Gemini 3.5 Flash-Lite 또는 Gemini 3.8 Flash를 권장합니다. 기존 워크로드, 프롬프트 세트, 평가가 gemini-2.5-flash-lite를 기준으로 만들어졌다면 이 모델을 고르세요. RunAPI에서는 두 모델을 같은 API 키로 쓸 수 있습니다."
        }
      },
      {
        "@type": "Question",
        "name": "Gemini 2.5 Flash-Lite를 지금도 쓸 수 있나요?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "네. Google은 종료 날짜를 발표하지 않았습니다. 다만 Google 자체 API에서는 2.5 모델을 이전에 사용한 적이 있는 사용자만 쓸 수 있도록 제한하고 있습니다. RunAPI에서는 모든 계정이 gemini-2.5-flash-lite를 사용할 수 있습니다."
        }
      },
      {
        "@type": "Question",
        "name": "OpenAI SDK로 Gemini 2.5 Flash-Lite를 호출할 수 있나요?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "네. OpenAI SDK의 연결 주소를 https://runapi.ai/v1로 지정하고 RunAPI API 키를 설정한 뒤, model을 gemini-2.5-flash-lite로 지정한 Chat Completions 요청을 보내세요. 도구는 표준 OpenAI tools 형식을 사용합니다."
        }
      },
      {
        "@type": "Question",
        "name": "Gemini 2.5 Flash-Lite는 답하기 전에 사고하나요?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "기본적으로는 사고하지 않습니다. Google은 대량 처리와 짧은 지연 시간을 위해 사고를 끈 상태로 제공하며, 선택형 사고 모드를 안내합니다."
        }
      },
      {
        "@type": "Question",
        "name": "gemini-2.5-flash-lite는 어떻게 선택하나요?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "quickstart에 표시된 모델 ID를 전달하세요."
        }
      },
      {
        "@type": "Question",
        "name": "가격은 사용량 기반인가요?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "네. 호출 또는 단위 기준으로 측정됩니다."
        }
      }
    ]
  }
]
```
