endpoint 구성
2개의 공개 endpoint를 제공합니다: chat_completion, stream_generate_content.
Chat Completions 또는 네이티브 콘텐츠 스트리밍으로 텍스트를 생성하는 경량 Gemini
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-3.5-flash-lite:generateContent
POST /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.5-flash-lite",
"messages": [
{
"role": "user",
"content": "이 코드베이스를 분석하고 이전/이후 예시와 함께 세 가지 성능 개선 방안을 제안해 주세요."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="gemini-3.5-flash-lite",
messages=[{"role": "user", "content": "이 코드베이스를 분석하고 이전/이후 예시와 함께 세 가지 성능 개선 방안을 제안해 주세요."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "gemini-3.5-flash-lite",
messages: [{ role: "user", content: "이 코드베이스를 분석하고 이전/이후 예시와 함께 세 가지 성능 개선 방안을 제안해 주세요." }]
});
사용 가능한 버전 9개
원하는 모델을 선택하고 몇 초 만에 생성해보세요.
| 제공자 | |
| 모델 ID | gemini-3.5-flash-lite |
| 모달리티 | 텍스트 |
| 작업 유형 | Synchronous |
| API 엔드포인트 | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/gemini-3.5-flash-lite:generateContent | |
| /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent | |
| 청구 단위 | 1K 토큰 |
| 카탈로그 상태 | 운영 중 |
무료로 가입하고 대시보드에서 gemini-3.5-flash-lite용 API 키를 만드세요.
/v1/chat/completions로 gemini-3.5-flash-lite 모델 ID와 매개변수를 포함한 POST 요청을 보내세요.
엔드포인트에서 완료된 gemini-3.5-flash-lite 응답을 직접 읽으세요.
2개의 공개 endpoint를 제공합니다: chat_completion, stream_generate_content.
1K 토큰 기준으로 측정되며 구독 없이 이용 가능합니다.
이 엔드포인트에 게시된 요청 매개변수가 없습니다.
LLM을 채팅과 추론에 사용합니다.
구현 작업을 생성하고 리뷰합니다.
모델을 backend 작업에 연결합니다.
quickstart에 표시된 모델 ID를 전달하세요.
네. 호출 또는 단위 기준으로 측정됩니다.