VARIANT · Google / Gemini

gemini-3.5-flash API

Google / Gemini

Korzystaj z gemini-3.5-flash z rodziny Gemini przez RunAPI. Cennik za wywołanie, bez subskrypcji — nieudane generacje nie są rozliczane.

Operacyjny · text · Do użytku komercyjnego
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-3.5-flash:generateContent
POST /v1beta/models/gemini-3.5-flash:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.5-flash",
  "contents": [
    {
      "parts": [
        {
          "text": "Analyze this codebase and suggest three performance improvements with before/after examples."
        }
      ]
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-3.5-flash",
    messages=[{"role": "user", "content": "Analyze this codebase and suggest three performance improvements with before/after examples."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-3.5-flash",
  messages: [{ role: "user", content: "Analyze this codebase and suggest three performance improvements with before/after examples." }]
});
https://runapi.ai 5 endpoints
Zmień wariant
OVERVIEW

gemini-3.5-flash trafia w optymalny punkt między jakością a kosztem w rodzinie Gemini.

  • Cennik za wywołanie w USD
  • Nieudane generacje nie są rozliczane
  • Streaming, gdy jest obsługiwany przez model
  • Setup model skilla
PRICING

Cennik

Nieudane generacje nie są rozliczane
Generate content stream
Input $0.75 / 1M tokens
Output $4.50 / 1M tokens
Cache read $0.08
Chat completion
Input $0.75 / 1M tokens
Output $4.50 / 1M tokens
Cache read $0.08
SPECYFIKACJA

Szczegóły techniczne

ID modelu gemini-3.5-flash
Dostawca Google
Modalność text
Typ zadania synchronous
Jednostka rozliczeniowa 1K tokens
API endpoint /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/gemini-3.5-flash:generateContent
/v1beta/models/gemini-3.5-flash:streamGenerateContent
Licencja komercyjna Tak — wliczona przez API
Status katalogu Operacyjny
SKILLS

Szybki start — gemini-3.5-flash

Ten sam format · wariant przypięty w modelu

Endpoint Protocol
/v1/chat/completions OpenAI compatible
/v1/responses OpenAI Responses
/v1/messages Anthropic compatible
/v1beta/models/gemini-3.5-flash:generateContent Gemini generateContent
/v1beta/models/gemini-3.5-flash:streamGenerateContent Gemini streamGenerateContent
JAK TO DZIAŁA

Użyj gemini-3.5-flash w czterech krokach

01

Instalacja

Zainstaluj model skill dla tej linii modeli.

02

Konfiguracja

Ustaw pole model na pełny identyfikator modelu widoczny na tej stronie.

03

Wywołanie

Wyślij typowane żądanie z promptem, danymi wejściowymi i ustawieniami callbacku.

04

Odbiór

Odczytaj odpowiedź zadania, webhook callback lub adres URL zapisanego wyniku z RunAPI.

DIFFERENCES

Co wyróżnia gemini-3.5-flash

VS GEMINI-2.5-FLASH

Fast multimodal streaming for high-volume production workloads

Speed/cost optimized; 1M context; older generation baseline

VS GEMINI-2.5-PRO

Fast multimodal streaming for high-volume production workloads

Best reasoning in 2.5 gen; 1M context

VS GEMINI-3-FLASH-PREVIEW

Fast multimodal streaming for high-volume production workloads

gemini-3-flash-preview

PRZYPADKI UŻYCIA

Najlepiej sprawdza się w

Obsługa klienta

Odpowiadaj na pytania klientów na podstawie prywatnej bazy wiedzy, zmniejszając liczbę zgłoszeń.

Analiza dokumentów

Twórz podsumowania umów i wyłapuj kluczowe klauzule do weryfikacji przez prawnika.

Generowanie kodu

Automatycznie generuj testy jednostkowe, sugestie code review i refaktoryzacji w CI.

FAQ

Najczęściej zadawane pytania o gemini-3.5-flash

Czy identyfikator modelu jest stały między wersjami?

RunAPI utrzymuje stały identyfikator modelu i obsługuje zgodne odświeżenia wersji bez zmiany kształtu żądania.

Jaki jest limit rate limit dla tej warianty?

Limity na klucz skalują się wraz z poziomem wykorzystania. Aktualne limity znajdziesz na stronie cennika.

Czy mogę później zmienić wariant?

Tak — wariant to flaga. Zmieniasz go, aktualizując parametr model.

Czy obsługuje streaming?

Tam, gdzie streaming jest dostępny, RunAPI streamuje end-to-end.

Gdzie zgłaszać problemy z jakością?

Otwórz issue w publicznym repo na GitHubie albo napisz do supportu.

ZACZNIJ TERAZ

Zacznij budować z Gemini.