VARIANT · Google / Gemini

gemini-3.5-flash API

Google / Gemini

Gebruik gemini-3.5-flash uit de Gemini-familie via RunAPI. Prijs per aanroep, geen abonnement en mislukte generaties worden nooit in rekening gebracht.

Operationeel · text · Commercieel toegestaan
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-3.5-flash:generateContent
POST /v1beta/models/gemini-3.5-flash:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.5-flash",
  "contents": [
    {
      "parts": [
        {
          "text": "Analyze this codebase and suggest three performance improvements with before/after examples."
        }
      ]
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-3.5-flash",
    messages=[{"role": "user", "content": "Analyze this codebase and suggest three performance improvements with before/after examples."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-3.5-flash",
  messages: [{ role: "user", content: "Analyze this codebase and suggest three performance improvements with before/after examples." }]
});
https://runapi.ai 5 endpoints
Wissel variant
OVERVIEW

gemini-3.5-flash biedt de ideale balans tussen kwaliteit en kosten binnen de Gemini-familie.

  • Prijs per call in USD
  • Mislukte generaties worden niet gefactureerd
  • Streaming wanneer ondersteund door het model
  • Modelskill-setup
PRICING

Prijzen

Mislukte generaties worden niet in rekening gebracht
Generate content stream
Input $0.75 / 1M tokens
Output $4.50 / 1M tokens
Cache read $0.08
Chat completion
Input $0.75 / 1M tokens
Output $4.50 / 1M tokens
Cache read $0.08
SPECIFICATIEBLAD

Technische details

Model-ID gemini-3.5-flash
Provider Google
Modaliteit text
Taaktype synchronous
Facturatie-eenheid 1K tokens
API endpoint /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/gemini-3.5-flash:generateContent
/v1beta/models/gemini-3.5-flash:streamGenerateContent
Commerciële licentie Ja — inbegrepen via API
Catalogusstatus Operationeel
SKILLS

Snelstart — gemini-3.5-flash

Zelfde structuur · variant vastgelegd in model

Endpoint Protocol
/v1/chat/completions OpenAI compatible
/v1/responses OpenAI Responses
/v1/messages Anthropic compatible
/v1beta/models/gemini-3.5-flash:generateContent Gemini generateContent
/v1beta/models/gemini-3.5-flash:streamGenerateContent Gemini streamGenerateContent
HOE HET WERKT

Gebruik gemini-3.5-flash in vier stappen

01

Installeren

Installeer de modelskill voor deze modelreeks.

02

Configureren

Zet het modelveld op de volledige model-ID die op deze pagina staat.

03

Aanroepen

Stuur een getypeerde request met je prompt, inputs en callback-instellingen.

04

Ontvangen

Lees de task-response, webhook-callback of cached output-URL van RunAPI.

DIFFERENCES

Wat is er anders aan gemini-3.5-flash

VS GEMINI-2.5-FLASH

Fast multimodal streaming for high-volume production workloads

Speed/cost optimized; 1M context; older generation baseline

VS GEMINI-2.5-PRO

Fast multimodal streaming for high-volume production workloads

Best reasoning in 2.5 gen; 1M context

VS GEMINI-3-FLASH-PREVIEW

Fast multimodal streaming for high-volume production workloads

gemini-3-flash-preview

USE CASES

Ideaal voor

Klantenservice

Beantwoord klantvragen vanuit een privékennisbank en verlaag zo het aantal tickets.

Documentanalyse

Stel samenvattingen van contracten op en markeer belangrijke clausules voor beoordeling door een jurist.

Codegeneratie

Genereer automatisch unittests, code reviews en refactoringsuggesties in CI.

FAQ

Veelgestelde vragen over gemini-3.5-flash

Is de model-ID stabiel tussen versies?

RunAPI houdt de model-ID stabiel en verwerkt compatibele versie-updates zonder de opzet van je request te wijzigen.

Wat is de rate limit voor deze variant?

Rate limits per key schalen mee met je usage tier. Bekijk de prijzenpagina voor de actuele limieten.

Kan ik later van variant wisselen?

Ja — variant is een flag. Wissel door de modelparameter aan te passen.

Ondersteunt het streaming?

Waar streaming beschikbaar is, streamt RunAPI end-to-end.

Waar meld ik kwaliteitsproblemen?

Open een issue in de publieke GitHub-repo of mail support.

NU BEGINNEN

Begin met bouwen met Gemini.