Pokrycie endpointów
Udostępnia 1 publiczny(-e) endpoint(-y): chat_completion.
Model Qwen do kodowania dla agentów, o otwartych wagach (3B aktywnych); kontekst 256K; API zgodne z OpenAI
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3-coder-next:generateContent
POST /v1beta/models/qwen3-coder-next:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-coder-next",
"messages": [
{
"role": "user",
"content": "Przeczytaj ten zrzut ekranu dashboardu z błędem, wyjaśnij, co oznacza komunikat o błędzie, i zaproponuj zmianę w kodzie, która go naprawi."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3-coder-next",
messages=[{"role": "user", "content": "Przeczytaj ten zrzut ekranu dashboardu z błędem, wyjaśnij, co oznacza komunikat o błędzie, i zaproponuj zmianę w kodzie, która go naprawi."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3-coder-next",
messages: [{ role: "user", content: "Przeczytaj ten zrzut ekranu dashboardu z błędem, wyjaśnij, co oznacza komunikat o błędzie, i zaproponuj zmianę w kodzie, która go naprawi." }]
});
9 dostępnych wariantów
Qwen3-Coder-Next to model do kodowania o otwartych wagach od Alibaba Qwen, wydany na licencji Apache 2.0 3 lutego 2026 roku. Bazuje na Qwen3-Next-80B-A3B, rzadkim modelu Mixture-of-Experts z hybrydową uwagą (attention), który ma 80B parametrów łącznie i 3B aktywnych na token. Qwen wytrenował go z myślą o agentach kodujących i pracy na poziomie całego repozytorium.
Według karty modelu Qwen działa on wyłącznie w trybie non-thinking i nie tworzy bloków thinking, więc odpowiedź zaczyna się od razu od treści albo od wywołania narzędzia. API Alibaba udostępnia go z oknem kontekstu 262 144 tokenów, maksymalnie 204 800 tokenami wejściowymi i maksymalnie 65 536 tokenami wyjściowymi.
W RunAPI wywołujesz qwen3-coder-next przez zgodny z OpenAI endpoint Chat Completions (/v1/chat/completions), korzystając z SDK OpenAI skierowanego na https://runapi.ai/v1. Model przyjmuje tekst na wejściu. Narzędzia definiujesz w standardowym formacie tools OpenAI, a model zwraca tool_calls w odpowiedzi.
| Dostawca | Alibaba |
| ID modelu | qwen3-coder-next |
| Modalność | Tekst |
| Typy zadań | Synchronous |
| Endpoint API | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/qwen3-coder-next:generateContent | |
| /v1beta/models/qwen3-coder-next:streamGenerateContent | |
| Jednostka rozliczeniowa | 1 tys. tokenów |
| Status katalogu | Wycofany |
Zarejestruj się bezpłatnie i utwórz klucz API dla qwen3-coder-next w panelu.
Wyślij żądanie POST do /v1/chat/completions z identyfikatorem modelu qwen3-coder-next i parametrami.
Odczytaj bezpośrednio z endpointu ukończoną odpowiedź qwen3-coder-next.
Udostępnia 1 publiczny(-e) endpoint(-y): chat_completion.
Rozliczane według 1 tys. tokenów bez wymogu subskrypcji.
Dla tego endpointu nie opublikowano parametrów żądania.
Odpowiadaj na pytania klientów na podstawie prywatnej bazy wiedzy, zmniejszając liczbę zgłoszeń.
Twórz podsumowania umów i wyłapuj kluczowe klauzule do weryfikacji przez prawnika.
Automatycznie generuj testy jednostkowe, sugestie code review i refaktoryzacji w CI.
Do agentów kodujących i pracy na poziomie repozytorium, takiej jak czytanie bazy kodu, edycja wielu plików i wywoływanie narzędzi w pętli. Qwen podaje wyniki w SWE-Bench-Pro porównywalne z modelami, które mają od 10 do 20 razy więcej aktywnych parametrów.
Tak. Wyślij tools w formacie OpenAI w żądaniu Chat Completions, a model zwróci tool_calls. Karta modelu Qwen opisuje wywoływanie narzędzi jako jedną z jego głównych mocnych stron.
Nie. Według karty modelu Qwen obsługuje wyłącznie tryb non-thinking i nie generuje bloków thinking. Jeśli zadanie wymaga etapu rozumowania, użyj modelu Qwen3.5 lub Qwen3.6, które mają tryb thinking.
Z 80B parametrów na każdy token aktywnych jest 3B. Model bazuje na Qwen3-Next-80B-A3B, który łączy rzadką architekturę Mixture-of-Experts z hybrydową uwagą.
Przekaż identyfikator modelu wyświetlony w quickstarcie.
Limity na klucz skalują się wraz z poziomem wykorzystania. Aktualne limity znajdziesz na stronie cennika.
Tak — wariant to flaga. Zmieniasz go, aktualizując parametr model.
Tam, gdzie streaming jest dostępny, RunAPI streamuje end-to-end.
Otwórz issue w publicznym repo na GitHubie albo napisz do supportu.
Pomożemy w konfiguracji dla firm, integracjach i kwestiach technicznych.
Skontaktuj się