Uma API key
Use as mesmas credenciais entre modelos e provedores.
Use a API do Qwen via RunAPI com um model skill, autenticação unificada e preços pay-as-you-go.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.6-35b-a3b",
"messages": [
{
"role": "user",
"content": "Leia esta captura de tela de um dashboard com erro, explique o que a mensagem de erro significa e sugira a mudança no código que resolveria o problema."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3.6-35b-a3b",
messages=[{"role": "user", "content": "Leia esta captura de tela de um dashboard com erro, explique o que a mensagem de erro significa e sugira a mudança no código que resolveria o problema."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3.6-35b-a3b",
messages: [{ role: "user", content: "Leia esta captura de tela de um dashboard com erro, explique o que a mensagem de erro significa e sugira a mudança no código que resolveria o problema." }]
});
Qwen é a família de modelos de linguagem com pesos abertos da Alibaba, lançados sob Apache 2.0. No RunAPI, os modelos Qwen3.5 (397B-A17B, 122B-A10B, 27B, 35B-A3B) e Qwen3.6 (27B, 35B-A3B) são modelos nativos de visão e linguagem com janela de contexto de 262.144 tokens e thinking híbrido. O Qwen3-VL-235B-A22B vem nas versões Thinking e Instruct para compreensão de imagens, com janela de contexto de 131.072 tokens. O Qwen3-Coder-Next é um modelo de programação para agentes que trabalha só com texto e tem 3B de parâmetros ativos. Todos são chamados pelo endpoint Chat Completions compatível com OpenAI do RunAPI, com uma única chave de API.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| Variante | Cobrança | Preços | |
|---|---|---|---|
| qwen3-coder-next | 1K tokens | Descontinuado | Ver → |
| qwen3-vl-235b-a22b-instruct | 1K tokens | Descontinuado | Ver → |
| qwen3-vl-235b-a22b-thinking | 1K tokens | Descontinuado | Ver → |
| qwen3.5-122b-a10b | 1K tokens | Entrada $0.40 / 1M de tokens | Saída $3.20 / 1M de tokens | Ver → |
| qwen3.5-27b | 1K tokens | Entrada $0.30 / 1M de tokens | Saída $2.40 / 1M de tokens | Ver → |
| qwen3.5-35b-a3b | 1K tokens | Entrada $0.25 / 1M de tokens | Saída $2.00 / 1M de tokens | Ver → |
| qwen3.5-397b-a17b | 1K tokens | Entrada $0.60 / 1M de tokens | Saída $3.60 / 1M de tokens | Ver → |
| qwen3.6-27b | 1K tokens | Entrada $0.60 / 1M de tokens | Saída $3.60 / 1M de tokens | Ver → |
| qwen3.6-35b-a3b | 1K tokens | Entrada $0.38 / 1M de tokens | Saída $2.25 / 1M de tokens | Ver → |
| Endpoint | Resolução | Duração | Preço | |
|---|---|---|---|---|
| chat_completion | — | — | Entrada $0.40 / 1M de tokens | Saída $3.20 / 1M de tokens |
Preços exibidos para qwen3.5-122b-a10b. Outras variantes mantêm seus próprios preços por endpoint.
Selecione o modelo e a variante que combinam com seu tipo de saída, meta de qualidade e latência.
Use sua chave RunAPI para todos os modelos compatíveis.
Adicione o model skill ao workspace de código antes de implementar a funcionalidade.
Consulte por task ID ou trate o callback quando a geração terminar.
Os modelos de linguagem Qwen da Alibaba são LLMs com pesos abertos, tanto Mixture-of-Experts quanto densos, com contexto de 131K a 256K. A maioria aceita entrada de imagem e oferece um modo thinking. Pelo RunAPI, eles compartilham uma única chave de API e cobrança por token, e qualquer SDK da OpenAI pode chamá-los em https://runapi.ai/v1. Estes são os modelos de linguagem da Qwen, separados dos modelos de geração de imagem Qwen Image, Qwen 2 e Qwen 3.
Use as mesmas credenciais entre modelos e provedores.
O model skill inclui schemas, notas de setup, contexto de preços e IDs de modelo.
O preço por uso fica visível antes da chamada.
Comece com o qwen3.6-27b ou o qwen3.6-35b-a3b, os modelos Qwen mais recentes no RunAPI, para chat, programação e entrada de imagem. Use o qwen3.5-397b-a17b quando quiser o maior modelo Qwen3.5, e o qwen3-coder-next para agentes de programação que não precisam de etapa de thinking.
Todos os modelos Qwen3.5 e Qwen3.6 e as duas versões do Qwen3-VL-235B-A22B aceitam imagens. Envie-as como partes image_url em uma requisição Chat Completions. O qwen3-coder-next trabalha só com texto.
Os modelos Qwen3.5 e Qwen3.6 são híbridos e têm modos thinking e non-thinking. O qwen3-vl-235b-a22b-thinking sempre raciocina, enquanto o qwen3-vl-235b-a22b-instruct e o qwen3-coder-next respondem sem etapa de thinking.
Use o endpoint Chat Completions compatível com OpenAI em https://runapi.ai/v1/chat/completions, com sua chave de API do RunAPI e um ID de modelo Qwen. Qualquer SDK da OpenAI funciona depois que você troca a base URL.
Sim. A Alibaba lança esses modelos Qwen com pesos abertos sob a licença Apache 2.0. O RunAPI dá acesso por API, para que você não precise hospedá-los nas suas próprias GPUs.
A linha Qwen reúne os modelos de linguagem, que leem texto e imagens e retornam texto. Qwen Image, Qwen 2 e Qwen 3 são linhas separadas do RunAPI que geram e editam imagens.