Texto Alibaba

Qwen API

Use a API do Qwen via RunAPI com um model skill, autenticação unificada e preços pay-as-you-go.

runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "qwen3.6-35b-a3b",
  "messages": [
    {
      "role": "user",
      "content": "Leia esta captura de tela de um dashboard com erro, explique o que a mensagem de erro significa e sugira a mudança no código que resolveria o problema."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="qwen3.6-35b-a3b",
    messages=[{"role": "user", "content": "Leia esta captura de tela de um dashboard com erro, explique o que a mensagem de erro significa e sugira a mudança no código que resolveria o problema."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "qwen3.6-35b-a3b",
  messages: [{ role: "user", content: "Leia esta captura de tela de um dashboard com erro, explique o que a mensagem de erro significa e sugira a mudança no código que resolveria o problema." }]
});
https://runapi.ai 5 endpoints
VISÃO GERAL

Sobre Qwen

Qwen é a família de modelos de linguagem com pesos abertos da Alibaba, lançados sob Apache 2.0. No RunAPI, os modelos Qwen3.5 (397B-A17B, 122B-A10B, 27B, 35B-A3B) e Qwen3.6 (27B, 35B-A3B) são modelos nativos de visão e linguagem com janela de contexto de 262.144 tokens e thinking híbrido. O Qwen3-VL-235B-A22B vem nas versões Thinking e Instruct para compreensão de imagens, com janela de contexto de 131.072 tokens. O Qwen3-Coder-Next é um modelo de programação para agentes que trabalha só com texto e tem 3B de parâmetros ativos. Todos são chamados pelo endpoint Chat Completions compatível com OpenAI do RunAPI, com uma única chave de API.

Provedor
Alibaba
Modalidade
Texto

Endpoints da API Qwen

EndpointProtocol
POST /v1/chat/completionsOpenAI compatible
POST /v1/responsesOpenAI Responses
POST /v1/messagesAnthropic compatible
POST /v1beta/models/{model}:generateContentGemini generateContent
POST /v1beta/models/{model}:streamGenerateContentGemini streamGenerateContent

Variantes

Variante Cobrança Preços
qwen3-coder-next 1K tokens Descontinuado Ver →
qwen3-vl-235b-a22b-instruct 1K tokens Descontinuado Ver →
qwen3-vl-235b-a22b-thinking 1K tokens Descontinuado Ver →
qwen3.5-122b-a10b 1K tokens Entrada $0.40 / 1M de tokens | Saída $3.20 / 1M de tokens Ver →
qwen3.5-27b 1K tokens Entrada $0.30 / 1M de tokens | Saída $2.40 / 1M de tokens Ver →
qwen3.5-35b-a3b 1K tokens Entrada $0.25 / 1M de tokens | Saída $2.00 / 1M de tokens Ver →
qwen3.5-397b-a17b 1K tokens Entrada $0.60 / 1M de tokens | Saída $3.60 / 1M de tokens Ver →
qwen3.6-27b 1K tokens Entrada $0.60 / 1M de tokens | Saída $3.60 / 1M de tokens Ver →
qwen3.6-35b-a3b 1K tokens Entrada $0.38 / 1M de tokens | Saída $2.25 / 1M de tokens Ver →
PREÇOS

Preços de Qwen

Endpoint Resolução Duração Preço
chat_completion — — Entrada $0.40 / 1M de tokens | Saída $3.20 / 1M de tokens

Preços exibidos para qwen3.5-122b-a10b. Outras variantes mantêm seus próprios preços por endpoint.

Integração com agentes

Execute Qwen a partir de um agente

COMO FUNCIONA

Comece com Qwen

  1. Escolha o modelo

    Selecione o modelo e a variante que combinam com seu tipo de saída, meta de qualidade e latência.

  2. Autentique uma vez

    Use sua chave RunAPI para todos os modelos compatíveis.

  3. Instale o skill

    Adicione o model skill ao workspace de código antes de implementar a funcionalidade.

  4. Receba a saída

    Consulte por task ID ou trate o callback quando a geração terminar.

CONTEXTO

Onde Qwen se encaixa

Os modelos de linguagem Qwen da Alibaba são LLMs com pesos abertos, tanto Mixture-of-Experts quanto densos, com contexto de 131K a 256K. A maioria aceita entrada de imagem e oferece um modo thinking. Pelo RunAPI, eles compartilham uma única chave de API e cobrança por token, e qualquer SDK da OpenAI pode chamá-los em https://runapi.ai/v1. Estes são os modelos de linguagem da Qwen, separados dos modelos de geração de imagem Qwen Image, Qwen 2 e Qwen 3.

Provedor
Alibaba
Ver tudo →
Modalidade
Texto
Explorar modelos →

Por que usar Qwen pela RunAPI

Uma API key

Use as mesmas credenciais entre modelos e provedores.

Pronto para skills

O model skill inclui schemas, notas de setup, contexto de preços e IDs de modelo.

Cobrança previsível

O preço por uso fica visível antes da chamada.

Perguntas sobre Qwen

Com qual modelo Qwen devo começar?

Comece com o qwen3.6-27b ou o qwen3.6-35b-a3b, os modelos Qwen mais recentes no RunAPI, para chat, programação e entrada de imagem. Use o qwen3.5-397b-a17b quando quiser o maior modelo Qwen3.5, e o qwen3-coder-next para agentes de programação que não precisam de etapa de thinking.

Quais modelos Qwen aceitam imagens?

Todos os modelos Qwen3.5 e Qwen3.6 e as duas versões do Qwen3-VL-235B-A22B aceitam imagens. Envie-as como partes image_url em uma requisição Chat Completions. O qwen3-coder-next trabalha só com texto.

Como funciona o thinking nos modelos Qwen?

Os modelos Qwen3.5 e Qwen3.6 são híbridos e têm modos thinking e non-thinking. O qwen3-vl-235b-a22b-thinking sempre raciocina, enquanto o qwen3-vl-235b-a22b-instruct e o qwen3-coder-next respondem sem etapa de thinking.

Qual API uso para chamar o Qwen no RunAPI?

Use o endpoint Chat Completions compatível com OpenAI em https://runapi.ai/v1/chat/completions, com sua chave de API do RunAPI e um ID de modelo Qwen. Qualquer SDK da OpenAI funciona depois que você troca a base URL.

Os modelos de linguagem Qwen têm pesos abertos?

Sim. A Alibaba lança esses modelos Qwen com pesos abertos sob a licença Apache 2.0. O RunAPI dá acesso por API, para que você não precise hospedá-los nas suas próprias GPUs.

Qual é a diferença entre a linha Qwen e o Qwen Image?

A linha Qwen reúne os modelos de linguagem, que leem texto e imagens e retornam texto. Qwen Image, Qwen 2 e Qwen 3 são linhas separadas do RunAPI que geram e editam imagens.

MODELOS SIMILARES

Modelos similares a Qwen

Comece a construir com Qwen.