Alibaba

Qwen3.5-35B-A3B

Texto

MoE de visão Qwen3.5 compacto com pesos abertos (3B ativos); contexto de 256K; API compatível com OpenAI

Entrada $0.25 / 1M de tokens | Saída $2.00 / 1M de tokens Qwen3.5-35B-A3B Ler a documentação →
Saúde do modelo Dados insuficientes
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3.5-35b-a3b:generateContent
POST /v1beta/models/qwen3.5-35b-a3b:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "qwen3.5-35b-a3b",
  "messages": [
    {
      "role": "user",
      "content": "Leia esta captura de tela de um dashboard com erro, explique o que a mensagem de erro significa e sugira a mudança no código que resolveria o problema."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="qwen3.5-35b-a3b",
    messages=[{"role": "user", "content": "Leia esta captura de tela de um dashboard com erro, explique o que a mensagem de erro significa e sugira a mudança no código que resolveria o problema."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "qwen3.5-35b-a3b",
  messages: [{ role: "user", content: "Leia esta captura de tela de um dashboard com erro, explique o que a mensagem de erro significa e sugira a mudança no código que resolveria o problema." }]
});
https://runapi.ai 5 endpoints
VISÃO GERAL

Para que serve o Qwen3.5-35B-A3B

O Qwen3.5-35B-A3B é o modelo Mixture-of-Experts compacto da série Qwen3.5 Medium da Alibaba, lançado com pesos abertos sob Apache 2.0 em 24 de fevereiro de 2026. É um modelo nativo de visão e linguagem com atenção linear híbrida, 35B de parâmetros no total e 3B ativos por token. A Alibaba avalia seu desempenho geral como comparável ao do Qwen3.5-27B.

É um modelo híbrido com thinking ativo por padrão, janela de contexto de 262.144 tokens e até 65.536 tokens de saída. A Alibaba lista function calling e structured outputs como suportados.

No RunAPI, chame o qwen3.5-35b-a3b pelo endpoint Chat Completions compatível com OpenAI (/v1/chat/completions), usando um SDK da OpenAI apontado para https://runapi.ai/v1. As imagens vão em partes image_url dentro de messages[].content[].

ID do modelo
qwen3.5-35b-a3b
Lançamento
24/02/2026
Arquitetura
MoE, 35B no total / 3B ativos, pesos sob Apache 2.0
Janela de contexto
262.144 tokens
Saída máxima
65.536 tokens
Thinking
Híbrido, ativo por padrão
Endpoint no RunAPI
OpenAI Chat Completions, entrada de texto e imagem
Playground

Experimente Qwen3.5-35B-A3B

Escolha qualquer modelo e gere em segundos.

Estimado: Entrada $0.25 / 1M de tokens | Saída $2.00 / 1M de tokens

Entre para gerar com a RunAPI.

Faça login para gerar

Entre para começar a gerar com seus modelos de linguagem disponíveis.

Especificações

FICHA TÉCNICA

Provedor Alibaba
ID do modelo qwen3.5-35b-a3b
Modalidade Texto
Tipos de tarefa Synchronous
Endpoint da API /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/qwen3.5-35b-a3b:generateContent
/v1beta/models/qwen3.5-35b-a3b:streamGenerateContent
Unidade de cobrança 1K tokens
Status do catálogo Operacional
COMO FUNCIONA

Use este modelo em 3 etapas

  1. Crie sua chave

    Cadastre-se gratuitamente e crie uma chave de API para qwen3.5-35b-a3b no painel.

  2. Envie uma solicitação

    Envie uma solicitação POST para /v1/chat/completions com o identificador do modelo qwen3.5-35b-a3b e seus parâmetros.

  3. Obtenha os resultados

    Leia diretamente do endpoint a resposta concluída de qwen3.5-35b-a3b.

O que este modelo oferece

Cobertura de endpoints

Expõe 1 endpoint(s) público(s): chat_completion.

Cobrança por uso

Medido por 1K tokens, sem exigência de assinatura.

Qwen3.5-35B-A3B PREÇOS

Endpoint
Preço
chat_completion
Entrada: $0.25 / 1M de tokens Saída: $2.00 / 1M de tokens
REFERÊNCIA DA API

Especificação do endpoint

Endpoint
POST /v1/chat/completions
ID do modelo
qwen3.5-35b-a3b
Tipos de tarefa
chat_completion

Parâmetros da solicitação

Nenhum parâmetro de solicitação foi publicado para este endpoint.

CASOS DE USO

Chat

Use LLMs para chat e raciocínio.

Código

Gere e revise trabalho de implementação.

Automação

Conecte modelos a tarefas backend.

Métricas de uso

Desenvolvedores confiam em nós
6
Chamadas de API / Dia
100.0%
Taxa de sucesso
5.7s
Geração média

Feedback verificado de clientes ainda não está disponível para este modelo.

FAQ

Perguntas frequentes sobre Qwen3.5-35B-A3B

O que significa A3B em Qwen3.5-35B-A3B?

Significa 3B de parâmetros ativos. O modelo tem 35B de parâmetros no total, e o roteador Mixture-of-Experts usa 3B deles em cada token.

Devo usar o Qwen3.5-35B-A3B ou o Qwen3.6-35B-A3B?

O Qwen3.6-35B-A3B é o sucessor direto deste modelo, com o mesmo tamanho de 35B no total e 3B ativos. A Alibaba relata grandes ganhos no modelo 3.6 em programação agêntica, raciocínio matemático e de código, inteligência espacial e detecção de objetos.

O Qwen3.5-35B-A3B suporta function calling?

Sim. A Alibaba lista function calling e structured outputs como suportados. No RunAPI, envie tools no formato da OpenAI pelo Chat Completions e leia tool_calls na resposta.

O Qwen3.5-35B-A3B consegue ler imagens?

Sim. É um modelo nativo de visão e linguagem. Envie partes image_url junto com o texto em uma requisição Chat Completions. A Alibaba também lista entrada de vídeo; requisições com vídeo não foram verificadas no RunAPI.

Como seleciono qwen3.5-35b-a3b?

Envie o ID de modelo mostrado no quickstart.

O preço é por uso?

Sim. O preço é medido por chamada ou unidade.

Construindo com uma equipe?

Ajudamos com a configuração empresarial, integrações e dúvidas técnicas.

Fale conosco