Alibaba · Tekst

Hermes Agent x Qwen

Modele językowe Qwen od Alibaba to LLM-y o otwartych wagach, zarówno Mixture-of-Experts, jak i gęste, z kontekstem od 131K do 256K. Większość przyjmuje obrazy na wejściu i ma tryb thinking. W RunAPI korzystają z jednego klucza API i rozliczenia za token, a każde SDK OpenAI może je wywołać pod adresem https://runapi.ai/v1. To modele językowe Qwen, odrębne od modeli do generowania obrazów Qwen Image, Qwen 2 i Qwen 3.

6 variants od $0.25 / 1M tokenów Do użytku komercyjnego

Prerequisite: npx runapi mcp install

Prompt

Modele promptów

Użyj qwen3.5-122b-a10b, gdy pasuje do zadania: Wizyjny MoE Qwen3.5 o otwartych wagach (10B aktywnych); kontekst 256K; API zgodne z OpenAI.

You have access to RunAPI chat models for Qwen.

Available Qwen models:
- qwen3.5-122b-a10b: Wizyjny MoE Qwen3.5 o otwartych wagach (10B aktywnych); kontekst 256K; API zgodne z OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.5-27b: Gęsty model wizyjny Qwen3.5 o otwartych wagach; kontekst 256K, hybrydowy thinking; API zgodne z OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.5-35b-a3b: Mały wizyjny MoE Qwen3.5 o otwartych wagach (3B aktywnych); kontekst 256K; API zgodne z OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.5-397b-a17b: Flagowy wizyjny MoE Qwen3.5 o otwartych wagach (17B aktywnych); kontekst 256K; API zgodne z OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.6-27b: Gęsty model wizyjny Qwen3.6 o otwartych wagach do agentowego kodowania; kontekst 256K; API zgodne z OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.6-35b-a3b: Pierwszy model Qwen3.6 o otwartych wagach, wizyjny MoE z 3B aktywnych; kontekst 256K; API zgodne z OpenAI
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: Przeczytaj ten zrzut ekranu dashboardu z błędem, wyjaśnij, co oznacza komunikat o błędzie, i zaproponuj zmianę w kodzie, która go naprawi.
Verify the active model with: hermes model;hermes doctor

Publiczne wersje i endpointy

ID modelu Endpointy Cena początkowa Katalog
qwen3.5-122b-a10b
/v1/chat/completions
$0.40 / 1M tokenów Szczegóły modelu
qwen3.5-27b
/v1/chat/completions
$0.30 / 1M tokenów Szczegóły modelu
qwen3.5-35b-a3b
/v1/chat/completions
$0.25 / 1M tokenów Szczegóły modelu
qwen3.5-397b-a17b
/v1/chat/completions
$0.60 / 1M tokenów Szczegóły modelu
qwen3.6-27b
/v1/chat/completions
$0.60 / 1M tokenów Szczegóły modelu
qwen3.6-35b-a3b
/v1/chat/completions
$0.38 / 1M tokenów Szczegóły modelu

Weryfikacja

Odpytywanie do momentu osiągnięcia przez Task stanu końcowego

Wybierz <model-id>, aby wygenerować polecenia weryfikacyjne.

Konfiguracja

Endpoint przewodnika: <endpoint>

Wybierz <model-id>, aby wygenerować żądanie zgodne z publicznym kontraktem wejściowym endpointu.
Jak to działa

Zacznij w 3 krokach

  1. Wybierz ID modelu

    Wybierz publiczny ID modelu z katalogu i sprawdź jego endpoint oraz bieżącą cenę początkową.

  2. Skonfiguruj RunAPI

    Dodaj konfigurację dostawcy dla tego agenta.

  3. Zweryfikuj wynik

    Uruchom pokazane poniżej polecenia stanu i wyboru modelu.

Co możesz zbudować za pomocą Hermes Agent + Qwen

  • Programowanie i wnioskowanie z agentem

    Pozwól agentowi planować, pisać i przeglądać kod lub rozwiązywać wieloetapowe problemy dzięki wnioskowaniu modelu.

  • Analiza i ekstrakcja z długich dokumentów

    Streszczaj raporty, umowy lub bazy kodu i wyodrębniaj ustrukturyzowane pola z długich dokumentów.

  • Przepływy z wywołaniami narzędzi

    Połącz model z funkcjami i API, aby agent mógł między odpowiedziami pobierać dane i wykonywać działania.

Dlaczego warto używać Qwen przez RunAPI + Hermes Agent

  • 6 wariantów, jeden klucz API

    Korzystaj z jednego połączenia RunAPI, aby wybierać spośród dostępnych wariantów modelu bez zmiany integracji.

  • Przejrzyste ceny użycia

    Sprawdź aktualne ceny w katalogu przed wysłaniem żądania, bez subskrypcji i minimalnych wydatków.

  • Bezpośrednie odpowiedzi

    Wywołania synchroniczne zwracają wynik w tej samej odpowiedzi, więc agent może od razu go użyć bez odpytywania o stan zadania.

Pytania o Hermes Agent + Qwen

Od którego modelu Qwen zacząć?

Zacznij od qwen3.6-27b lub qwen3.6-35b-a3b, najnowszych modeli Qwen w RunAPI, do czatu, kodowania i obrazów na wejściu. Użyj qwen3.5-397b-a17b, gdy potrzebujesz największego modelu Qwen3.5, a qwen3-coder-next dla agentów kodujących, którym etap thinking nie jest potrzebny.

Które modele Qwen przyjmują obrazy?

Wszystkie modele Qwen3.5 i Qwen3.6 oraz obie wersje Qwen3-VL-235B-A22B przyjmują obrazy. Wysyłaj je jako części image_url w żądaniu Chat Completions. qwen3-coder-next obsługuje wyłącznie tekst.

Jak działa thinking w modelach Qwen?

Modele Qwen3.5 i Qwen3.6 są hybrydowe i mają tryby thinking i non-thinking. qwen3-vl-235b-a22b-thinking zawsze rozumuje, a qwen3-vl-235b-a22b-instruct i qwen3-coder-next odpowiadają bez etapu thinking.

Przez które API wywołać Qwen w RunAPI?

Użyj zgodnego z OpenAI endpointu Chat Completions pod adresem https://runapi.ai/v1/chat/completions, ze swoim kluczem API RunAPI i ID modelu Qwen. Każde SDK OpenAI zadziała po zmianie base URL.

Czy modele językowe Qwen mają otwarte wagi?

Tak. Alibaba wydaje te modele Qwen z otwartymi wagami na licencji Apache 2.0. RunAPI daje ci dostęp przez API, więc nie musisz hostować ich na własnych GPU.

Czym linia Qwen różni się od Qwen Image?

Linia Qwen obejmuje modele językowe, które czytają tekst i obrazy, a zwracają tekst. Qwen Image, Qwen 2 i Qwen 3 to osobne linie w RunAPI, które generują i edytują obrazy.

Którego ID modelu użyć?

Wybierz publiczny ID modelu z tabeli wersji. Każdy ID udostępnia endpointy pokazane w jego wierszu.

Czy ten przewodnik konfiguruje model czatu?

Tak. Ta linia modeli obsługuje protokół LLM przeznaczony dla klienta.

Zacznij używać Qwen z Hermes Agent

Budujesz z zespołem?

Pomożemy w konfiguracji dla firm, integracjach i kwestiach technicznych.

Skontaktuj się