ElevenLabs · Audio i muzyka

OpenClaw x ElevenLabs

ElevenLabs to firma zajmująca się głosową AI, której modele obejmują TTS, dialogi, efekty dźwiękowe, transkrypcję i izolację audio. W RunAPI wszystkie endpointy ElevenLabs korzystają z jednego klucza i rozliczenia za wywołanie.

6 variants od $0.04 / minuta Do użytku komercyjnego

Prerequisite: npx runapi mcp install

Prompt

Modele promptów

Użyj audio-isolation, gdy pasuje do zadania: Wyodrębnianie głosu z miksu audio.

You have access to RunAPI task tools for ElevenLabs.

Available ElevenLabs models:
- audio-isolation: Wyodrębnianie głosu z miksu audio
  endpoints: /api/v1/elevenlabs/isolate_audio
  request fields: source_audio_url
- sound-effect-v2: Efekty dźwiękowe z tekstu do gier, wideo i podcastów
  endpoints: /api/v1/elevenlabs/text_to_sound
  request fields: text, loop, duration_seconds, prompt_influence, output_format
- speech-to-text: Transkrypcja w ponad 29 językach z diaryzacją mówców
  endpoints: /api/v1/elevenlabs/speech_to_text
  request fields: source_audio_url, language_code, diarize
- text-to-dialogue-v3: Generowanie dialogów wielu mówców z naturalną wymianą kwestii
  endpoints: /api/v1/elevenlabs/text_to_dialogue
  request fields: dialogue, stability, language_code
- text-to-speech-multilingual-v2: 29 języków; najbardziej naturalna ekspresja emocji; idealny do audiobooków
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code
- text-to-speech-turbo-v2.5: 32 języki; 3× szybszy dla języków innych niż angielski; limit 40K znaków
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code

Use the model ID and endpoint that match the user's request.
Example prompt: Zamień ten akapit na naturalną mowę ciepłym brytyjskim męskim głosem, w umiarkowanym tempie.
/api/v1/elevenlabs/isolate_audio: Submit the task, poll for its status, then verify the completed output. Wyślij POST do /api/v1/elevenlabs/isolate_audio i zapisz ID zwróconej Task.
Wyślij GET do /api/v1/elevenlabs/isolate_audio/<task-id>, aż stan zmieni się na completed lub failed.
Sprawdź, czy odpowiedź completed zawiera wynik właściwy dla endpointu opisany w dokumentacji API.
/api/v1/elevenlabs/text_to_sound: Submit the task, poll for its status, then verify the completed output. Wyślij POST do /api/v1/elevenlabs/text_to_sound i zapisz ID zwróconej Task.
Wyślij GET do /api/v1/elevenlabs/text_to_sound/<task-id>, aż stan zmieni się na completed lub failed.
Sprawdź, czy odpowiedź completed zawiera wynik właściwy dla endpointu opisany w dokumentacji API.
/api/v1/elevenlabs/speech_to_text: Submit the task, poll for its status, then verify the completed output. Wyślij POST do /api/v1/elevenlabs/speech_to_text i zapisz ID zwróconej Task.
Wyślij GET do /api/v1/elevenlabs/speech_to_text/<task-id>, aż stan zmieni się na completed lub failed.
Sprawdź, czy odpowiedź completed zawiera wynik właściwy dla endpointu opisany w dokumentacji API.
/api/v1/elevenlabs/text_to_dialogue: Submit the task, poll for its status, then verify the completed output. Wyślij POST do /api/v1/elevenlabs/text_to_dialogue i zapisz ID zwróconej Task.
Wyślij GET do /api/v1/elevenlabs/text_to_dialogue/<task-id>, aż stan zmieni się na completed lub failed.
Sprawdź, czy odpowiedź completed zawiera wynik właściwy dla endpointu opisany w dokumentacji API.
/api/v1/elevenlabs/text_to_speech: Submit the task, poll for its status, then verify the completed output. Wyślij POST do /api/v1/elevenlabs/text_to_speech i zapisz ID zwróconej Task.
Wyślij GET do /api/v1/elevenlabs/text_to_speech/<task-id>, aż stan zmieni się na completed lub failed.
Sprawdź, czy odpowiedź completed zawiera wynik właściwy dla endpointu opisany w dokumentacji API.

Publiczne wersje i endpointy

ID modelu Endpointy Cena początkowa Katalog
audio-isolation
/api/v1/elevenlabs/isolate_audio
$0.12 / minuta Szczegóły modelu
sound-effect-v2
/api/v1/elevenlabs/text_to_sound
$0.15 / minuta Szczegóły modelu
speech-to-text
/api/v1/elevenlabs/speech_to_text
$0.04 / minuta Szczegóły modelu
text-to-dialogue-v3
/api/v1/elevenlabs/text_to_dialogue
$0.14 / 1 tys. znaków Szczegóły modelu
text-to-speech-multilingual-v2
/api/v1/elevenlabs/text_to_speech
$0.12 / 1 tys. znaków Szczegóły modelu
text-to-speech-turbo-v2.5
/api/v1/elevenlabs/text_to_speech
$0.06 / 1 tys. znaków Szczegóły modelu

Weryfikacja

Odpytywanie do momentu osiągnięcia przez Task stanu końcowego

Wybierz <model-id>, aby wygenerować polecenia weryfikacyjne.

Konfiguracja

Endpoint przewodnika: <endpoint>

Wybierz <model-id>, aby wygenerować żądanie zgodne z publicznym kontraktem wejściowym endpointu.
Jak to działa

Zacznij w 3 krokach

  1. Wybierz ID modelu

    Wybierz publiczny ID modelu z katalogu i sprawdź jego endpoint oraz bieżącą cenę początkową.

  2. Skonfiguruj RunAPI

    Ustaw RUNAPI_API_KEY przed wysłaniem żądania do endpointu.

  3. Zweryfikuj wynik

    Dla asynchronicznych endpointów odpytuj ten sam endpoint, aż Task osiągnie stan końcowy.

Co możesz zbudować za pomocą OpenClaw + ElevenLabs

  • Narracja audiobooków i podcastów

    Zamieniaj długie teksty na mowę ze spójnymi głosami postaci przez wiele godzin treści.

  • Dubbing wideo w wielu językach

    Dubbinguj materiały wideo na inne języki z tym samym profilem głosu, tworząc wersje lokalne, które zachowują charakter głosu mówcy.

  • Efekty dźwiękowe do wideo i gier

    Generuj efekty foley, dźwięki otoczenia i sygnały dźwiękowe z opisów tekstowych zamiast przeszukiwać biblioteki gotowych nagrań.

Dlaczego warto używać ElevenLabs przez RunAPI + OpenClaw

  • 6 wariantów, jeden klucz API

    Korzystaj z jednego połączenia RunAPI, aby wybierać spośród dostępnych wariantów modelu bez zmiany integracji.

  • Przejrzyste ceny użycia

    Sprawdź aktualne ceny w katalogu przed wysłaniem żądania, bez subskrypcji i minimalnych wydatków.

  • Automatyczne przepływy zadań

    Wysyłaj zadania, sprawdzaj ich status i odbieraj asynchroniczne wyniki w jednym przepływie, bez ręcznego kodu odpytywania.

Pytania o OpenClaw + ElevenLabs

Jakie ustawienia głosu brzmią najbardziej naturalnie?

Wyższa stabilność sprawia, że głos jest równiejszy, ale mniej ekspresyjny, a wyższe podobieństwo utrzymuje go bliżej oryginalnego profilu. Przy narracji używaj większej stabilności, a przy treściach konwersacyjnych mniejszej.

Jak obsługiwać długie treści, takie jak audiobooki?

Dziel długie teksty na fragmenty, wysyłaj jedno żądanie na fragment i przetwarzaj rozdziały równolegle zamiast po kolei.

Czy mogę tworzyć nagrania z wieloma mówcami w OpenClaw?

Tak. Wywołaj endpoint dialogu z listą kwestii, z których każda jest przypisana do głosu, a ElevenLabs zwróci jedną rozmowę z wieloma mówcami.

Którego ID modelu użyć?

Wybierz publiczny ID modelu z tabeli wersji. Każdy ID udostępnia endpointy pokazane w jego wierszu.

Czy ten przewodnik konfiguruje model czatu?

Nie. Ta linia modeli korzysta z pokazanego procesu endpointu i nie jest przedstawiana jako model czatu agenta.

Zacznij używać ElevenLabs z OpenClaw

Budujesz z zespołem?

Pomożemy w konfiguracji dla firm, integracjach i kwestiach technicznych.

Skontaktuj się