---
title: API audio i mowy AI | RunAPI
description: Synteza mowy, klonowanie głosu, transkrypcja i efekty dźwiękowe przez jedno publiczne API audio.
url: https://runapi.ai/pl/audio.md
canonical: https://runapi.ai/pl/audio
locale: pl
site: RunAPI
image: https://runapi.ai/assets/opengraph-bfaaa0f0.png
alternates:
  en: https://runapi.ai/audio
  zh-CN: https://runapi.ai/zh-CN/audio
  es: https://runapi.ai/es/audio
  ja: https://runapi.ai/ja/audio
  de: https://runapi.ai/de/audio
  fr: https://runapi.ai/fr/audio
  pt-BR: https://runapi.ai/pt-BR/audio
  ko: https://runapi.ai/ko/audio
  it: https://runapi.ai/it/audio
  nl: https://runapi.ai/nl/audio
  pl: https://runapi.ai/pl/audio
  tr: https://runapi.ai/tr/audio
  zh-TW: https://runapi.ai/zh-TW/audio
  zh-HK: https://runapi.ai/zh-HK/audio
  ar: https://runapi.ai/ar/audio
  x-default: https://runapi.ai/audio
---

> HTML version: https://runapi.ai/pl/audio
> Site index for agents: https://runapi.ai/llms.txt


# API audio i mowy AI

Synteza mowy, klonowanie głosu, transkrypcja i efekty dźwiękowe przez jedno publiczne API audio.

- [Uzyskaj klucz API](https://runapi.ai/pl/login)
- [Przeglądaj modele](https://runapi.ai/pl/models.md)

32 modeli audio · 6 Dostawcy · 89 Publiczne endpointy

## Playground

Zacznij tutaj tworzyć następne audio. Wybierz publiczny model, aby sprawdzić aktualną cenę i szczegóły endpointu.

| Model | Dostawca | Modalność | Cena |
| --- | --- | --- | --- |
| [ElevenLabs/audio-isolation](https://runapi.ai/pl/models/elevenlabs/audio-isolation.md) | ElevenLabs | Audio & Music | $0.12 / minute |
| [Fish Audio](https://runapi.ai/pl/models/fish-audio.md) | Fish Audio | Audio & Music | Free / track |
| [Gemini Omni/gemini-omni-audio](https://runapi.ai/pl/models/gemini-omni/audio.md) | Google | Audio & Music | Free / track |

Tryb: `text_to_speech`

## Szybki start

### Syntezuj mowę

#### curl

```bash
curl https://runapi.ai/api/v1/elevenlabs/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"text-to-speech-multilingual-v2","text":"Welcome to RunAPI.","voice":"Adam","language_code":"en"}'
```

#### Python

```python
import json
import os
import requests

response = requests.post(
    "https://runapi.ai/api/v1/elevenlabs/text_to_speech",
    headers={"Authorization": f"Bearer {os.environ['RUNAPI_API_KEY']}"},
    json=json.loads("{\"model\":\"text-to-speech-multilingual-v2\",\"text\":\"Welcome to RunAPI.\",\"voice\":\"Adam\",\"language_code\":\"en\"}")
)
response.raise_for_status()
print(response.json())
```

#### Node.js

```javascript
const response = await fetch("https://runapi.ai/api/v1/elevenlabs/text_to_speech", {
  method: "POST",
  headers: {
    "Authorization": "Bearer " + process.env.RUNAPI_API_KEY,
    "Content-Type": "application/json"
  },
  body: JSON.stringify({"model":"text-to-speech-multilingual-v2","text":"Welcome to RunAPI.","voice":"Adam","language_code":"en"})
});
console.log(await response.json());
```

#### Go

```go
package main

import (
    "io"
    "net/http"
    "os"
    "strings"
)

func main() {
    payload := strings.NewReader("{\"model\":\"text-to-speech-multilingual-v2\",\"text\":\"Welcome to RunAPI.\",\"voice\":\"Adam\",\"language_code\":\"en\"}")
    request, err := http.NewRequest("POST", "https://runapi.ai/api/v1/elevenlabs/text_to_speech", payload)
    if err != nil { panic(err) }
    request.Header.Set("Authorization", "Bearer "+os.Getenv("RUNAPI_API_KEY"))
    request.Header.Set("Content-Type", "application/json")
    response, err := http.DefaultClient.Do(request)
    if err != nil { panic(err) }
    defer response.Body.Close()
    io.Copy(os.Stdout, response.Body)
}
```

#### Odpowiedź

```json
{
  "id": "tsk_example",
  "status": "processing"
}
```


## Cztery kroki do pierwszego wygenerowania

**Jak to działa**

1. **Uzyskaj klucz API** - Jeden klucz do wszystkich modeli TTS i głosowych.
2. **Wybierz głos** - Przeglądaj dostępne głosy w obsługiwanych modelach audio.
3. **Wyślij tekst** - Wyślij tekst i wybrany głos do /api/v1/elevenlabs/text_to_speech.
4. **Odbierz audio** - Odbierz wygenerowany dźwięk z wyniku zadania.



### Odkrywaj

## Więcej API AI

- [API wideo](https://runapi.ai/pl/models?modality=video) - Generuj, edytuj i skaluj wideo za pomocą 80 modeli [Dowiedz się więcej](https://runapi.ai/pl/models?modality=video)
- [API obrazów](https://runapi.ai/pl/models?modality=image) - Twórz i przekształcaj obrazy za pomocą 49 modeli [Dowiedz się więcej](https://runapi.ai/pl/models?modality=image)
- [API muzyki](https://runapi.ai/pl/music) - Komponuj oryginalne utwory z pomocą AI [Dowiedz się więcej](https://runapi.ai/pl/music)
- [API LLM](https://runapi.ai/pl/models?modality=text) - Uzupełnianie czatu za pomocą 66 modeli językowych [Dowiedz się więcej](https://runapi.ai/pl/models?modality=text)


## Co zespoły budują za pomocą API

- **Agenci głosowi**: Połącz strumieniowe TTS z LLM i transkrypcją, aby zbudować w pełni dwukierunkową pętlę głosową za pomocą jednego klucza.
- **Lokalizacja**: Zdubbinguj istniejący film na nowe języki za pomocą sklonowanego głosu, który pozostaje rozpoznawalny.
- **Notatki ze spotkań**: Wykonuj transkrypcję z etykietami mówców, a następnie podsumowuj ją przez punkt końcowy LLM w tym samym potoku.
- **Dostępność**: Dodaj narrację do artykułów, dokumentów i treści w aplikacji bez sesji nagraniowej.


## RunAPI na tle alternatyw

| Funkcja | RunAPI | ElevenLabs bezpośrednio | OpenAI TTS |
| --- | --- | --- | --- |
| Modele głosowe | 32 modeli audio | 1 dostawca | 6 głosów |
| Ceny | Od $0.12 / minute | Stawka oficjalna | Stawka oficjalna |
| Przesyłanie strumieniowe w czasie rzeczywistym | Tak | Tak | Nie |
| Ujednolicone rozliczenia | Tak | Nie | Nie |
| Serwer MCP | Tak | Nie | Nie |
| Przełączanie dostawcy | Tak | Nie | Nie |



## Everything the audio endpoint can do

- **Text to Speech** - Stream natural speech from text with per-request voice and speed control.
- **Voice Cloning** - Build a reusable voice from a short reference sample, then call it by id like any other voice.
- **Speech to Text** - Transcribe long-form audio with timestamps, speaker labels, and word-level confidence.
- **Text to Sound** - Generate foley and sound effects from a description — impacts, ambience, UI cues.
- **Text to Dialogue** - Render multi-speaker conversations with distinct voices and natural turn timing in one call.

## Audio models on one key

| Model | Dostawca | Cena |
| --- | --- | --- |
| ElevenLabs/audio-isolation | ElevenLabs | $0.12 / minute |
| ElevenLabs/sound-effect-v2 | ElevenLabs | $0.15 / minute |
| ElevenLabs/speech-to-text | ElevenLabs | $0.04 / minute |
| ElevenLabs/text-to-dialogue-v3 | ElevenLabs | $0.14 / 1K chars |
| ElevenLabs/text-to-speech-multilingual-v2 | ElevenLabs | $0.12 / 1K chars |
| ElevenLabs/text-to-speech-turbo-v2.5 | ElevenLabs | $0.06 / 1K chars |

[View all 32 audio models](https://runapi.ai/pl/models?modality=audio_music.md)

## Dlaczego deweloperzy wybierają RunAPI

- **Jeden klucz, wszystkie modele** - Nie zarządzaj już wieloma kluczami API. Jedna integracja daje dostęp do ponad 200 modeli wszystkich dostawców.
- **Oszczędność kosztów 15-25%** - Dzięki umowom wolumenowym z dostawcami oferujemy ceny niższe niż zakup bezpośredni, bez narzutu.
- **Automatyczny failover** - Gdy dostawca przestaje działać, kierujemy żądanie do kolejnej najlepszej opcji. Twoja aplikacja działa dalej.
- **Kompatybilność z OpenAI** - Bezpośredni zamiennik OpenAI SDK. Zmień jedną linię kodu, aby uzyskać dostęp do dowolnego modelu.
- **Rozliczenia w czasie rzeczywistym** - Płacisz tylko za wykorzystanie. Ceny za żądanie bez minimów oraz śledzenie kosztów według modelu i projektu.
- **Uwierzytelnianie kluczem API** - Uwierzytelniaj żądania do API audio za pomocą klucza API RunAPI.

## Pytania dotyczące Audio API

### Jak rozliczany jest TTS?

Za każde 1 000 znaków tekstu wejściowego według stawki modelu. Transkrypcja jest rozliczana za minutę nagrania.
### Czy mogę sklonować głos?

Tak. Prześlij próbkę referencyjną, aby utworzyć identyfikator głosu, a następnie przekaż go w kolejnych żądaniach.
### Czy streaming jest obsługiwany?

Obsługa streamingu zależy od wybranego endpointu. Przed integracją odtwarzania sprawdź udokumentowany format odpowiedzi.
### Jakie języki są obsługiwane?

Obsługiwane języki zależą od modelu. Sprawdź dokumentację wybranego modelu.
### Czy przechowujecie nagrania audio lub próbki głosów?

Treść żądań i odpowiedzi może być przechowywana. Szczegóły przetwarzania danych znajdziesz w polityce prywatności.
### Czy mogę uzyskać znaczniki czasu na poziomie słów?

Obsługa i dokładność znaczników czasu zależą od endpointu transkrypcji. Sprawdź udokumentowane pola odpowiedzi; etykiety mówców to osobna funkcja.

## Give your product a voice

Speech, cloning, and transcription behind one key. Start free, no credit card required.

- [Get API Key](https://runapi.ai/pl/login)
- [Read the Docs](https://runapi.ai/pl/docs/guides)


---

## More from RunAPI

- [Home](https://runapi.ai/pl/.md)
### Produkt
- [Katalog modeli](https://runapi.ai/pl/models.md)
- [Cennik](https://runapi.ai/pl/pricing.md)
- [Dostawcy](https://runapi.ai/pl/models#all-models)
### Dla developerów
- [Dokumentacja](https://runapi.ai/pl/docs/guides)
- [SDK](https://runapi.ai/pl/sdk.md)
- [CLI](https://runapi.ai/pl/cli.md)
- [Serwer MCP](https://runapi.ai/pl/mcp.md)
### Przewodniki
- [Claude Code vs Cursor](https://runapi.ai/pl/claude-code-vs-cursor.md)
- [Konfiguracja Cursor API](https://runapi.ai/pl/cursor-api-setup.md)
- [RunAPI vs OpenRouter](https://runapi.ai/pl/openrouter-alternative.md)
### Firma
- [Enterprise](https://runapi.ai/pl/contact.md)
- [Kontakt](https://runapi.ai/pl/contact.md)
### Prawne
- [Regulamin](https://runapi.ai/pl/terms.md)
- [Prywatność](https://runapi.ai/pl/privacy.md)
- [Site index for agents](https://runapi.ai/llms.txt)

Contact: contact@runapi.ai

## Structured data

```json
[
  {
    "@context": "https://schema.org",
    "inLanguage": "pl",
    "@type": "WebSite",
    "name": "RunAPI",
    "url": "https://runapi.ai/pl",
    "potentialAction": {
      "@type": "SearchAction",
      "target": {
        "@type": "EntryPoint",
        "urlTemplate": "https://runapi.ai/pl/models?q={search_term_string}"
      },
      "query-input": "required name=search_term_string"
    }
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "pl",
    "@type": "Organization",
    "name": "RunAPI",
    "url": "https://runapi.ai/pl",
    "logo": {
      "@type": "ImageObject",
      "url": "https://runapi.ai/plicon.svg"
    },
    "sameAs": [
      "https://github.com/runapi-ai"
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "pl",
    "@type": "CollectionPage",
    "name": "API audio i mowy AI",
    "description": "Synteza mowy, klonowanie głosu, transkrypcja i efekty dźwiękowe przez jedno publiczne API audio.",
    "url": "https://runapi.ai/pl/audio"
  }
]
```
