OpenAI TTS API
Accesso API a OpenAI TTS per sintesi vocale a bassa latenza e alta qualità, con output MP3 gestito da RunAPI.
curl -X POST https://runapi.ai/api/v1/openai_tts/text_to_speech \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "tts-1-hd",
"text": "Trasforma questo script di onboarding del prodotto in una voce chiara e naturale per una procedura guidata in-app."
}'
import { OpenaiTtsClient } from "@runapi.ai/openai-tts";
const client = new OpenaiTtsClient();
const result = await client.textToSpeech.run({
model: "tts-1-hd",
text: "Trasforma questo script di onboarding del prodotto in una voce chiara e naturale per una procedura guidata in-app.",
});
require "runapi/openai_tts"
client = RunApi::OpenaiTts::Client.new
result = client.text_to_speech.run(
model: "tts-1-hd",
text: "Trasforma questo script di onboarding del prodotto in una voce chiara e naturale per una procedura guidata in-app."
)
npx skills add runapi-ai/openai-tts -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
OpenAI TTS converte il testo in voce tramite un endpoint sincrono RunAPI. Scegli tts-1 per applicazioni sensibili alla latenza o tts-1-hd per narrazioni a maggiore fedeltà; entrambi restituiscono un URL MP3 gestito.
- Più varianti per diversi livelli di velocità / qualità
- Il model skill include documentazione, schema e note di setup
- Funziona con workflow di sviluppo app
- Le generazioni fallite non vengono addebitate
Confronta tutte le varianti API
| Variant | Billing | From | |
|---|---|---|---|
| tts-1 | 1K UTF-8 bytes | $0.040 | Visualizza → |
| tts-1-hd | 1K UTF-8 bytes | $0.080 | Visualizza → |
Installa lo skill OpenAI TTS per lo sviluppo di app
Carica documentazione del modello, schema, note prezzi e passaggi di setup nel tuo workspace di codice.
# Install the model skill for app development workflows
npx skills add runapi-ai/openai-tts -g
Install the OpenAI TTS skill for this app: 1. Add runapi-ai/openai-tts with the skills installer. 2. Load SKILL.md in this workspace. 3. Use its docs, schemas, pricing notes, and setup steps when adding model features. 4. Confirm the install path when done.
Dal model skill al primo risultato in quattro passaggi
Scegli il modello
Seleziona modello e variante adatti al tipo di output, al livello qualità e alla latenza target.
Configura
Imposta la tua chiave RunAPI e installa il model skill nel workspace di codice.
Implementa
Usa le istruzioni dello skill per aggiungere la feature modello dentro la tua applicazione.
Ricevi
Interroga per task ID, usa streaming dove supportato o gestisci il callback webhook.
Che cos'è l'API OpenAI TTS?
OpenAI TTS offre modelli di sintesi vocale pensati per la riproduzione interattiva e le narrazioni curate. Tramite RunAPI, entrambe le varianti usano lo stesso formato di richiesta e restituiscono metadati audio gestiti.
Perché usare l'API OpenAI TTS tramite RunAPI
Un’unica autenticazione, tutti i provider
Una sola chiave RunAPI sblocca l’intero catalogo. Niente account separati, niente rotazione delle chiavi per integrazione.
Prezzi e billing unificati
Prezzi per chiamata in USD, fatturati mensilmente. Le generazioni fallite non vengono addebitate.
Skill con schema
Schema tipizzati e note di setup sono inclusi nel model skill, così l'implementazione parte dal contratto corretto.
Domande frequenti
Qual è la differenza tra tts-1 e tts-1-hd?
tts-1 privilegia la bassa latenza per la riproduzione interattiva, mentre tts-1-hd privilegia una qualità audio superiore per narrazioni e contenuti finali.
Quale formato audio restituisce OpenAI TTS?
Entrambe le varianti restituiscono audio MP3 con formato, tipo MIME e metadati sulla dimensione in byte nella risposta RunAPI.
L'audio generato è ospitato da RunAPI?
Sì. RunAPI convalida l'audio e restituisce un URL gestito invece di esporre un URL sorgente temporaneo.
Posso selezionare una voce o una velocità personalizzate?
L'endpoint iniziale usa la voce e la velocità predefinite pubblicate. I controlli personalizzati per voce e velocità non fanno parte del contratto di questo endpoint.
La sintesi vocale è sincrona?
Sì. Una richiesta riuscita restituisce direttamente il risultato audio completato, senza un endpoint di polling separato.
Da quale variante dovrei iniziare?
Scegli la variante più economica che soddisfa il tuo livello di qualità. La maggior parte dei team inizia con la variante veloce e passa alla pro per la produzione.
C’è un piano gratuito?
I nuovi account ricevono le prime chiamate gratuite su ogni modello. Dopo, paghi per chiamata.
Trasmettete i risultati in streaming?
Dove lo streaming è disponibile, RunAPI trasmette end-to-end.
Come vengono addebitati i fallimenti?
Le generazioni non riuscite non vengono addebitate.
Gli output vengono memorizzati nella cache?
Gli output generati vengono salvati e recuperabili tramite ID del task. Gli input non vengono memorizzati nella cache.
Posso usarlo a fini commerciali?
Sì — l’uso commerciale è incluso per ogni variante, salvo che una licenza del modello lo limiti esplicitamente; in tal caso è indicato nella pagina della variante.
E i limiti di rate limit?
I rate limit per chiave scalano in base al tier di utilizzo. Vedi la pagina prezzi per i limiti aggiornati.
Dove posso segnalare problemi?
Apri un issue nel repo GitHub pubblico oppure scrivi al supporto.