Audio & Music · OpenAI

OpenAI TTS API

Acceso a la API de OpenAI TTS para texto a voz de baja latencia y alta calidad, con salida MP3 gestionada por RunAPI.

Operativo · 2 variants · desde $0.040
runapi.ai
curl -X POST https://runapi.ai/api/v1/openai_tts/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "tts-1-hd",
  "text": "Convierte este guion de incorporación al producto en una locución clara y natural para un tutorial dentro de la aplicación."
}'
import { OpenaiTtsClient } from "@runapi.ai/openai-tts";

const client = new OpenaiTtsClient();
const result = await client.textToSpeech.run({
    model: "tts-1-hd",
    text: "Convierte este guion de incorporación al producto en una locución clara y natural para un tutorial dentro de la aplicación.",
});
require "runapi/openai_tts"

client = RunApi::OpenaiTts::Client.new
result = client.text_to_speech.run(
    model: "tts-1-hd",
    text: "Convierte este guion de incorporación al producto en una locución clara y natural para un tutorial dentro de la aplicación."
)
npx skills add runapi-ai/openai-tts -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/openai-tts v1
RESUMEN

OpenAI TTS convierte texto en voz mediante un endpoint síncrono de RunAPI. Elige tts-1 para aplicaciones sensibles a la latencia o tts-1-hd para narraciones de mayor fidelidad; ambos devuelven una URL de audio MP3 gestionada.

  • Variantes para distintos objetivos de calidad y latencia
  • API key unificada
  • El model skill incluye documentación, schemas y notas de setup
  • Las generaciones fallidas no se cobran
VARIANTES

Variantes

Variant Billing From
tts-1 1K UTF-8 bytes $0.040 Ver →
tts-1-hd 1K UTF-8 bytes $0.080 Ver →
MODELS

Instala el skill de OpenAI TTS para desarrollar apps

Carga documentación del modelo, schemas, notas de precios y pasos de setup en tu workspace de código.

# Install the model skill for app development workflows
npx skills add runapi-ai/openai-tts -g
Installs docs, schemas, pricing context, and setup notes into your developer workspace.
Or use this setup request in your coding tool:
Install the OpenAI TTS skill for this app:

1. Add runapi-ai/openai-tts with the skills installer.
2. Load SKILL.md in this workspace.
3. Use its docs, schemas, pricing notes, and setup steps when adding model features.
4. Confirm the install path when done.
CÓMO FUNCIONA

Cómo construir con este model skill

01

Elige el modelo

Selecciona el modelo y la variante que encajan con tu tipo de salida, calidad objetivo y latencia.

02

Autentica una vez

Usa tu clave RunAPI para todos los modelos compatibles.

03

Instala el skill

Añade el model skill a tu workspace de código antes de implementar la función.

04

Recibe la salida

Consulta por task ID o procesa el callback cuando termine la generación.

CONTEXTO

Dónde encaja OpenAI TTS

OpenAI TTS ofrece modelos especializados de texto a voz para reproducción interactiva y narraciones de alta calidad. Mediante RunAPI, ambas variantes comparten el mismo formato de solicitud y devuelven metadatos de audio gestionados.

Provider
OpenAI
Modality
Audio & Music
POR QUÉ RUNAPI

Por qué usar OpenAI TTS mediante RunAPI

Una API key

Usa las mismas credenciales entre modelos y proveedores.

Listo para skills

El model skill incluye schemas, notas de setup, contexto de precios e IDs de modelo.

Facturación predecible

El precio por uso es visible antes de llamar.

FAQ

Preguntas frecuentes

¿Cuál es la diferencia entre tts-1 y tts-1-hd?

tts-1 prioriza la baja latencia para la reproducción interactiva, mientras que tts-1-hd prioriza una mayor calidad de audio para narraciones y contenido final.

¿Qué formato de audio devuelve OpenAI TTS?

Ambas variantes devuelven audio MP3 con metadatos de formato, tipo MIME y tamaño en bytes en la respuesta de RunAPI.

¿Aloja RunAPI el audio generado?

Sí. RunAPI valida el audio y devuelve una URL gestionada en lugar de exponer una URL de origen temporal.

¿Puedo elegir una voz o velocidad personalizadas?

El endpoint inicial usa los valores predeterminados publicados para la voz y la velocidad. Los controles de voz y velocidad personalizados no forman parte del contrato de este endpoint.

¿La conversión de texto a voz es síncrona?

Sí. Una solicitud completada correctamente devuelve directamente el resultado de audio completo, sin un endpoint de polling independiente.

¿Cómo llamo a este modelo?

Instala el model skill y sigue sus notas de setup con tu clave RunAPI.

¿Las generaciones fallidas cuestan dinero?

Las generaciones fallidas no se cobran

¿Puedo llamarlo desde mi aplicación?

Sí. Instala el model skill en tu workspace de código y úsalo mientras añades la función del modelo.

EMPEZAR

Empieza a construir con OpenAI TTS.