---
title: AI音声・スピーチAPI | RunAPI
description: 1つの公開音声APIで、テキスト読み上げ、音声クローン、文字起こし、効果音を利用できます。
url: https://runapi.ai/ja/audio.md
canonical: https://runapi.ai/ja/audio
locale: ja
site: RunAPI
image: https://runapi.ai/assets/opengraph-bfaaa0f0.png
alternates:
  en: https://runapi.ai/audio
  zh-CN: https://runapi.ai/zh-CN/audio
  es: https://runapi.ai/es/audio
  ja: https://runapi.ai/ja/audio
  de: https://runapi.ai/de/audio
  fr: https://runapi.ai/fr/audio
  pt-BR: https://runapi.ai/pt-BR/audio
  ko: https://runapi.ai/ko/audio
  it: https://runapi.ai/it/audio
  nl: https://runapi.ai/nl/audio
  pl: https://runapi.ai/pl/audio
  tr: https://runapi.ai/tr/audio
  zh-TW: https://runapi.ai/zh-TW/audio
  zh-HK: https://runapi.ai/zh-HK/audio
  ar: https://runapi.ai/ar/audio
  x-default: https://runapi.ai/audio
---

> HTML version: https://runapi.ai/ja/audio
> Site index for agents: https://runapi.ai/llms.txt


# AI音声・スピーチAPI

1つの公開音声APIで、テキスト読み上げ、音声クローン、文字起こし、効果音を利用できます。

- [APIキーを取得](https://runapi.ai/ja/login)
- [モデルを見る](https://runapi.ai/ja/models.md)

32 音声モデル · 6 プロバイダー · 89 公開エンドポイント

## プレイグラウンド

次の音声生成をここから始めましょう。公開モデルを選ぶと、現在の料金とエンドポイントの詳細を確認できます。

| モデル | プロバイダー | モダリティ | 料金 |
| --- | --- | --- | --- |
| [ElevenLabs/audio-isolation](https://runapi.ai/ja/models/elevenlabs/audio-isolation.md) | ElevenLabs | Audio & Music | $0.12 / minute |
| [Fish Audio](https://runapi.ai/ja/models/fish-audio.md) | Fish Audio | Audio & Music | Free / track |
| [Gemini Omni/gemini-omni-audio](https://runapi.ai/ja/models/gemini-omni/audio.md) | Google | Audio & Music | Free / track |

モード: `text_to_speech`

## クイックスタート

### 音声を合成

#### curl

```bash
curl https://runapi.ai/api/v1/elevenlabs/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"text-to-speech-multilingual-v2","text":"Welcome to RunAPI.","voice":"Adam","language_code":"en"}'
```

#### Python

```python
import json
import os
import requests

response = requests.post(
    "https://runapi.ai/api/v1/elevenlabs/text_to_speech",
    headers={"Authorization": f"Bearer {os.environ['RUNAPI_API_KEY']}"},
    json=json.loads("{\"model\":\"text-to-speech-multilingual-v2\",\"text\":\"Welcome to RunAPI.\",\"voice\":\"Adam\",\"language_code\":\"en\"}")
)
response.raise_for_status()
print(response.json())
```

#### Node.js

```javascript
const response = await fetch("https://runapi.ai/api/v1/elevenlabs/text_to_speech", {
  method: "POST",
  headers: {
    "Authorization": "Bearer " + process.env.RUNAPI_API_KEY,
    "Content-Type": "application/json"
  },
  body: JSON.stringify({"model":"text-to-speech-multilingual-v2","text":"Welcome to RunAPI.","voice":"Adam","language_code":"en"})
});
console.log(await response.json());
```

#### Go

```go
package main

import (
    "io"
    "net/http"
    "os"
    "strings"
)

func main() {
    payload := strings.NewReader("{\"model\":\"text-to-speech-multilingual-v2\",\"text\":\"Welcome to RunAPI.\",\"voice\":\"Adam\",\"language_code\":\"en\"}")
    request, err := http.NewRequest("POST", "https://runapi.ai/api/v1/elevenlabs/text_to_speech", payload)
    if err != nil { panic(err) }
    request.Header.Set("Authorization", "Bearer "+os.Getenv("RUNAPI_API_KEY"))
    request.Header.Set("Content-Type", "application/json")
    response, err := http.DefaultClient.Do(request)
    if err != nil { panic(err) }
    defer response.Body.Close()
    io.Copy(os.Stdout, response.Body)
}
```

#### レスポンス

```json
{
  "id": "tsk_example",
  "status": "processing"
}
```


## 初回生成までの4ステップ

**使い方**

1. **APIキーを取得** - すべてのTTSと音声モデルに1つのキーでアクセスできます。
2. **音声を選択** - 対応する音声モデルから利用できる音声を探します。
3. **テキストを送信** - テキストと音声の選択を /api/v1/elevenlabs/text_to_speech に送信します。
4. **音声を取得** - タスク結果から生成された音声を受け取ります。



### 探索

## その他のAI API

- [動画API](https://runapi.ai/ja/models?modality=video) - 80モデルで動画の生成、編集、アップスケールができます [詳しく見る](https://runapi.ai/ja/models?modality=video)
- [画像API](https://runapi.ai/ja/models?modality=image) - 49モデルで画像を作成・変換できます [詳しく見る](https://runapi.ai/ja/models?modality=image)
- [音楽API](https://runapi.ai/ja/music) - AIでオリジナル楽曲を作成できます [詳しく見る](https://runapi.ai/ja/music)
- [LLM API](https://runapi.ai/ja/models?modality=text) - 66の言語モデルでチャット補完を利用できます [詳しく見る](https://runapi.ai/ja/models?modality=text)


## チームがこれで作るもの

- **音声エージェント**: ストリーミングTTSをLLMと文字起こしに組み合わせ、1つのキーで全二重の音声ループを実現します。
- **ローカライズ**: 既存の動画を、聞き分けやすいクローン音声で新しい言語に吹き替えます。
- **会議メモ**: 話者ラベル付きで文字起こしし、同じパイプラインのLLMエンドポイントで要約します。
- **アクセシビリティ**: 録音セッションなしで、記事やドキュメント、アプリ内コンテンツにナレーションを追加します。


## RunAPI と代替サービスの比較

| 機能 | RunAPI | ElevenLabs 直接利用 | OpenAI TTS |
| --- | --- | --- | --- |
| 音声モデル | 32 個の音声モデル | 1 プロバイダー | 6 音声 |
| 料金 | $0.12 / minute から | 公式料金 | 公式料金 |
| リアルタイムストリーミング | 対応 | 対応 | 非対応 |
| 統合請求 | 対応 | 非対応 | 非対応 |
| MCP サーバー | 対応 | 非対応 | 非対応 |
| プロバイダーのフェイルオーバー | 対応 | 非対応 | 非対応 |



## Everything the audio endpoint can do

- **Text to Speech** - Stream natural speech from text with per-request voice and speed control.
- **Voice Cloning** - Build a reusable voice from a short reference sample, then call it by id like any other voice.
- **Speech to Text** - Transcribe long-form audio with timestamps, speaker labels, and word-level confidence.
- **Text to Sound** - Generate foley and sound effects from a description — impacts, ambience, UI cues.
- **Text to Dialogue** - Render multi-speaker conversations with distinct voices and natural turn timing in one call.

## Audio models on one key

| モデル | プロバイダー | 料金 |
| --- | --- | --- |
| ElevenLabs/audio-isolation | ElevenLabs | $0.12 / minute |
| ElevenLabs/sound-effect-v2 | ElevenLabs | $0.15 / minute |
| ElevenLabs/speech-to-text | ElevenLabs | $0.04 / minute |
| ElevenLabs/text-to-dialogue-v3 | ElevenLabs | $0.14 / 1K chars |
| ElevenLabs/text-to-speech-multilingual-v2 | ElevenLabs | $0.12 / 1K chars |
| ElevenLabs/text-to-speech-turbo-v2.5 | ElevenLabs | $0.06 / 1K chars |

[View all 32 audio models](https://runapi.ai/ja/models?modality=audio_music.md)

## 開発者がRunAPIを選ぶ理由

- **1つのキーですべてのモデル** - 複数のAPIキーを使い分ける必要はありません。1つの統合で全プロバイダーの200以上のモデルにアクセスできます。
- **15〜25%のコスト削減** - プロバイダーとのボリューム契約により、直接契約より低い価格を追加料金なしで提供します。
- **自動フェイルオーバー** - プロバイダーが停止した場合は、次に最適な選択肢へルーティングします。アプリは稼働し続けます。
- **OpenAI互換** - OpenAI SDKのドロップイン置換です。コードを1行変えるだけで任意のモデルにアクセスできます。
- **リアルタイム請求** - 使った分だけ支払います。最低利用料なしのリクエスト単位で、モデルやプロジェクトごとに費用を追跡できます。
- **API キー認証** - RunAPI API キーを使用して音声 API リクエストを認証します。

## Audio APIに関するよくある質問

### TTSの料金はどのように計算されますか？

入力テキスト1,000文字あたり、モデルの料金に基づいて課金されます。文字起こしは音声1分あたりの課金です。
### 音声のクローンは作成できますか？

はい。リファレンス音声をアップロードしてvoice idを作成し、以降のリクエストでそのidを指定してください。
### ストリーミングは対応していますか？

ストリーミング対応は選択したエンドポイントによって異なります。再生機能を組み込む前に、ドキュメントのレスポンス形式を確認してください。
### 対応言語は何ですか？

対応言語はモデルによって異なります。選択したモデルのドキュメントで確認してください。
### 音声やボイスサンプルは保存されますか？

リクエストとレスポンスの内容が保持される場合があります。データの取り扱いについてはプライバシーポリシーをご覧ください。
### 単語レベルのタイムスタンプは取得できますか？

タイムスタンプの対応状況と粒度は文字起こしエンドポイントによって異なります。レスポンスフィールドを確認してください。話者ラベルは別の機能です。

## Give your product a voice

Speech, cloning, and transcription behind one key. Start free, no credit card required.

- [Get API Key](https://runapi.ai/ja/login)
- [Read the Docs](https://runapi.ai/ja/docs/guides)


---

## More from RunAPI

- [Home](https://runapi.ai/ja/.md)
### プロダクト
- [モデルカタログ](https://runapi.ai/ja/models.md)
- [料金](https://runapi.ai/ja/pricing.md)
- [プロバイダー](https://runapi.ai/ja/models#all-models)
### 開発者
- [ドキュメント](https://runapi.ai/ja/docs/guides)
- [SDK](https://runapi.ai/ja/sdk.md)
- [CLI](https://runapi.ai/ja/cli.md)
- [MCP Server](https://runapi.ai/ja/mcp.md)
### ガイド
- [Claude Code と Cursor](https://runapi.ai/ja/claude-code-vs-cursor.md)
- [Cursor API セットアップ](https://runapi.ai/ja/cursor-api-setup.md)
- [RunAPI と OpenRouter の比較](https://runapi.ai/ja/openrouter-alternative.md)
### 会社
- [エンタープライズ](https://runapi.ai/ja/contact.md)
- [お問い合わせ](https://runapi.ai/ja/contact.md)
### 法務
- [利用規約](https://runapi.ai/ja/terms.md)
- [プライバシー](https://runapi.ai/ja/privacy.md)
- [Site index for agents](https://runapi.ai/llms.txt)

Contact: contact@runapi.ai

## Structured data

```json
[
  {
    "@context": "https://schema.org",
    "inLanguage": "ja",
    "@type": "WebSite",
    "name": "RunAPI",
    "url": "https://runapi.ai/ja",
    "potentialAction": {
      "@type": "SearchAction",
      "target": {
        "@type": "EntryPoint",
        "urlTemplate": "https://runapi.ai/ja/models?q={search_term_string}"
      },
      "query-input": "required name=search_term_string"
    }
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "ja",
    "@type": "Organization",
    "name": "RunAPI",
    "url": "https://runapi.ai/ja",
    "logo": {
      "@type": "ImageObject",
      "url": "https://runapi.ai/jaicon.svg"
    },
    "sameAs": [
      "https://github.com/runapi-ai"
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "ja",
    "@type": "CollectionPage",
    "name": "AI音声・スピーチAPI",
    "description": "1つの公開音声APIで、テキスト読み上げ、音声クローン、文字起こし、効果音を利用できます。",
    "url": "https://runapi.ai/ja/audio"
  }
]
```
