模型目录

探索 249 个 AI 模型

浏览、对比并接入最优质的视频、图像、音乐、音频和文本生成 AI 模型——统一通过一个 API 调用。

全部模型可用 · 实时定价
# Available Endpoints
POST /v1/chat/completions # LLM
POST /v1/images/generations # Image
POST /api/v1/kling/text_to_video # Video
POST /v1/audio/speech # TTS
POST /v1/audio/transcriptions # STT
POST /api/v1/suno/text_to_music # Music

一个 API,接入主流 AI 模型

  • Flux
  • Midjourney
  • Whisper
  • ElevenLabs
  • HappyHorse
  • GPT Image 2
  • Veo
  • Minimax
  • Luma
  • PixVerse
  • Recraft
  • Fish Audio
  • DeepSeek
  • Qwen
  • Claude
  • GPT
  • Gemini
  • Seedance
  • Kling
  • Suno
提供方

56 个模型

文本
Claude
Anthropic

Claude API 调用 Anthropic 大语言模型,擅长复杂推理、代码、分析和超长上下文任务。

文本
DeepSeek
DeepSeek

DeepSeek API 调用 —— flash 快速低成本,pro 应对复杂智能体任务。

音频与音乐
ElevenLabs
ElevenLabs

ElevenLabs API 调用语音合成、文字转语音、音效生成、语音转文字和音频隔离。

文本
Embedding
OpenAI

OpenAI 文本向量模型,适用于语义搜索、检索、聚类和排序。

音频与音乐
Fish Audio
Fish Audio

Fish Audio API 提供富有表现力的多语言与生产级文本转语音,并返回托管 MP3。

图像
Flux
Black Forest Labs

Flux 图像 API:Dev、Pro 与 2 Klein 支持文生图,Dev 与 Pro 支持单图编辑。

图像
Flux 2
Black Forest Labs

Flux 2 API 调用 Black Forest Labs 文生图和图像 remix,具备强提示词遵循能力。

图像
Flux Kontext
Black Forest Labs

Flux Kontext API 调用上下文感知图像编辑,支持局部修改、风格迁移和角色一致性生成。

文本
Gemini
Google

Gemini API 调用 Google 多模态大语言模型,支持对话、代码生成、推理和长上下文任务。

视频
Gemini Omni
Google

Gemini Omni API 调用声音、角色和多模态视频资源,用于旁白、对白和 Agent 媒体工作流。

音频与音乐
Gemini TTS
Google

Gemini TTS API 调用多角色对白语音合成,可分别配置声音、口音、表达风格和语速。

文本
GLM
Z.ai

Z.ai GLM API 调用 —— MIT 开源 MoE 模型,最高 200K 上下文,开放权重编码基准领先。

文本
GPT
OpenAI

GPT API 调用 OpenAI 旗舰大语言模型,支持对话、代码生成和多步推理任务。

图像
GPT Image
OpenAI

GPT Image API 调用 OpenAI 图像生成,支持文字生成图片和图像编辑。

图像
GPT Image 2
OpenAI

GPT Image 2 API 调用 OpenAI 最新图像生成,支持多语言图内文字近乎完美渲染。

图像
GPT Image 2.5
OpenAI

通过 RunAPI 使用 GPT Image 2.5 API,配套 model skill、统一认证和按需计费。

图像
GPT-4o Image
OpenAI

GPT-4o Image API 调用原生图像生成,在对话中直接生成和编辑图像。

文本
Grok
xAI

通过 RunAPI Responses 与 Chat Completions 调用 xAI Grok 4.5 和 4.6,支持推理、工具与结构化输出。

图像
Grok Imagine
xAI

Grok Imagine API 调用图片和视频生成,支持文生图、图生图、文生视频和图生视频。

视频
Grok Imagine Video
xAI

通过 RunAPI 使用 Grok Imagine Video API,配套 model skill、统一认证和按需计费。

视频
Hailuo
MiniMax

Hailuo API 调用文本和图片生成 1080p 原生视频,支持精准物理模拟和运动效果。

视频
HappyHorse
Alibaba

HappyHorse API 调用文生视频、图生视频和视频编辑生成,支持 720p/1080p 输出和角色参考图。

图像
Ideogram V3
Ideogram

Ideogram V3 API 调用高图内文字准确率文生图,适合海报、Logo 和排版设计。

图像
Imagen 4
Google

Imagen 4 API 调用照片级真实感文生图,精准排版渲染,广泛风格支持。

视频
InfiniteTalk
MeiGen-AI

InfiniteTalk API 调用音频驱动的数字人动画,从任意音频输入实现肖像唇形同步和动画。

JE 工具
Jev
TypeSafe

TypeSafe Jev API,面向软件的结构化决策:分类、路由、评分,并返回带置信度的类型化结果。

文本
Kimi
Moonshot AI

Moonshot AI Kimi API 调用,当前旗舰 kimi-k3 具备始终开启的推理;首版提供基础文本同步与 SSE。

视频
Kling
Kuaishou

Kling API 调用文本和图片生成视频,最高 4K,支持多模态音频和 AI 数字人。

视频
Luma
Luma

Luma API 调用基于 Dream Machine 的视频修改和变换。

图像
Midjourney Image
Midjourney

通过 RunAPI 使用 Midjourney Image API,配套 model skill、统一认证和按需计费。

视频
Midjourney Video
Midjourney

通过 RunAPI 使用 Midjourney Video API,配套 model skill、统一认证和按需计费。

文本
MiMo
Xiaomi

RunAPI MiMo API:基础版 mimo-v2.5 仅在同步 OpenAI Chat Completions 中支持文本和远程 HTTP(S) 图片,mimo-v2.5-pro 仅支持文本。

文本
MiniMax
MiniMax

MiniMax 文本 API 调用 —— 稀疏 MoE 模型,200K–1M 上下文,最高 SWE-bench Verified 80.5%。

视频
MiniMax H3
MiniMax

MiniMax H3 视频生成 API,支持最高 2K 的文生视频、图生视频,以及图像、视频和音频多参考生成。

图像
Nano Banana
Google

Nano Banana API 调用快速文生图,支持精准图内文字渲染和多角色一致性。

工具
OmniHuman
Bytedance

OmniHuman API 调用音频驱动数字人视频、人体识别和主体 mask 检测能力。

工具
OpenAI Moderation
OpenAI

通过 RunAPI 使用 OpenAI Moderation API,配套 model skill、统一认证和按需计费。

音频与音乐
OpenAI Transcription
OpenAI

OpenAI 兼容音频转文字 API,支持 Whisper-1 与 GPT Transcribe 语音转文字模型。

音频与音乐
OpenAI TTS
OpenAI

OpenAI TTS API 提供低延迟与高质量文本转语音,并返回 RunAPI 托管的 MP3。

视频
PixVerse
PixVerse

通过 RunAPI 调用 PixVerse V6 视频 API —— 从文本、图像、参考图集、转场帧生成视频,并可续写已完成的结果。

音频与音乐
Producer
Producer

Producer API 支持根据指定歌词或纯音乐制作说明生成 FUZZ 音乐。

图像
Qwen 2
Alibaba

Qwen 2 API 调用阿里巴巴视觉模型家族的文生图和图像编辑。

图像
Qwen 3
Alibaba

Qwen 3 标准版与 Pro 版文生图和图像编辑 API。

图像
Qwen Image
Alibaba

Qwen Image API 支持高质量文生图、提示词引导的图像重混和精准的文字指令编辑。

工具
Recraft
Recraft

Recraft API 调用 AI 图像超分辨率和背景移除,适用于设计和生产工作流。

视频
Runway
Runway

Runway API 调用视频生成与编辑,使用文字提示创作和变换视频。

视频
Runway Aleph
Runway

Runway Aleph API 调用提示词驱动的视频编辑,变换现有素材并保持帧级连续性。

视频
Seedance
Bytedance

Seedance API 调用文本和图片生成视频,原生音视频联合合成,支持多镜头片段。

图像
Seedream
Bytedance

Seedream API 调用文生图和图像编辑,强大排版渲染能力,最高 4K 分辨率。

音频与音乐
Suno
Suno

Suno API 调用 AI 音乐生成 — 通过文字提示创作完整歌曲,包含人声、乐器和歌词。

工具
Topaz
Topaz

Topaz Labs API 调用 AI 图片和视频超分辨率,提升分辨率和细节。

视频
Veo 3.1
Google

Veo 3.1 API 调用高保真视频生成,最高 4K,原生合成对话、音效和环境音。

视频
Volcengine Lip Sync
Bytedance

Volcengine Lip Sync API 调用音频驱动的视频到视频口型同步,输入源视频和音频即可生成结果。

图像
Wan Image
Alibaba

通过 RunAPI 使用 Wan Image API,配套 model skill、统一认证和按需计费。

视频
Wan Video
Alibaba

通过 RunAPI 使用 Wan Video API,配套 model skill、统一认证和按需计费。

图像
Z Image
Alibaba

Z Image API 调用超快文生图,8 步推理即可生成照片级真实图像。

56 个模型

现在试用模型

选择任意模型,几秒内开始生成。

预计: $0.61 / 秒

登录后即可使用 RunAPI 生成。

登录后生成

登录后即可使用可用语言模型开始生成。

为何选择 RunAPI

一个 API,覆盖所有 AI 模型

统一接口

一个 SDK 即可调用全部模态下的 240+ 个模型。切换提供商无需改代码。

实时价格

按量付费,价格透明。没有订阅费,没有隐藏费用,余额永不过期。

企业级保障

支持团队 API 密钥、用量分析和优先支持。

快速上手

Python SDK
pip install runapi-suno
CLI
curl -fsSL https://runapi.ai/cli/install.sh | sh
MCP Server
npx -y @runapi.ai/mcp

团队用 200+ 个模型构建什么

视频营销

用 Kling、Veo 和 Runway 为每个受众群体生成不同版本的广告

产品摄影

用 Flux 和 Midjourney 制作影棚级产品图

播客制作

用 Fish Audio 和 ElevenLabs 克隆声音并生成开场白

AI 代理

通过 MCP 或 REST 让你的代理接入任意模型

内容配乐

用 Suno 和 Udio 为视频和播客配乐

多语言语音合成

用自然的声音将应用本地化为 40 多种语言

模型目录问题

如何浏览可用模型?

访问 /models,或使用 CLI: runapi models list。可按模态、提供商筛选,或按名称搜索。

我能在一个项目里使用多个模型吗?

可以。一个 API 密钥可调用全部 240+ 个模型,在视频、图像、音乐、音频和 LLM 模型之间自由切换。

新模型是怎么上线的?

我们持续上线新模型。重大发布通常在正式推出后几天内即可使用。关注我们的更新日志获取最新动态。

我能申请特定模型吗?

可以。联系我们,告诉我们模型名称和提供商。我们会评估所有申请,并按需求优先级排期。

模型下线后会怎样?

我们会在下线前 30 天通知用户。你现有的代码不受影响,只需将模型参数更新为更新的版本即可。

模型如何计费?

文本模型按每百万输入和输出 token 计费;媒体模型按秒、按张或按分钟计费。每个模型页面和价格表上都列出了具体费率。

立即使用 249 个模型开始构建。