GPT-4o Image API
GPT-4o Image API 调用原生图像生成,在对话中直接生成和编辑图像。
curl -X POST https://runapi.ai/api/v1/gpt_4o_image/text_to_image \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-4o-image",
"prompt": "根据我们关于品牌重设计的对话,生成一张新首页 hero 区域的 mockup。"
}'
import { Gpt4oImageClient } from "@runapi.ai/gpt-4o-image";
const client = new Gpt4oImageClient();
const result = await client.textToImage.run({
model: "gpt-4o-image",
prompt: "根据我们关于品牌重设计的对话,生成一张新首页 hero 区域的 mockup。",
});
<?php
require __DIR__ . "/vendor/autoload.php";
use RunApi\Gpt4oImage\Gpt4oImageClient;
$client = new Gpt4oImageClient();
$result = $client->textToImage->run([
'model' => 'gpt-4o-image',
'prompt' => '根据我们关于品牌重设计的对话,生成一张新首页 hero 区域的 mockup。',
]);
require "runapi/gpt_4o_image"
client = RunApi::Gpt4oImage::Client.new
result = client.text_to_image.run(
model: "gpt-4o-image",
prompt: "根据我们关于品牌重设计的对话,生成一张新首页 hero 区域的 mockup。"
)
npx skills add runapi-ai/gpt-4o-image -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
GPT-4o Image 在 GPT-4o 对话中直接实现原生图像生成,将语言理解与视觉创作融合于单一模型。它能理解对话上下文,生成语境高度吻合的图像。
- 多变体覆盖不同速度/质量层级
- Model skill 包含文档、schema 和接入说明
- 适合面向应用的编码工作流
- 失败的生成不计费
定价
技术细节
| 模型 ID | gpt-4o-image |
| 提供方 | OpenAI |
| 模态 | image |
| 任务类型 | asynchronous |
| 计费单位 | call |
| API 端点 | /api/v1/gpt_4o_image/text_to_image |
| 商用许可 | 允许商用 |
| 收录状态 | 运行中 |
为应用开发安装 GPT-4o Image skill
把模型文档、schema、定价说明和接入步骤加载进代码工作区。
# Install the model skill for app development workflows
npx skills add runapi-ai/gpt-4o-image -g
Install the GPT-4o Image skill for this app: 1. Add runapi-ai/gpt-4o-image with the skills installer. 2. Load SKILL.md in this workspace. 3. Use its docs, schemas, pricing notes, and setup steps when adding model features. 4. Confirm the install path when done.
四步从 model skill 到首次结果
选择模型
根据输出类型、质量要求和延迟目标选择模型与变体。
配置
设置 RunAPI key,并在代码工作区安装对应 model skill。
调用
按 skill 里的说明,把模型能力接入到你的应用里。
接收
按 task ID 轮询、在支持时使用流式,或处理 webhook 回调。
GPT-4o Image API 是什么?
GPT-4o Image 将视觉创作原生集成到 GPT-4o 中,融合推理与生成。通过 RunAPI,与所有 OpenAI 模型共享 API 和计费。
为什么用 RunAPI 调用 GPT-4o Image API
一把认证,覆盖所有提供方
一把 RunAPI key 解锁整个模型目录。无需为每家提供方单独建账户。
统一的定价与账单
USD 按次定价,按月结算。失败的生成不计费。
Schema 优先的 SDK
Typed schema 和接入说明已打包进 model skill,让实现从正确契约开始。
常见问题
GPT-4o Image 与 GPT Image 有什么区别?
GPT-4o Image 在 GPT-4o 对话中原生生成图像,利用对话上下文指导图像内容。GPT Image 是独立的图像生成端点。
对话上下文有什么帮助?
模型会利用完整的对话历史来理解你的需求——你可以用自然语言描述修改内容,迭代优化图像。
单张图像中能处理多少个对象?
GPT-4o Image 可以在单个场景中处理多个不同对象,同时保持构图连贯性和对象身份。
我能编辑之前生成的图像吗?
可以——在对话中描述修改内容,模型会在保留场景其余部分的同时修改现有图像。
它适合迭代设计工作流吗?
适合——对话式界面让迭代变得自然:生成、审查、描述调整,再重新生成,无需重写完整提示词。
应该从哪个变体开始?
选满足质量要求的最便宜变体。多数团队从 fast 起步,生产时升级到 pro。
有免费额度吗?
新账户每个模型都有免费调用额度,之后按次计费。
支持流式吗?
模型支持流式时,RunAPI 端到端流式。
失败怎么计费?
失败的生成不计费。
输出会缓存吗?
输出按任务 ID 存储在 R2 供回取。输入不缓存。
可以商用吗?
可以——所有变体默认含商用许可,除非模型许可明确限制;有例外会在变体页面注明。
速率限制?
Key 级限流随使用层级伸缩。当前限制见定价页。
在哪里报问题?
在公共 GitHub 仓库提 issue 或邮件联系 support。
如果喜欢 GPT-4o Image API,也可以试试这些
立即体验 GPT-4o Image API。
- text_to_image