OpenAI · 텍스트

Hermes Agent x GPT

GPT는 다양한 비용-성능 트레이드오프를 위한 표준 및 mini 변형에 걸쳐 있는 OpenAI의 프론티어 LLM 패밀리입니다. RunAPI를 통해 모든 GPT 모델이 동일한 API 형태와 과금 방식을 공유합니다.

15 variants 최저 $0.06 / 100만 토큰 상업적 사용 지원

Prerequisite: npx runapi mcp install

Prompt

프롬프트 모델

작업에 맞는 경우 codex-auto-review를 사용하세요: codex-auto-review.

You have access to RunAPI chat models for GPT.

Available GPT models:
- codex-auto-review: codex-auto-review
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-4o-mini: 일상적인 텍스트 작업에 적합한 빠르고 경제적인 GPT-4o 모델
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-5-pro: Responses API를 통한 분석과 코딩을 위한 GPT-5 Pro
  chat endpoints: /v1/responses
- gpt-5.2: 전문 지식 업무; 심화 작업을 위한 사고 모드
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-5.4: 최고의 코딩 + 에이전트 워크플로우; 업계 최고 코드 벤치마크
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-5.4-mini: gpt-5.4의 비용 효율적인 대안; 무료 티어 사용 가능
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-5.4-nano: gpt-5.4-nano
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-5.5: 장기 에이전트 작업 전용; 최고의 오류 복구
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-5.6-luna: 요약, 초안, 일상 자동화를 위한 가장 빠르고 가벼운 GPT-5.6 티어
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-5.6-sol: 가장 어려운 작업을 위한 플래그십; 복잡한 코딩, 심층 리서치, 장기 에이전트
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-5.6-terra: 대량 작업을 위한 균형잡힌 주력 모델; 플래그십에 가까운 품질, 비용 효율적
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-6-astra: 최고 성능 모델: 최첨단 추론, 100만 컨텍스트, 코드 생성, 에이전트 작업
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-6-luna: 가장 빠르고 가벼운 GPT-6 모델: 100만 컨텍스트로 요약, 초안, 일상 자동화
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-6-sol: 비용 효율적인 GPT-6 모델: 강력한 추론, 100만 컨텍스트, 코딩, 에이전트 작업
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-6.1-sol: 비용 효율적인 GPT-6 모델: 강력한 추론, 100만 컨텍스트, 코딩, 에이전트 작업
  chat endpoints: /v1/chat/completions, /v1/responses

Use the model ID and chat endpoint that match the user's request.
Example request: 이 분기별 수익 데이터를 분석하고 주요 트렌드, 이상 현상, 세 가지 권고 사항이 포함된 요약을 작성해 주세요.
Verify the active model with: hermes model;hermes doctor

공개 버전 및 엔드포인트

모델 ID 엔드포인트 시작 가격 모델 카탈로그
codex-auto-review
/v1/chat/completions /v1/responses
$0.20 / 100만 토큰 모델 상세
gpt-4o-mini
/v1/chat/completions /v1/responses
$0.15 / 100만 토큰 모델 상세
gpt-5-pro
/v1/responses
$7.50 / 100만 토큰 모델 상세
gpt-5.2
/v1/responses /v1/chat/completions
$1.75 / 100만 토큰 모델 상세
gpt-5.4
/v1/responses /v1/chat/completions
$2.50 / 100만 토큰 모델 상세
gpt-5.4-mini
/v1/chat/completions /v1/responses
$0.75 / 100만 토큰 모델 상세
gpt-5.4-nano
/v1/responses /v1/chat/completions
$0.20 / 100만 토큰 모델 상세
gpt-5.5
/v1/chat/completions /v1/responses
$5.00 / 100만 토큰 모델 상세
gpt-5.6-luna
/v1/responses /v1/chat/completions
$0.20 / 100만 토큰 모델 상세
gpt-5.6-sol
/v1/chat/completions /v1/responses
$5.00 / 100만 토큰 모델 상세
gpt-5.6-terra
/v1/responses /v1/chat/completions
$2.00 / 100만 토큰 모델 상세
gpt-6-astra
/v1/chat/completions /v1/responses
$5.00 / 100만 토큰 모델 상세
gpt-6-luna
/v1/chat/completions /v1/responses
$0.06 / 100만 토큰 모델 상세
gpt-6-sol
/v1/chat/completions /v1/responses
$1.20 / 100만 토큰 모델 상세
gpt-6.1-sol
/v1/chat/completions /v1/responses
$1.00 / 100만 토큰 모델 상세

검증

Task가 최종 상태에 도달할 때까지 폴링합니다

<model-id>를 선택하면 검증 명령을 생성합니다.

설정

가이드 엔드포인트: <endpoint>

<model-id>를 선택하면 엔드포인트의 공개 입력 계약에 맞는 요청을 생성합니다.
사용 절차

3단계로 시작하기

  1. 모델 ID 선택

    공개 모델 ID를 선택하고 엔드포인트와 현재 시작 가격을 확인합니다.

  2. RunAPI 설정

    이 Agent의 Provider 설정을 추가합니다.

  3. 결과 검증

    아래 Agent 상태 및 모델 선택 명령을 실행합니다.

Hermes Agent + GPT로 만들 수 있는 것

  • 복잡한 추론과 다단계 작업

    Hermes Agent를 통해 GPT로 복잡한 추론, 리팩터링, 다단계 자동화 워크플로를 처리합니다.

  • 구조화된 출력을 이용한 일괄 처리

    스키마에 맞춘 JSON으로 대량의 문서를 처리해 RAG 파이프라인, 청구서 분석, 콘텐츠 분류에 활용합니다.

  • 작업 난이도에 따른 모델 라우팅

    간단한 요청은 작은 GPT 버전으로, 어려운 추론은 큰 버전으로 보내며, 모두 같은 RunAPI 공급자와 키로 처리합니다.

GPT을(를) RunAPI + Hermes Agent로 사용하는 이유

  • 15개 변형 모델, 하나의 API 키

    하나의 RunAPI 연결에서 사용 가능한 모델 변형을 선택할 수 있어 통합 방식을 바꿀 필요가 없습니다.

  • 명확한 사용 요금

    요청을 보내기 전에 현재 카탈로그 요금을 확인하세요. 구독이나 최소 사용 금액이 없습니다.

  • 즉시 응답

    동기 호출은 같은 응답 안에 결과를 반환하므로 에이전트가 작업 상태를 폴링하지 않고 바로 결과를 사용할 수 있습니다.

Hermes Agent + GPT 자주 묻는 질문

RunAPI로 Hermes Agent에서 GPT를 사용할 수 있나요?

네. Hermes Agent는 OpenAI 호환 사용자 지정 공급자를 지원합니다. 이 페이지에 표시된 설정으로 RunAPI를 추가하고 버전 목록의 GPT 버전을 모델로 지정하세요.

Hermes Agent에서 RunAPI로 Responses API를 사용할 수 있나요?

RunAPI는 GPT에 대해 Chat Completions API와 Responses API를 모두 지원합니다. Hermes Agent는 같은 API 키로 둘 중 어느 것이든 사용할 수 있습니다.

Hermes Agent가 요청마다 GPT 버전을 바꿀 수 있나요?

네. model 필드만 바꾸면 됩니다. 공급자, base URL, API 키는 그대로입니다.

어떤 모델 ID를 사용해야 하나요?

버전 표에서 공개 모델 ID를 선택하세요. 각 ID가 제공하는 엔드포인트는 해당 행에 표시됩니다.

이 가이드는 채팅 모델을 설정하나요?

예. 이 Model Line은 클라이언트용 LLM 프로토콜을 지원합니다.

Hermes Agent에서 GPT 사용 시작하기

팀과 함께 구축하고 계신가요?

엔터프라이즈 설정, 통합, 기술 문의를 도와드립니다.

문의하기