Google · 텍스트

Hermes Agent x Gemini

Gemini는 Flash(빠른) 및 Pro(프론티어 추론) 변형으로 제공되는 Google의 멀티모달 플래그십 LLM입니다. RunAPI를 통해 모든 Gemini 모델이 동일한 API 형태와 과금 방식을 공유합니다.

11 variants 최저 $0.10 / 100만 토큰 상업적 사용 지원

Prerequisite: npx runapi mcp install

Prompt

프롬프트 모델

작업에 맞는 경우 gemini-2.5-flash를 사용하세요: 속도/비용 최적화; 1M 컨텍스트; 이전 세대 기준.

You have access to RunAPI chat models for Gemini.

Available Gemini models:
- gemini-2.5-flash: 속도/비용 최적화; 1M 컨텍스트; 이전 세대 기준
  chat endpoints: /v1/chat/completions
- gemini-2.5-flash-lite: Gemini 2.5 Flash-Lite; 1M 컨텍스트, 사고 기본값 꺼짐; OpenAI 호환 Chat Completions
  chat endpoints: /v1/chat/completions
- gemini-2.5-pro: 2.5 세대 최고 추론; 1M 컨텍스트
  chat endpoints: /v1/chat/completions
- gemini-3-flash-preview: gemini-3-flash-preview
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3-flash-preview:streamGenerateContent
- gemini-3.1-flash-lite: Gemini 3.1 Flash-Lite; 1M 컨텍스트, 조절형 사고; OpenAI 호환 Chat Completions로 텍스트 요청
  chat endpoints: /v1/chat/completions
- gemini-3.1-pro-preview: gemini-3.1-pro-preview
  chat endpoints: /v1/chat/completions
- gemini-3.5-flash: 고용량 프로덕션 워크로드를 위한 빠른 멀티모달 스트리밍
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash:streamGenerateContent
- gemini-3.5-flash-lite: Chat Completions 또는 네이티브 콘텐츠 스트리밍으로 텍스트를 생성하는 경량 Gemini
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
- gemini-3.6-flash: 프로덕션 워크로드를 위한 빠른 멀티모달 채팅, 도구 및 스트리밍
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.6-flash:streamGenerateContent
- gemini-3.7-flash: 사용량 보고를 지원하는 빠른 스트리밍 채팅 및 네이티브 콘텐츠 출력
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.7-flash:streamGenerateContent
- gemini-3.8-flash: 함수 호출과 네이티브 콘텐츠 스트리밍을 지원하는 에이전트용 텍스트 채팅
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.8-flash:streamGenerateContent

Use the model ID and chat endpoint that match the user's request.
Example request: 이 코드베이스를 분석하고 이전/이후 예시와 함께 세 가지 성능 개선 방안을 제안해 주세요.
Verify the active model with: hermes model;hermes doctor

공개 버전 및 엔드포인트

모델 ID 엔드포인트 시작 가격 모델 카탈로그
gemini-2.5-flash
/v1/chat/completions
$0.30 / 100만 토큰 모델 상세
gemini-2.5-flash-lite
/v1/chat/completions
$0.10 / 100만 토큰 모델 상세
gemini-2.5-pro
/v1/chat/completions
$1.25 / 100만 토큰 모델 상세
gemini-3-flash-preview
/v1/chat/completions /v1beta/models/gemini-3-flash-preview:streamGenerateContent
$0.30 / 100만 토큰 모델 상세
gemini-3.1-flash-lite
/v1/chat/completions
$0.25 / 100만 토큰 모델 상세
gemini-3.1-pro-preview
/v1/chat/completions
$1.00 / 100만 토큰 모델 상세
gemini-3.5-flash
/v1/chat/completions /v1beta/models/gemini-3.5-flash:streamGenerateContent
$0.90 / 100만 토큰 모델 상세
gemini-3.5-flash-lite
/v1/chat/completions /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
$0.15 / 100만 토큰 모델 상세
gemini-3.6-flash
/v1/chat/completions /v1beta/models/gemini-3.6-flash:streamGenerateContent
$0.75 / 100만 토큰 모델 상세
gemini-3.7-flash
/v1/chat/completions /v1beta/models/gemini-3.7-flash:streamGenerateContent
$0.45 / 100만 토큰 모델 상세
gemini-3.8-flash
/v1/chat/completions /v1beta/models/gemini-3.8-flash:streamGenerateContent
$0.45 / 100만 토큰 모델 상세

검증

Task가 최종 상태에 도달할 때까지 폴링합니다

<model-id>를 선택하면 검증 명령을 생성합니다.

설정

가이드 엔드포인트: <endpoint>

<model-id>를 선택하면 엔드포인트의 공개 입력 계약에 맞는 요청을 생성합니다.
사용 절차

3단계로 시작하기

  1. 모델 ID 선택

    공개 모델 ID를 선택하고 엔드포인트와 현재 시작 가격을 확인합니다.

  2. RunAPI 설정

    이 Agent의 Provider 설정을 추가합니다.

  3. 결과 검증

    아래 Agent 상태 및 모델 선택 명령을 실행합니다.

Hermes Agent + Gemini로 만들 수 있는 것

  • 멀티모달 에이전트

    Gemini의 멀티모달 입력을 활용해 텍스트, 이미지, 오디오, 영상을 함께 추론하는 Hermes Agent 워크플로를 구축합니다.

  • 긴 문서 분석

    대규모 코드베이스, 계약서, 연구 자료를 한 번의 요청으로 Gemini에 전달하고, 같은 자료에 대해 Hermes Agent가 후속 질문을 하도록 합니다.

  • 비용 효율적인 도구 호출 체인

    에이전트가 여러 번 연속으로 호출하는 도구 루프에서 빠르고 저렴한 Gemini의 Flash 버전을 실행합니다.

Gemini을(를) RunAPI + Hermes Agent로 사용하는 이유

  • 11개 변형 모델, 하나의 API 키

    하나의 RunAPI 연결에서 사용 가능한 모델 변형을 선택할 수 있어 통합 방식을 바꿀 필요가 없습니다.

  • 명확한 사용 요금

    요청을 보내기 전에 현재 카탈로그 요금을 확인하세요. 구독이나 최소 사용 금액이 없습니다.

  • 즉시 응답

    동기 호출은 같은 응답 안에 결과를 반환하므로 에이전트가 작업 상태를 폴링하지 않고 바로 결과를 사용할 수 있습니다.

Hermes Agent + Gemini 자주 묻는 질문

Google Cloud 자격 증명 없이 Hermes Agent에서 Gemini를 사용할 수 있나요?

네. RunAPI는 OpenAI 호환 엔드포인트로 Gemini를 제공합니다. RunAPI API 키로 Hermes Agent에서 RunAPI를 공급자로 설정하면 되며, Google Cloud 프로젝트나 Vertex AI 설정은 필요 없습니다.

컨텍스트 캐싱은 긴 문서에 어떻게 도움이 되나요?

같은 큰 컨텍스트를 여러 요청에서 보낼 때 캐싱을 쓰면 이후 호출의 입력 비용이 낮아집니다. 지시와 참고 자료가 반복되는 에이전트 루프에 도움이 됩니다.

Hermes Agent가 세션 도중에 Gemini와 다른 모델을 오갈 수 있나요?

네. RunAPI의 모든 언어 모델은 같은 공급자와 API 키를 공유하므로, 공급자 설정을 바꾸지 않고 세션 중에 모델을 전환할 수 있습니다.

어떤 모델 ID를 사용해야 하나요?

버전 표에서 공개 모델 ID를 선택하세요. 각 ID가 제공하는 엔드포인트는 해당 행에 표시됩니다.

이 가이드는 채팅 모델을 설정하나요?

예. 이 Model Line은 클라이언트용 LLM 프로토콜을 지원합니다.

Hermes Agent에서 Gemini 사용 시작하기

팀과 함께 구축하고 계신가요?

엔터프라이즈 설정, 통합, 기술 문의를 도와드립니다.

문의하기