OpenAI · Text

Hermes Agent x Embedding

I modelli OpenAI Embedding espongono l'API standard OpenAI Embeddings tramite RunAPI, così le pipeline di vector search e RAG possono usare la stessa chiave RunAPI del traffico GPT chat e Responses.

Versioni ed endpoint pubblici

ID modelloVersioneEndpointPrezzo inizialeCatalogo
text-embedding-3-largeVettori testuali ad alta capacità per qualità di retrieval e ranking
/v1/embeddings
$0.0000Dettagli modello
text-embedding-3-smallVettori testuali efficienti per ricerca semantica in produzione
/v1/embeddings
$0.0000Dettagli modello
text-embedding-ada-002Embedding testuali ampiamente supportati per pipeline esistenti
/v1/embeddings
$0.0000Dettagli modello

Configurazione

Endpoint della guida: <endpoint>

Seleziona <model-id> per generare una richiesta con il contratto di input pubblico dell’endpoint.

Verifica

Seleziona <model-id> per generare i comandi di verifica.

Come funziona

  1. 1. Scegli un ID modello

    Seleziona un ID pubblico del catalogo e controlla il relativo endpoint e il prezzo iniziale corrente.

  2. 2. Configura RunAPI

    Imposta RUNAPI_API_KEY prima di inviare la richiesta all’endpoint.

  3. 3. Verifica il risultato

    Per gli endpoint asincroni, interroga lo stesso endpoint finché la Task non raggiunge uno stato finale.

Domande frequenti

Quale ID modello devo usare?

Scegli un ID pubblico dalla tabella delle versioni. Ogni ID espone gli endpoint mostrati nella sua riga.

Questa guida configura un modello di chat?

No. Questa linea di modelli usa il flusso dell’endpoint mostrato e non viene presentata come modello di chat dell’agente.