OpenAI · Text
Hermes Agent x Embedding
I modelli OpenAI Embedding espongono l'API standard OpenAI Embeddings tramite RunAPI, così le pipeline di vector search e RAG possono usare la stessa chiave RunAPI del traffico GPT chat e Responses.
Versioni ed endpoint pubblici
| ID modello | Versione | Endpoint | Prezzo iniziale | Catalogo |
|---|---|---|---|---|
text-embedding-3-large | Vettori testuali ad alta capacità per qualità di retrieval e ranking | /v1/embeddings | $0.0000 | Dettagli modello |
text-embedding-3-small | Vettori testuali efficienti per ricerca semantica in produzione | /v1/embeddings | $0.0000 | Dettagli modello |
text-embedding-ada-002 | Embedding testuali ampiamente supportati per pipeline esistenti | /v1/embeddings | $0.0000 | Dettagli modello |
Configurazione
Endpoint della guida: <endpoint>
Seleziona <model-id> per generare una richiesta con il contratto di input pubblico dell’endpoint.Verifica
Seleziona <model-id> per generare i comandi di verifica.Come funziona
- 1. Scegli un ID modello
Seleziona un ID pubblico del catalogo e controlla il relativo endpoint e il prezzo iniziale corrente.
- 2. Configura RunAPI
Imposta RUNAPI_API_KEY prima di inviare la richiesta all’endpoint.
- 3. Verifica il risultato
Per gli endpoint asincroni, interroga lo stesso endpoint finché la Task non raggiunge uno stato finale.
Domande frequenti
Quale ID modello devo usare?
Scegli un ID pubblico dalla tabella delle versioni. Ogni ID espone gli endpoint mostrati nella sua riga.
Questa guida configura un modello di chat?
No. Questa linea di modelli usa il flusso dell’endpoint mostrato e non viene presentata come modello di chat dell’agente.