---
title: "Embedding API — varianti, prezzi e model skill"
url: "https://runapi.ai/it/models/embedding.md"
canonical: "https://runapi.ai/it/models/embedding.md"
locale: "it"
model: "Embedding"
provider: "OpenAI"
modality: "text"
variant_count: 3
price_from_cents: 1
---

# Embedding API

Embedding testuali OpenAI per ricerca semantica, recupero, clustering e ranking.

**Provider:** OpenAI
**Modality:** Text
**Catalog:** 3 variants

I modelli OpenAI Embedding convertono il testo in vettori densi per ricerca semantica, retrieval-augmented generation, clustering, classificazione e ranking. La famiglia text-embedding-3 supporta il recupero efficiente in produzione con controllo opzionale della dimensionalità dei vettori.

## Variants

| Version | Variant | Pricing | Billing | URL |
|---|---|---|---|---|
| text-embedding-3-large | `text-embedding-3-large` | $0.010 | 1K tokens | https://runapi.ai/it/models/embedding/text-embedding-3-large.md |
| text-embedding-3-small | `text-embedding-3-small` | $0.010 | 1K tokens | https://runapi.ai/it/models/embedding/text-embedding-3-small.md |
| text-embedding-ada-002 | `text-embedding-ada-002` | $0.010 | 1K tokens | https://runapi.ai/it/models/embedding/text-embedding-ada-002.md |


## API endpoints

Base URL: `https://runapi.ai`

- `POST /v1/embeddings`

Use the OpenAI or Anthropic SDK with your RunAPI API key. No extra SDK required.

## Context

I modelli OpenAI Embedding espongono l&#39;API standard OpenAI Embeddings tramite RunAPI, così le pipeline di vector search e RAG possono usare la stessa chiave RunAPI del traffico GPT chat e Responses.

## FAQ

### Da quale variante dovrei iniziare?

Scegli la variante più economica che soddisfa il tuo livello di qualità. La maggior parte dei team inizia con la variante veloce e passa alla pro per la produzione.

### C’è un piano gratuito?

I nuovi account ricevono le prime chiamate gratuite su ogni modello. Dopo, paghi per chiamata.

### Trasmettete i risultati in streaming?

Dove lo streaming è disponibile, RunAPI trasmette end-to-end.

### Come vengono addebitati i fallimenti?

Le generazioni non riuscite non vengono addebitate.

### Gli output vengono memorizzati nella cache?

Gli output generati vengono salvati e recuperabili tramite ID del task. Gli input non vengono memorizzati nella cache.

### Posso usarlo a fini commerciali?

Sì — l’uso commerciale è incluso per ogni variante, salvo che una licenza del modello lo limiti esplicitamente; in tal caso è indicato nella pagina della variante.

### E i limiti di rate limit?

I rate limit per chiave scalano in base al tier di utilizzo. Vedi la pagina prezzi per i limiti aggiornati.

### Dove posso segnalare problemi?

Apri un issue nel repo GitHub pubblico oppure scrivi al supporto.

