公開版本與端點
驗證
輪詢,直到 Task 進入終態
選擇 <model-id> 後產生驗證命令。
設定
指南端點: <endpoint>
選擇 <model-id> 後,依端點的公開輸入契約產生請求。
三步開始使用
-
選擇模型 ID
選擇公開模型 ID,並查看其端點與目前起始價格。
-
設定 RunAPI
呼叫端點前設定 RUNAPI_API_KEY。
-
驗證結果
對非同步端點輪詢同一路徑,直到 Task 進入終態。
使用 Hermes Agent + Embedding 可以建立甚麼
-
供程式使用的結構化結果
取得機器可讀的輸出而非聊天文字,讓應用程式可以直接儲存、比較或據此執行操作。
-
處理你自己的資料
將文件、圖片或記錄交給模型處理,並把結果與來源資料一併保存,供後續步驟使用。
-
大批量處理
使用同一個 RunAPI 金鑰批量提交輸入,並透過程式收集結果。
為甚麼透過 RunAPI + Hermes Agent 使用 Embedding
-
3 個變體,一個 API 金鑰
透過一個 RunAPI 連線選擇可用的模型變體,無需更改現有整合。
-
清晰的用量價格
發送請求前查看目錄中的目前價格,無需訂閱或最低消費。
-
直接返回結果
同步調用會在同一個回應中返回結果,Agent 無需輪詢任務即可直接使用。
Hermes Agent + Embedding 常見問題
我應該用邊個 embedding 模型?
高效率生產檢索請用 text-embedding-3-small;如果 recall 質素比向量大小更重要,請用 text-embedding-3-large。
可以縮短 embedding 向量嗎?
可以,當你需要較細向量時,對 text-embedding-3-large 或 text-embedding-3-small 傳入 dimensions 參數。
endpoint 會回傳標準 OpenAI response shape 嗎?
會,/v1/embeddings 會回傳與 OpenAI 相容嘅 list response,包含 embedding data、model 同 usage。
embedding 模型可以配合 Chat Completions 或 Responses 使用嗎?
唔可以,embedding 模型只可用喺 /v1/embeddings。
支援邊啲輸入?
按 OpenAI Embeddings API 格式,可以使用字串、字串陣列或者 token 陣列。
應該使用哪個模型 ID?
從版本表選擇公開模型 ID。每個 ID 可用的端點均列於相應資料列。
本指南會設定聊天模型嗎?
不會。此 Model Line 使用頁面所示的端點流程,不會被描述為 Agent 聊天模型。