常見問題
關於相容性、模型、計費、資料處理與疑難排解的常見問題。
常見問題
一般
Inference 和直接用 OpenAI / Anthropic 有什麼差別? 差別在整合成本,而不是模型本身。你用一把金鑰、一個 base URL、一套程式碼,就能同時使用多家供應商的模型;帳單集中在一處,用量與成本在同一個 Dashboard 查得到;換模型只要改一個字串。
需要安裝專屬 SDK 嗎? 不需要。任何支援自訂 base URL 的 OpenAI 用戶端都能直接使用。見 SDK 與語言整合。
支援 OpenAI 的所有端點嗎?
目前提供 POST /v1/chat/completions 與 GET /v1/models。不支援的參數會被安全忽略,而不是回傳錯誤。
模型
有哪些模型可用?
呼叫 GET /v1/models,它回傳的是你這把金鑰目前可用的清單。
為什麼 gpt-4o 會 404?
模型 ID 需要供應商前綴,應該是 openai/gpt-4o。見 模型與命名規則。
可以限制某把金鑰只用特定模型嗎?
可以。在 Dashboard 為金鑰設定模型白名單,名單外的模型會回傳 403 model_not_allowed。
模型會被替換掉嗎? 不會。你指定哪個模型,我們就送到哪個模型;不會在背後偷換。備援請在應用層自行實作,見 模型。
計費
怎麼計價? 以每 1M tokens 計,input、cached input、output 三者分開,並已包含平台加成。見 計費方式。
餘額用完會怎樣?
API 回傳 402 insufficient_credit。到 Dashboard 儲值即可恢復,建議先開啟低餘額通知。
怎麼避免花超過預算?
為每把金鑰設定每月花費上限。達到上限後回傳 402 spend_limit_reached,次月自動重置。
失敗的請求會計費嗎? 在送到上游之前就被擋下的請求(401、402、403、404、429)不計費。若上游已開始生成才失敗,已產生的 token 會計費。
credits 會過期嗎? 不會。
功能
支援串流嗎?
支援。設定 stream: true 即可,格式是標準 SSE。見 串流。
支援 function calling 嗎? 支援,且是統一的 OpenAI 格式,可跨供應商使用。見 Tools。
支援圖片輸入嗎? 支援具備 vision 能力的模型。見 Vision。
支援 embeddings、影像生成、語音嗎? 目前不支援,我們專注在 chat completions。
資料與隱私
你們會保存我的 prompt 嗎? 我們保存計費與稽核所需的中繼資料(時間、模型、token 數、成本)。請求與回應內容不會被用於模型訓練。詳細條款請見隱私政策。
請求會送到哪裡?
送到你在 model 欄位指定的那家上游供應商。你的資料同時也適用該供應商的政策。
疑難排解
一直收到 401。
確認標頭是 Authorization: Bearer sk-inf-...,金鑰完整無多餘空白,且沒有被停用。用 curl -i https://api.alphacurve.io/v1/models 快速驗證。
收到 429。
超過此金鑰的速率限制。依 Retry-After 退避重試,並降低並發。見 速率限制。
收到 502 upstream_error。
上游供應商異常或逾時。可安全重試,或改用備援模型。
串流沒有逐字出現,而是一次全部出來。
通常是中間的代理在緩衝。curl 請加 --no-buffer;Nginx 請設 proxy_buffering off;;serverless 平台請使用 streaming / edge runtime。
回應被截斷。
檢查 finish_reason。若為 length,代表撞到 max_tokens,調高即可。
怎麼回報問題?
請提供回應中的 id、錯誤 code、發生時間與使用的模型。