無審查 Gemma:開發者整合指南
更新於
Uncensored Gemma 指的是針對高保真度、低拒絕率生成進行優化的開放權重大語言模型,可透過標準聊天補全介面存取。本指南說明如何將此純文字 API 整合至您的工作流程,將其視為 OpenAI 相容客戶端的即插即用替代方案,同時了解相關的 token 限制與定價結構。
為何選擇無審查 Gemma?
當開發者尋求 無審查的 gemma 風格體驗時,他們通常希望找到一個能避免商業產品常見安全過濾器的模型。此 API 提供單一的高容量模型,針對合法成人用途、安全研究或爭議性主題進行調校,使其在回答時不會拒絕內容。與聚合多個廠商的平台不同,此服務專注於單一特定的開放權重模型,確保行為一致且延遲可預測。
該模型不會拒絕標準的創意或分析提示詞,使其適合生成多樣化的內容風格。然而,必須注意它是獨立的開放權重模型,並非 Google 的 Gemma,也與 xAI 的 Grok 無關。它在專用伺服器上運行,提供純文字輸入與輸出,為需要原始模型輸出且無需多模型路由開銷的開發者提供乾淨、可預測的環境。
API 相容性概覽
此 API 完全與 OpenAI 相容,意味著你可以使用官方的 OpenAI SDK 或任何支援 OpenAI 協定的其他客戶端。你只需更新 base_url 並提供你的 API 金鑰即可。端點結構與標準的聊天完成介面相同,因此從其他供應商遷移變得非常簡單。
- 端點: 僅提供
POST /v1/chat/completions與GET /v1/models。 - 無額外功能: 沒有嵌入、圖像生成、音訊處理或微調端點。
- 基礎 URL:
https://api.grokuncensored.cc/v1 - 模型 ID: 使用
uncensored作為模型識別符。
這種簡潔性降低了整合複雜度。你無需為不同功能處理不同的回應格式。回應格式一致,回傳文字內容與 token 用量統計。
設定您的環境
整合始於取得 API 金鑰。透過 取得 API 金鑰 頁面註冊,使用 Google 驗證或電子郵件與密碼。金鑰會立即顯示,且不需要電話號碼。此流程設計為快速,讓您在幾分鐘內即可開始測試。
取得金鑰後,請設定您的環境變數。例如,在 Python 中:
確保您的基礎 URL 指向 https://api.grokuncensored.cc/v1。您也可以利用免費試用額度,提供 $0.50 且有效期為 7 天,無需信用卡。這讓您在承諾加密儲值之前,可以驗證連線與回應品質。
發送您的第一個請求
環境設定完成後,您就可以發送請求。API 接受標準訊息陣列。以下是使用 cURL 的基本範例:
curl https://api.grokuncensored.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'回應將包含生成的文字與 token 用量。如果你將 max_tokens 設為一個值,API 將遵守該限制。若未設定 max_tokens,預設最大輸出為 2,048 tokens。對於更長的輸出,你可以將此數值提高至 32,000 tokens,前提是總上下文(提示詞 + 補全)保持在 100,000 token 視窗內。
處理回應與 Token
回應以標準 JSON 格式返回。token 用量包含在串流回應的最後一個區塊中,讓您可以即時追蹤成本。定價透明:每 1M 輸入 token $0.25 與 每 1M 輸出 token $1.00。錯誤與拒絕是免費的,因此您可以實驗而無需擔心浪費額度。
使用串流輸出時,請確保你的客戶端能正確處理 Server-Sent Events (SSE)。API 會回傳文字區塊,最後一個區塊包含 usage 欄位。這有助於精確的帳務對帳。請注意,額度為預付制,錯誤不會從你的餘額中扣款。此模型並非嵌入服務,因此無法直接用於向量搜尋;如有需要,你必須自行處理嵌入部分。
進階參數
API 支援多個參數以控制生成品質。你可以調整 temperature 以控制創意,top_p 用於核心採樣,以及 seed 以確保可重複性。其他支援的參數包括 stop、presence_penalty 和 frequency_penalty。
透過 tools 與 tool_choice 欄位支援函式呼叫。這允許模型生成結構化輸出,供你的應用程式解析。此外,可透過 response_format: {"type": "json_object"} 啟用 JSON 模式,確保輸出為有效的 JSON。這對於建構代理程式或結構化資料管線非常有用。此模型為開放權重模型,針對高品質文字生成進行調校,適合用於複雜的指令遵循。
錯誤處理
錯誤以標準 HTTP 狀態碼返回。常見錯誤包括速率限制 (429) 或無效的 API 金鑰 (401)。速率限制設為每分鐘 300 次請求與每個金鑰 8 個並行請求。如果您達到這些限制,請在客戶端中實作指數退避。
請求主體限制為 8 MB。如果您超過此限制,請求將被拒絕。確保您的提示詞在這些限制內。由於 API 僅限文字,因此不會發生與媒體處理相關的錯誤。對於帳單錯誤(例如額度不足),API 將返回 402 狀態。額度永不過期,因此您可以隨時儲值。錯誤如重複扣款可透過支援頁面解決,因為額度不會自動退還。
與 Grok 無審查比較
雖然常與其他無審查模型如 grok uncensored 一起討論,但此 API 是獨立服務。它不提供 Google 的 Gemma,也不是 xAI 的官方 Grok API。搜尋結果中的 無審查的 gemma 一詞通常指該開放權重模型的行為,此 API 緊密模擬了該行為。然而,模型 ID 僅為 uncensored,且與 Google 的架構無關。
與可能具有不同定價與限制的官方 Grok API 不同,此 API 提供每百萬 token $0.25/$1.00 的固定費率。它也僅支援加密貨幣付款,免費試用無需信用卡。這使其成為偏好加密貨幣或希望避免訂閱綁定的開發者的靈活替代方案。該模型不是 Grok 的轉售商;它是獨特的開放權重模型。
結論
此 API 為無審查開放權重模型提供了強大的開發者優先介面。透過堅持使用 OpenAI 相容協議,它可以無縫整合至現有工作流程。定價透明,且限制對於大多數使用情境來說相當寬鬆。無論您是在建構聊天機器人、代理程式還是內容生成工具,此 API 都提供可靠、無審查的替代方案。請記住這是純文字 API,因此請相應規劃您的架構。有關定價與金鑰的更多詳細資訊,請造訪網站上的相應頁面。