無検閲Gemma:開発者向け統合ガイド
更新日:
Uncensored Gemmaは、高忠実度・低拒否の生成に最適化されたオープンウェイト大規模言語モデルで、標準的なチャット完了インターフェースを通じてアクセスできます。このガイドでは、このテキスト専用APIをワークフローに統合する方法を説明します。OpenAI互換クライアントへのそのまま置き換え可能な代替として扱い、関連するトークン制限と価格体系を理解してください。
なぜ無検閲Gemmaなのか?
開発者がuncensored gemmaスタイルの体験を求めている場合、多くの場合、商用の提供物に一般的な安全性フィルターを回避するモデルを探しています。このAPIは、法的な成人向け利用、セキュリティ研究、または論争的なトピックに対してコンテンツ拒否なしで回答するよう調整された、単一の高性能モデルを提供します。複数のベンダーを統合するプラットフォームとは異なり、このサービスは1つの特定のオープンウェイトモデルに焦点を当て、一貫した動作と予測可能なレイテンシーを保証します。
このモデルは標準的なクリエイティブまたは分析的なプロンプトを拒否しないため、多様なコンテンツスタイルの生成に適しています。ただし、これはGoogleのGemmaではなく独立したオープンウェイトモデルであり、xAIのGrokとも関係がないことに注意してください。専用サーバーで実行され、テキスト入力とテキスト出力を提供し、マルチモデルルーティングのオーバーヘッドなしで生のモデル出力が必要な開発者のために、クリーンで予測可能な環境を提供します。
API互換性の概要
APIはOpenAIと完全に互換性があり、公式のOpenAI SDKやOpenAIプロトコルをサポートするその他のクライアントを使用できます。base_urlを更新し、APIキーを提供するだけです。エンドポイントの構造は標準的なチャット完了インターフェースを反映しており、他のプロバイダーからの移行は容易です。
- エンドポイント:
POST /v1/chat/completionsとGET /v1/modelsのみ利用可能です。 - 追加機能なし: エンベディング、画像生成、音声処理、ファインチューニングのエンドポイントはありません。
- ベースURL:
https://api.grokuncensored.cc/v1 - モデルID: モデル識別子として
uncensoredを使用してください。
このシンプルさは統合の複雑さを軽減します。異なる機能に対して異なるレスポンススキーマを処理する必要はありません。レスポンス形式は一定で、テキストコンテンツとトークン使用統計を返します。
環境設定
統合はAPIキーの取得から始まります。Google認証またはメールアドレスとパスワードを使用して、APIキーを取得ページからサインアップしてください。キーは直ちに表示され、電話番号は必要ありません。このプロセスは速度を重視しており、数分でテストを開始できます。
キーを取得したら、環境変数を構成してください。例えばPythonでは:
ベースURLが https://api.grokuncensored.cc/v1 を指していることを確認してください。また、クレジットカード不要で7日間有効な$0.50のトライアルクレジットを活用することもできます。これにより、暗号通貨でのチャージにコミットする前に、接続性とレスポンスの品質を確認できます。
最初のリクエストの実行
環境が設定されたら、リクエストを送信できます。APIは標準的なメッセージ配列を受け入れます。以下はcURLを使用した基本的な例です:
curl https://api.grokuncensored.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'レスポンスには生成テキストとトークン使用量が含まれます。max_tokensに値を設定した場合、APIはその制限を尊重します。max_tokensを設定しない場合、デフォルトの最大出力は2,048トークンです。より長い出力が必要な場合は、合計コンテキスト(プロンプト+生成テキスト)が100,000トークンのウィンドウ内に収まる限り、これを最大32,000トークンまで増やすことができます。
レスポンスとトークンの処理
レスポンスは標準的なJSON形式で返されます。トークン使用量はストリーミングレスポンスの最後のチャンクに含まれており、リアルタイムでコストを追跡できます。料金は透明です:入力トークン1Mあたり$0.25 および 出力トークン1Mあたり$1.00 です。エラーと拒否は無料なので、クレジットの無駄を気にせずに実験できます。
ストリーミングを使用する場合は、クライアントがServer-Sent Events(SSE)を正しく処理することを確認してください。APIはテキストのチャンクを返し、最後のチャンクには usage フィールドが含まれます。これにより、正確な請求の照合が可能です。クレジットは前払いであり、エラーは残高から差し引かれないことに注意してください。このモデルはエンベディングサービスではないため、ベクトル検索に直接使用することはできません。必要な場合はエンベディングを別途処理する必要があります。
高度なパラメータ
APIは生成品質を制御するためのいくつかのパラメータをサポートしています。創造性のために temperature を調整し、核サンプリングのために top_p を調整し、再現性のために seed を使用できます。その他のサポートされているパラメータには stop、presence_penalty、および frequency_penalty が含まれます。
関数呼び出しはtoolsおよびtool_choiceフィールドを介してサポートされています。これにより、モデルはアプリケーションで解析可能な構造化された出力を生成できます。さらに、JSONモードはresponse_format: {"type": "json_object"}で利用可能で、出力が有効なJSONであることを保証します。これはエージェントや構造化データパイプラインの構築に役立ちます。このモデルはオープンウェイトモデルであり、高品質なテキスト生成のためにチューニングされており、複雑な指示のフォローに適しています。
エラー処理
エラーは標準的なHTTPステータスコードで返されます。一般的なエラーにはレート制限(429)または無効なAPIキー(401)が含まれます。レート制限は1分あたり300リクエスト、キーあたり8つの同時リクエストに設定されています。これらの制限に達した場合は、クライアントで指数バックオフを実装してください。
リクエストボディは8 MBに制限されています。これを超えるとリクエストは拒否されます。プロンプトがこの範囲内にあることを確認してください。APIはテキストのみであるため、メディア処理に関連するエラーは発生しません。残高不足などの請求エラーの場合、APIは402ステータスを返します。クレジットは期限切れにならないため、都合に応じてチャージできます。二重請求などのミスは、クレジットが自動的に返金されないため、サポートページを通じて解決できます。
Grok無検閲との比較
Grok無検閲 などの他の無検閲モデルと共に議論されることが多いですが、このAPIは独立したサービスです。GoogleのGemmaを提供するものではなく、xAIの公式Grok APIでもありません。検索結果における 無検閲Gemma という用語は、オープンウェイトモデルの動作を指すことが多く、このAPIはそれを closely にエミュレートします。ただし、モデルIDは単に uncensored であり、Googleのアーキテクチャに依存していません。
異なる価格と制限を持つ可能性のある公式Grok APIとは異なり、このAPIは1Mトークンあたり$0.25/$1.00の均一な料金を提供します。また、トライアルにはクレジットカード不要で暗号通貨の支払いのみをサポートしており、サブスクリプションのロックインを避けたい開発者にとって柔軟な代替手段となります。このモデルはGrokのリセラーではなく、独自のオープンウェイトモデルです。
結論
このAPIは、無検閲オープンウェイトモデル向けの堅牢で開発者向けのインターフェースを提供します。OpenAI互換プロトコルに準拠しているため、既存のワークフローにシームレスに統合されます。料金は透明で、制限はほとんどのユースケースに対して寛大です。チャットボット、エージェント、またはコンテンツ生成ツールを構築している場合、このAPIは信頼性の高い無検閲の代替手段を提供します。これはテキストのみAPIであるため、アーキテクチャを適切に計画してください。価格やキーの詳細については、サイトの該当ページをご覧ください。