FR ▾

Guide de démarrage pour les utilisateurs de Grok

Intégrez le modèle sans censure en quelques minutes en pointant votre client OpenAI existant vers notre URL de base et en fournissant votre clé API.

URL de base et authentification

Notre API est entièrement compatible avec les SDK OpenAI. Vous devez uniquement mettre à jour l'base_url et fournir votre clé dans l'en-tête Authorization. Inscrivez-vous via Google ou e-mail pour recevoir votre clé instantanément. Aucun numéro de téléphone ni carte bancaire n'est requis pour commencer. Utilisez l'ID de modèle uncensored pour toutes les requêtes.

L'authentification est gérée via des jetons Bearer. Assurez-vous que votre clé est envoyée dans chaque en-tête de requête. Si vous recevez une erreur 401, votre clé est invalide ou expirée. Notre service est indépendant et ne revend pas les modèles d'autres fournisseurs.

Complétion de chat basique

Envoyez une requête POST standard vers /v1/chat/completions. L'API accepte une entrée textuelle et retourne une sortie textuelle. Vous pouvez définir des prompts système pour guider le comportement du modèle. Le modèle répond sans refus pour le contenu adulte légal, la fiction ou les sujets controversés.

Spécifiez le modèle comme uncensored dans votre charge utile. La fenêtre de contexte prend en charge jusqu'à 100 000 tokens au total. La sortie maximale est de 32 000 tokens par requête. Les erreurs et les refus ne consomment pas de crédit.

Réponses en streaming

Activez le streaming en définissant stream: true. L'API retourne des événements envoyés par le serveur (SSE). Chaque chunk contient des mises à jour de texte incrémentales. Le dernier chunk inclut les statistiques d'utilisation des tokens pour la transparence de la facturation.

Le streaming est idéal pour les mises à jour d'interface utilisateur en temps réel. Analysez le flux SSE pour afficher le texte au fur et à mesure de sa génération. Cela réduit la latence perçue pour les utilisateurs. L'API gère automatiquement le protocole de streaming.

Appel de fonctions

Définissez des outils dans le paramètre tools. Le modèle peut retourner des appels d'outils structurés. Utilisez tool_choice pour forcer des comportements spécifiques. Cela permet l'intégration avec des systèmes et des flux de travail externes.

L'appel de fonctions fonctionne avec le format OpenAI standard. Analysez la réponse pour exécuter les outils demandés. Le modèle maintient le contexte entre les appels de fonctions. Cela est utile pour les agents automatisés et les tâches d'extraction de données.

Mode JSON

Définissez response_format sur {"type": "json_object"} pour une sortie JSON stricte. Le modèle formatera sa réponse sous forme de JSON valide. Cela est utile pour analyser des données structurées dans les applications.

Le mode JSON garantit un formatage cohérent. Utilisez-le lorsque votre code en aval attend des structures de schéma spécifiques. Le modèle respecte le format demandé. Cela réduit le besoin de logique d'analyse supplémentaire.

Paramètres, limites et erreurs

Contrôlez la génération avec temperature, top_p et les séquences stop. La limite de débit est de 300 requêtes par minute par clé. Vous pouvez avoir jusqu'à 8 requêtes simultanées. Les corps de requête ne doivent pas dépasser 8 Mo. Une erreur 402 indique un crédit insuffisant. Une erreur 429 signifie que vous avez atteint la limite de débit. Le crédit est prépayé et n'expire jamais. Les erreurs sont gratuites.

cURL

curl https://api.grokuncensored.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.grokuncensored.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.grokuncensored.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Fonctions et limites

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
ID du modèleuncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.grokuncensored.cc/v1
AuthentificationAuthorization: Bearer YOUR_KEY
Fenêtre de contexte100 000 tokens (entrée + sortie)
Mode JSONresponse_format: {"type": "json_object"}
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Concurrence8 requêtes simultanées par clé
Taillejusqu'à 8 Mo par requête
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Limite de débit300 requêtes par minute et par clé
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Validitéle crédit payé n'expire jamais, sans abonnement
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
Bonus+5 % dès 50 $, +10 % dès 100 $
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
Clésune clé active par compte ; une nouvelle remplace l'ancienne
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé
ConnexionGoogle ou e-mail et mot de passe

Codes d'erreur

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes

Questions et réponses

Comment recharger mon crédit ?

Rechargez uniquement en crypto (USDT sur TRC20 ou USDC sur Base). Les montants varient de 10 $ à 500 $. Un crédit bonus est ajouté pour les recharges plus importantes. Les cartes de crédit et PayPal ne sont pas acceptés.

S'agit-il de l'API officielle Grok ?

Non, nous sommes un service indépendant. Nous hébergeons un modèle à poids ouverts sans censure sur nos propres serveurs. Il ne s'agit pas de GPT, Claude ou du modèle d'un autre fournisseur. Consultez la documentation du fournisseur pour les détails spécifiques de leur API.

Que se passe-t-il en cas d'erreur ?

Les erreurs et les refus sont gratuits. Si vous êtes facturé deux fois, utilisez la page Support pour corriger le problème. Le crédit n'expire jamais, vous pouvez donc l'utiliser quand vous le souhaitez.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.

Obtenir une clé API