Schnellstart für Grok-Nutzer
Integriere das unzensierte Modell in Minuten, indem du deinen bestehenden OpenAI-Client auf unsere Basis-URL zeigst und deinen API-Schlüssel übergibst.
Basis-URL und Authentifizierung
Unsere API ist vollständig mit den OpenAI-SDKs kompatibel. Du musst nur die base_url aktualisieren und deinen Schlüssel im Authorization-Header angeben. Melde dich über Google oder E-Mail an, um deinen Schlüssel sofort zu erhalten. Keine Telefonnummer oder Kreditkarte ist zum Starten erforderlich. Verwende die Modell-ID uncensored für alle Anfragen.
Die Authentifizierung erfolgt über Bearer-Tokens. Stelle sicher, dass dein Schlüssel in jedem Anfrage-Header gesendet wird. Bei einem 401-Fehler ist dein Schlüssel ungültig oder abgelaufen. Unser Dienst ist unabhängig und verkauft keine Modelle anderer Anbieter.
Einfache Chat-Abschlüsse
Sende eine standard POST-Anfrage an /v1/chat/completions. Die API akzeptiert Texteingaben und gibt Textausgaben zurück. Du kannst System-Prompts definieren, um das Verhalten des Modells zu steuern. Das Modell antwortet ohne Ablehnungen für legale erwachsene Inhalte, Fiktion oder kontroverse Themen.
Gib das Modell als uncensored in deiner Payload an. Das Kontextfenster unterstützt bis zu 100.000 Token insgesamt. Maximaler Output sind 32.000 Token pro Anfrage. Fehler und Ablehnungen verbrauchen kein Guthaben.
Streaming-Antworten
Aktiviere Streaming, indem du stream: true setzt. Die API gibt Server-Sent Events (SSE) zurück. Jeder Chunk enthält inkrementale Textaktualisierungen. Der letzte Chunk enthält Token-Nutzungsstatistiken für Abrechnungstransparenz.
Streaming ist ideal für Echtzeit-UI-Aktualisierungen. Analysiere den SSE-Stream, um Text während der Generierung anzuzeigen. Dies reduziert die wahrgenommene Latenz für Nutzer. Die API behandelt das Streaming-Protokoll automatisch.
Function Calling
Definiere Tools im Parameter tools. Das Modell kann strukturierte Tool-Aufrufe zurückgeben. Verwende tool_choice, um spezifisches Verhalten zu erzwingen. Dies ermöglicht die Integration in externe Systeme und Workflows.
Function Calling funktioniert mit dem Standard-OpenAI-Format. Analysiere die Antwort, um die angeforderten Tools auszuführen. Das Modell behält den Kontext über Funktionsaufrufe hinweg. Dies ist nützlich für automatisierte Agenten und Datenerfassungsaufgaben.
JSON-Modus
Setze response_format auf {"type": "json_object"} für strikte JSON-Ausgabe. Das Modell formatiert seine Antwort als gültiges JSON. Dies ist nützlich zum Analysieren strukturierter Daten in Anwendungen.
Der JSON-Modus gewährleistet konsistente Formatierung. Nutze ihn, wenn dein nachgelageter Code spezifische Schema-Strukturen erwartet. Das Modell hält sich an das angeforderte Format. Dies reduziert den Bedarf an zusätzlicher Analyse-Logik.
Parameter, Limits und Fehler
Steuere die Generierung mit temperature, top_p und stop-Sequenzen. Das Ratenlimit beträgt 300 Anfragen pro Minute pro Schlüssel. Du kannst bis zu 8 parallele Anfragen haben. Request-Body darf 8 MB nicht überschreiten. Ein 402-Fehler zeigt unzureichendes Guthaben an. Ein 429-Fehler bedeutet, dass du das Ratenlimit erreicht hast. Guthaben ist Prepaid-Guthaben und verfällt nie. Fehler sind kostenlos.
cURL
curl https://api.grokuncensored.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.grokuncensored.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.grokuncensored.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Fragen und Antworten
Wie lade ich mein Guthaben auf?
Lade nur mit Krypto auf (USDT auf TRC20 oder USDC auf Base). Beträge reichen von $10 bis $500. Bei größeren Aufladungen wird Bonusguthaben hinzugefügt. Keine Kreditkarten oder PayPal.
Ist dies die offizielle Grok API?
Nein, wir sind ein unabhängiger Dienst. Wir hosten ein Open-Weight unzensiertes Modell auf unseren eigenen Servern. Es ist kein GPT, Claude oder ein Modell eines anderen Anbieters. Prüfe die Dokumentation des Anbieters für deren spezifische API-Details.
Was passiert, wenn ich einen Fehler mache?
Fehler und Ablehnungen sind kostenlos. Wenn du doppelt belastet wurdest, nutze die Support-Seite zur Behebung. Guthaben verfällt nie, also kannst du es nutzen, wann immer du bereit bist.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.
Funktionen und Limits
Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Modell-ID | uncensored |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Base-URL | https://api.grokuncensored.cc/v1 |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| JSON-Modus | response_format: {"type": "json_object"} |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Anfragegröße | bis 8 MB |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Anmeldung | Google oder E-Mail und Passwort |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |