DE ▾

Schnellstart für Grok-Nutzer

Integriere das unzensierte Modell in Minuten, indem du deinen bestehenden OpenAI-Client auf unsere Basis-URL zeigst und deinen API-Schlüssel übergibst.

Basis-URL und Authentifizierung

Unsere API ist vollständig mit den OpenAI-SDKs kompatibel. Du musst nur die base_url aktualisieren und deinen Schlüssel im Authorization-Header angeben. Melde dich über Google oder E-Mail an, um deinen Schlüssel sofort zu erhalten. Keine Telefonnummer oder Kreditkarte ist zum Starten erforderlich. Verwende die Modell-ID uncensored für alle Anfragen.

Die Authentifizierung erfolgt über Bearer-Tokens. Stelle sicher, dass dein Schlüssel in jedem Anfrage-Header gesendet wird. Bei einem 401-Fehler ist dein Schlüssel ungültig oder abgelaufen. Unser Dienst ist unabhängig und verkauft keine Modelle anderer Anbieter.

Einfache Chat-Abschlüsse

Sende eine standard POST-Anfrage an /v1/chat/completions. Die API akzeptiert Texteingaben und gibt Textausgaben zurück. Du kannst System-Prompts definieren, um das Verhalten des Modells zu steuern. Das Modell antwortet ohne Ablehnungen für legale erwachsene Inhalte, Fiktion oder kontroverse Themen.

Gib das Modell als uncensored in deiner Payload an. Das Kontextfenster unterstützt bis zu 100.000 Token insgesamt. Maximaler Output sind 32.000 Token pro Anfrage. Fehler und Ablehnungen verbrauchen kein Guthaben.

Streaming-Antworten

Aktiviere Streaming, indem du stream: true setzt. Die API gibt Server-Sent Events (SSE) zurück. Jeder Chunk enthält inkrementale Textaktualisierungen. Der letzte Chunk enthält Token-Nutzungsstatistiken für Abrechnungstransparenz.

Streaming ist ideal für Echtzeit-UI-Aktualisierungen. Analysiere den SSE-Stream, um Text während der Generierung anzuzeigen. Dies reduziert die wahrgenommene Latenz für Nutzer. Die API behandelt das Streaming-Protokoll automatisch.

Function Calling

Definiere Tools im Parameter tools. Das Modell kann strukturierte Tool-Aufrufe zurückgeben. Verwende tool_choice, um spezifisches Verhalten zu erzwingen. Dies ermöglicht die Integration in externe Systeme und Workflows.

Function Calling funktioniert mit dem Standard-OpenAI-Format. Analysiere die Antwort, um die angeforderten Tools auszuführen. Das Modell behält den Kontext über Funktionsaufrufe hinweg. Dies ist nützlich für automatisierte Agenten und Datenerfassungsaufgaben.

JSON-Modus

Setze response_format auf {"type": "json_object"} für strikte JSON-Ausgabe. Das Modell formatiert seine Antwort als gültiges JSON. Dies ist nützlich zum Analysieren strukturierter Daten in Anwendungen.

Der JSON-Modus gewährleistet konsistente Formatierung. Nutze ihn, wenn dein nachgelageter Code spezifische Schema-Strukturen erwartet. Das Modell hält sich an das angeforderte Format. Dies reduziert den Bedarf an zusätzlicher Analyse-Logik.

Parameter, Limits und Fehler

Steuere die Generierung mit temperature, top_p und stop-Sequenzen. Das Ratenlimit beträgt 300 Anfragen pro Minute pro Schlüssel. Du kannst bis zu 8 parallele Anfragen haben. Request-Body darf 8 MB nicht überschreiten. Ein 402-Fehler zeigt unzureichendes Guthaben an. Ein 429-Fehler bedeutet, dass du das Ratenlimit erreicht hast. Guthaben ist Prepaid-Guthaben und verfällt nie. Fehler sind kostenlos.

cURL

curl https://api.grokuncensored.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.grokuncensored.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.grokuncensored.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Fragen und Antworten

Wie lade ich mein Guthaben auf?

Lade nur mit Krypto auf (USDT auf TRC20 oder USDC auf Base). Beträge reichen von $10 bis $500. Bei größeren Aufladungen wird Bonusguthaben hinzugefügt. Keine Kreditkarten oder PayPal.

Ist dies die offizielle Grok API?

Nein, wir sind ein unabhängiger Dienst. Wir hosten ein Open-Weight unzensiertes Modell auf unseren eigenen Servern. Es ist kein GPT, Claude oder ein Modell eines anderen Anbieters. Prüfe die Dokumentation des Anbieters für deren spezifische API-Details.

Was passiert, wenn ich einen Fehler mache?

Fehler und Ablehnungen sind kostenlos. Wenn du doppelt belastet wurdest, nutze die Support-Seite zur Behebung. Guthaben verfällt nie, also kannst du es nutzen, wann immer du bereit bist.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhalten

Funktionen und Limits

Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
Modell-IDuncensored
EndpunktePOST /v1/chat/completions · GET /v1/models
Base-URLhttps://api.grokuncensored.cc/v1
AuthentifizierungAuthorization: Bearer YOUR_KEY
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
JSON-Modusresponse_format: {"type": "json_object"}
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Anfragegrößebis 8 MB
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Ratenlimit300 Anfragen pro Minute und Schlüssel
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Bonus+5 % ab $50, +10 % ab $100
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt
AnmeldungGoogle oder E-Mail und Passwort

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen