IT ▾

Uncensored Gemma: Guida all'integrazione per sviluppatori

Aggiornato

Uncensored Gemma si riferisce a un modello linguistico di grandi dimensioni open-weight ottimizzato per la generazione ad alta fedeltà con bassi tassi di rifiuto, accessibile tramite un'interfaccia standard di chat-completions. Questa guida spiega come integrare questa API solo testo nel tuo flusso di lavoro, trattandola come una sostituzione pronta all'uso per i client compatibili con OpenAI, comprendendo i limiti specifici sui token e le strutture di prezzo coinvolte.

Perché scegliere Uncensored Gemma?

Quando gli sviluppatori cercano un'esperienza di tipo gemma senza censura, spesso cercano un modello che eviti i filtri di sicurezza comuni nelle offerte commerciali. Questa API fornisce un singolo modello ad alta capacità sintonizzato per rispondere senza rifiuti di contenuti per uso adulto legale, ricerca sulla sicurezza o argomenti controversi. A differenza delle piattaforme che aggregano più fornitori, questo servizio si concentra su un singolo modello open-weight specifico, garantendo un comportamento coerente e una latenza prevedibile.

Il modello non rifiuta prompt creativi o analitici standard, rendendolo adatto alla generazione di stili di contenuto diversificati. Tuttavia, è importante notare che si tratta di un modello open-weight indipendente, non di Gemma di Google, né è correlato a Grok di xAI. Esegue su server dedicati e serve testo in entrata e testo in uscita, fornendo un ambiente pulito e prevedibile per gli sviluppatori che hanno bisogno dell'output grezzo del modello senza il sovraccarico del routing multi-modello.

Panoramica sulla compatibilità API

L'API è completamente compatibile con OpenAI, il che significa che puoi utilizzare gli SDK ufficiali di OpenAI o qualsiasi altro client che parli il protocollo OpenAI. Devi solo aggiornare l'base_url e fornire la tua chiave API. La struttura degli endpoint riflette l'interfaccia standard di completamento chat, rendendo la migrazione da altri provider banale.

  • Endpoint: Sono disponibili solo POST /v1/chat/completions e GET /v1/models.
  • Nessuna funzionalità extra: Non ci sono endpoint per embedding, generazione di immagini, elaborazione audio o affinamento.
  • URL di base: https://api.grokuncensored.cc/v1
  • ID modello: Usa uncensored come identificatore del modello.

Questa semplicità riduce la complessità di integrazione. Non è necessario gestire diversi schemi di risposta per funzionalità diverse. Il formato della risposta è coerente, restituendo il contenuto testuale e le statistiche di utilizzo dei token.

Configurazione dell'ambiente

L'integrazione inizia con l'ottenimento di una chiave API. Iscriviti tramite la pagina Ottieni chiave API utilizzando l'autenticazione Google o un'email e una password. La chiave viene visualizzata immediatamente e non è richiesto un numero di telefono. Questo processo è progettato per la velocità, permettendoti di iniziare i test entro minuti.

Una volta ottenuta la tua chiave, configura le variabili di ambiente. Ad esempio, in Python:

Assicurati che il tuo URL di base punti a https://api.grokuncensored.cc/v1. Puoi anche sfruttare il credito di prova, che fornisce $0,50 validi per 7 giorni, senza bisogno di carta di credito. Questo ti permette di verificare la connettività e la qualità della risposta prima di impegnarti in una ricarica crypto.

Eseguire la prima richiesta

Con il tuo ambiente configurato, puoi inviare una richiesta. L'API accetta array di messaggi standard. Ecco un esempio di base usando cURL:

curl https://api.grokuncensored.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

La risposta conterrà il testo generato e l'utilizzo dei token. Se imposti max_tokens a un valore, l'API rispetterà quel limite. Se non imposti max_tokens, l'output massimo predefinito è di 2.048 token. Per output più lunghi, puoi aumentare questo valore fino a 32.000 token, purché il contesto totale (prompt + completamento) rimanga entro la finestra di 100.000 token.

Gestione delle risposte e dei token

Le risposte vengono restituite in formato JSON standard. L'utilizzo dei token è incluso nell'ultimo chunk di una risposta in streaming, permettendoti di tracciare i costi in tempo reale. Il prezzo è trasparente: $0,25 per 1M di token di input e $1,00 per 1M di token di output. Errori e rifiuti sono gratuiti, quindi puoi sperimentare senza preoccuparti di crediti sprecati.

Quando usi lo streaming, assicurati che il tuo client gestisca correttamente gli eventi inviati dal server (SSE). L'API restituisce chunk di testo e l'ultimo chunk contiene il campo usage. Questo permette una riconciliazione precisa della fatturazione. Nota che il credito è prepagato e gli errori non deducono dal tuo saldo. Questo modello non è un servizio di embedding, quindi non puoi usarlo per ricerche vettoriali direttamente; devi gestire l'embedding separatamente se necessario.

Parametri avanzati

L'API supporta diversi parametri per controllare la qualità della generazione. Puoi regolare temperature per la creatività, top_p per il campionamento del nucleo e seed per la riproducibilità. Altri parametri supportati includono stop, presence_penalty e frequency_penalty.

La chiamata di funzioni è supportata tramite i campi tools e tool_choice. Questo permette al modello di generare output strutturati che possono essere analizzati dalla tua applicazione. Inoltre, la modalità JSON è disponibile tramite response_format: {"type": "json_object"}, garantendo che l'output sia JSON valido. Questo è utile per costruire agenti o pipeline di dati strutturati. Il modello è un modello a pesi aperti, ottimizzato per la generazione di testo di alta qualità, rendendolo adatto per il follow-up complesso di istruzioni.

Gestione degli errori

Gli errori vengono restituiti con codici di stato HTTP standard. Gli errori comuni includono limiti di velocità (429) o chiavi API non valide (401). I limiti di velocità sono impostati a 300 richieste al minuto e 8 richieste concorrenti per chiave. Se superi questi limiti, implementa un backoff esponenziale nel tuo client.

Il corpo della richiesta è limitato a 8 MB. Se lo superi, la richiesta verrà rifiutata. Assicurati che i tuoi prompt rientrino in questi limiti. Essendo l'API solo testuale, non si verificheranno errori relativi all'elaborazione dei media. Per errori di fatturazione, come credito insufficiente, l'API restituirà un codice di stato 402. Il credito non scade mai, quindi puoi ricaricarlo quando preferisci. Errori come addebiti doppi possono essere risolti tramite la pagina Supporto, poiché il credito non viene rimborsato automaticamente.

Confronto con Grok senza censura

Sebbene spesso discusso insieme ad altri modelli senza censura come grok senza censura, questa API è un servizio indipendente. Non serve Gemma di Google, né è l'API ufficiale Grok di xAI. Il termine gemma senza censura nei risultati di ricerca si riferisce spesso al comportamento del modello open-weight, che questa API emula strettamente. Tuttavia, l'ID del modello è semplicemente uncensored e non è legato all'architettura di Google.

A differenza dell'API ufficiale Grok, che potrebbe avere prezzi e limiti diversi, questa API offre un tariffa fissa di $0,25/$1,00 per milione di token. Supporta inoltre esclusivamente pagamenti in criptovalute, senza bisogno di carta di credito per la prova. Questo la rende un'alternativa flessibile per gli sviluppatori che preferiscono le criptovalute o vogliono evitare vincoli di abbonamento. Il modello non è un rivenditore di Grok; è un modello a pesi aperti distinto.

Conclusione

Questa API offre un'interfaccia robusta e pensata per gli sviluppatori per un modello open-weight senza censura. Seguendo il protocollo compatibile con OpenAI, si integra senza problemi nei flussi di lavoro esistenti. I prezzi sono trasparenti e i limiti sono generosi per la maggior parte dei casi d'uso. Che tu stia costruendo un chatbot, un agente o uno strumento di generazione di contenuti, questa API offre un'alternativa affidabile e senza censura. Ricorda che è un'API solo testuale, quindi pianifica la tua architettura di conseguenza. Per maggiori dettagli su prezzi e chiavi, visita le pagine corrispondenti sul sito.

Domande e risposte

Questa API è uguale a quella di Google Gemma?

No, questa API serve un modello open-weight indipendente. Non è Gemma di Google, né è legata all'architettura di Google. Il termine 'uncensored gemma' si riferisce spesso al comportamento del modello, ma l'ID del modello è semplicemente 'uncensored'.

Come pago per l'API?

I pagamenti sono accettati solo tramite criptovalute, specificamente USDT (TRC20) o USDC (Base). Puoi ricaricare con qualsiasi importo intero tra $10 e $500. Non ci sono opzioni con carta di credito o PayPal. È disponibile un credito di prova di $0,50 senza bisogno di carta.

Qual è il limite della finestra di contesto?

La finestra di contesto è di 100.000 token, che includono sia il prompt che il completamento. L'output massimo per richiesta è di 32.000 token, o 2.048 se non specifichi un valore per max_tokens.

L'API supporta la chiamata di funzioni?

Sì, l'API supporta la chiamata di funzioni tramite i parametri 'tools' e 'tool_choice'. Supporta anche la modalità JSON per output strutturati. Lo streaming è disponibile tramite SSE, con l'utilizzo dei token riportato nell'ultimo chunk.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.

Ottieni la chiave API