PT ▾

Gemma Sem Censura: Guia de Integração para Desenvolvedores

Atualizado

Gemma sem censura refere-se a um modelo de linguagem grande de pesos abertos otimizado para geração de alta fidelidade e baixa recusa, acessível via interface padrão de chat-completions. Este guia explica como integrar esta API apenas de texto no seu fluxo de trabalho, tratando-a como uma substituição pronta para usar para clientes compatíveis com OpenAI, enquanto compreende os limites de tokens e estruturas de preços envolvidos.

Por que escolher o Gemma Sem Censura?

Quando desenvolvedores buscam uma experiência estilo gemma sem censura, eles geralmente procuram um modelo que evita os filtros de segurança comuns em ofertas comerciais. Esta API fornece um único modelo de alta capacidade ajustado para responder sem recusas de conteúdo para uso adulto legal, pesquisa de segurança ou tópicos controversos. Ao contrário de plataformas que agregam vários fornecedores, este serviço se concentra em um modelo de pesos abertos específico, garantindo comportamento consistente e latência previsível.

O modelo não recusa prompts criativos ou analíticos padrão, tornando-o adequado para gerar estilos de conteúdo diversos. No entanto, é importante notar que é um modelo de pesos abertos independente, não a Gemma do Google, nem está relacionado ao Grok da xAI. Ele é executado em servidores dedicados e serve texto de entrada e texto de saída, fornindo um ambiente limpo e previsível para desenvolvedores que precisam da saída bruta do modelo sem a sobrecarga do roteamento de múltiplos modelos.

Visão geral da compatibilidade da API

A API é totalmente compatível com OpenAI, o que significa que você pode usar os SDKs oficiais da OpenAI ou qualquer outro cliente que fale o protocolo OpenAI. Você só precisa atualizar o base_url e fornecer sua chave de API. A estrutura do endpoint espelha a interface padrão de conclusões de chat, tornando a migração de outros provedores trivial.

  • Endpoints: Apenas POST /v1/chat/completions e GET /v1/models estão disponíveis.
  • Sem recursos extras: Não há endpoints de embeddings, geração de imagens, processamento de áudio ou ajuste fino.
  • URL base: https://api.grokuncensored.cc/v1
  • ID do modelo: Use uncensored como identificador do modelo.

Essa simplicidade reduz a complexidade de integração. Você não precisa lidar com esquemas de resposta diferentes para recursos diferentes. O formato de resposta é consistente, retornando conteúdo de texto e estatísticas de uso de tokens.

Configurando seu ambiente

A integração começa obtendo uma chave de API. Cadastre-se na página Obter chave de API usando autenticação do Google ou e-mail e senha. A chave é exibida imediatamente e nenhum número de telefone é necessário. Este processo é projetado para velocidade, permitindo que você comece a testar em minutos.

Depois de obter sua chave, configure suas variáveis de ambiente. Por exemplo, em Python:

Certifique-se de que sua URL base aponte para https://api.grokuncensored.cc/v1. Você também pode aproveitar o crédito de teste, que fornece $0,50 válidos por 7 dias, sem necessidade de cartão de crédito. Isso permite que você verifique a conectividade e a qualidade da resposta antes de decidir recarregar com cripto.

Fazendo sua primeira requisição

Com seu ambiente configurado, você pode enviar uma requisição. A API aceita matrizes de mensagens padrão. Aqui está um exemplo básico usando cURL:

curl https://api.grokuncensored.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

A resposta conterá o texto gerado e o uso de tokens. Se você definir max_tokens para um valor, a API respeitará esse limite. Se você não definir max_tokens, a saída máxima padrão é de 2.048 tokens. Para saídas mais longas, você pode aumentar isso até 32.000 tokens, desde que o contexto total (prompt + conclusão) permaneça dentro da janela de 100.000 tokens.

Manipulando respostas e tokens

As respostas são retornadas em formato JSON padrão. O uso de tokens é incluído no último chunk de uma resposta de streaming, permitindo que você rastreie os custos em tempo real. O preço é transparente: $0,25 por 1M de tokens de entrada e $1,00 por 1M de tokens de saída. Erros e recusas são gratuitos, então você pode experimentar sem se preocupar com créditos desperdiçados.

Ao usar streaming, certifique-se de que seu cliente manipule Eventos Enviados pelo Servidor (SSE) corretamente. A API retorna chunks de texto, e o último chunk contém o campo usage. Isso permite uma conciliação de cobrança precisa. Observe que o crédito é pré-pago e erros não deduzem do seu saldo. Este modelo não é um serviço de embedding, então você não pode usá-lo para pesquisas de vetores diretamente; você deve lidar com o embedding separadamente se necessário.

Parâmetros avançados

A API suporta vários parâmetros para controlar a qualidade da geração. Você pode ajustar temperature para criatividade, top_p para amostragem de núcleo e seed para reprodutibilidade. Outros parâmetros suportados incluem stop, presence_penalty e frequency_penalty.

A chamada de funções é suportada via campos tools e tool_choice. Isso permite que o modelo gere saídas estruturadas que podem ser analisadas pelo seu aplicativo. Além disso, o modo JSON está disponível via response_format: {"type": "json_object"}, garantindo que a saída seja JSON válido. Isso é útil para construir agentes ou pipelines de dados estruturados. O modelo é um modelo de pesos abertos, ajustado para geração de texto de alta qualidade, tornando-o adequado para seguir instruções complexas.

Tratamento de erros

Os erros são retornados em códigos de status HTTP padrão. Erros comuns incluem limites de taxa (429) ou chaves de API inválidas (401). Os limites de taxa são definidos para 300 requisições por minuto e 8 requisições simultâneas por chave. Se você atingir esses limites, implemente backoff exponencial no seu cliente.

O corpo da requisição é limitado a 8 MB. Se você exceder isso, a requisição será rejeitada. Certifique-se de que seus prompts estejam dentro desses limites. Como a API é apenas de texto, erros relacionados ao processamento de mídia não ocorrerão. Para erros de cobrança, como crédito insuficiente, a API retornará um status 402. O crédito nunca expira, então você pode recarregar quando quiser. Erros como cobranças duplas podem ser resolvidos via página de Suporte, pois o crédito não é reembolsado automaticamente.

Comparação com o Grok Sem Censura

Embora frequentemente discutido junto com outros modelos sem censura como grok sem censura, esta API é um serviço independente. Não serve a Gemma do Google, nem é a API oficial do Grok da xAI. O termo gemma sem censura nos resultados de pesquisa geralmente se refere ao comportamento do modelo de pesos abertos, que esta API emula de perto. No entanto, o ID do modelo é simplesmente uncensored e não está ligado à arquitetura do Google.

Ao contrário da API oficial do Grok, que pode ter preços e limites diferentes, esta API oferece uma taxa fixa de $0,25/$1,00 por milhão de tokens. Também aceita pagamentos exclusivos em criptomoedas, sem necessidade de cartão de crédito para o teste. Isso a torna uma alternativa flexível para desenvolvedores que preferem criptomoedas ou querem evitar bloqueios por assinatura. O modelo não é um revendedor do Grok; é um modelo de pesos abertos distinto.

Conclusão

Esta API oferece uma interface robusta e feita para desenvolvedores para um modelo de pesos abertos sem censura. Ao seguir o protocolo compatível com OpenAI, ela se integra perfeitamente aos fluxos de trabalho existentes. Os preços são transparentes e os limites são generosos para a maioria dos casos de uso. Seja você estiver construindo um chatbot, um agente ou uma ferramenta de geração de conteúdo, esta API oferece uma alternativa confiável e sem censura. Lembre-se de que é uma API apenas de texto, então planeje sua arquitetura de acordo. Para mais detalhes sobre preços e chaves, visite as páginas respectivas no site.

Perguntas e respostas

Esta API é igual à Gemma do Google?

Não, esta API serve um modelo de pesos abertos independente. Não é a Gemma do Google, nem está ligada à arquitetura do Google. O termo 'gemma sem censura' geralmente se refere ao comportamento do modelo, mas o ID do modelo é simplesmente 'uncensored'.

Como pagar pela API?

Os pagamentos são aceitos apenas via cripto, especificamente USDT (TRC20) ou USDC (Base). Você pode recarregar com qualquer valor inteiro entre $10 e $500. Não há opções de cartão de crédito ou PayPal. Um crédito de teste de $0,50 está disponível sem necessidade de cartão.

Qual é o limite da janela de contexto?

A janela de contexto é de 100.000 tokens, o que inclui tanto o prompt quanto a conclusão. A saída máxima por requisição é de 32.000 tokens, ou 2.048 se você não especificar um valor para max_tokens.

A API suporta chamada de funções?

Sim, a API suporta chamada de funções por meio dos parâmetros 'tools' e 'tool_choice'. Ela também suporta modo JSON para saída estruturada. O streaming está disponível via SSE, com o uso de tokens relatado no último chunk.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a base URL. Essa é toda a configuração.

Obter chave de API