PT ▾
Obter chave de API

Início rápido para usuários do Grok NSFW

Conecte seu SDK OpenAI existente em minutos a um endpoint LLM sem censura hospedado. Este guia rápido orienta você pela autenticação, requisições básicas, streaming e integração de ferramentas usando o mesmo código que você já conhece.

Autenticação e URL Base

Nossa API implementa o protocolo compatível com openai. Você se autentica passando sua chave de API exclusiva no cabeçalho Authorization. A URL base para todas as requisições é https://api.groknsfw.cc/v1. Diferente dos provedores padrão, não exigimos um ID de organização específico. Basta gerar sua chave pelo painel ou na página de cadastro rápido. Mantenha sua chave segura; ela fornece acesso total ao seu crédito pré-pago. Não há taxas mensais nem assinaturas, apenas precificação por token sem expiração.

Toda requisição deve incluir o identificador do modelo uncensored. Este modelo é um LLM de pesos abertos hospedado em nossa infraestrutura, distinto de outros fornecedores. Ele é ajustado para fornecer respostas sem restrições para conteúdo adulto lícito, mantendo alta precisão factual. Você não precisa alterar a versão da biblioteca do cliente; SDKs padrão do OpenAI funcionam imediatamente.

Chat Completion Básico

Envie uma requisição padrão de conclusão de chat para gerar texto. O endpoint aceita uma lista de mensagens, incluindo papéis de sistema, usuário e assistente. Essa estrutura permite definir contexto, instruções e histórico de conversas. O modelo retorna uma resposta de texto com base no prompt fornecido. Você pode controlar a criatividade da saída usando parâmetros como temperature e top_p. Se nenhum max_tokens for especificado, o limite padrão de saída é de 2.048 tokens. Você pode aumentar isso para até 32.000 tokens por requisição, dentro da janela de contexto total de 100.000 tokens.

Erros são retornados em formato JSON padrão. Problemas comuns incluem chaves inválidas ou crédito insuficiente. A API não realiza tokenização para você; você envia texto e o modelo o processa internamente. Você recebe o texto final gerado ou fluxos parciais se habilitados.

Respostas em Streaming

O streaming é suportado via Server-Sent Events (SSE). Use o parâmetro stream definido como true em sua requisição. A API retorna uma série de blocos conforme o modelo gera texto. Isso é útil para atualizações de interface em tempo real ou para reduzir a latência percebida. Cada bloco contém dados parciais. O último bloco inclui as estatísticas de uso de tokens da requisição, permitindo que você rastreie os custos com precisão. Certifique-se de que sua biblioteca cliente lide com interrupções de stream de forma elegante.

Chamada de Funções e Ferramentas

A API suporta chamada de funções, permitindo que o modelo gere dados estruturados em vez de texto livre. Defina suas ferramentas no parâmetro tools, especificando o nome da função, descrição e esquema de parâmetros. Quando o modelo determina que uma chamada de ferramenta é necessária, ele retorna o nome da função e os argumentos em formato JSON. Seu aplicativo executa então a função e alimenta o resultado de volta na conversa. Isso permite fluxos de trabalho complexos, extração de dados e ações automatizadas. Defina tool_choice para controlar se o modelo deve usar uma ferramenta ou pode escolher livremente.

Modo JSON

Para aplicativos que exigem formatos de saída rigorosos, use o modo JSON. Defina o parâmetro response_format como {"type": "json_object"}. O modelo restringirá sua saída para JSON válido. Isso é ideal para analisar dados em seus sistemas de back-end ou gerar configurações estruturadas. Observe que o modo JSON pode reduzir ligeiramente a flexibilidade de raciocínio do modelo em comparação com texto livre. Certifique-se de que seu prompt instrua claramente o modelo a gerar apenas JSON. Este recurso funciona junto com a chamada de funções, mas fornece uma interface mais simples quando você precisa apenas de dados estruturados sem definições de ferramentas.

Uso de Tokens e Limites

Sua conta está limitada a 300 requisições por minuto e 8 requisições simultâneas por chave. O tamanho máximo do corpo da requisição é de 8 MB. Se você exceder esses limites, a API retornará o código de status 429. Erros de autenticação retornam 401 e crédito insuficiente retorna 402. O preço é $0,25 por milhão de tokens de entrada e $1,00 por milhão de tokens de saída. Erros e recusas não consomem crédito. A janela de contexto é de 100.000 tokens no total, incluindo prompt e conclusão. Gerencie o uso de tokens com cuidado para evitar custos inesperados. O crédito nunca expira e você pode recarregar a qualquer momento usando criptomoeda.

cURL

curl https://api.groknsfw.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.groknsfw.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.groknsfw.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Ficha técnica da API

Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
AutenticaçãoAuthorization: Bearer YOUR_KEY
ID do modelouncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.groknsfw.cc/v1
Modo JSONresponse_format: {"type": "json_object"}
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Janela de contexto100.000 tokens (entrada + saída)
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Concorrência8 requisições ao mesmo tempo por chave
Limite de taxa300 requisições por minuto por chave
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Tamanhoaté 8 MB por requisição
Bônus+5% a partir de $50, +10% a partir de $100
Validadecrédito pago não expira, sem assinatura
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
LoginGoogle ou e-mail e senha
Chavesuma chave ativa por conta; uma nova substitui a anterior
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado

Códigos de erro

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos

Perguntas e respostas

Este serviço é um revendedor dos modelos Grok?

Não. Esta é uma API independente. Hospedamos nosso próprio modelo de pesos abertos sem censura em nossos servidores. Não é GPT, Claude, Gemini, Grok ou qualquer outro modelo de fornecedor. Ele roda em nossa infraestrutura e é ajustado para geração de conteúdo irrestrito.

Como faço para recarregar meu crédito?

Aceitamos apenas USDT (TRC20) e USDC (Base). Você pode recarregar qualquer valor inteiro entre $10 e $500. Os créditos nunca expiram. Não há taxas mensais nem assinaturas. Recargas de $50 e $100 incluem crédito bônus.

Qual é o comprimento máximo de saída?

A saída máxima por requisição é de 32.000 tokens. A janela de contexto total, incluindo prompt e conclusão, é de 100.000 tokens. Se você não definir o <code>max_tokens</code> parâmetro, o limite padrão de saída é de 2.048 tokens.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.

Obter chave de API