Início rápido para usuários do Grok NSFW
Conecte seu SDK OpenAI existente em minutos a um endpoint LLM sem censura hospedado. Este guia rápido orienta você pela autenticação, requisições básicas, streaming e integração de ferramentas usando o mesmo código que você já conhece.
Autenticação e URL Base
Nossa API implementa o protocolo compatível com openai. Você se autentica passando sua chave de API exclusiva no cabeçalho Authorization. A URL base para todas as requisições é https://api.groknsfw.cc/v1. Diferente dos provedores padrão, não exigimos um ID de organização específico. Basta gerar sua chave pelo painel ou na página de cadastro rápido. Mantenha sua chave segura; ela fornece acesso total ao seu crédito pré-pago. Não há taxas mensais nem assinaturas, apenas precificação por token sem expiração.
Toda requisição deve incluir o identificador do modelo uncensored. Este modelo é um LLM de pesos abertos hospedado em nossa infraestrutura, distinto de outros fornecedores. Ele é ajustado para fornecer respostas sem restrições para conteúdo adulto lícito, mantendo alta precisão factual. Você não precisa alterar a versão da biblioteca do cliente; SDKs padrão do OpenAI funcionam imediatamente.
Chat Completion Básico
Envie uma requisição padrão de conclusão de chat para gerar texto. O endpoint aceita uma lista de mensagens, incluindo papéis de sistema, usuário e assistente. Essa estrutura permite definir contexto, instruções e histórico de conversas. O modelo retorna uma resposta de texto com base no prompt fornecido. Você pode controlar a criatividade da saída usando parâmetros como temperature e top_p. Se nenhum max_tokens for especificado, o limite padrão de saída é de 2.048 tokens. Você pode aumentar isso para até 32.000 tokens por requisição, dentro da janela de contexto total de 100.000 tokens.
Erros são retornados em formato JSON padrão. Problemas comuns incluem chaves inválidas ou crédito insuficiente. A API não realiza tokenização para você; você envia texto e o modelo o processa internamente. Você recebe o texto final gerado ou fluxos parciais se habilitados.
Respostas em Streaming
O streaming é suportado via Server-Sent Events (SSE). Use o parâmetrostream definido como true em sua requisição. A API retorna uma série de blocos conforme o modelo gera texto. Isso é útil para atualizações de interface em tempo real ou para reduzir a latência percebida. Cada bloco contém dados parciais. O último bloco inclui as estatísticas de uso de tokens da requisição, permitindo que você rastreie os custos com precisão. Certifique-se de que sua biblioteca cliente lide com interrupções de stream de forma elegante.
Chamada de Funções e Ferramentas
A API suporta chamada de funções, permitindo que o modelo gere dados estruturados em vez de texto livre. Defina suas ferramentas no parâmetro tools, especificando o nome da função, descrição e esquema de parâmetros. Quando o modelo determina que uma chamada de ferramenta é necessária, ele retorna o nome da função e os argumentos em formato JSON. Seu aplicativo executa então a função e alimenta o resultado de volta na conversa. Isso permite fluxos de trabalho complexos, extração de dados e ações automatizadas. Defina tool_choice para controlar se o modelo deve usar uma ferramenta ou pode escolher livremente.
Modo JSON
Para aplicativos que exigem formatos de saída rigorosos, use o modo JSON. Defina o parâmetro response_format como {"type": "json_object"}. O modelo restringirá sua saída para JSON válido. Isso é ideal para analisar dados em seus sistemas de back-end ou gerar configurações estruturadas. Observe que o modo JSON pode reduzir ligeiramente a flexibilidade de raciocínio do modelo em comparação com texto livre. Certifique-se de que seu prompt instrua claramente o modelo a gerar apenas JSON. Este recurso funciona junto com a chamada de funções, mas fornece uma interface mais simples quando você precisa apenas de dados estruturados sem definições de ferramentas.
Uso de Tokens e Limites
Sua conta está limitada a 300 requisições por minuto e 8 requisições simultâneas por chave. O tamanho máximo do corpo da requisição é de 8 MB. Se você exceder esses limites, a API retornará o código de status 429. Erros de autenticação retornam 401 e crédito insuficiente retorna 402. O preço é $0,25 por milhão de tokens de entrada e $1,00 por milhão de tokens de saída. Erros e recusas não consomem crédito. A janela de contexto é de 100.000 tokens no total, incluindo prompt e conclusão. Gerencie o uso de tokens com cuidado para evitar custos inesperados. O crédito nunca expira e você pode recarregar a qualquer momento usando criptomoeda.
cURL
curl https://api.groknsfw.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.groknsfw.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.groknsfw.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Ficha técnica da API
Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| Autenticação | Authorization: Bearer YOUR_KEY |
| ID do modelo | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.groknsfw.cc/v1 |
| Modo JSON | response_format: {"type": "json_object"} |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Limite de taxa | 300 requisições por minuto por chave |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Tamanho | até 8 MB por requisição |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Validade | crédito pago não expira, sem assinatura |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Login | Google ou e-mail e senha |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
Códigos de erro
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
Este serviço é um revendedor dos modelos Grok?
Não. Esta é uma API independente. Hospedamos nosso próprio modelo de pesos abertos sem censura em nossos servidores. Não é GPT, Claude, Gemini, Grok ou qualquer outro modelo de fornecedor. Ele roda em nossa infraestrutura e é ajustado para geração de conteúdo irrestrito.
Como faço para recarregar meu crédito?
Aceitamos apenas USDT (TRC20) e USDC (Base). Você pode recarregar qualquer valor inteiro entre $10 e $500. Os créditos nunca expiram. Não há taxas mensais nem assinaturas. Recargas de $50 e $100 incluem crédito bônus.
Qual é o comprimento máximo de saída?
A saída máxima por requisição é de 32.000 tokens. A janela de contexto total, incluindo prompt e conclusão, é de 100.000 tokens. Se você não definir o <code>max_tokens</code> parâmetro, o limite padrão de saída é de 2.048 tokens.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.