ES ▾
Obtener clave de API

Inicio rápido para usuarios de Grok NSFW

Conecta tu SDK de OpenAI existente en minutos a un endpoint de LLM sin censura alojado. Esta guía rápida te guía a través de la autenticación, peticiones básicas, streaming e integración de herramientas usando el mismo código que ya conoces.

Autenticación y URL base

Nuestra API implementa el protocolo compatible con openai. Te autenticas pasando tu clave de API única en el encabezado Authorization. La URL base para todas las peticiones es https://api.groknsfw.cc/v1. A diferencia de los proveedores estándar, no requerimos un ID de organización específico. Simplemente genera tu clave desde el panel o la página de registro rápido. Mantén tu clave segura; otorga acceso completo a tu crédito prepago. No hay cuotas ni suscripciones mensuales, solo precios por token sin caducidad.

Toda petición debe incluir el identificador del modelo uncensored. Este modelo es un modelo de lenguaje grande de pesos abiertos alojado en nuestra infraestructura, distinto de otros proveedores. Está ajustado para ofrecer respuestas sin restricciones para contenido adulto lícito manteniendo alta fidedignidad. No necesitas cambiar la versión de tu biblioteca cliente; los SDKs estándar de OpenAI funcionan de forma inmediata.

Completado de chat básico

Envía una petición estándar de finalización de chat para generar texto. El endpoint acepta una lista de mensajes, incluidos los roles system, user y assistant. Esta estructura te permite definir contexto, instrucciones e historial de conversación. El modelo devuelve una respuesta de texto basada en el prompt proporcionado. Puedes controlar la creatividad de la salida usando parámetros como temperature y top_p. Si no se especifica max_tokens, el límite de salida predeterminado es de 2,048 tokens. Puedes aumentar esto hasta 32,000 tokens por petición, dentro de la ventana de contexto total de 100,000 tokens.

Los errores se devuelven en formato JSON estándar. Los problemas comunes incluyen claves no válidas o crédito insuficiente. La API no realiza la tokenización por ti; envías texto y el modelo lo procesa internamente. Recibes el texto generado final o streaming parcial si está habilitado.

Respuestas en streaming

El streaming es compatible mediante Server-Sent Events (SSE). Usa el parámetro stream establecido en true en tu petición. La API devuelve una serie de fragmentos a medida que el modelo genera texto. Esto es útil para actualizaciones de interfaz de usuario en tiempo real o para reducir la latencia percibida. Cada fragmento contiene datos parciales. El último fragmento incluye las estadísticas de uso de tokens de la petición, lo que te permite rastrear los costos con precisión. Asegúrate de que tu biblioteca cliente maneje las interrupciones del streaming de forma adecuada.

Llamadas a funciones y herramientas

La API admite llamadas a funciones, lo que permite que el modelo genere datos estructurados en lugar de texto plano. Define tus herramientas en el parámetro tools, especificando el nombre de la función, la descripción y el esquema de parámetros. Cuando el modelo determina que es necesario un llamado a herramienta, devuelve el nombre de la función y los argumentos en formato JSON. Tu aplicación luego ejecuta la función y devuelve el resultado a la conversación. Esto permite flujos de trabajo complejos, extracción de datos y acciones automatizadas. Establece tool_choice para controlar si el modelo debe usar una herramienta o puede elegir libremente.

Modo JSON

Para aplicaciones que requieren formatos de salida estrictos, usa el modo JSON. Establece el parámetro response_format en {"type": "json_object"}. El modelo restringirá su salida a JSON válido. Esto es ideal para analizar datos en tus sistemas backend o generar configuraciones estructuradas. Ten en cuenta que el modo JSON puede reducir ligeramente la flexibilidad de razonamiento del modelo en comparación con el texto de formato libre. Asegúrate de que tu prompt instruya claramente al modelo para que genere solo JSON. Esta función funciona junto con las llamadas a funciones, pero proporciona una interfaz más simple cuando solo necesitas datos estructurados sin definiciones de herramientas.

Uso de tokens y límites

Tu cuenta está limitada a 300 peticiones por minuto y 8 peticiones simultáneas por clave. El tamaño máximo del cuerpo de la petición es de 8 MB. Si excedes estos límites, la API devuelve un código de estado 429. Los errores de autenticación devuelven 401 y el crédito insuficiente devuelve 402. El precio es de $0.25 por millón de tokens de entrada y $1.00 por millón de tokens de salida. Los errores y las denegaciones no consumen crédito. La ventana de contexto es de 100,000 tokens en total, incluyendo tanto prompt como respuesta. Gestiona tu uso de tokens cuidadosamente para evitar costos inesperados. El crédito nunca caduca y puedes recargar en cualquier momento usando criptomonedas.

cURL

curl https://api.groknsfw.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.groknsfw.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.groknsfw.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Ficha técnica de la API

Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
AutenticaciónAuthorization: Bearer YOUR_KEY
ID del modelouncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.groknsfw.cc/v1
Modo JSONresponse_format: {"type": "json_object"}
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Ventana de contexto100.000 tokens (entrada + salida)
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Concurrencia8 peticiones a la vez por clave
Límite de peticiones300 por minuto por clave
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Tamaño de peticiónhasta 8 MB
Bono+5 % desde $50, +10 % desde $100
Caducidadel crédito pagado no caduca, sin suscripción
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
AccesoGoogle o correo y contraseña
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores

Códigos de error

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas y respuestas

¿Es este servicio un revendedor de modelos Grok?

No. Esta es una API independiente. Alojamos nuestro propio modelo de pesos abiertos sin censura en nuestros servidores. No es GPT, Claude, Gemini, Grok ni ningún otro modelo de proveedor. Se ejecuta en nuestra infraestructura y está optimizado para la generación de contenido sin restricciones.

¿Cómo recargo mi crédito?

Solo aceptamos USDT (TRC20) y USDC (Base). Puedes recargar cualquier cantidad entera entre $10 y $500. Los créditos no caducan. No hay cuotas ni suscripciones mensuales. Las recargas de $50 y $100 incluyen crédito de bonificación.

¿Cuál es la longitud máxima de salida?

La salida máxima por petición es de 32,000 tokens. La ventana de contexto total, que incluye tanto el prompt como la completación, es de 100,000 tokens. Si no estableces el <code>max_tokens</code> parámetro, el límite de salida predeterminado es de 2,048 tokens.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.

Obtener clave de API