Inicio rápido para usuarios de Grok NSFW
Conecta tu SDK de OpenAI existente en minutos a un endpoint de LLM sin censura alojado. Esta guía rápida te guía a través de la autenticación, peticiones básicas, streaming e integración de herramientas usando el mismo código que ya conoces.
Autenticación y URL base
Nuestra API implementa el protocolo compatible con openai. Te autenticas pasando tu clave de API única en el encabezado Authorization. La URL base para todas las peticiones es https://api.groknsfw.cc/v1. A diferencia de los proveedores estándar, no requerimos un ID de organización específico. Simplemente genera tu clave desde el panel o la página de registro rápido. Mantén tu clave segura; otorga acceso completo a tu crédito prepago. No hay cuotas ni suscripciones mensuales, solo precios por token sin caducidad.
Toda petición debe incluir el identificador del modelo uncensored. Este modelo es un modelo de lenguaje grande de pesos abiertos alojado en nuestra infraestructura, distinto de otros proveedores. Está ajustado para ofrecer respuestas sin restricciones para contenido adulto lícito manteniendo alta fidedignidad. No necesitas cambiar la versión de tu biblioteca cliente; los SDKs estándar de OpenAI funcionan de forma inmediata.
Completado de chat básico
Envía una petición estándar de finalización de chat para generar texto. El endpoint acepta una lista de mensajes, incluidos los roles system, user y assistant. Esta estructura te permite definir contexto, instrucciones e historial de conversación. El modelo devuelve una respuesta de texto basada en el prompt proporcionado. Puedes controlar la creatividad de la salida usando parámetros como temperature y top_p. Si no se especifica max_tokens, el límite de salida predeterminado es de 2,048 tokens. Puedes aumentar esto hasta 32,000 tokens por petición, dentro de la ventana de contexto total de 100,000 tokens.
Los errores se devuelven en formato JSON estándar. Los problemas comunes incluyen claves no válidas o crédito insuficiente. La API no realiza la tokenización por ti; envías texto y el modelo lo procesa internamente. Recibes el texto generado final o streaming parcial si está habilitado.
Respuestas en streaming
El streaming es compatible mediante Server-Sent Events (SSE). Usa el parámetrostream establecido en true en tu petición. La API devuelve una serie de fragmentos a medida que el modelo genera texto. Esto es útil para actualizaciones de interfaz de usuario en tiempo real o para reducir la latencia percibida. Cada fragmento contiene datos parciales. El último fragmento incluye las estadísticas de uso de tokens de la petición, lo que te permite rastrear los costos con precisión. Asegúrate de que tu biblioteca cliente maneje las interrupciones del streaming de forma adecuada.
Llamadas a funciones y herramientas
La API admite llamadas a funciones, lo que permite que el modelo genere datos estructurados en lugar de texto plano. Define tus herramientas en el parámetro tools, especificando el nombre de la función, la descripción y el esquema de parámetros. Cuando el modelo determina que es necesario un llamado a herramienta, devuelve el nombre de la función y los argumentos en formato JSON. Tu aplicación luego ejecuta la función y devuelve el resultado a la conversación. Esto permite flujos de trabajo complejos, extracción de datos y acciones automatizadas. Establece tool_choice para controlar si el modelo debe usar una herramienta o puede elegir libremente.
Modo JSON
Para aplicaciones que requieren formatos de salida estrictos, usa el modo JSON. Establece el parámetro response_format en {"type": "json_object"}. El modelo restringirá su salida a JSON válido. Esto es ideal para analizar datos en tus sistemas backend o generar configuraciones estructuradas. Ten en cuenta que el modo JSON puede reducir ligeramente la flexibilidad de razonamiento del modelo en comparación con el texto de formato libre. Asegúrate de que tu prompt instruya claramente al modelo para que genere solo JSON. Esta función funciona junto con las llamadas a funciones, pero proporciona una interfaz más simple cuando solo necesitas datos estructurados sin definiciones de herramientas.
Uso de tokens y límites
Tu cuenta está limitada a 300 peticiones por minuto y 8 peticiones simultáneas por clave. El tamaño máximo del cuerpo de la petición es de 8 MB. Si excedes estos límites, la API devuelve un código de estado 429. Los errores de autenticación devuelven 401 y el crédito insuficiente devuelve 402. El precio es de $0.25 por millón de tokens de entrada y $1.00 por millón de tokens de salida. Los errores y las denegaciones no consumen crédito. La ventana de contexto es de 100,000 tokens en total, incluyendo tanto prompt como respuesta. Gestiona tu uso de tokens cuidadosamente para evitar costos inesperados. El crédito nunca caduca y puedes recargar en cualquier momento usando criptomonedas.
cURL
curl https://api.groknsfw.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.groknsfw.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.groknsfw.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Ficha técnica de la API
Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| Autenticación | Authorization: Bearer YOUR_KEY |
| ID del modelo | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.groknsfw.cc/v1 |
| Modo JSON | response_format: {"type": "json_object"} |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Concurrencia | 8 peticiones a la vez por clave |
| Límite de peticiones | 300 por minuto por clave |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Tamaño de petición | hasta 8 MB |
| Bono | +5 % desde $50, +10 % desde $100 |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Acceso | Google o correo y contraseña |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
Códigos de error
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿Es este servicio un revendedor de modelos Grok?
No. Esta es una API independiente. Alojamos nuestro propio modelo de pesos abiertos sin censura en nuestros servidores. No es GPT, Claude, Gemini, Grok ni ningún otro modelo de proveedor. Se ejecuta en nuestra infraestructura y está optimizado para la generación de contenido sin restricciones.
¿Cómo recargo mi crédito?
Solo aceptamos USDT (TRC20) y USDC (Base). Puedes recargar cualquier cantidad entera entre $10 y $500. Los créditos no caducan. No hay cuotas ni suscripciones mensuales. Las recargas de $50 y $100 incluyen crédito de bonificación.
¿Cuál es la longitud máxima de salida?
La salida máxima por petición es de 32,000 tokens. La ventana de contexto total, que incluye tanto el prompt como la completación, es de 100,000 tokens. Si no estableces el <code>max_tokens</code> parámetro, el límite de salida predeterminado es de 2,048 tokens.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.