Guide de démarrage pour les utilisateurs de Grok NSFW
Connectez votre SDK OpenAI existant en quelques minutes à un endpoint LLM sans censure hébergé. Ce guide de démarrage vous accompagne dans l'authentification, les requêtes de base, le streaming et l'intégration des outils en utilisant le même code que vous connaissez déjà.
Authentification et URL de base
Notre API implémente le protocole compatible openai. Vous vous authentifiez en ajoutant votre clé API unique dans l'en-tête Authorization. L'URL de base pour toutes les requêtes est https://api.groknsfw.cc/v1. Contrairement aux fournisseurs standards, nous ne requérons pas d'ID d'organisation spécifique. Générez simplement votre clé via le tableau de bord ou la page d'inscription rapide. Conservez votre clé en sécurité ; elle donne un accès complet à votre crédit prépayé. Il n'y a pas de frais mensuels ni d'abonnements, uniquement une tarification au token sans expiration.
Chaque requête doit inclure l'identifiant du modèle uncensored. Ce modèle est un grand modèle de langage à poids ouverts hébergé sur notre infrastructure, distinct des autres fournisseurs. Il est optimisé pour fournir des réponses sans restriction pour le contenu adulte légal tout en maintenant une haute précision factuelle. Vous n'avez pas besoin de modifier la version de votre bibliothèque cliente ; les SDK OpenAI standards fonctionnent directement.
Complétion de chat basique
Envoyez une requête standard de complétion de chat pour générer du texte. L'endpoint accepte une liste de messages, incluant les rôles système, utilisateur et assistant. Cette structure vous permet de définir le contexte, les instructions et l'historique de la conversation. Le modèle renvoie une réponse textuelle basée sur le prompt fourni. Vous pouvez contrôler la créativité de la sortie à l'aide de paramètres comme temperature et top_p. Si aucun max_tokens n'est spécifié, la limite de sortie par défaut est de 2 048 tokens. Vous pouvez augmenter cela jusqu'à 32 000 tokens par requête, dans la limite de la fenêtre de contexte totale de 100 000 tokens.
Les erreurs sont renvoyées au format JSON standard. Les problèmes courants incluent des clés invalides ou un crédit insuffisant. L'API ne gère pas la tokenisation pour vous ; vous envoyez du texte, et le modèle le traite en interne. Vous recevez le texte final généré ou des flux partiels si activés.
Réponses en streaming
Le streaming est pris en charge via les Server-Sent Events (SSE). Utilisez le paramètrestream défini sur true dans votre requête. L'API renvoie une série de chunks à mesure que le modèle génère du texte. Cela est utile pour les mises à jour d'interface utilisateur en temps réel ou pour réduire la latence perçue. Chaque chunk contient des données partielles. Le dernier chunk inclut les statistiques d'utilisation des tokens pour la requête, vous permettant de suivre les coûts avec précision. Assurez-vous que votre bibliothèque cliente gère l'interruption du flux de manière gracieuse.
Appel de fonctions et outils
L'API prend en charge l'appel de fonctions, permettant au modèle de générer des données structurées au lieu de texte brut. Définissez vos outils dans le paramètre tools, en spécifiant le nom de la fonction, la description et le schéma des paramètres. Lorsque le modèle détermine qu'un appel d'outil est nécessaire, il renvoie le nom de la fonction et les arguments au format JSON. Votre application exécute ensuite la fonction et renvoie le résultat dans la conversation. Cela permet des workflows complexes, l'extraction de données et les actions automatisées. Définissez tool_choice pour contrôler si le modèle doit utiliser un outil ou peut choisir librement.
Mode JSON
Pour les applications nécessitant des formats de sortie stricts, utilisez le mode JSON. Définissez le paramètre response_format sur {"type": "json_object"}. Le modèle contraindra sa sortie à du JSON valide. C'est idéal pour analyser des données dans vos systèmes backend ou générer des configurations structurées. Notez que le mode JSON peut légèrement réduire la flexibilité de raisonnement du modèle par rapport au texte libre. Assurez-vous que votre prompt indique clairement au modèle de ne générer que du JSON. Cette fonctionnalité fonctionne avec l'appel de fonctions mais offre une interface plus simple lorsque vous avez besoin uniquement de données structurées sans définitions d'outils.
Utilisation des tokens et limites
Votre compte est limité à 300 requêtes par minute et 8 requêtes simultanées par clé. La taille maximale du corps de la requête est de 8 Mo. Si vous dépassez ces limites, l'API renvoie un code d'état 429. Les erreurs d'authentification renvoient 401, et un crédit insuffisant renvoie 402. Le prix est de 0,25 $ par million de tokens d'entrée et de 1,00 $ par million de tokens de sortie. Les erreurs et les refus ne consomment pas de crédit. La fenêtre de contexte est de 100 000 tokens au total, incluant à la fois le prompt et la complétion. Gérez votre utilisation de tokens avec soin pour éviter des coûts inattendus. Le crédit n'expire jamais, et vous pouvez le recharger à tout moment en utilisant des cryptomonnaies.
cURL
curl https://api.groknsfw.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.groknsfw.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.groknsfw.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Fiche technique de l'API
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Authentification | Authorization: Bearer YOUR_KEY |
| ID du modèle | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.groknsfw.cc/v1 |
| Mode JSON | response_format: {"type": "json_object"} |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Concurrence | 8 requêtes simultanées par clé |
| Limite de débit | 300 requêtes par minute et par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Taille | jusqu'à 8 Mo par requête |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Connexion | Google ou e-mail et mot de passe |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Ce service est-il un revendeur des modèles Grok ?
Non. Il s'agit d'une API indépendante. Nous hébergeons notre propre modèle à poids ouverts sans censure sur nos serveurs. Ce n'est pas un modèle GPT, Claude, Gemini, Grok ou d'un autre fournisseur. Il s'exécute sur notre infrastructure et est optimisé pour la génération de contenu sans restriction.
Comment recharger mon crédit ?
Nous acceptons uniquement USDT (TRC20) et USDC (Base). Vous pouvez recharger n'importe quel montant entier entre 10 $ et 500 $. Les crédits n'expirent pas. Il n'y a pas de frais mensuels ni d'abonnements. Les recharges à partir de 50 $ et 100 $ incluent un crédit bonus.
Quelle est la longueur maximale de sortie ?
La sortie maximale par requête est de 32 000 tokens. La fenêtre de contexte totale, incluant à la fois le prompt et la complétion, est de 100 000 tokens. Si vous ne définissez pas le paramètre <code>max_tokens</code>, la limite de sortie par défaut est de 2 048 tokens.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.