FR ▾
Obtenir une clé API

Guide de démarrage pour les utilisateurs de Grok NSFW

Connectez votre SDK OpenAI existant en quelques minutes à un endpoint LLM sans censure hébergé. Ce guide de démarrage vous accompagne dans l'authentification, les requêtes de base, le streaming et l'intégration des outils en utilisant le même code que vous connaissez déjà.

Authentification et URL de base

Notre API implémente le protocole compatible openai. Vous vous authentifiez en ajoutant votre clé API unique dans l'en-tête Authorization. L'URL de base pour toutes les requêtes est https://api.groknsfw.cc/v1. Contrairement aux fournisseurs standards, nous ne requérons pas d'ID d'organisation spécifique. Générez simplement votre clé via le tableau de bord ou la page d'inscription rapide. Conservez votre clé en sécurité ; elle donne un accès complet à votre crédit prépayé. Il n'y a pas de frais mensuels ni d'abonnements, uniquement une tarification au token sans expiration.

Chaque requête doit inclure l'identifiant du modèle uncensored. Ce modèle est un grand modèle de langage à poids ouverts hébergé sur notre infrastructure, distinct des autres fournisseurs. Il est optimisé pour fournir des réponses sans restriction pour le contenu adulte légal tout en maintenant une haute précision factuelle. Vous n'avez pas besoin de modifier la version de votre bibliothèque cliente ; les SDK OpenAI standards fonctionnent directement.

Complétion de chat basique

Envoyez une requête standard de complétion de chat pour générer du texte. L'endpoint accepte une liste de messages, incluant les rôles système, utilisateur et assistant. Cette structure vous permet de définir le contexte, les instructions et l'historique de la conversation. Le modèle renvoie une réponse textuelle basée sur le prompt fourni. Vous pouvez contrôler la créativité de la sortie à l'aide de paramètres comme temperature et top_p. Si aucun max_tokens n'est spécifié, la limite de sortie par défaut est de 2 048 tokens. Vous pouvez augmenter cela jusqu'à 32 000 tokens par requête, dans la limite de la fenêtre de contexte totale de 100 000 tokens.

Les erreurs sont renvoyées au format JSON standard. Les problèmes courants incluent des clés invalides ou un crédit insuffisant. L'API ne gère pas la tokenisation pour vous ; vous envoyez du texte, et le modèle le traite en interne. Vous recevez le texte final généré ou des flux partiels si activés.

Réponses en streaming

Le streaming est pris en charge via les Server-Sent Events (SSE). Utilisez le paramètre stream défini sur true dans votre requête. L'API renvoie une série de chunks à mesure que le modèle génère du texte. Cela est utile pour les mises à jour d'interface utilisateur en temps réel ou pour réduire la latence perçue. Chaque chunk contient des données partielles. Le dernier chunk inclut les statistiques d'utilisation des tokens pour la requête, vous permettant de suivre les coûts avec précision. Assurez-vous que votre bibliothèque cliente gère l'interruption du flux de manière gracieuse.

Appel de fonctions et outils

L'API prend en charge l'appel de fonctions, permettant au modèle de générer des données structurées au lieu de texte brut. Définissez vos outils dans le paramètre tools, en spécifiant le nom de la fonction, la description et le schéma des paramètres. Lorsque le modèle détermine qu'un appel d'outil est nécessaire, il renvoie le nom de la fonction et les arguments au format JSON. Votre application exécute ensuite la fonction et renvoie le résultat dans la conversation. Cela permet des workflows complexes, l'extraction de données et les actions automatisées. Définissez tool_choice pour contrôler si le modèle doit utiliser un outil ou peut choisir librement.

Mode JSON

Pour les applications nécessitant des formats de sortie stricts, utilisez le mode JSON. Définissez le paramètre response_format sur {"type": "json_object"}. Le modèle contraindra sa sortie à du JSON valide. C'est idéal pour analyser des données dans vos systèmes backend ou générer des configurations structurées. Notez que le mode JSON peut légèrement réduire la flexibilité de raisonnement du modèle par rapport au texte libre. Assurez-vous que votre prompt indique clairement au modèle de ne générer que du JSON. Cette fonctionnalité fonctionne avec l'appel de fonctions mais offre une interface plus simple lorsque vous avez besoin uniquement de données structurées sans définitions d'outils.

Utilisation des tokens et limites

Votre compte est limité à 300 requêtes par minute et 8 requêtes simultanées par clé. La taille maximale du corps de la requête est de 8 Mo. Si vous dépassez ces limites, l'API renvoie un code d'état 429. Les erreurs d'authentification renvoient 401, et un crédit insuffisant renvoie 402. Le prix est de 0,25 $ par million de tokens d'entrée et de 1,00 $ par million de tokens de sortie. Les erreurs et les refus ne consomment pas de crédit. La fenêtre de contexte est de 100 000 tokens au total, incluant à la fois le prompt et la complétion. Gérez votre utilisation de tokens avec soin pour éviter des coûts inattendus. Le crédit n'expire jamais, et vous pouvez le recharger à tout moment en utilisant des cryptomonnaies.

cURL

curl https://api.groknsfw.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.groknsfw.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.groknsfw.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Fiche technique de l'API

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
AuthentificationAuthorization: Bearer YOUR_KEY
ID du modèleuncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.groknsfw.cc/v1
Mode JSONresponse_format: {"type": "json_object"}
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Fenêtre de contexte100 000 tokens (entrée + sortie)
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Concurrence8 requêtes simultanées par clé
Limite de débit300 requêtes par minute et par clé
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Taillejusqu'à 8 Mo par requête
Bonus+5 % dès 50 $, +10 % dès 100 $
Validitéle crédit payé n'expire jamais, sans abonnement
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
ConnexionGoogle ou e-mail et mot de passe
Clésune clé active par compte ; une nouvelle remplace l'ancienne
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé

Codes d'erreur

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes

Questions et réponses

Ce service est-il un revendeur des modèles Grok ?

Non. Il s'agit d'une API indépendante. Nous hébergeons notre propre modèle à poids ouverts sans censure sur nos serveurs. Ce n'est pas un modèle GPT, Claude, Gemini, Grok ou d'un autre fournisseur. Il s'exécute sur notre infrastructure et est optimisé pour la génération de contenu sans restriction.

Comment recharger mon crédit ?

Nous acceptons uniquement USDT (TRC20) et USDC (Base). Vous pouvez recharger n'importe quel montant entier entre 10 $ et 500 $. Les crédits n'expirent pas. Il n'y a pas de frais mensuels ni d'abonnements. Les recharges à partir de 50 $ et 100 $ incluent un crédit bonus.

Quelle est la longueur maximale de sortie ?

La sortie maximale par requête est de 32 000 tokens. La fenêtre de contexte totale, incluant à la fois le prompt et la complétion, est de 100 000 tokens. Si vous ne définissez pas le paramètre <code>max_tokens</code>, la limite de sortie par défaut est de 2 048 tokens.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.

Obtenir une clé API