Schnellstart für Grok NSFW-Nutzer
Verbinde dein bestehendes OpenAI SDK in wenigen Minuten mit einem gehosteten, unzensierten LLM-Endpunkt. Dieser Schnellstart führt dich durch Authentifizierung, grundlegende Anfragen, Streaming und Tool-Integration mit dem Code, den du bereits kennst.
Authentifizierung & Basis-URL
Unsere API implementiert das openai-kompatible Protokoll. Du authentifizierst dich, indem du deinen eindeutigen API-Schlüssel im Authorization-Header übergibst. Die Basis-URL für alle Anfragen ist https://api.groknsfw.cc/v1. Im Gegensatz zu Standard-Anbietern benötigen wir keine spezifische Organisations-ID. Generiere deinen Schlüssel einfach über das Dashboard oder die Schnellregistrierungsseite. Bewahre deinen Schlüssel sicher auf; er gewährt vollen Zugriff auf dein Prepaid-Guthaben. Es gibt keine monatlichen Gebühren oder Abonnements, nur eine Token-basierte Abrechnung ohne Verfallsdatum.
Jede Anfrage muss die Modellkennung uncensored enthalten. Dieses Modell ist ein Open-Weight-Modell, das auf unserer Infrastruktur gehostet wird und sich von Modellen anderer Anbieter unterscheidet. Es ist darauf ausgelegt, uneingeschränkte Antworten für legale erwachsene Inhalte zu liefern, während eine hohe faktische Genauigkeit gewahrt bleibt. Du musst die Version deiner Client-Bibliothek nicht ändern; Standard-OpenAI-SDKs funktionieren out of the box.
Basis-Chat-Vervollständigung
Sende eine Standard-Chat-Vervollständigungsanfrage, um Text zu generieren. Der Endpunkt akzeptiert eine Liste von Nachrichten, einschließlich Rollen für System, Benutzer und Assistent. Diese Struktur ermöglicht es dir, Kontext, Anweisungen und Konversationsverlauf zu definieren. Das Modell gibt eine Textantwort basierend auf dem bereitgestellten Prompt zurück. Du kannst die Kreativität der Ausgabe mit Parametern wie temperature und top_p steuern. Wenn kein max_tokens angegeben ist, beträgt die Standard-Ausgabelänge 2.048 Token. Du kannst dies bis zu 32.000 Token pro Anfrage erhöhen, innerhalb des gesamten Kontextfensters von 100.000 Token.
Fehler werden im Standard-JSON-Format zurückgegeben. Häufige Probleme sind ungültige Schlüssel oder unzureichendes Guthaben. Die API führt keine Tokenisierung für dich durch; du sendest Text, und das Modell verarbeitet ihn intern. Du erhältst den endgültigen generierten Text oder teilweise Streams, wenn aktiviert.
Streaming-Antworten
Streaming wird über Server-Sent Events (SSE) unterstützt. Verwende den Parameterstream mit dem Wert true in deiner Anfrage. Die API gibt eine Reihe von Chunks zurück, während das Modell Text generiert. Dies ist nützlich für Echtzeit-UI-Aktualisierungen oder zur Reduzierung der wahrgenommenen Latenz. Jeder Chunk enthält teilweise Daten. Der letzte Chunk enthält die Token-Nutzungsstatistiken für die Anfrage, sodass du die Kosten genau verfolgen kannst. Stelle sicher, dass deine Client-Bibliothek Stream-Unterbrechungen ordnungsgemäß verarbeitet.
Function Calling & Tools
Die API unterstützt Function Calling, wodurch das Modell strukturierte Daten anstelle von Fließtext ausgeben kann. Definiere deine Tools im Parameter tools und gib den Funktionsnamen, die Beschreibung und das Parameterschema an. Wenn das Modell einen Tool-Aufruf für notwendig hält, gibt es den Funktionsnamen und die Argumente im JSON-Format zurück. Deine Anwendung führt dann die Funktion aus und speist das Ergebnis zurück in die Konversation. Dies ermöglicht komplexe Workflows, Datenextraktion und automatisierte Aktionen. Setze tool_choice, um zu steuern, ob das Modell ein Tool verwenden muss oder frei wählen kann.
JSON-Modus
Für Anwendungen, die strenge Ausgabeformate erfordern, verwende den JSON-Modus. Setze den Parameter response_format auf {"type": "json_object"}. Das Modell beschränkt seine Ausgabe auf gültiges JSON. Dies ist ideal, um Daten in deine Backend-Systeme zu analysieren oder strukturierte Konfigurationen zu generieren. Beachte, dass der JSON-Modus die Flexibilität der Schlussfolgerungen des Modells im Vergleich zu freiem Text leicht verringern kann. Stelle sicher, dass dein Prompt das Modell klar anweist, nur JSON auszugeben. Diese Funktion funktioniert neben Function Calling, bietet aber eine einfachere Schnittstelle, wenn du nur strukturierte Daten ohne Tool-Definitionen benötigst.
Token-Nutzung & Limits
Dein Konto ist auf 300 Anfragen pro Minute und 8 parallele Anfragen pro Schlüssel begrenzt. Die maximale Größe des Anfragekörpers beträgt 8 MB. Wenn du diese Limits überschreitest, gibt die API einen 429-Statuscode zurück. Authentifizierungsfehler geben 401 zurück, und unzureichendes Guthaben gibt 402 zurück. Der Preis beträgt $0,25 pro Million Input-Token und $1,00 pro Million Output-Token. Fehler und Ablehnungen verbrauchen kein Guthaben. Das Kontextfenster beträgt insgesamt 100.000 Token, einschließlich Prompt und Vervollständigung. Verwalte deine Token-Nutzung sorgfältig, um unerwartete Kosten zu vermeiden. Guthaben verfällt nie, und du kannst jederzeit per Krypto aufladen.
cURL
curl https://api.groknsfw.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.groknsfw.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.groknsfw.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)API-Spezifikation
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfe sie, bevor du Guthaben kaufst.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Modell-ID | uncensored |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Base-URL | https://api.groknsfw.cc/v1 |
| JSON-Modus | response_format: {"type": "json_object"} |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Anfragegröße | bis 8 MB |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Anmeldung | Google oder E-Mail und Passwort |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Ist dieser Dienst ein Wiederverkäufer von Grok-Modellen?
Nein. Dies ist eine unabhängige API. Wir hosten unser eigenes unzensiertes Open-Weight-Modell auf unseren Servern. Es ist kein GPT-, Claude-, Gemini-, Grok- oder ein anderes Modell eines anderen Anbieters. Es läuft auf unserer Infrastruktur und ist für die Generierung unbeschränkter Inhalte optimiert.
Wie lade ich mein Guthaben auf?
Wir akzeptieren nur USDT (TRC20) und USDC (Base). Du kannst jeden beliebigen Gesamtbetrag zwischen $10 und $500 aufladen. Guthaben verfallen nie. Es gibt keine monatlichen Gebühren oder Abonnements. Aufladungen ab $50 und ab $100 beinhalten Bonusguthaben.
Was ist die maximale Ausgabelänge?
Die maximale Ausgabe pro Anfrage beträgt 32.000 Token. Das gesamte Kontextfenster, einschließlich Prompt und Vervollständigung, umfasst 100.000 Token. Wenn du den Parameter <code>max_tokens</code> nicht festlegst, beträgt die Standard-Ausgabelänge 2.048 Token.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.