Szybki start dla użytkowników Grok NSFW
Połącz swoje istniejące OpenAI SDK w kilka minut z hostowanym endpointem LLM bez cenzury. Ten szybki start przeprowadzi Cię przez uwierzytelnianie, podstawowe zapytania, strumieniowanie i integrację narzędzi, używając tego samego kodu, który już znasz.
Uwierzytelnianie i URL bazowy
Nasz API implementuje openai kompatybilny protokół. Uwierzytelniasz się, przekazując swój unikalny klucz API w nagłówku Authorization. Podstawowy URL dla wszystkich zapytań to https://api.groknsfw.cc/v1. W przeciwieństwie do standardowych dostawców, nie wymagamy identyfikatora organizacji. Po prostu wygeneruj swój klucz przez panel lub stronę szybkiej rejestracji. Chroń swój klucz; zapewnia pełny dostęp do przedpłaconego kredytu. Nie ma miesięcznych opłat ani subskrypcji, tylko płatność za tokeny bez wygaśnięcia.
Każde zapytanie musi zawierać identyfikator modelu uncensored. Jest to model o otwartych wagach, duży model językowy hostowany na naszej infrastrukturze, odróżniający się od modeli innych dostawców. Jest dostrojony do dostarczania nieograniczonych odpowiedzi dla legalnej treści dla dorosłych, przy jednoczesnym zachowaniu wysokiej dokładności faktów. Nie musisz zmieniać wersji biblioteki klienckiej; standardowe biblioteki OpenAI SDK działają od razu.
Podstawowe uzupełnianie czatu
Wyślij standardowe zapytanie o uzupełnienie czatu, aby wygenerować tekst. Endpoint akceptuje listę wiadomości, w tym role systemowe, użytkownika i asystenta. Ta struktura pozwala zdefiniować kontekst, instrukcje i historię rozmowy. Model zwraca odpowiedź tekstową na podstawie dostarczonego promptu. Możesz kontrolować kreatywność wyjścia za pomocą parametrów takich jak temperature i top_p. Jeśli nie zostanie określony max_tokens, domyślny limit odpowiedzi to 2048 tokenów. Możesz zwiększyć to do 32 000 tokenów na zapytanie, w ramach całkowitego okna kontekstu 100 000 tokenów.
Błędy są zwracane w standardowym formacie JSON. Powszechne problemy obejmują nieprawidłowe klucze lub niewystarczający kredyt. API nie wykonuje tokenizacji za Ciebie; wysyłasz tekst, a model przetwarza go wewnętrznie. Otrzymujesz wygenerowany tekst końcowy lub częściowe strumienie, jeśli są włączone.
Odpowiedzi strumieniowe
Strumieniowanie jest obsługiwane za pomocą Wydarzeń wysłanych przez serwer (SSE). Użyj parametrustream ustawionego na true w swoim zapytaniu. API zwraca serię fragmentów, podczas gdy model generuje tekst. Jest to przydatne do aktualizacji interfejsu użytkownika w czasie rzeczywistym lub zmniejszenia postrzeganego opóźnienia. Każdy fragment zawiera częściowe dane. Ostatni fragment zawiera statystyki użycia tokenów dla zapytania, co pozwala na dokładne śledzenie kosztów. Upewnij się, że Twoja biblioteka kliencka obsługuje przerwanie strumienia w sposób elegancki.
Wywoływanie funkcji i narzędzia
API obsługuje wywoływanie funkcji, pozwalając modelowi na generowanie danych strukturalnych zamiast zwykłego tekstu. Zdefiniuj swoje narzędzia w parametrze tools, określając nazwę funkcji, opis i schemat parametrów. Gdy model uzna, że wywołanie narzędzia jest konieczne, zwraca nazwę funkcji i argumenty w formacie JSON. Twoja aplikacja wykonuje następnie funkcję i przekazuje wynik z powrotem do rozmowy. To umożliwia złożone przepływy pracy, ekstrakcję danych i automatyczne akcje. Ustaw tool_choice, aby kontrolować, czy model musi użyć narzędzia, czy może wybrać swobodnie.
Tryb JSON
Dla aplikacji wymagających ścisłych formatów wyjściowych, użyj trybu JSON. Ustaw parametr response_format na {"type": "json_object"}. Model ograniczy swoje wyjście do poprawnego JSON. Jest to idealne do parsowania danych do systemów backendowych lub generowania skonfigurowanych struktur. Zauważ, że tryb JSON może nieznacznie zmniejszyć elastyczność rozumowania modelu w porównaniu do tekstu swobodnego. Upewnij się, że Twój prompt wyraźnie instruuje model do wyprowadzania tylko JSON. Ta funkcja działa wraz z wywoływaniem funkcji, ale zapewnia prostszy interfejs, gdy potrzebujesz tylko danych strukturalnych bez definicji narzędzi.
Użycie tokenów i limity
Twoje konto jest ograniczone do 300 zapytań na minutę i 8 równoległych zapytań na klucz. Maksymalny rozmiar ciała zapytania to 8 MB. Jeśli przekroczysz te limity, API zwróci kod statusu 429. Błędy uwierzytelnienia zwracają 401, a niewystarczający kredyt zwraca 402. Cennik to $0,25 za milion tokenów wejściowych i $1,00 za milion tokenów wyjściowych. Błędy i odmowy nie zużywają kredytu. Okno kontekstu to 100 000 tokenów łącznie, w tym zarówno prompt, jak i uzupełnienie. Zarządzaj swoim użyciem tokenów ostrożnie, aby uniknąć nieoczekiwanych kosztów. Kredyt nigdy nie wygasa, a doładować możesz w dowolnym momencie używając kryptowalut.
cURL
curl https://api.groknsfw.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.groknsfw.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.groknsfw.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Strumieniowanie
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Parametry API
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| ID modelu | uncensored |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.groknsfw.cc/v1 |
| Tryb JSON | response_format: {"type": "json_object"} |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rozmiar zapytania | do 8 MB |
| Bonus | +5% od $50, +10% od $100 |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Logowanie | Google albo e-mail i hasło |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Czy ta usługa jest resellerem modeli Grok?
Nie. To niezależne API. Hostujemy własny model o otwartych wagach bez cenzury na naszych serwerach. Nie jest to model GPT, Claude, Gemini, Grok ani żaden inny model dostawcy. Działa na naszej infrastrukturze i jest dostrojony do generowania treści bez ograniczeń.
Jak doładować kredyt?
Akceptujemy tylko USDT (TRC20) i USDC (Base). Możesz doładować dowolną kwotę całkowitą między $10 a $500. Kredyty nie wygasają. Nie ma miesięcznych opłat ani subskrypcji. Doładowania od $50 i $100 zawierają kredyt bonusowy.
Jaka jest maksymalna długość odpowiedzi?
Maksymalna długość odpowiedzi na zapytanie to 32 000 tokenów. Całkowite okno kontekstu, obejmujące zarówno prompt, jak i uzupełnienie, wynosi 100 000 tokenów. Jeśli nie ustawisz parametru <code>max_tokens</code>, domyślny limit odpowiedzi to 2048 tokenów.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień URL bazowy. To cała konfiguracja.