PL ▾
Pobierz klucz API

Szybki start dla użytkowników Grok NSFW

Połącz swoje istniejące OpenAI SDK w kilka minut z hostowanym endpointem LLM bez cenzury. Ten szybki start przeprowadzi Cię przez uwierzytelnianie, podstawowe zapytania, strumieniowanie i integrację narzędzi, używając tego samego kodu, który już znasz.

Uwierzytelnianie i URL bazowy

Nasz API implementuje openai kompatybilny protokół. Uwierzytelniasz się, przekazując swój unikalny klucz API w nagłówku Authorization. Podstawowy URL dla wszystkich zapytań to https://api.groknsfw.cc/v1. W przeciwieństwie do standardowych dostawców, nie wymagamy identyfikatora organizacji. Po prostu wygeneruj swój klucz przez panel lub stronę szybkiej rejestracji. Chroń swój klucz; zapewnia pełny dostęp do przedpłaconego kredytu. Nie ma miesięcznych opłat ani subskrypcji, tylko płatność za tokeny bez wygaśnięcia.

Każde zapytanie musi zawierać identyfikator modelu uncensored. Jest to model o otwartych wagach, duży model językowy hostowany na naszej infrastrukturze, odróżniający się od modeli innych dostawców. Jest dostrojony do dostarczania nieograniczonych odpowiedzi dla legalnej treści dla dorosłych, przy jednoczesnym zachowaniu wysokiej dokładności faktów. Nie musisz zmieniać wersji biblioteki klienckiej; standardowe biblioteki OpenAI SDK działają od razu.

Podstawowe uzupełnianie czatu

Wyślij standardowe zapytanie o uzupełnienie czatu, aby wygenerować tekst. Endpoint akceptuje listę wiadomości, w tym role systemowe, użytkownika i asystenta. Ta struktura pozwala zdefiniować kontekst, instrukcje i historię rozmowy. Model zwraca odpowiedź tekstową na podstawie dostarczonego promptu. Możesz kontrolować kreatywność wyjścia za pomocą parametrów takich jak temperature i top_p. Jeśli nie zostanie określony max_tokens, domyślny limit odpowiedzi to 2048 tokenów. Możesz zwiększyć to do 32 000 tokenów na zapytanie, w ramach całkowitego okna kontekstu 100 000 tokenów.

Błędy są zwracane w standardowym formacie JSON. Powszechne problemy obejmują nieprawidłowe klucze lub niewystarczający kredyt. API nie wykonuje tokenizacji za Ciebie; wysyłasz tekst, a model przetwarza go wewnętrznie. Otrzymujesz wygenerowany tekst końcowy lub częściowe strumienie, jeśli są włączone.

Odpowiedzi strumieniowe

Strumieniowanie jest obsługiwane za pomocą Wydarzeń wysłanych przez serwer (SSE). Użyj parametru stream ustawionego na true w swoim zapytaniu. API zwraca serię fragmentów, podczas gdy model generuje tekst. Jest to przydatne do aktualizacji interfejsu użytkownika w czasie rzeczywistym lub zmniejszenia postrzeganego opóźnienia. Każdy fragment zawiera częściowe dane. Ostatni fragment zawiera statystyki użycia tokenów dla zapytania, co pozwala na dokładne śledzenie kosztów. Upewnij się, że Twoja biblioteka kliencka obsługuje przerwanie strumienia w sposób elegancki.

Wywoływanie funkcji i narzędzia

API obsługuje wywoływanie funkcji, pozwalając modelowi na generowanie danych strukturalnych zamiast zwykłego tekstu. Zdefiniuj swoje narzędzia w parametrze tools, określając nazwę funkcji, opis i schemat parametrów. Gdy model uzna, że wywołanie narzędzia jest konieczne, zwraca nazwę funkcji i argumenty w formacie JSON. Twoja aplikacja wykonuje następnie funkcję i przekazuje wynik z powrotem do rozmowy. To umożliwia złożone przepływy pracy, ekstrakcję danych i automatyczne akcje. Ustaw tool_choice, aby kontrolować, czy model musi użyć narzędzia, czy może wybrać swobodnie.

Tryb JSON

Dla aplikacji wymagających ścisłych formatów wyjściowych, użyj trybu JSON. Ustaw parametr response_format na {"type": "json_object"}. Model ograniczy swoje wyjście do poprawnego JSON. Jest to idealne do parsowania danych do systemów backendowych lub generowania skonfigurowanych struktur. Zauważ, że tryb JSON może nieznacznie zmniejszyć elastyczność rozumowania modelu w porównaniu do tekstu swobodnego. Upewnij się, że Twój prompt wyraźnie instruuje model do wyprowadzania tylko JSON. Ta funkcja działa wraz z wywoływaniem funkcji, ale zapewnia prostszy interfejs, gdy potrzebujesz tylko danych strukturalnych bez definicji narzędzi.

Użycie tokenów i limity

Twoje konto jest ograniczone do 300 zapytań na minutę i 8 równoległych zapytań na klucz. Maksymalny rozmiar ciała zapytania to 8 MB. Jeśli przekroczysz te limity, API zwróci kod statusu 429. Błędy uwierzytelnienia zwracają 401, a niewystarczający kredyt zwraca 402. Cennik to $0,25 za milion tokenów wejściowych i $1,00 za milion tokenów wyjściowych. Błędy i odmowy nie zużywają kredytu. Okno kontekstu to 100 000 tokenów łącznie, w tym zarówno prompt, jak i uzupełnienie. Zarządzaj swoim użyciem tokenów ostrożnie, aby uniknąć nieoczekiwanych kosztów. Kredyt nigdy nie wygasa, a doładować możesz w dowolnym momencie używając kryptowalut.

cURL

curl https://api.groknsfw.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.groknsfw.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.groknsfw.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Strumieniowanie

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Parametry API

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
UwierzytelnianieAuthorization: Bearer YOUR_KEY
ID modeluuncensored
EndpointyPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.groknsfw.cc/v1
Tryb JSONresponse_format: {"type": "json_object"}
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Równoległe zapytaniado 8 jednocześnie na klucz
Limit zapytań300 zapytań na minutę na klucz
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Rozmiar zapytaniado 8 MB
Bonus+5% od $50, +10% od $100
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
LogowanieGoogle albo e-mail i hasło
Kluczejeden aktywny klucz na konto; nowy zastępuje stary
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund

Pytania i odpowiedzi

Czy ta usługa jest resellerem modeli Grok?

Nie. To niezależne API. Hostujemy własny model o otwartych wagach bez cenzury na naszych serwerach. Nie jest to model GPT, Claude, Gemini, Grok ani żaden inny model dostawcy. Działa na naszej infrastrukturze i jest dostrojony do generowania treści bez ograniczeń.

Jak doładować kredyt?

Akceptujemy tylko USDT (TRC20) i USDC (Base). Możesz doładować dowolną kwotę całkowitą między $10 a $500. Kredyty nie wygasają. Nie ma miesięcznych opłat ani subskrypcji. Doładowania od $50 i $100 zawierają kredyt bonusowy.

Jaka jest maksymalna długość odpowiedzi?

Maksymalna długość odpowiedzi na zapytanie to 32 000 tokenów. Całkowite okno kontekstu, obejmujące zarówno prompt, jak i uzupełnienie, wynosi 100 000 tokenów. Jeśli nie ustawisz parametru <code>max_tokens</code>, domyślny limit odpowiedzi to 2048 tokenów.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień URL bazowy. To cała konfiguracja.

Pobierz klucz API