Avvio rapido per gli utenti di Grok NSFW
Connetti il tuo SDK OpenAI esistente in pochi minuti a un endpoint LLM senza censura ospitato. Questa guida rapida ti accompagna attraverso l'autenticazione, le richieste di base, lo streaming e l'integrazione degli strumenti utilizzando lo stesso codice che già conosci.
Autenticazione e URL di base
La nostra API implementa il protocollo compatibile con openai. Ti autentichi inserendo la tua chiave API univaca nell'intestazione Authorization. L'URL di base per tutte le richieste è https://api.groknsfw.cc/v1. A differenza dei provider standard, non serve un ID organizzazione specifico. Genera semplicemente la tua chiave tramite la dashboard o la pagina di registrazione rapida. Tieni la chiave al sicuro: garantisce l'accesso completo al tuo credito prepagato. Non ci sono canoni mensili né abbonamenti, solo un prezzo a consumo per token senza scadenza.
Ogni richiesta deve includere l'identificatore del modello uncensored. Questo modello è un modello linguistico grande a pesi aperti ospitato sulla nostra infrastruttura, distinto da altri fornitori. È ottimizzato per fornire risposte senza restrizioni per contenuti adulti leciti mantenendo un'elevata accuratezza fattuale. Non è necessario modificare la versione della libreria client; gli SDK OpenAI standard funzionano subito.
Completamento chat di base
Invia una richiesta standard di completamento chat per generare testo. L'endpoint accetta un elenco di messaggi, inclusi ruoli system, user e assistant. Questa struttura ti permette di definire contesto, istruzioni e cronologia delle conversazioni. Il modello restituisce una risposta testuale basata sul prompt fornito. Puoi controllare la creatività dell'output utilizzando parametri come temperature e top_p. Se non è specificato max_tokens, il limite di output predefinito è di 2.048 token. Puoi aumentarlo fino a 32.000 token per richiesta, entro la finestra di contesto totale di 100.000 token.
Gli errori vengono restituiti in formato JSON standard. I problemi comuni includono chiavi non valide o credito insufficiente. L'API non gestisce la tokenizzazione per te; invii testo e il modello lo elabora internamente. Ricevi il testo generato finale o flussi parziali se abilitati.
Risposte in streaming
Lo streaming è supportato tramite Server-Sent Events (SSE). Usa il parametrostream impostato su true nella tua richiesta. L'API restituisce una serie di chunk mentre il modello genera testo. Questo è utile per aggiornamenti UI in tempo reale o per ridurre la latenza percepita. Ogni chunk contiene dati parziali. L'ultimo chunk include le statistiche di utilizzo dei token per la richiesta, permettendoti di monitorare i costi con precisione. Assicurati che la tua libreria client gestisca l'interruzione dello stream in modo elegante.
Chiamata di funzioni e strumenti
L'API supporta la chiamata di funzioni, consentendo al modello di produrre dati strutturati invece di testo normale. Definisci i tuoi strumenti nel parametro tools, specificando il nome della funzione, la descrizione e lo schema dei parametri. Quando il modello determina che è necessaria una chiamata a uno strumento, restituisce il nome della funzione e gli argomenti in formato JSON. La tua applicazione esegue quindi la funzione e inserisce il risultato nella conversazione. Questo abilita flussi di lavoro complessi, estrazione di dati e azioni automatizzate. Imposta tool_choice per controllare se il modello deve usare uno strumento o può scegliere liberamente.
Modalità JSON
Per le applicazioni che richiedono formati di output rigorosi, usa la modalità JSON. Imposta il parametro response_format su {"type": "json_object"}. Il modello limiterà il suo output a JSON valido. Questo è ideale per analizzare i dati nei tuoi sistemi backend o generare configurazioni strutturate. Nota che la modalità JSON può ridurre leggermente la flessibilità di ragionamento del modello rispetto al testo libero. Assicurati che il prompt istruisca chiaramente il modello a produrre solo JSON. Questa funzionalità funziona insieme alla chiamata di funzioni ma fornisce un'interfaccia più semplice quando ti servono solo dati strutturati senza definizioni di strumenti.
Utilizzo dei token e limiti
Il tuo account è limitato a 300 richieste al minuto e 8 richieste parallele per chiave. La dimensione massima del corpo della richiesta è 8 MB. Se superi questi limiti, l'API restituisce il codice di stato 429. Gli errori di autenticazione restituiscono 401, mentre il credito insufficiente restituisce 402. Il prezzo è $0,25 per milione di token di input e $1,00 per milione di token di output. Errori e rifiuti non consumano credito. La finestra di contesto è di 100.000 token in totale, inclusi sia prompt che completamento. Gestisci attentamente l'utilizzo dei token per evitare costi imprevisti. Il credito non scade mai e puoi ricaricarlo in qualsiasi momento usando criptovalute.
cURL
curl https://api.groknsfw.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.groknsfw.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.groknsfw.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Scheda tecnica dell'API
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| ID modello | uncensored |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.groknsfw.cc/v1 |
| Modalità JSON | response_format: {"type": "json_object"} |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Finestra di contesto | 100.000 token (input + output) |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Concorrenza | 8 richieste contemporanee per chiave |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Dimensione | fino a 8 MB per richiesta |
| Bonus | +5% da $50, +10% da $100 |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Accesso | Google oppure e-mail e password |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
Questo servizio è un rivenditore dei modelli Grok?
No. Questa è un'API indipendente. Ospitiamo il nostro modello a pesi aperti senza censura sui nostri server. Non è GPT, Claude, Gemini, Grok o il modello di alcun altro fornitore. Funziona sulla nostra infrastruttura ed è ottimizzato per la generazione di contenuti senza restrizioni.
Come ricarico il mio credito?
Accettiamo solo USDT (TRC20) e USDC (Base). Puoi ricaricare qualsiasi importo intero tra $10 e $500. I crediti non scadono. Non ci sono canoni mensili né abbonamenti. Le ricariche da $50 e $100 includono credito bonus.
Qual è la lunghezza massima dell'output?
L'output massimo per richiesta è di 32.000 token. La finestra di contesto totale, inclusi prompt e completamento, è di 100.000 token. Se non imposti il parametro <code>max_tokens</code>, il limite di output predefinito è di 2.048 token.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.