IT ▾
Ottieni la chiave API

Avvio rapido per gli utenti di Grok NSFW

Connetti il tuo SDK OpenAI esistente in pochi minuti a un endpoint LLM senza censura ospitato. Questa guida rapida ti accompagna attraverso l'autenticazione, le richieste di base, lo streaming e l'integrazione degli strumenti utilizzando lo stesso codice che già conosci.

Autenticazione e URL di base

La nostra API implementa il protocollo compatibile con openai. Ti autentichi inserendo la tua chiave API univaca nell'intestazione Authorization. L'URL di base per tutte le richieste è https://api.groknsfw.cc/v1. A differenza dei provider standard, non serve un ID organizzazione specifico. Genera semplicemente la tua chiave tramite la dashboard o la pagina di registrazione rapida. Tieni la chiave al sicuro: garantisce l'accesso completo al tuo credito prepagato. Non ci sono canoni mensili né abbonamenti, solo un prezzo a consumo per token senza scadenza.

Ogni richiesta deve includere l'identificatore del modello uncensored. Questo modello è un modello linguistico grande a pesi aperti ospitato sulla nostra infrastruttura, distinto da altri fornitori. È ottimizzato per fornire risposte senza restrizioni per contenuti adulti leciti mantenendo un'elevata accuratezza fattuale. Non è necessario modificare la versione della libreria client; gli SDK OpenAI standard funzionano subito.

Completamento chat di base

Invia una richiesta standard di completamento chat per generare testo. L'endpoint accetta un elenco di messaggi, inclusi ruoli system, user e assistant. Questa struttura ti permette di definire contesto, istruzioni e cronologia delle conversazioni. Il modello restituisce una risposta testuale basata sul prompt fornito. Puoi controllare la creatività dell'output utilizzando parametri come temperature e top_p. Se non è specificato max_tokens, il limite di output predefinito è di 2.048 token. Puoi aumentarlo fino a 32.000 token per richiesta, entro la finestra di contesto totale di 100.000 token.

Gli errori vengono restituiti in formato JSON standard. I problemi comuni includono chiavi non valide o credito insufficiente. L'API non gestisce la tokenizzazione per te; invii testo e il modello lo elabora internamente. Ricevi il testo generato finale o flussi parziali se abilitati.

Risposte in streaming

Lo streaming è supportato tramite Server-Sent Events (SSE). Usa il parametro stream impostato su true nella tua richiesta. L'API restituisce una serie di chunk mentre il modello genera testo. Questo è utile per aggiornamenti UI in tempo reale o per ridurre la latenza percepita. Ogni chunk contiene dati parziali. L'ultimo chunk include le statistiche di utilizzo dei token per la richiesta, permettendoti di monitorare i costi con precisione. Assicurati che la tua libreria client gestisca l'interruzione dello stream in modo elegante.

Chiamata di funzioni e strumenti

L'API supporta la chiamata di funzioni, consentendo al modello di produrre dati strutturati invece di testo normale. Definisci i tuoi strumenti nel parametro tools, specificando il nome della funzione, la descrizione e lo schema dei parametri. Quando il modello determina che è necessaria una chiamata a uno strumento, restituisce il nome della funzione e gli argomenti in formato JSON. La tua applicazione esegue quindi la funzione e inserisce il risultato nella conversazione. Questo abilita flussi di lavoro complessi, estrazione di dati e azioni automatizzate. Imposta tool_choice per controllare se il modello deve usare uno strumento o può scegliere liberamente.

Modalità JSON

Per le applicazioni che richiedono formati di output rigorosi, usa la modalità JSON. Imposta il parametro response_format su {"type": "json_object"}. Il modello limiterà il suo output a JSON valido. Questo è ideale per analizzare i dati nei tuoi sistemi backend o generare configurazioni strutturate. Nota che la modalità JSON può ridurre leggermente la flessibilità di ragionamento del modello rispetto al testo libero. Assicurati che il prompt istruisca chiaramente il modello a produrre solo JSON. Questa funzionalità funziona insieme alla chiamata di funzioni ma fornisce un'interfaccia più semplice quando ti servono solo dati strutturati senza definizioni di strumenti.

Utilizzo dei token e limiti

Il tuo account è limitato a 300 richieste al minuto e 8 richieste parallele per chiave. La dimensione massima del corpo della richiesta è 8 MB. Se superi questi limiti, l'API restituisce il codice di stato 429. Gli errori di autenticazione restituiscono 401, mentre il credito insufficiente restituisce 402. Il prezzo è $0,25 per milione di token di input e $1,00 per milione di token di output. Errori e rifiuti non consumano credito. La finestra di contesto è di 100.000 token in totale, inclusi sia prompt che completamento. Gestisci attentamente l'utilizzo dei token per evitare costi imprevisti. Il credito non scade mai e puoi ricaricarlo in qualsiasi momento usando criptovalute.

cURL

curl https://api.groknsfw.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.groknsfw.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.groknsfw.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Scheda tecnica dell'API

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
AutenticazioneAuthorization: Bearer YOUR_KEY
ID modellouncensored
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.groknsfw.cc/v1
Modalità JSONresponse_format: {"type": "json_object"}
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Finestra di contesto100.000 token (input + output)
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Concorrenza8 richieste contemporanee per chiave
Limite di frequenza300 richieste al minuto per chiave
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Dimensionefino a 8 MB per richiesta
Bonus+5% da $50, +10% da $100
Scadenzail credito pagato non scade, nessun abbonamento
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
AccessoGoogle oppure e-mail e password
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande e risposte

Questo servizio è un rivenditore dei modelli Grok?

No. Questa è un'API indipendente. Ospitiamo il nostro modello a pesi aperti senza censura sui nostri server. Non è GPT, Claude, Gemini, Grok o il modello di alcun altro fornitore. Funziona sulla nostra infrastruttura ed è ottimizzato per la generazione di contenuti senza restrizioni.

Come ricarico il mio credito?

Accettiamo solo USDT (TRC20) e USDC (Base). Puoi ricaricare qualsiasi importo intero tra $10 e $500. I crediti non scadono. Non ci sono canoni mensili né abbonamenti. Le ricariche da $50 e $100 includono credito bonus.

Qual è la lunghezza massima dell'output?

L'output massimo per richiesta è di 32.000 token. La finestra di contesto totale, inclusi prompt e completamento, è di 100.000 token. Se non imposti il parametro <code>max_tokens</code>, il limite di output predefinito è di 2.048 token.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.

Ottieni la chiave API