IT ▾

API LLM open-weight senza limiti di contenuto.

Guida rapida all'uso dell'API AI senza censura

Questa documentazione ti guida nell'integrazione dell'API LLM senza censura nella tua applicazione in modo semplice. Usa questa guida per iniziare a utilizzare l'API chat completions senza filtri in pochi minuti.

URL di base
https://api.apitanpasensor.com/v1
Modello
uncensored
Ottieni la chiave API

Configurazione URL di base e autenticazione

Per iniziare, devi configurare l'URL di base in modo che l'SDK compatibile con OpenAI punti ai nostri server. Usa https://api.apitanpasensor.com/v1 come endpoint principale. L'autenticazione avviene tramite l'intestazione Authorization: Bearer YOUR_API_KEY. La chiave API che ottieni durante la registrazione è unica e valida per un solo account. Se rigeneri la chiave, quella vecchia verrà revocata immediatamente e non potrà più essere utilizzata, anche se la vecchia chiave non scade automaticamente nel tempo.

Esempio di prima richiesta

Invia una richiesta POST a /v1/chat/completions con il modello uncensored. Questo modello open-weight non filtra argomenti adulti legittimi o controversi, a differenza dei modelli enterprise standard.

curl https://api.apitanpasensor.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Assicurati di includere il parametro model con il valore uncensored. La risposta sarà un JSON contenente il testo generato dal modello.

Integrazione con SDK Python

Usa la libreria openai in Python per interagire con l'API. Imposta base_url e api_key secondo la configurazione sopra. Il modello uncensored supporta un contesto lungo fino a 100.000 token, permettendoti di inviare prompt molto lunghi senza perdere informazioni importanti.

from openai import OpenAI

client = OpenAI(base_url="https://api.apitanpasensor.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

L'esempio di codice sopra mostra come inviare messaggi di sistema e utente in modo semplice.

Integrazione con SDK Node.js

Per gli utenti Node.js, l'SDK OpenAI può essere configurato facilmente. Imposta baseURL sull'URL del nostro endpoint e usa la tua chiave API. Questo approccio ti permette di integrare l'AI senza censura nella tua applicazione web o server-side rapidamente.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.apitanpasensor.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Ricorda che questo modello gestisce solo testo e non supporta la generazione di immagini, audio o video.

Abilita lo streaming (SSE)

Per un'esperienza utente più reattiva, abilita lo streaming aggiungendo stream: true ai parametri della richiesta. L'API restituirà la risposta utilizzando Server-Sent Events (SSE). Questo è molto utile per le applicazioni chat in tempo reale dove l'utente vede i risultati token per token.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Lo streaming non modifica il prezzo o il limite di token, solo il modo in cui viene inviata la risposta.

Limiti, errori e gestione del contesto

Questa API ha un limite di 300 richieste al minuto per chiave e una dimensione massima del body della richiesta di 8 MB. Se la chiave non è valida, riceverai un errore 401. Se il saldo del credito è esaurito, apparirà un errore 402. L'errore 429 indica che hai superato il limite di richieste. La finestra di contesto è di 100.000 token per prompt e completion combinati. Assicurati di gestire i token in modo intelligente per non superare questo limite.

Domande e risposte

La mia chiave API scade?

Le chiavi API non hanno una scadenza automatica. Tuttavia, se scegli di rigenerare la chiave dalla dashboard, quella vecchia verrà revocata immediatamente e non sarà più valida, anche se non è trascorso alcun periodo di tempo.

Il modello è davvero senza censura?

Sì, il nostro modello a pesi aperti è configurato per non rifiutare argomenti adulti legittimi, fiction o ricerche di sicurezza. L'unica restrizione rigorosa che si applica sempre è il contenuto sessuale che coinvolge minori.

Cosa succede se rimango senza credito?

Riceverai un errore 402 (Payment Required) sulla richiesta successiva. Il credito che acquisti non scade mai, quindi puoi ricaricarlo in qualsiasi momento senza temere di perdere il saldo.

La tua chiave richiede un solo passaggio

Crea un account, copia la chiave, modifica l'URL di base. È tutto ciò che serve per la configurazione.

Scheda tecnica dell'API

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
EndpointPOST /v1/chat/completions · GET /v1/models
AutenticazioneAuthorization: Bearer YOUR_KEY
ID modellouncensored
Base URLhttps://api.apitanpasensor.com/v1
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Modalità JSONresponse_format: {"type": "json_object"}
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Finestra di contesto100.000 token (input + output)
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Concorrenza8 richieste contemporanee per chiave
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Limite di frequenza300 richieste al minuto per chiave
Dimensionefino a 8 MB per richiesta
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
Bonus+5% da $50, +10% da $100, +15% da $200
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $20 a $500
Scadenzail credito pagato non scade, nessun abbonamento
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori
AccessoGoogle oppure e-mail e password

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi