IT ▾
Ottieni la chiave API

API senza censura

API LLM senza filtri per gli sviluppatori

Un singolo endpoint API ospitato per modelli abliterated che rimuove i pattern di rifiuto senza il sovraccarico di gestire le GPU. Invia prompt e ricevi testo con piena compatibilità OpenAI.

  • Endpoint chat compatibile con OpenAI
  • Nessun abbonamento, pagamento per token
  • Supporto finestra di contesto 100k

Ottieni chiave APILeggi i documenti

Provalo con una sola richiesta

curl https://api.abliteratedmodelhub.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'
$0.25
per 1M token di input
$1.00
Token di output / 1M
100,000
contesto di token
$0.50
credito di prova
300
richieste al minuto

Cosa ottieni

Compatibilità standard

Usa gli SDK ufficiali di OpenAI o qualsiasi client compatibile. Aggiorna solo l'URL di base e la chiave API per instradare le richieste al nostro endpoint senza censura.

Streaming e strumenti

Supporto integrato per lo streaming tramite Server-Sent Events (SSE) e la chiamata di funzioni/strumenti. Ottieni output in tempo reale e integra facilmente flussi di lavoro di agenti complessi.

Tariffazione trasparente

Paga solo ciò che usi. I token di input costano $0,25 per 1M, quelli di output $1,00 per 1M. Il credito prepagato non scade mai e non richiede canoni mensili.

Accesso immediato

Iscriviti solo con email e password. La tua chiave API viene visualizzata immediatamente dopo la registrazione, permettendoti di iniziare i test in pochi secondi.

Limiti generosi

Ogni chiave supporta 300 richieste al minuto e gestisce corpi di richiesta fino a 8 MB. Rigenera la tua chiave in qualsiasi momento per revocare l'accesso istantaneamente.

Privacy orientata

I prompt non vengono utilizzati per addestrare il modello. Teniamo separato l'utilizzo dei tuoi dati dal tuo pipeline di addestramento del modello per risultati sperimentali più puliti.

Come funziona

Crea account

Registrati con email e password per ricevere immediatamente la tua chiave API univoca.

Configura SDK

Indirizza il tuo client compatibile con OpenAI a https://api.abliteratedmodelhub.com/v1 e inserisci la tua chiave.

Invia richieste

Chiama l'endpoint /v1/chat/completions con l'ID del modello 'uncensored' e inizia a generare testo.

Cosa costruiscono le persone con esso

Scrittura creativa

Genera narrativa senza restrizioni, roleplay o temi maturi senza che il modello si scusi o rifiuti basandosi sui filtri di contenuto. Ideale per autori che testano tono e voce.

Analisi del codice

Interroga il modello ai senza censura per attività di codifica senza rifiuti su argomenti tecnologici controversi o scenari di debugging aggressivi. Perfetto per pipeline di revisione del codice automatizzate.

Ricerca sulla sicurezza

I test di iniezione di prompt e la convalida del jailbreak diventano affidabili quando il modello di base non limita artificialmente le proprie risposte. Valuta con precisione la robustezza del modello.

Estrazione dati

Analizza documenti di grandi dimensioni o log dove i modelli standard potrebbero rifiutarsi di emettere determinate parole chiave. Estrai dati di testo grezzo con interferenze minime di filtraggio.

Cosa sono i modelli abliterated?

I modelli abliterated sono modelli linguistici open-weight che sono stati elaborati per rimuovere i layer specifici responsabili dei pattern di rifiuto. A differenza dei modelli commerciali standard, che sono ottimizzati per essere cortesi e cauti, i pesi abliterated permettono al modello di rispondere a argomenti controversi, adulti o non convenzionali senza dire 'non posso farlo'. Questo si ottiene modificando matematicamente i pesi del modello per sopprimere il comportamento di 'rifiuto' mantenendo intatte le sue capacità di intelligenza e ragionamento.

Questi modelli abliterated non sono semplicemente 'uncensored' in senso binario; sono ottimizzati per l'uso adulto e la ricerca sulla sicurezza, dove sono richiesti output onesti e senza filtri. Ospitiamo questi pesi specifici sui nostri server GPU, fornendo un singolo endpoint coerente. Ottieni tutti i vantaggi di un llm uncensored senza dover comprendere l'architettura del modello sottostante o gestire i costi di inferenza GPU.

Perché usare un'API ospitata senza censura?

Eseguire un llm locale senza censura richiede risorse hardware significative, specificamente GPU con grande VRAM. Utilizzando la nostra API ospitata, scarichi il lavoro di calcolo pesante sulla nostra infrastruttura. Ottieni un'interfaccia standard compatibile con OpenAI, il che significa che puoi usare lo stesso codice che già conosci, puntando semplicemente a un URL di base diverso.

Il nostro endpoint supporta lo streaming tramite SSE, permettendoti di ricevere token in tempo reale. Questo è fondamentale per costruire interfacce chat reattive o flussi di lavoro di agenti. A differenza dei marketplace che aggregano dozzine di modelli con qualità variabile, ci concentriamo esclusivamente su un modello senza censura costruito per uno scopo specifico. Questo garantisce latenza e comportamento coerenti, vitali per le applicazioni di produzione dove la prevedibilità è importante.

Specifiche tecniche: contesto e compatibilità

L'API supporta una finestra di contesto di 100.000 token sia per il prompt che per il completamento. Questo ti consente di elaborare documenti di grandi dimensioni, lunghe basi di codice o cronologie di conversazioni estese in una singola richiesta. L'endpoint segue rigorosamente il formato OpenAI Chat Completions, garantendo ampia compatibilità con gli strumenti esistenti.

from openai import OpenAI

client = OpenAI(base_url="https://api.abliteratedmodelhub.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Le richieste sono limitate a 8 MB nella dimensione del corpo, e ogni chiave API può gestire 300 richieste al minuto. Se devi ruotare le chiavi per sicurezza o bilanciamento del carico, puoi rigenerare la tua chiave in qualsiasi momento, revocando istantaneamente quella precedente. L'ID del modello è semplicemente 'uncensored'. Non ci sono endpoint di embeddings, generazione di immagini o fine-tuning—solo puro completamento di testo.

Tariffazione: pagamento trasparente a consumo

Non addebitiamo canoni mensili né richiediamo abbonamenti. Acquisti credito prepagato, che non scade mai. La tariffazione è semplice: $0,25 per 1 milione di token di input e $1,00 per 1 milione di token di output. Puoi ricaricare con criptovalute (USDT o USDC), partendo da soli $10.

Per ricariche più grandi, offriamo crediti bonus: +5% quando aggiungi $50 o più, e +10% quando aggiungi $100 o più. Questo modello pay-as-you-go è ideale per gli sviluppatori che vogliono controllare i costi con precisione senza impegnarsi in un bill ricorrente. I nuovi account ricevono $0.50 di credito di prova, valido per 7 giorni, senza bisogno di carta di credito.

A chi NON è rivolto

Questa API è progettata per gli sviluppatori che comprendono il funzionamento dei LLM e desiderano un endpoint senza censura. Non è destinata agli utenti finali che cercano un'interfaccia chat pronta all'uso o un assistente generico come ChatGPT. Non offriamo il routing dei modelli, quindi sei vincolato al nostro unico modello senza censura. Se hai bisogno di embedding, generazione di immagini o garanzie SLA specifiche, questo non è il prodotto giusto. Inoltre, sebbene il modello sia senza censura, applichiamo un limite rigido: i contenuti che coinvolgono minori sono bloccati. Se il tuo caso d'uso richiede contenuti assolutamente non filtrati in tutte le categorie, incluso questo specifico caso limite, potresti aver bisogno di una soluzione diversa.

Domande e risposte

Il modello è davvero senza censura?

Sì, il modello è stato abliterato per rimuovere i pattern di rifiuto. Risponderà a temi adulti, controversi o insoliti senza le tipiche attenuazioni cortesi. Tuttavia, applichiamo un limite rigido ai contenuti: le richieste contenenti materiale sessuale che coinvolge minori vengono bloccate. Questa è l'unica restrizione che si applica sempre.

Ho bisogno di una carta di credito per iniziare?

No. Puoi registrarti semplicemente con email e password. I nuovi account ricevono $0,50 di credito di prova valido per 7 giorni. Non è necessario fornire una carta per accedere a questo credito di prova o alla tua chiave API.

Come funziona la tariffazione?

Utilizziamo il pagamento a consumo senza canoni mensili. Acquisti credito prepagato e i token vengono detratti man mano che utilizzi l'API. I token di input costano $0,25 per 1M, mentre i token di output costano $1,00 per 1M. Il credito non scade mai.

Posso usarlo con l'SDK Python di OpenAI?

Sì. L'API è completamente compatibile con OpenAI. Imposta semplicemente il base_url su https://api.abliteratedmodelhub.com/v1 e fornisci la tua chiave API. L'ID del modello da utilizzare è 'uncensored'. Sono supportati lo streaming e la chiamata di funzioni.

Qual è la dimensione della finestra di contesto?

L'API supporta una finestra di contesto di 100.000 token. Questo include sia il prompt di input che il completamento di output. Ciò consente di elaborare documenti di grandi dimensioni o cronologie di conversazioni lunghe in una singola richiesta.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, modifica il base URL. È tutta qui la configurazione.

Ottieni la chiave API