API sans censure
API LLM sans filtre pour les développeurs
Un endpoint API hébergé unique pour les modèles abliterated qui supprime les motifs de refus sans la surcharge de gestion des GPU. Envoyez des prompts et recevez du texte avec une compatibilité totale OpenAI.
- Endpoint de chat compatible OpenAI
- Pas d'abonnement, paiement par token
- Support de fenêtre de contexte 100k
Essayez avec une seule requête
curl https://api.abliteratedmodelhub.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.abliteratedmodelhub.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.abliteratedmodelhub.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);- $0.25
- par 1M tokens d'entrée
- $1.00
- Tokens de sortie / 1M
- 100,000
- fenêtre de contexte de tokens
- $0.50
- crédit d'essai
- 300
- requêtes par minute
Ce que vous obtenez
Compatibilité standard
Utilisez les SDK officiels OpenAI ou n'importe quel client compatible. Mettez simplement à jour l'URL de base et la clé API pour acheminer les requêtes vers notre endpoint sans censure.
Streaming & Outils
La prise en charge du streaming SSE (Server-Sent Events) et de l'appel de fonctions est intégrée. Obtenez des sorties en temps réel et intégrez facilement des workflows d'agents complexes.
Tarification transparente
Ne payez que ce que vous utilisez. Les tokens d'entrée coûtent 0,25 $ par 1M, les tokens de sortie 1,00 $ par 1M. Le crédit prépayé n'expire jamais et ne nécessite aucun frais mensuel.
Accès immédiat
Inscrivez-vous simplement avec une adresse e-mail et un mot de passe. Votre clé API s'affiche immédiatement après l'inscription, vous permettant de commencer les tests en quelques secondes.
Limites généreuses
Chaque clé prend en charge 300 requêtes par minute et gère des corps de requête jusqu'à 8 Mo. Régénérez votre clé à tout moment pour révoquer l'accès instantanément.
Axé sur la confidentialité
Les prompts ne sont pas utilisés pour entraîner le modèle. Nous séparons l'utilisation de vos données de votre pipeline d'entraînement du modèle pour des résultats expérimentaux plus propres.
Comment ça marche
Créer un compte
Inscrivez-vous avec un e-mail et un mot de passe pour recevoir votre clé API unique immédiatement.
Configurer le SDK
Configurez votre client compatible OpenAI sur https://api.abliteratedmodelhub.com/v1 et insérez votre clé.
Envoyer des requêtes
Appelez l'endpoint /v1/chat/completions avec l'ID de modèle 'uncensored' et commencez à générer du texte.
Ce que les gens créent avec elle
Écriture créative
Générez de la fiction non restreinte, du jeu de rôle ou des thèmes matures sans que le modèle ne s'excuse ou ne refuse en fonction des filtres de contenu. Idéal pour les auteurs testant le ton et la voix.
Analyse de code
Interrogez le modèle IA sans censure pour des tâches de codage sans refus sur des sujets technologiques controversés ou des scénarios de débogage agressifs. Parfait pour les pipelines de revue de code automatisés.
Recherche en sécurité
Les tests d'injection de prompt et la validation des jailbreak deviennent fiables lorsque le modèle de base ne limite pas artificiellement ses propres réponses. Évaluez la robustesse du modèle avec précision.
Extraction de données
Analysez de grands documents ou journaux où les modèles standards pourraient refuser de générer certains mots-clés. Extrayez des données textuelles brutes avec une interférence minimale des filtres.
Qu'est-ce que les modèles ablitérés ?
Les modèles ablitérés sont des modèles de langage à poids ouverts qui ont été traités pour supprimer les couches spécifiques responsables des motifs de refus. Contrairement aux modèles commerciaux standard qui sont ajustés pour être polis et prudents, les poids ablitérés permettent au modèle de répondre aux sujets controversés, adultes ou non conventionnels sans dire « Je ne peux pas le faire ». Cela est réalisé en modifiant mathématiquement les poids du modèle pour supprimer le comportement de « refus » tout en conservant son intelligence et ses capacités de raisonnement fondamentales.
Ces modèles ablitérés ne sont pas simplement « sans censure » de manière binaire ; ils sont ajustés pour une utilisation adulte et la recherche en sécurité où des sorties honnêtes et non filtrées sont requises. Nous hébergeons ces poids spécifiques sur nos propres serveurs GPU, fournissant un endpoint unique et cohérent. Vous bénéficiez pleinement d'un LLM sans censure sans avoir besoin de comprendre l'architecture du modèle sous-jacent ou de gérer les coûts d'inférence GPU.
Pourquoi utiliser une API hébergée sans censure ?
L'exécution d'un LLM local sans censure nécessite des ressources matérielles importantes, en particulier des GPU avec une grande VRAM. En utilisant notre API hébergée, vous déchargez le traitement intensif sur notre infrastructure. Vous bénéficiez d'une interface compatible OpenAI, ce qui signifie que vous pouvez utiliser le même code que vous connaissez déjà, en indiquant simplement une URL de base différente.
Notre endpoint prend en charge le streaming via SSE, vous permettant de recevoir des tokens en temps réel. Cela est essentiel pour créer des interfaces de chat réactives ou des workflows d'agents. Contrairement aux marketplaces qui agrègent des dizaines de modèles de qualité variable, nous nous concentrons exclusivement sur un seul modèle sans censure conçu à cet effet. Cela garantit une latence et un comportement cohérents, ce qui est vital pour les applications de production où la prévisibilité est importante.
Spécifications techniques : Contexte & Compatibilité
L'API prend en charge une fenêtre de contexte de 100 000 tokens pour le prompt et la complétion. Cela vous permet de traiter de grands documents, de longs codebases ou des historiques de conversation étendus dans une seule requête. L'endpoint suit strictement le format OpenAI Chat Completions, assurant une large compatibilité avec les outils existants.
from openai import OpenAI
client = OpenAI(base_url="https://api.abliteratedmodelhub.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Les requêtes sont limitées à 8 Mo de taille de corps, et chaque clé API peut gérer 300 requêtes par minute. Si vous devez faire tourner les clés pour des raisons de sécurité ou d'équilibrage de charge, vous pouvez régénérer votre clé à tout moment, ce qui révoque instantanément la précédente. L'ID du modèle est simplement « uncensored ». Il n'y a pas d'endpoints d'embeddings, de génération d'images ou de fine-tuning — juste de la complétion de texte pure.
Tarification : Paiement transparent à l'usage
Nous ne facturons pas de frais mensuels ni ne nécessitons d'abonnements. Vous achetez du crédit prépayé, qui n'expire jamais. La tarification est simple : 0,25 $ par 1 million de tokens d'entrée et 1,00 $ par 1 million de tokens de sortie. Vous pouvez recharger avec de la crypto (USDT ou USDC), à partir de seulement 10 $.
Pour les recharges plus importantes, nous offrons des crédits bonus : +5 % lorsque vous ajoutez 50 $ ou plus, et +10 % lorsque vous ajoutez 100 $ ou plus. Ce modèle de paiement à l'usage est idéal pour les développeurs qui souhaitent contrôler précisément les coûts sans s'engager dans une facture récurrente. Les nouveaux comptes reçoivent 0,50 $ de crédit d'essai gratuit, valable 7 jours, sans carte bancaire requise.
Ce n'est PAS pour vous
Cette API est conçue pour les développeurs qui comprennent le fonctionnement des LLM et qui souhaitent un endpoint sans censure. Elle n'est pas destinée aux utilisateurs finaux recherchant une interface de chat prête à l'emploi ou un assistant polyvalent comme ChatGPT. Nous ne proposons pas de routage de modèles, vous êtes donc liés à notre unique modèle sans censure. Si vous avez besoin d'embeddings, de génération d'images ou de garanties SLA spécifiques, ce produit n'est pas adapté. De plus, bien que nous soyons sans censure, nous appliquons une limite stricte : le contenu impliquant des mineurs est bloqué. Si votre cas d'utilisation nécessite un contenu absolument sans filtres dans toutes les catégories, y compris ce cas limite spécifique, vous devrez peut-être opter pour une autre solution.
Questions et réponses
Le modèle est-il vraiment sans censure ?
Oui, le modèle a été ablitéré pour supprimer les motifs de refus. Il répondra aux sujets adultes, controversés ou inhabituels sans formules de politesse atténuantes. Cependant, nous appliquons une limite stricte de contenu : les requêtes contenant du contenu sexuel impliquant des mineurs sont bloquées. C'est la seule restriction qui s'applique toujours.
Ai-je besoin d'une carte bancaire pour commencer ?
Non. Vous pouvez vous inscrire simplement avec une adresse e-mail et un mot de passe. Les nouveaux comptes reçoivent 0,50 $ de crédit d'essai gratuit qui dure 7 jours. Vous n'avez pas besoin de fournir une carte pour accéder à ce crédit d'essai ou à votre clé API.
Comment fonctionne la tarification ?
Nous utilisons un modèle de paiement à l'usage sans frais mensuels. Vous achetez du crédit prépayé et les tokens sont déduits à mesure que vous utilisez l'API. Les tokens d'entrée coûtent 0,25 $ par 1M, et les tokens de sortie coûtent 1,00 $ par 1M. Le crédit n'expire jamais.
Puis-je utiliser cela avec le SDK Python d'OpenAI ?
Oui. L'API est entièrement compatible OpenAI. Vous définissez simplement l'URL de base sur https://api.abliteratedmodelhub.com/v1 et fournissez votre clé API. L'ID du modèle à utiliser est « uncensored ». Le streaming et l'appel de fonctions sont pris en charge.
Quelle est la taille de la fenêtre de contexte ?
L'API prend en charge une fenêtre de contexte de 100 000 tokens. Cela inclut à la fois le prompt d'entrée et la complétion de sortie. Cela permet de traiter de grands documents ou de longs historiques de conversation dans une seule requête.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.