API sin censura
API LLM sin censura para desarrolladores
Un único endpoint de API alojado para modelos abliterados que elimina patrones de rechazo sin la sobrecarga de gestionar GPUs. Envía prompts y recibe texto con total compatibilidad con OpenAI.
- Endpoint de chat compatible con OpenAI
- Sin suscripción, pago por token
- Compatible con ventana de contexto de 100k
Pruébalo con una sola petición
curl https://api.abliteratedmodelhub.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.abliteratedmodelhub.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.abliteratedmodelhub.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);- $0.25
- por 1M de tokens de entrada
- $1.00
- Tokens de salida / 1M
- 100,000
- ventana de contexto
- $0.50
- crédito de prueba
- 300
- peticiones por minuto
Lo que obtienes
Compatibilidad estándar
Usa los SDK oficiales de OpenAI o cualquier cliente compatible. Solo actualiza la URL base y la clave de API para enrutar peticiones a nuestro endpoint sin censura.
Streaming y herramientas
Soporte integrado para streaming de Eventos Enviados por Servidor (SSE) y llamadas a funciones/herramientas. Obtén salidas en tiempo real e integra flujos de trabajo de agentes complejos fácilmente.
Precios transparentes
Paga solo por lo que usas. Los tokens de entrada cuestan $0.25 por 1M y los de salida $1.00 por 1M. El crédito prepago nunca expira y no requiere cuota mensual.
Acceso inmediato
Regístrate solo con un correo electrónico y contraseña. Tu clave de API se muestra inmediatamente después del registro, permitiéndote comenzar a probar en segundos.
Límites generosos
Cada clave admite 300 peticiones por minuto y maneja cuerpos de petición de hasta 8 MB. Regenera tu clave en cualquier momento para revocar el acceso al instante.
Enfoque en privacidad
Los prompts no se usan para entrenar el modelo. Mantenemos el uso de tus datos separado de tu pipeline de entrenamiento del modelo para resultados experimentales más limpios.
Cómo funciona
Crear cuenta
Regístrate con un correo electrónico y una contraseña para recibir tu clave de API única de inmediato.
Configurar SDK
Apunta tu cliente compatible con OpenAI a https://api.abliteratedmodelhub.com/v1 e inserta tu clave.
Enviar peticiones
Llama al endpoint /v1/chat/completions con el ID del modelo 'uncensored' y comienza a generar texto.
Lo que la gente construye con esto
Escritura creativa
Genera ficción sin restricciones, roleplay o temas maduros sin que el modelo se disculpe o se niegue por filtros de contenido. Ideal para autores que prueban tono y voz.
Análisis de código
Consulta el modelo de IA sin censura para tareas de programación sin rechazos en temas tecnológicos controversiales o escenarios de depuración agresivos. Perfecto para pipelines de revisión de código automatizada.
Investigación de seguridad
Las pruebas de inyección de prompts y la validación de jailbreak se vuelven confiables cuando el modelo base no limita artificialmente sus propias respuestas. Evalúa la robustez del modelo con precisión.
Extracción de datos
Analiza documentos grandes o registros donde los modelos estándar podrían negarse a generar ciertas palabras clave. Extrae datos de texto sin filtrado mínimo.
¿Qué son los Modelos Abliterados?
Los modelos abliterados son modelos de lenguaje de pesos abiertos que han sido procesados para eliminar las capas específicas responsables de los patrones de rechazo. A diferencia de los modelos comerciales estándar que están ajustados para ser educados y cautelosos, los pesos abliterados permiten al modelo responder temas controversiales, adultos o no convencionales sin decir 'No puedo hacer eso'. Esto se logra editando matemáticamente los pesos del modelo para suprimir el comportamiento de 'rechazo' mientras se retiene su inteligencia y capacidades de razonamiento centrales.
Estos modelos abliterados no son simplemente 'sin censura' en un sentido binario; están ajustados para uso adulto e investigación de seguridad donde se requieren salidas honestas y sin filtros. Alojamos estos pesos específicos en nuestros propios servidores GPU, proporcionando un único endpoint consistente. Obtienes todos los beneficios de un LLM sin censura sin necesidad de entender la arquitectura del modelo subyacente o gestionar los costos de inferencia de GPU.
¿Por qué usar una API alojada sin censura?
Ejecutar un LLM local sin censura requiere recursos de hardware significativos, específicamente GPUs con gran VRAM. Al usar nuestra API alojada, descargas la carga computacional pesada a nuestra infraestructura. Obtienes una interfaz compatible con OpenAI estándar, lo que significa que puedes usar el mismo código que ya conoces, solo apuntando a una URL base diferente.
Nuestro endpoint admite streaming vía SSE, permitiéndote recibir tokens en tiempo real. Esto es crítico para construir interfaces de chat responsivas o flujos de trabajo de agentes. A diferencia de los mercados que agregan docenas de modelos con calidad variable, nos enfocamos exclusivamente en un modelo sin censura diseñado para un propósito. Esto garantiza latencia y comportamiento consistentes, vitales para aplicaciones de producción donde la predictibilidad importa.
Especificaciones técnicas: Contexto y compatibilidad
La API admite una ventana de contexto de 100.000 tokens para prompt y completado. Esto te permite procesar documentos grandes, bases de código extensas o historiales de conversaciones prolongadas en una sola petición. El endpoint sigue estrictamente el formato de Chat Completions de OpenAI, garantizando una amplia compatibilidad con las herramientas existentes.
from openai import OpenAI
client = OpenAI(base_url="https://api.abliteratedmodelhub.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Las peticiones están limitadas a 8 MB en el cuerpo, y cada clave de API puede manejar 300 peticiones por minuto. Si necesitas rotar claves por seguridad o balanceo de carga, puedes regenerar tu clave en cualquier momento, lo que revoca instantáneamente la anterior. El ID del modelo es simplemente 'uncensored'. No hay endpoints de embeddings, generación de imágenes ni ajuste fino: solo completado de texto puro.
Precios: Pago por uso transparente
No cobramos cuotas mensuales ni requerimos suscripciones. Compras crédito prepago, que nunca expira. La facturación es sencilla: $0.25 por 1 millón de tokens de entrada y $1.00 por 1 millón de tokens de salida. Puedes recargar con criptomonedas (USDT o USDC), comenzando desde solo $10.
Para recargas más grandes, ofrecemos créditos bonus: +5% cuando agregas $50 o más, y +10% cuando agregas $100 o más. Este modelo de pago por uso es ideal para desarrolladores que desean controlar los costos con precisión sin comprometerse con una factura recurrente. Las cuentas nuevas reciben $0.50 en crédito de prueba, válido por 7 días, sin necesidad de tarjeta de crédito.
Para quién NO es esto
Esta API está diseñada para desarrolladores que entienden cómo funcionan los LLM y buscan un endpoint sin censura. No está pensada para usuarios finales que busquen una interfaz de chat lista para usar o un asistente de propósito general como ChatGPT. No ofrecemos enrutamiento de modelos, por lo que quedas vinculado a nuestro único modelo sin censura. Si necesitas embeddings, generación de imágenes o garantías específicas de SLA, este no es el producto adecuado. Además, aunque somos sin censura, aplicamos un límite estricto: se bloquean los contenidos que involucren a menores. Si tu caso de uso requiere contenido absolutamente sin filtros en todas las categorías, incluido ese caso específico, puede que necesites una solución diferente.
Preguntas y respuestas
¿El modelo es realmente sin censura?
Sí, el modelo ha sido abliterado para eliminar los patrones de rechazo. Responderá temas adultos, controversiales o inusuales sin atenuaciones corteses. Sin embargo, aplicamos un límite de contenido estricto: se bloquean las peticiones que contengan contenido sexual que involucre a menores. Esta es la única restricción que siempre se aplica.
¿Necesito una tarjeta de crédito para empezar?
No. Puedes registrarte solo con un correo electrónico y una contraseña. Las cuentas nuevas reciben $0.50 en crédito de prueba que dura 7 días. No necesitas proporcionar una tarjeta para acceder a este crédito de prueba ni a tu clave de API.
¿Cómo funciona la facturación?
Usamos un modelo de pago por uso sin cuotas mensuales. Compras crédito prepago y los tokens se descuentan a medida que usas la API. Los tokens de entrada cuestan $0.25 por 1M, y los tokens de salida cuestan $1.00 por 1M. El crédito nunca expira.
¿Puedo usar esto con el SDK de Python de OpenAI?
Sí. La API es totalmente compatible con OpenAI. Simplemente establece la URL base en https://api.abliteratedmodelhub.com/v1 y proporciona tu clave de API. El ID del modelo a usar es 'uncensored'. Se admite streaming y llamadas a funciones.
¿Cuál es el tamaño de la ventana de contexto?
La API admite una ventana de contexto de 100,000 tokens. Esto incluye tanto el prompt de entrada como la finalización de salida. Esto permite procesar documentos grandes o historiales de conversaciones largas en una sola petición.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave y cambia la URL base. Ese es todo el proceso de configuración.