무검열 API
Abliterated Models: 개발자를 위한 무검열 API
GPU 관리 오버헤드 없이 거부 패턴을 제거하는 Abliterated 모델을 위한 단일 호스팅 API 엔드포인트입니다. 프롬프트를 보내고 텍스트를 받으며 완전한 OpenAI 호환성을 제공합니다.
- OpenAI 호환 채팅 엔드포인트
- 구독 없음, 토큰별 과금
- 100k 컨텍스트 창 지원
요청 한 번으로 시험해 보세요
curl https://api.abliteratedmodelhub.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.abliteratedmodelhub.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.abliteratedmodelhub.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);- $0.25
- 1M 입력 토큰당
- $1.00
- 출력 토큰 / 1M
- 100,000
- 토큰 컨텍스트
- $0.50
- 체험 크레딧
- 300
- 분당 요청
제공되는 기능
표준 호환성
공식 OpenAI SDK 또는 호환 가능한 클라이언트를 사용하세요. base URL과 API 키만 업데이트하면 요청이 무검열 엔드포인트로 라우팅됩니다.
스트리밍 및 도구
Server-Sent Events (SSE) 스트리밍과 도구/함수 호출 지원이 내장되어 있습니다. 실시간 출력을 얻고 복잡한 에이전트 워크플로우를 쉽게 통합하세요.
투명한 가격 정책
사용한 만큼만 지불하세요. 입력 토큰은 1M당 $0.25, 출력 토큰은 1M당 $1.00입니다. 선불 크레딧은 만료되지 않으며 월별 요금이 필요 없습니다.
즉각적인 접근
이메일과 비밀번호만으로 가입하세요. API 키는 등록 직후 표시되며, 몇 초 안에 테스트를 시작할 수 있습니다.
관대한 제한
각 키는 분당 300개의 요청을 지원하며 최대 8 MB 크기의 요청 본문을 처리합니다. 키를 언제든지 재생성하여 접근을 즉시 취소할 수 있습니다.
프라이버시 중심
프롬프트는 모델을 학습하는 데 사용되지 않습니다. 우리는 더 깨끗한 실험 결과를 위해 데이터 사용과 모델 학습 파이프라인을 분리합니다.
작동 방식
계정 만들기
이메일과 비밀번호로 등록하여 고유한 API 키를 즉시 받으세요.
SDK 구성
OpenAI 호환 클라이언트를 https://api.abliteratedmodelhub.com/v1로 설정하고 키를 삽입하세요.
요청 보내기
모델 ID 'uncensored'로 /v1/chat/completions 엔드포인트를 호출하고 텍스트 생성을 시작하세요.
사용자가 구축하는 것
창작 문학
콘텐츠 필터로 인해 사과하거나 거부하지 않고 제한 없는 소설, 역할극 또는 성인 테마를 생성하세요. 어조와 목소지를 테스트하는 작가에게 이상적입니다.
코드 분석
논쟁적인 기술 주제나 공격적인 디버깅 시나리오에서 거부 없이 코딩 작업에 무검열 AI 모델을 쿼리하세요. 자동화된 코드 검토 파이프라인에 완벽합니다.
보안 연구
프롬프트 인젝션 테스트와 젤브레이크 검증은 기본 모델이 자신의 응답을 인위적으로 제한하지 않을 때 신뢰할 수 있습니다. 모델의 견고성을 정확하게 평가하세요.
데이터 추출
표준 모델이 특정 키워드를 출력하는 것을 거부할 수 있는 큰 문서나 로그를 구문 분석하세요. 최소한의 필터링 간섭으로 원시 텍스트 데이터를 추출하세요.
Abliterated 모델이란 무엇인가요?
Abliterated 모델은 거부 패턴을 담당하는 특정 레이어를 제거하기 위해 처리된 오픈 웨이트 언어 모델입니다. 정중하고 신중하게 조정된 일반 상용 모델과 달리, Abliterated 가중치는 '그건 할 수 없어요'라고 말하지 않고도 논쟁적, 성인, 비전통적 주제에 대해 답변할 수 있게 합니다. 이는 모델의 핵심 지능과 추론 능력을 유지하면서 '거부' 행동을 억제하도록 모델의 가중치를 수학적으로 편집하여 달성됩니다.
이러한 Abliterated 모델은 단순히 이진적 의미에서 '무검열'된 것이 아닙니다. 정직하고 필터가 없는 출력이 필요한 성인용 및 보안 연구용으로 조정되었습니다. 우리는 이러한 특정 가중치를 자체 GPU 서버에 호스팅하여 단일하고 일관된 엔드포인트를 제공합니다. 기본 모델 아키텍처를 이해하거나 GPU 추론 비용을 관리할 필요 없이 무검열 LLM의 모든 혜택을 얻습니다.
호스팅된 무검열 API를 사용해야 하는 이유는?
무검열 로컬 LLM을 실행하려면 상당한 하드웨어 자원, 특히 큰 VRAM GPU가 필요합니다. 호스팅된 API를 사용하면 계산 작업을 우리 인프라로 오프로드할 수 있습니다. 표준 OpenAI 호환 인터페이스를 제공하므로 이미 알고 있는 코드를 그대로 사용하되 다른 base URL로만 연결하면 됩니다.
우리의 엔드포인트는 SSE를 통한 스트리밍을 지원하여 토큰을 실시간으로 받을 수 있습니다. 이는 반응형 채팅 인터페이스나 에이전트 워크플로우를 구축하는 데 중요합니다. 다양한 품질의 수십 가지 모델을 집계하는 마켓플레이스와 달리 우리는 단일 목적의 무검열 모델에 전념합니다. 이는 예측 가능성이 중요한 프로덕션 애플리케이션에 필수적인 일관된 지연 시간과 동작을 보장합니다.
기술 사양: 컨텍스트 및 호환성
API는 프롬프트와 완성문 모두에 대해 100,000 토큰의 컨텍스트 창을 지원합니다. 이를 통해 단일 요청에서 큰 문서, 긴 코드베이스 또는 확장된 대화 기록을 처리할 수 있습니다. 엔드포인트는 기존 도구와의 광범위한 호환성을 보장하기 위해 OpenAI Chat Completions 형식을 엄격히 따릅니다.
from openai import OpenAI
client = OpenAI(base_url="https://api.abliteratedmodelhub.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)요청 본문 크기는 8 MB로 제한되며, 각 API 키는 분당 300개의 요청을 처리할 수 있습니다. 보안 또는 부하 분산을 위해 키를 교체해야 하는 경우 언제든지 키를 재생성할 수 있으며, 이전 키는 즉시 무효화됩니다. 모델 ID는 단순히 'uncensored'입니다. 임베딩, 이미지 생성, 파인튜닝 엔드포인트는 없으며 순수 텍스트 완성만 제공합니다.
가격 정책: 투명한 사용량 기반 과금
월별 요금을 부과하거나 구독을 요구하지 않습니다. 만료되지 않는 선불 크레딧을 구매합니다. 가격 정책은 간단합니다: 입력 토큰 100만 개당 $0.25, 출력 토큰 100만 개당 $1.00. USDT 또는 USDC와 같은 암호화폐로 최소 $10부터 충전할 수 있습니다.
더 큰 충전의 경우 보너스 크레딧을 제공합니다: $50 이상 충전 시 +5%, $100 이상 충전 시 +10%. 이 사용량 기반 과금 모델은 반복 청구서에 가입하지 않고 비용을 정확하게 제어하려는 개발자에게 이상적입니다. 새 계정에는 신용카드 없이 7일 동안 유효한 $0.50의 체험 크레딧이 제공됩니다.
이 제품이 적합하지 않은 사람
이 API는 LLM의 작동 방식을 이해하고 무검열 엔드포인트를 원하는 개발자를 위해 설계되었습니다. 완성된 채팅 UI나 ChatGPT와 같은 범용 어시스턴트를 찾는 최종 사용자를 위한 제품은 아닙니다. 모델 라우팅을 제공하지 않으므로 단일 무검열 모델에 고정됩니다. 임베딩, 이미지 생성 또는 특정 SLA 보장이 필요한 경우 이 제품이 적합하지 않습니다. 또한 무검열이지만 확실한 제한을 적용합니다: 미성년자 관련 콘텐츠는 차단됩니다. 미성년자 관련 특정 예외 케이스를 포함해 모든 카테고리에서 필터링 없는 콘텐츠가 필요한 경우 다른 솔루션이 필요할 수 있습니다.
질문과 답변
모델이 정말 무검열인가요?
네, 모델은 거부 패턴을 제거하기 위해 abliterated 처리되었습니다. 예의적인 완곡한 표현 없이 성인, 논쟁적이거나 특이한 주제에 답변합니다. 그러나 확실한 콘텐츠 제한을 적용합니다: 미성년자와 관련된 성인 콘텐츠가 포함된 요청은 차단됩니다. 이것이 항상 적용되는 유일한 제한 사항입니다.
시작하려면 신용카드가 필요한가요?
아니요. 이메일과 비밀번호만으로 가입할 수 있습니다. 새 계정에는 7일 동안 유효한 $0.50의 무료 체험 크레딧이 제공됩니다. API 키나 체험 크레딧에 접근하기 위해 카드를 제공할 필요가 없습니다.
가격 정책은 어떻게 되나요?
월별 요금 없이 사용량 기반 과금 모델을 사용합니다. 선불 크레딧을 구매하고 API 사용 시 토큰이 차감됩니다. 입력 토큰은 100만 토큰당 $0.25, 출력 토큰은 100만 토큰당 $1.00입니다. 크레딧은 만료되지 않습니다.
OpenAI Python SDK와 함께 사용할 수 있나요?
네. API는 OpenAI와 완전히 호환됩니다. base_url을 https://api.abliteratedmodelhub.com/v1로 설정하고 API 키를 제공하기만 하면 됩니다. 사용할 모델 ID는 'uncensored'입니다. 스트리밍과 함수 호출이 지원됩니다.
컨텍스트 창 크기는 어떻게 되나요?
API는 100,000 토큰 컨텍스트 창을 지원합니다. 여기에는 입력 프롬프트와 출력 완료 텍스트가 모두 포함됩니다. 이를 통해 단일 요청에서 큰 문서나 긴 대화 기록을 처리할 수 있습니다.
키는 양식 하나만 작성하면 받을 수 있습니다
계정을 생성하고 키를 복사한 후 base URL을 변경하십시오. 설정은 이것뿐입니다.