API bez cenzury
LLM bez cenzury dla programistów
Jeden, hostowany endpoint dla modeli bez cenzury, który usuwa wzorce odmowy bez narzutu zarządzania GPU. Wysyłaj prompty i odbieraj tekst z pełną kompatybilnością OpenAI.
- Endpoint czatu kompatybilny z OpenAI
- Bez subskrypcji, płatność za token
- Wsparcie dla okna kontekstu 100k
Wypróbuj jednym zapytaniem
curl https://api.abliteratedmodelhub.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.abliteratedmodelhub.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.abliteratedmodelhub.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);- $0.25
- za 1M tokenów wejściowych
- $1.00
- Tokeny wyjściowe / 1M
- 100,000
- okno kontekstu tokenów
- $0.50
- kredyt próbny
- 300
- zapytania na minutę
Co otrzymujesz
Kompatybilność standardowa
Używaj oficjalnych SDK OpenAI lub dowolnego klienta zgodnego. Zaktualizuj tylko base URL i klucz API, aby kierować zapytania do naszego endpointu bez cenzury.
Strumieniowanie i narzędzia
Wbudowane wsparcie dla strumieniowania SSE (Server-Sent Events) oraz wywoływania narzędzi/funkcji. Otrzymuj wyniki w czasie rzeczywistym i łatwo integruj złożone przepływy pracy agentów.
Przejrzysty cennik
Płać tylko za to, czego używasz. Tokeny wejściowe kosztują $0.25 za 1M, a tokeny wyjściowe $1.00 za 1M. Przedpłacony kredyt nigdy nie wygasa i nie wymaga miesięcznej opłaty.
Natychmiastowy dostęp
Zarejestruj się podając tylko e-mail i hasło. Twój klucz API jest wyświetlany natychmiast po rejestracji, co pozwala zacząć testować w ciągu sekund.
Generous Limits
Każdy klucz obsługuje 300 zapytań na minutę i obsługuje ciała zapytań do 8 MB. Wygeneruj ponownie swój klucz w dowolnym momencie, aby natychmiast unieważnić dostęp.
Oryentacja na prywatność
Prompty nie są używane do trenowania modelu. Oddzielamy użycie Twoich danych od procesu trenowania modelu, aby zapewnić czystsze wyniki eksperymentalne.
Jak to działa
Utwórz konto
Zarejestruj się podając e-mail i hasło, aby natychmiast otrzymać swój unikalny klucz API.
Skonfiguruj SDK
Wskaż swój klient kompatybilny z OpenAI na https://api.abliteratedmodelhub.com/v1 i wklej swój klucz.
Wyślij zapytania
Wywołaj endpoint /v1/chat/completions z ID modelu 'uncensored' i zacznij generować tekst.
Co budują ludzie
Pisanie kreatywne
Generuj nieograniczoną fikcję, roleplay lub tematy dla dorosłych bez przeprosin lub odmów modelu spowodowanych filtrami treści. Idealne dla autorów testujących ton i styl.
Analiza kodu
Zapytaj model ai bez cenzury o zadania programistyczne bez odmów dotyczących kontrowersyjnych tematów technologicznych lub agresywnych scenariuszy debugowania. Idealne do automatycznych potoków przeglądu kodu.
Badania bezpieczeństwa
Testowanie wstrzykiwania promptów i walidacja jailbreak stają się niezawodne, gdy bazowy model nie ogranicza sztucznie swoich odpowiedzi. Dokładnie oceniaj odporność modelu.
Ekstrakcja danych
Paruj duże dokumenty lub logi, gdzie standardowe modele mogą odmówić wypisania określonych słów kluczowych. Ekstrahuj surowe dane tekstowe z minimalnym zakłóceniem filtrów.
Czym są modele Abliterated?
Modele abliterated to modele językowe o otwartych wagach, które zostały przetworzone w celu usunięcia warstw odpowiedzialnych za wzorce odmowy. W przeciwieństwie do standardowych modeli komercyjnych, które są dostrojane, aby być uprzejmymi i ostrożnymi, wagi abliterated pozwalają modelowi odpowiadać na tematy kontrowersyjne, dorosłe lub nietypowe bez mówienia 'Nie mogę tego zrobić'. Osiąga się to poprzez matematyczną edycję wag modelu w celu stłumienia zachowania 'odmowy', zachowując jednocześnie jego podstawową inteligencję i zdolności rozumowania.
Te modele abliterated nie są 'bez cenzury' w sensie binarnym; są dostrojone do użytku dla dorosłych i badań bezpieczeństwa, gdzie wymagane są uczciwe, niefiltrowane wyniki. Hostujemy te konkretne wagi na własnych serwerach GPU, zapewniając pojedynczy, spójny endpoint. Cieszysz się pełnymi korzyściami z llm bez cenzury bez konieczności rozumienia architektury modelu bazowego lub zarządzania kosztami wnioskowania GPU.
Dlaczego użyć hostowanego API bez cenzury?
Uruchomienie lokalnego llm bez cenzury wymaga znacznych zasobów sprzętowych, a w szczególności dużych GPU z VRAM. Korzystając z naszego hostowanego API, przenosisz ciężar obliczeniowy na naszą infrastrukturę. Otrzymujesz standardowy interfejs kompatybilny z OpenAI, co oznacza, że możesz używać tego samego kodu, który już znasz, tylko wskazując na inny base URL.
Nasz endpoint obsługuje strumieniowanie przez SSE, pozwalając na otrzymywanie tokenów w czasie rzeczywistym. Jest to kluczowe dla budowania responsywnych interfejsów czatu lub przepływów pracy agentów. W przeciwieństwie do marketplace'ów agregujących dziesiątki modeli o zróżnicowanej jakości, skupiamy się wyłącznie na jednym modelu bez cenzury stworzonym do konkretnego celu. Zapewnia to spójną opóźnienie i zachowanie, co jest kluczowe dla aplikacji produkcyjnych, gdzie liczy się przewidywalność.
Specyfikacja techniczna: Kontekst i kompatybilność
API obsługuje okno kontekstu 100 000 tokenów zarówno dla promptu, jak i uzupełnienia. Pozwala to na przetwarzanie dużych dokumentów, długich baz kodu lub rozszerzonych historii konwersacji w jednym zapytaniu. Endpoint ściśle przestrzega format OpenAI Chat Completions, zapewniając szeroką kompatybilność z istniejącym narzędziem.
from openai import OpenAI
client = OpenAI(base_url="https://api.abliteratedmodelhub.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Żądania są ograniczone do 8 MB w rozmiarze ciała, a każdy klucz API może obsłużyć 300 zapytań na minutę. Jeśli musisz rotować klucze dla bezpieczeństwa lub równoważenia obciążenia, możesz wygenerować ponownie swój klucz w dowolnym momencie, co natychmiast unieważnia poprzedni. ID modelu to po prostu 'uncensored'. Nie ma endpointów embeddingów, generowania obrazów ani dostrajania — tylko czyste uzupełnianie tekstu.
Cennik: Przejrzysta płatność za użycie
Nie pobieramy miesięcznych opłat ani nie wymagamy subskrypcji. Kupujesz przedpłacony kredyt, który nigdy nie wygasa. Cennik jest prosty: $0.25 za 1 milion tokenów wejściowych i $1.00 za 1 milion tokenów wyjściowych. Możesz doładować kryptowalutą (USDT lub USDC), zaczynając od zaledwie $10.
Dla większych doładowań oferujemy bonusowe kredyty: +5% przy doładowaniu $50 lub więcej oraz +10% przy doładowaniu $100 lub więcej. Ten model płatności za użycie jest idealny dla programistów, którzy chcą precyzyjnie kontrolować koszty bez zobowiązań do cyklicznego rachunku. Nowe konta otrzymują $0.50 kredytu próbnego ważnego przez 7 dni, bez wymagania karty kredytowej.
Dla kogo to NIE JEST
To API jest zaprojektowane dla programistów, którzy rozumieją działanie LLM i chcą uzyskać dostęp do endpointu bez cenzury. Nie jest przeznaczone dla użytkowników końcowych szukających gotowego interfejsu czatu lub ogólnego asystenta, takiego jak ChatGPT. Nie oferujemy routingu modeli, więc jesteś ograniczony do naszego jednego modelu bez cenzury. Jeśli potrzebujesz embeddingów, generowania obrazów lub konkretnych gwarancji SLA, to nie jest to odpowiedni produkt. Dodatkowo, mimo że model jest bez cenzury, narzucamy ścisły limit: treści dotyczące małoletnich są blokowane. Jeśli Twój przypadek użycia wymaga absolutnie, niefiltrowanej treści we wszystkich kategoriach, w tym w tym konkretnym przypadku brzegowym, może być konieczne skorzystanie z innego rozwiązania.
Pytania i odpowiedzi
Czy model jest naprawdę bez cenzury?
Tak, model został poddany abliteracji w celu usunięcia wzorców odmowy. Odpowie na pytania dotyczące treści dla dorosłych, kontrowersyjnych lub nietypowych bez uprzejmego łagodzenia twierdzeń. Jednak narzucamy ścisły limit treści: żądania zawierające treści seksualne z udziałem małoletnich są blokowane. Jest to jedyny ograniczenie, które zawsze obowiązuje.
Czy potrzebuję karty kredytowej, aby zacząć?
Nie. Możesz zarejestrować się, podając tylko adres e-mail i hasło. Nowe konta otrzymują $0.50 kredytu próbnego, który ważny jest przez 7 dni. Nie musisz podawać karty, aby uzyskać dostęp do tego kredytu próbnego lub swojego klucza API.
Jak działa cennik?
Stosujemy model płatności za użycie bez miesięcznych opłat. Kupujesz przedpłacony kredyt, a tokeny są pobierane w miarę korzystania z API. Tokeny wejściowe kosztują $0.25 za 1 mln, a tokeny wyjściowe kosztują $1.00 za 1 mln. Kredyt nigdy nie wygasa.
Czy mogę użyć tego z Python SDK OpenAI?
Tak. API jest w pełni kompatybilne z OpenAI. Po prostu ustaw base_url na https://api.abliteratedmodelhub.com/v1 i podaj swój klucz API. ID modelu do użycia to 'uncensored'. Wspierane jest strumieniowanie i wywoływanie funkcji.
Jaki jest rozmiar okna kontekstu?
API obsługuje okno kontekstu o rozmiarze 100 000 tokenów. Obejmuje ono zarówno prompt wejściowy, jak i wygenerowane uzupełnienie. Pozwala to na przetwarzanie dużych dokumentów lub długich historii konwersacji w ramach jednego zapytania.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień base URL. To cała konfiguracja.