Zintegruj Open Source LLM API w kilka minut
Korzystaj z naszego API uzupełnień czatu kompatybilnego z OpenAI do wnioskowania bez cenzury przy użyciu jednego modelu, przejrzystych cen i standardowej integracji SDK.
Adres bazowy i uwierzytelnianie
Połącz się z open source llm api, wskazując klientowi nasz bazowy URL: https://api.opensourcellmapi.com/v1. Autoryzacja odbywa się za pomocą standardowego klucza API przekazanego w nagłówku Authorization. Otrzymujesz ten klucz natychmiast po zalogowaniu się na stronie Pobierz klucz API, podając tylko adres e-mail i hasło. Nie jest wymagany numer telefonu ani karta kredytowa, aby rozpocząć. Jeśli musisz wygenerować ponownie poświadczenia, możesz wygenerować klucz ponownie w dowolnym momencie, co natychmiast unieważnia poprzedni. Zapewnia to, że zachowujesz kontrolę nad dostępem, bez polegania na skomplikowanym interfejsie panelu.
Wyślij swoje pierwsze zapytanie
Wyślij standardowe zapytanie POST do /v1/chat/completions. Endpoint oczekuje ciała JSON z polem model ustawionym na uncensored oraz tablicą messages. Ten endpoint obsługuje standardowy format czatu, pozwalając na przejście z OpenAI lub innych dostawców przy minimalnych zmianach kodu. Poniżej znajduje się podstawowy przykład cURL do sprawdzenia łączności i otrzymania odpowiedzi tekstowej.
curl https://api.opensourcellmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Integracja z Python SDK
Korzystanie z oficjalnej biblioteki Pythona OpenAI upraszcza integrację. Zainstaluj pakiet za pomocą pip, a następnie zainicjuj klienta swoim kluczem API i bazowym URL. Ustaw model na uncensored i wywołaj metodę uzupełnień czatu. To podejście pozwala wykorzystać istniejące aplikacje LLM Pythona bez modyfikacji logiki wnioskowania. Biblioteka obsługuje serializację i parsowanie błędów automatycznie.
from openai import OpenAI
client = OpenAI(base_url="https://api.opensourcellmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integracja z Node.js SDK
Dla projektów JavaScript lub TypeScript użyj SDK Node.js OpenAI. Zainstaluj pakiet i skonfiguruj klienta z tym samym bazowym URL i kluczem API. ID modelu uncensored zapewnia, że trafiasz w nasz endpoint wnioskowania bez cenzury. Pozwala to na zintegrowanie nieograniczonych możliwości LLM bezpośrednio w aplikacjach webowych lub po stronie serwera, zachowując kompatybilność ze standardowym kodem klienta OpenAI.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.opensourcellmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Włącz strumieniowanie (SSE)
Aby uzyskać niższe opóźnienia i doświadczenia użytkownika w czasie rzeczywistym, włącz strumieniowanie, ustawiając stream: true. API zwraca Wydarzenia Wysyłane przez Serwer (SSE), pozwalając na przetwarzanie tokenów w miarę ich generowania. Jest to idealne dla interfejsów czatu, gdzie wskaźniki pisania poprawiają postrzeganą wydajność. Struktura odpowiedzi pozostaje spójna ze standardowymi formatami strumieniowania OpenAI, zapewniając, że twoje programy obsługi zdarzeń działają bez niestandardowej logiki parsowania.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limity, błędy i okno kontekstu
Twój klucz API jest ograniczony do 300 zapytań na minutę i 8 MB treści zapytania. Okno kontekstu obsługuje do 100 000 tokenów dla połączonego promptu i uzupełnienia. Jeśli otrzymasz 401, twój klucz jest nieprawidłowy lub wygasł. 402 oznacza niewystarczający przedpłacony kredyt; możesz doładować od $10 za pomocą kryptowalut (USDT lub USDC). 429 oznacza, że przekroczyłeś limit zapytań. Wszystkie kredyty są przedpłacone i nigdy nie wygasają, z bonusami dostępnymi dla większych doładowań.
Parametry API
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| ID modelu | uncensored |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.opensourcellmapi.com/v1 |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Tryb JSON | response_format: {"type": "json_object"} |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Rozmiar zapytania | do 8 MB |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Bonus | +5% od $50, +10% od $100 |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
| Logowanie | Google albo e-mail i hasło |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Czy to API obsługuje wywoływanie funkcji?
Tak, endpoint <code>/v1/chat/completions</code> obsługuje wywoływanie narzędzi i funkcji. Możesz zdefiniować narzędzia w zapytaniu, a model zwróci strukturalny JSON do ich użycia, kompatybilny ze standardowymi bibliotekami klienta OpenAI.
Jaka jest cena tego LLM bez cenzury?
Ceny to $0.25 za 1M tokenów wejściowych i $1.00 za 1M tokenów wyjściowych. Nie ma miesięcznych opłat ani subskrypcji. Płacisz za to, czego używasz ze swojego salda przedpłaconego kredytu.
Czy model bez cenzury jest taki sam jak GPT-4 lub Grok?
Nie. Identyfikator modelu <code>uncensored</code> odnosi się do modelu o otwartych wagach hostowanego na naszych własnych serwerach GPU. Nie jest to GPT, Claude, Gemini, Grok ani żaden inny model dostawcy. Jest dostrojony specjalnie w celu zmniejszenia liczby odmów treści, pozostając kompatybilny ze standardowymi API czatu.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień adres bazowy. To cała konfiguracja.
Pobierz klucz API