Integriere Open Source LLM API in Minuten
Nutze unsere OpenAI-kompatible Chat-Completions-API für unzensierte Inferenz mit einem einzigen Modell, transparenten Preisen und standardisierter SDK-Integration.
Basis-URL und Authentifizierung
Verbinde dich mit der Open-Source-LLM-API, indem du deinen Client auf unsere Basis-URL zeigst: https://api.opensourcellmapi.com/v1. Die Authentifizierung erfolgt über einen standardmäßigen API-Schlüssel, der im Authorization-Header übergeben wird. Du erhältst diesen Schlüssel sofort nach der Anmeldung auf der Seite API-Schlüssel erhalten mit nur E-Mail und Passwort. Es werden keine Telefonnummer oder Kreditkarte benötigt, um zu starten. Wenn du deine Anmeldeinformationen rotieren möchtest, kannst du deinen Schlüssel jederzeit neu generieren, wodurch der vorherige sofort ungültig wird. So behältst du die Kontrolle über deinen Zugriff, ohne dich auf eine komplexe Dashboard-Oberfläche zu verlassen.
Sende deine erste Anfrage
Stelle eine standardmäßige POST-Anfrage an /v1/chat/completions. Der Endpunkt erwartet einen JSON-Body mit einem model-Feld, das auf uncensored gesetzt ist, und einem messages-Array. Dieser Endpunkt unterstützt das Standard-Chat-Format, sodass du mit minimalen Codeänderungen von OpenAI oder anderen Anbietern wechseln kannst. Unten findest du ein grundlegendes cURL-Beispiel zur Überprüfung der Konnektivität und zum Empfangen einer Textantwort.
curl https://api.opensourcellmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python-SDK-Integration
Die Verwendung der offiziellen OpenAI Python-Bibliothek vereinfacht die Integration. Installiere das Paket über pip und initialisiere den Client mit deinem API-Schlüssel und unserer Basis-URL. Stelle das Modell auf uncensored und rufe die Chat-Vervollständigungsmethode auf. Dieser Ansatz ermöglicht es dir, bestehende Python-LLM-Anwendungen ohne Änderungen an der Inferenzlogik zu nutzen. Die Bibliothek übernimmt automatisch die Serialisierung und Fehleranalyse.
from openai import OpenAI
client = OpenAI(base_url="https://api.opensourcellmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node.js-SDK-Integration
Für JavaScript- oder TypeScript-Projekte verwende das OpenAI Node.js SDK. Installiere das Paket und konfiguriere den Client mit derselben Basis-URL und demselben API-Schlüssel. Die Modell-ID uncensored stellt sicher, dass du unseren unzensierten Inferenzendpunkt triffst. Dies ermöglicht es dir, uneingeschränkte LLM-Funktionen direkt in deine Web- oder Serveranwendungen zu integrieren, während die Kompatibilität mit Standard-OpenAI-Clientcode erhalten bleibt.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.opensourcellmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming aktivieren (SSE)
Aktiviere für geringere Latenz und Echtzeit-Benutzererfahrungen das Streaming, indem du stream: true setzt. Die API gibt Server-Sent Events (SSE) zurück, sodass du Token verarbeiten kannst, während sie generiert werden. Dies ist ideal für Chat-Oberflächen, bei denen Tipp-Indikatoren die wahrgenommene Leistung verbessern. Die Antwortstruktur bleibt konsistent mit Standard-OpenAI-Streaming-Formaten, sodass deine Event-Handler ohne benutzerdefinierte Parsing-Logik funktionieren.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limits, Fehler und Kontextfenster
Dein API-Schlüssel ist auf 300 Anfragen pro Minute und einen Anforderungstext von 8 MB begrenzt. Das Kontextfenster unterstützt bis zu 100.000 Token für die kombinierte Eingabe und Ausgabe. Wenn du einen 401 erhältst, ist dein Schlüssel ungültig oder abgelaufen. Ein 402 zeigt unzureichendes Prepaid-Guthaben an; du kannst ab 10 $ über Krypto (USDT oder USDC) aufladen. Ein 429 bedeutet, dass du das Ratenlimit überschritten hast. Alle Guthaben sind Prepaid und verfällt nie, wobei Boni für größere Aufladungen verfügbar sind.
API-Spezifikation
Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Modell-ID | uncensored |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Base-URL | https://api.opensourcellmapi.com/v1 |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON-Modus | response_format: {"type": "json_object"} |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Anfragegröße | bis 8 MB |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Anmeldung | Google oder E-Mail und Passwort |
Fehler und Lösungen
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Unterstützt diese API Function Calling?
Ja, der Endpunkt <code>/v1/chat/completions</code> unterstützt Tool- und Function Calling. Du kannst Tools in deiner Anfrage definieren, und das Modell gibt strukturiertes JSON für die Tool-Nutzung zurück, kompatibel mit Standard-OpenAI-Clientbibliotheken.
Wie ist die Preisgestaltung für dieses unzensierte LLM?
Der Preis beträgt $0,25 pro 1M Input-Token und $1,00 pro 1M Output-Token. Es gibt keine monatlichen Gebühren oder Abonnements. Du zahlst nur das, was du aus deinem Prepaid-Guthaben nutzt.
Ist das unzensierte Modell dasselbe wie GPT-4 oder Grok?
Nein. Die Modell-ID <code>uncensored</code> bezieht sich auf ein Open-Weight-Modell, das auf unseren eigenen GPU-Servern gehostet wird. Es ist kein GPT, Claude, Gemini, Grok oder ein Modell eines anderen Anbieters. Es wurde speziell für weniger Inhaltsablehnungen optimiert, bleibt aber mit Standard-Chat-APIs kompatibel.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.
API-Schlüssel erhalten