Integreer Open Source LLM API in minuten
Gebruik onze OpenAI-compatible chat completions API voor ongecensureerde inferentie met één model, transparante prijzen en standaard SDK integratie.
Base URL en Authenticatie
Verbind met de open source llm api door je client te wijzen naar onze base URL: https://api.opensourcellmapi.com/v1. Authenticatie wordt afgehandeld via een standaard API-sleutel in de Authorization header. Je ontvangt deze sleutel direct na het aanmaken van een account op de API-sleutel verkrijgen pagina met alleen een e-mail en wachtwoord. Geen telefoonnummer of creditcard nodig om te beginnen. Als je je referenties wilt draaien, kun je je sleutel op elk moment opnieuw genereren, waardoor de vorige direct ongeldig wordt. Dit zorgt ervoor dat je de controle houdt over je toegang zonder afhankelijk te zijn van een complex dashboard.
Stuur je Eerste Verzoek
Maak een standaard POST verzoek naar /v1/chat/completions. Het endpoint verwacht een JSON body met een model veld ingesteld op uncensored en een messages array. Dit endpoint ondersteunt de standaard chat formaat, waardoor je met minimale code wijzigingen kunt overschakelen van OpenAI of andere providers. Hieronder staat een basis cURL voorbeeld om de connectiviteit te verifiëren en een tekst respons te ontvangen.
curl https://api.opensourcellmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK Integratie
Het gebruik van de officiële OpenAI Python library vereenvoudigt de integratie. Installeer het pakket via pip en initialiseer de client met je API-sleutel en onze base URL. Stel het model in op uncensored en roep de chat completions methode aan. Deze aanpak stelt je in bestaande Python LLM applicaties te gebruiken met nul wijzigingen in de inferentie logica. De library handelt serialisatie en fout parsing automatisch af.
from openai import OpenAI
client = OpenAI(base_url="https://api.opensourcellmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node.js SDK Integratie
Voor JavaScript of TypeScript projecten, gebruik de OpenAI Node.js SDK. Installeer het pakket en configureer de client met dezelfde base URL en API-sleutel. De uncensored model ID zorgt ervoor dat je ons ongecensureerde inferentie endpoint raakt. Dit stelt je in om onbeperkte LLM mogelijkheden direct te integreren in je web- of server-side applicaties terwijl je compatibiliteit behoudt met standaard OpenAI client code.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.opensourcellmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming Inschakelen (SSE)
Voor lagere latentie en real-time gebruikerservaringen, schakel streaming in door stream: true in te stellen. De API retourneert Server-Sent Events (SSE), waardoor je tokens kunt verwerken terwijl ze gegenereerd worden. Dit is ideaal voor chat interfaces waar typing indicatoren de waargenomen prestaties verbeteren. De respons structuur blijft consistent met standaard OpenAI streaming formaten, waardoor je event handlers werken zonder aangepaste parsing logica.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limieten, Fouten en Contextvenster
Je API-sleutel is beperkt tot 300 verzoeken per minuut en een 8 MB verzoek body. Het contextvenster ondersteunt tot 100.000 tokens voor de gecombineerde prompt en completion. Als je een 401 ontvangt, is je sleutel ongeldig of verlopen. Een 402 geeft onvoldoende prepaid tegoed aan; je kunt opwaarderen vanaf $10 via crypto (USDT of USDC). Een 429 betekent dat je de rate limit hebt overschreden. Alle tegoeden zijn prepaid en vervallen nooit, met bonussen beschikbaar voor grotere opwaarderingen.
API-specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Model-ID | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.opensourcellmapi.com/v1 |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON-modus | response_format: {"type": "json_object"} |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Verzoekgrootte | tot 8 MB |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
| Inloggen | Google of e-mail en wachtwoord |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Ondersteunt deze API function calling?
Ja, het <code>/v1/chat/completions</code> endpoint ondersteunt tool- en function calling. Je kunt tools definiëren in je verzoek en het model retourneert gestructureerde JSON voor tool-gebruik, compatibel met standaard OpenAI client libraries.
Wat zijn de prijzen voor deze ongecensureerde LLM?
Prijzen zijn $0,25 per 1M input tokens en $1,00 per 1M output tokens. Er zijn geen maandelijkse kosten of abonnementen. Je betaalt voor wat je gebruikt van je prepaid tegoed.
Is het ongecensureerde model hetzelfde als GPT-4 of Grok?
Nee. De model ID <code>uncensored</code> verwijst naar een open-weight model gehost op onze eigen GPU servers. Het is geen GPT, Claude, Gemini, Grok of een model van een andere leverancier. Het is specifiek afgestemd op minder content refusals terwijl het compatibel blijft met standaard chat APIs.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, verander de base URL. Dat is de hele setup.
API-sleutel aanvragen