Intégrez Open Source LLM API en quelques minutes
Utilisez notre API de complétions de chat compatible OpenAI pour une inférence sans censure avec un seul modèle, des tarifs transparents et une intégration SDK standard.
URL de base et authentification
Connectez-vous à l'api llm open source en pointant votre client vers notre URL de base : https://api.opensourcellmapi.com/v1. L'authentification est gérée via une clé API standard passée dans l'en-tête Authorization. Vous recevez cette clé immédiatement après vous être inscrit sur la page Obtenir la clé API avec simplement un e-mail et un mot de passe. Aucun numéro de téléphone ni carte bancaire n'est requis pour commencer. Si vous devez faire tourner les identifiants, vous pouvez régénérer votre clé à tout moment, ce qui révoque immédiatement la précédente. Cela garantit que vous gardez le contrôle de votre accès sans dépendre d'une interface de tableau de bord complexe.
Envoyez votre première requête
Effectuez une requête POST standard vers /v1/chat/completions. L'endpoint attend un corps JSON avec un champ model défini sur uncensored et un tableau messages. Cet endpoint prend en charge le format de chat standard, vous permettant de passer d'OpenAI ou d'autres fournisseurs avec des modifications de code minimales. Voici un exemple cURL de base pour vérifier la connectivité et recevoir une réponse textuelle.
curl https://api.opensourcellmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Intégration SDK Python
L'utilisation de la bibliothèque Python officielle OpenAI simplifie l'intégration. Installez le package via pip, puis initialisez le client avec votre clé API et notre URL de base. Définissez le modèle sur uncensored et appelez la méthode de complétions de chat. Cette approche vous permet de tirer parti des applications LLM Python existantes avec zéro modification de la logique d'inférence. La bibliothèque gère automatiquement la sérialisation et l'analyse des erreurs.
from openai import OpenAI
client = OpenAI(base_url="https://api.opensourcellmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Intégration SDK Node.js
Pour les projets JavaScript ou TypeScript, utilisez le SDK Node.js OpenAI. Installez le package et configurez le client avec la même URL de base et clé API. L'ID de modèle uncensored garantit que vous atteignez notre endpoint d'inférence sans censure. Cela vous permet d'intégrer directement les capacités LLM sans restriction dans vos applications web ou côté serveur tout en maintenant la compatibilité avec le code client OpenAI standard.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.opensourcellmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Activer le streaming (SSE)
Pour une latence plus faible et des expériences utilisateur en temps réel, activez le streaming en définissant stream: true. L'API renvoie des Server-Sent Events (SSE), vous permettant de traiter les tokens au fur et à mesure de leur génération. C'est idéal pour les interfaces de chat où les indicateurs de frappe améliorent la performance perçue. La structure de réponse reste cohérente avec les formats de streaming OpenAI standard, garantissant que vos gestionnaires d'événements fonctionnent sans logique de parsing personnalisée.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites, erreurs et fenêtre de contexte
Votre clé API est limitée à 300 requêtes par minute et à un corps de requête de 8 Mo. La fenêtre de contexte prend en charge jusqu'à 100 000 tokens pour le prompt et la complétion combinés. Si vous recevez une erreur 401, votre clé est invalide ou expirée. Une erreur 402 indique un solde de crédit prépayé insuffisant ; vous pouvez recharger à partir de 10 $ via crypto (USDT ou USDC). Une erreur 429 signifie que vous avez dépassé la limite de débit. Tous les crédits sont prépayés et n'expirent jamais, avec des bonus disponibles pour les recharges plus importantes.
Fiche technique de l'API
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Authentification | Authorization: Bearer YOUR_KEY |
| ID du modèle | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.opensourcellmapi.com/v1 |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Mode JSON | response_format: {"type": "json_object"} |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Concurrence | 8 requêtes simultanées par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite de débit | 300 requêtes par minute et par clé |
| Taille | jusqu'à 8 Mo par requête |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Connexion | Google ou e-mail et mot de passe |
Erreurs et solutions
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Cette API prend-elle en charge l'appel de fonctions ?
Oui, l'endpoint <code>/v1/chat/completions</code> prend en charge l'appel d'outils et de fonctions. Vous pouvez définir des outils dans votre requête et le modèle renverra du JSON structuré pour l'utilisation des outils, compatible avec les bibliothèques clientes OpenAI standard.
Quel est le prix de ce LLM sans censure ?
Le prix est de 0,25 $ par 1 M de tokens d'entrée et de 1,00 $ par 1 M de tokens de sortie. Aucun frais mensuel ni abonnement. Vous payez ce que vous utilisez depuis votre solde de crédit prépayé.
Le modèle sans censure est-il identique à GPT-4 ou Grok ?
Non. L'ID de modèle <code>uncensored</code> désigne un modèle à poids ouverts hébergé sur nos propres serveurs GPU. Ce n'est ni GPT, ni Claude, ni Gemini, ni Grok, ni aucun autre modèle de fournisseur. Il est spécifiquement ajusté pour réduire les refus de contenu tout en restant compatible avec les APIs de chat standard.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.
Obtenir une clé API