Integre o Open Source LLM API em Minutos
Use nossa API de conclusões de chat compatível com OpenAI para inferência sem censura com um único modelo, preços transparentes e integração SDK padrão.
URL Base e Autenticação
Conecte-se à api de llm open source apontando seu cliente para nossa URL base: https://api.opensourcellmapi.com/v1. A autenticação é feita por meio de uma chave de API padrão passada no cabeçalho Authorization. Você recebe essa chave imediatamente após entrar na página Obter chave de API com apenas e-mail e senha. Não é necessário número de telefone ou cartão de crédito para começar. Se precisar rotacionar as credenciais, você pode regenerar sua chave a qualquer momento, o que revoga imediatamente a anterior. Isso garante que você mantenha o controle do seu acesso sem depender de uma interface de painel complexa.
Envie sua primeira requisição
Faça uma solicitação POST padrão para /v1/chat/completions. O endpoint espera um corpo JSON com um campo model definido como uncensored e uma matriz messages. Este endpoint suporta o formato de chat padrão, permitindo que você migre de OpenAI ou outros provedores com alterações mínimas de código. Abaixo está um exemplo básico de cURL para verificar a conectividade e receber uma resposta de texto.
curl https://api.opensourcellmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Integração com SDK Python
Usar a biblioteca oficial OpenAI Python simplifica a integração. Instale o pacote via pip e, em seguida, inicialize o cliente com sua chave de API e nossa URL base. Defina o modelo como uncensored e chame o método de conclusões de chat. Essa abordagem permite que você aproveite aplicativos LLM Python existentes com zero modificação na lógica de inferência. A biblioteca cuida automaticamente da serialização e do parse de erros.
from openai import OpenAI
client = OpenAI(base_url="https://api.opensourcellmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integração com SDK Node.js
Para projetos em JavaScript ou TypeScript, use o SDK Node.js da OpenAI. Instale o pacote e configure o cliente com a mesma URL base e chave de API. O ID do modelo uncensored garante que você está acessando nosso endpoint de inferência sem censura. Isso permite integrar capacidades de LLM sem restrições diretamente em suas aplicações web ou do lado do servidor, mantendo a compatibilidade com o código padrão do cliente OpenAI.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.opensourcellmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Ativar Streaming (SSE)
Para menor latência e experiências de usuário em tempo real, ative o streaming definindo stream: true. A API retorna Server-Sent Events (SSE), permitindo que você processe tokens conforme são gerados. Isso é ideal para interfaces de chat onde indicadores de digitação melhoram o desempenho percebido. A estrutura da resposta permanece consistente com os formatos de streaming padrão do OpenAI, garantindo que seus manipuladores de eventos funcionem sem lógica de análise personalizada.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites, Erros e Janela de Contexto
Sua chave de API está limitada a 300 requisições por minuto e um corpo de requisição de 8 MB. A janela de contexto suporta até 100.000 tokens para o prompt e a conclusão combinados. Se você receber um 401, sua chave é inválida ou expirada. Um 402 indica crédito pré-pago insuficiente; você pode recarregar a partir de $10 via cripto (USDT ou USDC). Um 429 significa que você excedeu o limite de requisições. Todos os créditos são pré-pagos e nunca expiram, com bônus disponíveis para recargas maiores.
Ficha técnica da API
Uma tabela com cada limite, recurso e preço.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| Autenticação | Authorization: Bearer YOUR_KEY |
| ID do modelo | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.opensourcellmapi.com/v1 |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Modo JSON | response_format: {"type": "json_object"} |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite de taxa | 300 requisições por minuto por chave |
| Tamanho | até 8 MB por requisição |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Validade | crédito pago não expira, sem assinatura |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
| Login | Google ou e-mail e senha |
Erros e o que fazer
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
Esta API suporta chamada de funções?
Sim, o endpoint <code>/v1/chat/completions</code> suporta chamada de ferramentas e funções. Você pode definir ferramentas na sua requisição e o modelo retornará JSON estruturado para uso de ferramentas, compatível com bibliotecas padrão de clientes OpenAI.
Qual é o preço deste LLM sem censura?
O preço é $0,25 por 1M de tokens de entrada e $1,00 por 1M de tokens de saída. Não há taxas ou assinaturas mensais. Você paga pelo que usar do seu saldo de crédito pré-pago.
O modelo sem censura é o mesmo que GPT-4 ou Grok?
Não. O ID do modelo <code>uncensored</code> refere-se a um modelo de pesos abertos hospedado em nossos próprios servidores GPU. Não é GPT, Claude, Gemini, Grok ou qualquer outro modelo de fornecedor. É ajustado especificamente para menos recusas de conteúdo, mantendo a compatibilidade com APIs de chat padrão.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.
Obter chave de API