HomeDocs
LLM API Snelstartgids | LLM API Source
Integreer onze ongecensureerde LLM API in je bestaande stack met een enkele wijziging van de base_url. Deze snelstartgids behandelt authenticatie, streaming, function calling en limieten, zodat je in minuten van nul naar productie gaat.
- Basis-URL
- https://api.llmapisource.com/v1
- Model
- ongecensureerd
Base URL en Authenticatie
Om de llm api te gebruiken, wijs je client naar https://api.llmapisource.com/v1. Authenticatie gebeurt via een standaard API-sleutel in de Authorization: Bearer <key> header. Je kunt sleutels genereren of draaien op het dashboard; het intrekken van een sleutel maakt de oude direct ongeldig.
- Voor de proefversie zijn geen telefoonnummer of creditcard nodig.
- Elk account heeft op elk moment precies één actieve sleutel.
- Prompts worden niet gebruikt voor training.
Eerste Verzoek
Stuur een eenvoudig chat completion verzoek om de connectiviteit te verifiëren. De endpoint ondersteunt standaard OpenAI JSON-structuren. Vervang de placeholder door je daadwerkelijke sleutel.
curl https://api.llmapisource.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Als de sleutel ongeldig is, ontvang je een 401-fout. Als je geen prepaid tegoed hebt, ontvang je een 402-fout. De modelidentifier is altijd uncensored.
Python SDK
Installeer de officiële OpenAI package en configureer de base_url om verzoeken naar onze infrastructuur te routeren. Dit werkt met elke OpenAI-compatible Python client.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmapisource.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Zorg dat de base_url het volledige pad naar /v1 bevat. De modelnaam moet ingesteld staan op uncensored om toegang te krijgen tot de dedicated instance.
Node SDK
Configureer de client voor Node.js-omgevingen op dezelfde manier. De structuur spiegelt de standaard OpenAI-interface, wat migratie eenvoudig maakt.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmapisource.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Geef de apiKey door en stel de basePath in op https://api.llmapisource.com/v1. Dit zorgt ervoor dat alle completations naar ons ongecensureerde model worden gerouteerd.
Streaming Inschakelen
Stel stream: true in je verzoek in om Server-Sent Events (SSE) te ontvangen. Hiermee kun je tokens verwerken terwijl ze worden gegenereerd, wat de waargenomen latentie voor lange responsen vermindert.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Verwerk de stream events om je UI real-time bij te werken. Elke chunk bevat een gedeeltelijke delta van de completion.
Limieten, Fouten en Context
Onze infrastructuur handhaaft specifieke limieten voor stabiliteit. Het contextvenster ondersteunt tot 100.000 tokens voor prompt plus completion samen.
- Rate Limit: 300 verzoeken per minuut per sleutel (retourneert 429).
- Lichaamsgrootte: Maximaal 8 MB per verzoek.
- Prijzen: $0,25/1M input tokens, $1,00/1M output tokens.
Verzoeken met seksuele inhoud met minderjarigen worden geblokkeerd. Alle andere wettelijke volwassen inhoud is toegestaan.
API-specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmapisource.com/v1 |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Model-ID | uncensored |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| JSON-modus | response_format: {"type": "json_object"} |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Verzoekgrootte | tot 8 MB |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inloggen | Google of e-mail en wachtwoord |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Is dit een OpenAI-model?
Nee. Wij draaien een dedicated open-weight model geoptimaliseerd voor onbeperkte generatie. Het is geen GPT, Claude of model van een andere leverancier, maar het gebruikt wel dezelfde API-indeling.
Heb ik een creditcard nodig voor de proefversie?
Nee. Nieuwe accounts ontvangen $0,50 aan gratis proeftegoed geldig voor 7 dagen, alleen met e-mail en wachtwoord. Er is geen kaart nodig om te beginnen.
Kan ik dit gebruiken voor function calling?
Ja. De API ondersteunt function calling via de standaard <code>tools</code> parameter in de chat completion endpoint.