NL ▾
API-sleutel aanvragen

HomeDocs

LLM API Snelstartgids | LLM API Source

Integreer onze ongecensureerde LLM API in je bestaande stack met een enkele wijziging van de base_url. Deze snelstartgids behandelt authenticatie, streaming, function calling en limieten, zodat je in minuten van nul naar productie gaat.

Basis-URL
https://api.llmapisource.com/v1
Model
ongecensureerd

Base URL en Authenticatie

Om de llm api te gebruiken, wijs je client naar https://api.llmapisource.com/v1. Authenticatie gebeurt via een standaard API-sleutel in de Authorization: Bearer <key> header. Je kunt sleutels genereren of draaien op het dashboard; het intrekken van een sleutel maakt de oude direct ongeldig.

  • Voor de proefversie zijn geen telefoonnummer of creditcard nodig.
  • Elk account heeft op elk moment precies één actieve sleutel.
  • Prompts worden niet gebruikt voor training.

Eerste Verzoek

Stuur een eenvoudig chat completion verzoek om de connectiviteit te verifiëren. De endpoint ondersteunt standaard OpenAI JSON-structuren. Vervang de placeholder door je daadwerkelijke sleutel.

curl https://api.llmapisource.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Als de sleutel ongeldig is, ontvang je een 401-fout. Als je geen prepaid tegoed hebt, ontvang je een 402-fout. De modelidentifier is altijd uncensored.

Python SDK

Installeer de officiële OpenAI package en configureer de base_url om verzoeken naar onze infrastructuur te routeren. Dit werkt met elke OpenAI-compatible Python client.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmapisource.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Zorg dat de base_url het volledige pad naar /v1 bevat. De modelnaam moet ingesteld staan op uncensored om toegang te krijgen tot de dedicated instance.

Node SDK

Configureer de client voor Node.js-omgevingen op dezelfde manier. De structuur spiegelt de standaard OpenAI-interface, wat migratie eenvoudig maakt.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmapisource.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Geef de apiKey door en stel de basePath in op https://api.llmapisource.com/v1. Dit zorgt ervoor dat alle completations naar ons ongecensureerde model worden gerouteerd.

Streaming Inschakelen

Stel stream: true in je verzoek in om Server-Sent Events (SSE) te ontvangen. Hiermee kun je tokens verwerken terwijl ze worden gegenereerd, wat de waargenomen latentie voor lange responsen vermindert.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Verwerk de stream events om je UI real-time bij te werken. Elke chunk bevat een gedeeltelijke delta van de completion.

Limieten, Fouten en Context

Onze infrastructuur handhaaft specifieke limieten voor stabiliteit. Het contextvenster ondersteunt tot 100.000 tokens voor prompt plus completion samen.

  • Rate Limit: 300 verzoeken per minuut per sleutel (retourneert 429).
  • Lichaamsgrootte: Maximaal 8 MB per verzoek.
  • Prijzen: $0,25/1M input tokens, $1,00/1M output tokens.

Verzoeken met seksuele inhoud met minderjarigen worden geblokkeerd. Alle andere wettelijke volwassen inhoud is toegestaan.

API-specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
AuthenticatieAuthorization: Bearer YOUR_KEY
Base URLhttps://api.llmapisource.com/v1
EndpointsPOST /v1/chat/completions · GET /v1/models
Model-IDuncensored
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
JSON-modusresponse_format: {"type": "json_object"}
Contextvenster100.000 tokens (invoer + uitvoer)
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
Rate limit300 verzoeken per minuut per sleutel
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Verzoekgroottetot 8 MB
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Bonus+5% vanaf $50, +10% vanaf $100
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
InloggenGoogle of e-mail en wachtwoord
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Is dit een OpenAI-model?

Nee. Wij draaien een dedicated open-weight model geoptimaliseerd voor onbeperkte generatie. Het is geen GPT, Claude of model van een andere leverancier, maar het gebruikt wel dezelfde API-indeling.

Heb ik een creditcard nodig voor de proefversie?

Nee. Nieuwe accounts ontvangen $0,50 aan gratis proeftegoed geldig voor 7 dagen, alleen met e-mail en wachtwoord. Er is geen kaart nodig om te beginnen.

Kan ik dit gebruiken voor function calling?

Ja. De API ondersteunt function calling via de standaard <code>tools</code> parameter in de chat completion endpoint.