DE ▾
API-Schlüssel erhalten

HomeDocs

LLM-API-Schnellstart-Anleitung | LLM API Source

Setze unsere unzensierte LLM-API mit einer einzigen Änderung der base_url in deine bestehende Infrastruktur ein. Dieser Schnellstart behandelt Authentifizierung, Streaming, Function Calling und Limits, damit du in Minuten von null zur Produktion kommst.

Base-URL
https://api.llmapisource.com/v1
Modell
unzensiert

Basis-URL und Authentifizierung

Um die llm api zu nutzen, richte deinen Client auf https://api.llmapisource.com/v1 ein. Die Authentifizierung erfolgt über einen API-Schlüssel, der im Authorization: Bearer <key>-Header übergeben wird. Du kannst Schlüssel im Dashboard generieren oder rotieren; das Widerrufen eines Schlüssels macht den alten sofort ungültig.

  • Für die Testphase werden keine Telefonnummer oder Kreditkarte benötigt.
  • Jedes Konto hat jeweils genau einen aktiven Schlüssel.
  • Prompts werden nicht zum Training verwendet.

Erste Anfrage

Sende eine einfache Chat-Abschlussanfrage, um die Konnektivität zu überprüfen. Der Endpunkt unterstützt standardmäßige OpenAI-JSON-Strukturen. Ersetze den Platzhalter durch deinen tatsächlichen Schlüssel.

curl https://api.llmapisource.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Wenn der Schlüssel ungültig ist, erhältst du einen 401-Fehler. Wenn du kein Prepaid-Guthaben hast, erhältst du einen 402-Fehler. Die Modellkennung ist immer uncensored.

Python SDK

Installiere das offizielle OpenAI-Paket und konfiguriere die Basis-URL, um Anfragen an unsere Infrastruktur zu leiten. Dies funktioniert mit jedem OpenAI-kompatiblen Python-Client.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmapisource.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Stelle sicher, dass die base_url den vollständigen Pfad zu /v1 enthält. Der Modellname muss auf uncensored gesetzt sein, um auf die dedizierte Instanz zuzugreifen.

Node SDK

Konfiguriere den Client in Node.js-Umgebungen ähnlich. Die Struktur spiegelt die Standard-Oberfläche von OpenAI wider, was die Migration einfach macht.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmapisource.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Gib die apiKey an und setze den basePath auf https://api.llmapisource.com/v1. So werden alle Vervollständigungen zu unserem unzensierten Modell geleitet.

Streaming aktivieren

Setze stream: true in deiner Anfrage, um Server-Sent Events (SSE) zu erhalten. Dies ermöglicht es dir, Token zu verarbeiten, während sie generiert werden, was die wahrgenommene Latenz bei langen Antworten reduziert.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Verarbeite die Streaming-Ereignisse, um deine Benutzeroberfläche in Echtzeit zu aktualisieren. Jeder Chunk enthält einen partiellen Delta der Vervollständigung.

Limits, Fehler und Kontext

Unsere Infrastruktur erzwingt spezifische Limits, um die Stabilität zu gewährleisten. Das Kontextfenster unterstützt bis zu 100.000 Token für Prompt und Vervollständigung zusammen.

  • Ratenlimit: 300 Anfragen pro Minute pro Schlüssel (gibt 429 zurück).
  • Body-Größe: Maximum 8 MB pro Anfrage.
  • Preise: $0,25/1M Input-Token, $1,00/1M Output-Token.

Anfragen mit sexuellem Inhalt mit Minderjährigen werden blockiert. Alle anderen rechtmäßigen Erwachseneninhalte sind erlaubt.

API-Spezifikation

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
AuthentifizierungAuthorization: Bearer YOUR_KEY
Base-URLhttps://api.llmapisource.com/v1
EndpunktePOST /v1/chat/completions · GET /v1/models
Modell-IDuncensored
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
JSON-Modusresponse_format: {"type": "json_object"}
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Ratenlimit300 Anfragen pro Minute und Schlüssel
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Anfragegrößebis 8 MB
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
Bonus+5 % ab $50, +10 % ab $100
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
AnmeldungGoogle oder E-Mail und Passwort
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Ist dies ein OpenAI-Modell?

Nein. Wir betreiben ein dediziertes Open-Weight-Modell, das für uneingeschränkte Generierung optimiert ist. Es ist kein GPT-, Claude- oder ein anderes Modell eines anderen Anbieters, verwendet aber das gleiche API-Format.

Brauche ich eine Kreditkarte für die Testphase?

Nein. Neue Konten erhalten $0,50 Testguthaben, das 7 Tage lang gültig ist, wenn du nur eine E-Mail und ein Passwort verwendest. Zum Starten wird keine Karte benötigt.

Kann ich das für Function Calling verwenden?

Ja. Die API unterstützt Function Calling über den Standardparameter <code>tools</code> im Endpunkt für Chat-Abschlüsse.