HomeDocs
LLM-API-Schnellstart-Anleitung | LLM API Source
Setze unsere unzensierte LLM-API mit einer einzigen Änderung der base_url in deine bestehende Infrastruktur ein. Dieser Schnellstart behandelt Authentifizierung, Streaming, Function Calling und Limits, damit du in Minuten von null zur Produktion kommst.
- Base-URL
- https://api.llmapisource.com/v1
- Modell
- unzensiert
Basis-URL und Authentifizierung
Um die llm api zu nutzen, richte deinen Client auf https://api.llmapisource.com/v1 ein. Die Authentifizierung erfolgt über einen API-Schlüssel, der im Authorization: Bearer <key>-Header übergeben wird. Du kannst Schlüssel im Dashboard generieren oder rotieren; das Widerrufen eines Schlüssels macht den alten sofort ungültig.
- Für die Testphase werden keine Telefonnummer oder Kreditkarte benötigt.
- Jedes Konto hat jeweils genau einen aktiven Schlüssel.
- Prompts werden nicht zum Training verwendet.
Erste Anfrage
Sende eine einfache Chat-Abschlussanfrage, um die Konnektivität zu überprüfen. Der Endpunkt unterstützt standardmäßige OpenAI-JSON-Strukturen. Ersetze den Platzhalter durch deinen tatsächlichen Schlüssel.
curl https://api.llmapisource.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Wenn der Schlüssel ungültig ist, erhältst du einen 401-Fehler. Wenn du kein Prepaid-Guthaben hast, erhältst du einen 402-Fehler. Die Modellkennung ist immer uncensored.
Python SDK
Installiere das offizielle OpenAI-Paket und konfiguriere die Basis-URL, um Anfragen an unsere Infrastruktur zu leiten. Dies funktioniert mit jedem OpenAI-kompatiblen Python-Client.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmapisource.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Stelle sicher, dass die base_url den vollständigen Pfad zu /v1 enthält. Der Modellname muss auf uncensored gesetzt sein, um auf die dedizierte Instanz zuzugreifen.
Node SDK
Konfiguriere den Client in Node.js-Umgebungen ähnlich. Die Struktur spiegelt die Standard-Oberfläche von OpenAI wider, was die Migration einfach macht.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmapisource.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Gib die apiKey an und setze den basePath auf https://api.llmapisource.com/v1. So werden alle Vervollständigungen zu unserem unzensierten Modell geleitet.
Streaming aktivieren
Setze stream: true in deiner Anfrage, um Server-Sent Events (SSE) zu erhalten. Dies ermöglicht es dir, Token zu verarbeiten, während sie generiert werden, was die wahrgenommene Latenz bei langen Antworten reduziert.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Verarbeite die Streaming-Ereignisse, um deine Benutzeroberfläche in Echtzeit zu aktualisieren. Jeder Chunk enthält einen partiellen Delta der Vervollständigung.
Limits, Fehler und Kontext
Unsere Infrastruktur erzwingt spezifische Limits, um die Stabilität zu gewährleisten. Das Kontextfenster unterstützt bis zu 100.000 Token für Prompt und Vervollständigung zusammen.
- Ratenlimit: 300 Anfragen pro Minute pro Schlüssel (gibt 429 zurück).
- Body-Größe: Maximum 8 MB pro Anfrage.
- Preise: $0,25/1M Input-Token, $1,00/1M Output-Token.
Anfragen mit sexuellem Inhalt mit Minderjährigen werden blockiert. Alle anderen rechtmäßigen Erwachseneninhalte sind erlaubt.
API-Spezifikation
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Base-URL | https://api.llmapisource.com/v1 |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Modell-ID | uncensored |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| JSON-Modus | response_format: {"type": "json_object"} |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Anfragegröße | bis 8 MB |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Anmeldung | Google oder E-Mail und Passwort |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Ist dies ein OpenAI-Modell?
Nein. Wir betreiben ein dediziertes Open-Weight-Modell, das für uneingeschränkte Generierung optimiert ist. Es ist kein GPT-, Claude- oder ein anderes Modell eines anderen Anbieters, verwendet aber das gleiche API-Format.
Brauche ich eine Kreditkarte für die Testphase?
Nein. Neue Konten erhalten $0,50 Testguthaben, das 7 Tage lang gültig ist, wenn du nur eine E-Mail und ein Passwort verwendest. Zum Starten wird keine Karte benötigt.
Kann ich das für Function Calling verwenden?
Ja. Die API unterstützt Function Calling über den Standardparameter <code>tools</code> im Endpunkt für Chat-Abschlüsse.