InicioDocumentación
Guía de inicio rápido de la API LLM | LLM API Source
Integra nuestra API LLM sin censura en tu stack existente con un solo cambio en la base_url. Esta guía rápida cubre autenticación, streaming, llamadas a funciones y límites para que pases de cero a producción en minutos.
- URL base
- https://api.llmapisource.com/v1
- Modelo
- sin censura
URL base y autenticación
Para usar la API LLM, apunta tu cliente a https://api.llmapisource.com/v1. La autenticación utiliza una clave de API estándar pasada en el encabezado Authorization: Bearer <key>. Puedes generar o rotar claves en el panel; revocar una clave invalida inmediatamente la anterior.
- No se requiere número de teléfono ni tarjeta de crédito para la prueba.
- Cada cuenta tiene exactamente una clave activa a la vez.
- Los prompts no se utilizan para entrenamiento.
Primera petición
Envía una finalización de chat simple para verificar la conectividad. El endpoint admite estructuras JSON estándar de OpenAI. Reemplaza el marcador con tu clave real.
curl https://api.llmapisource.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Si la clave no es válida, recibes un error 401. Si no tienes crédito prepago, recibes un error 402. El identificador del modelo es siempre uncensored.
SDK de Python
Instala el paquete oficial de OpenAI y configura la URL base para enrutar las peticiones a nuestra infraestructura. Esto funciona con cualquier cliente de Python compatible con OpenAI.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmapisource.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Asegúrate de que el base_url incluya la ruta completa a /v1. El nombre del modelo debe configurarse como uncensored para acceder a la instancia dedicada.
SDK de Node.js
Para entornos Node.js, configura el cliente de manera similar. La estructura refleja la interfaz estándar de OpenAI, lo que facilita la migración.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmapisource.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Pasa la apiKey apiKey y establece basePath basePath en https://api.llmapisource.com/v1. Esto asegura que todos los completions se enruten a nuestro modelo sin censura.
Habilitar streaming
Establece stream: true en tu petición para recibir Eventos Enviados por Servidor (SSE). Esto te permite procesar tokens a medida que se generan, reduciendo la latencia percibida para respuestas largas.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Maneja los eventos de streaming para actualizar tu interfaz en tiempo real. Cada fragmento contiene un delta parcial del completion.
Límites, errores y contexto
Nuestra infraestructura aplica límites específicos para garantizar la estabilidad. La ventana de contexto admite hasta 100,000 tokens para prompt y completion combinados.
- Límite de peticiones: 300 peticiones por minuto por clave (devuelve 429).
- Tamaño del cuerpo: Máximo 8 MB por petición.
- Precios: $0.25/1M tokens de entrada, $1.00/1M tokens de salida.
Se bloquean las peticiones que contienen contenido sexual con menores. Se permite todo el contenido adulto legal restante.
Ficha técnica de la API
Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| Autenticación | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmapisource.com/v1 |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID del modelo | uncensored |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Modo JSON | response_format: {"type": "json_object"} |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Límite de peticiones | 300 por minuto por clave |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Tamaño de petición | hasta 8 MB |
| Concurrencia | 8 peticiones a la vez por clave |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Bono | +5 % desde $50, +10 % desde $100 |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
| Acceso | Google o correo y contraseña |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
Códigos de error
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿Es este un modelo de OpenAI?
No. Ejecutamos un modelo de pesos abiertos dedicado optimizado para generación sin restricciones. No es GPT, Claude ni ningún otro modelo de proveedor, pero utiliza el mismo formato de API.
¿Necesito una tarjeta de crédito para la prueba?
No. Las cuentas nuevas reciben $0.50 de crédito de prueba válido por 7 días usando solo un correo electrónico y una contraseña. No se requiere tarjeta para comenzar.
¿Puedo usar esto para llamadas a funciones?
Sí. La API admite llamadas a funciones y herramientas a través del parámetro estándar <code>tools</code> en el endpoint de finalización de chat.