ES ▾
Obtener clave de API

InicioDocumentación

Guía de inicio rápido de la API LLM | LLM API Source

Integra nuestra API LLM sin censura en tu stack existente con un solo cambio en la base_url. Esta guía rápida cubre autenticación, streaming, llamadas a funciones y límites para que pases de cero a producción en minutos.

URL base
https://api.llmapisource.com/v1
Modelo
sin censura

URL base y autenticación

Para usar la API LLM, apunta tu cliente a https://api.llmapisource.com/v1. La autenticación utiliza una clave de API estándar pasada en el encabezado Authorization: Bearer <key>. Puedes generar o rotar claves en el panel; revocar una clave invalida inmediatamente la anterior.

  • No se requiere número de teléfono ni tarjeta de crédito para la prueba.
  • Cada cuenta tiene exactamente una clave activa a la vez.
  • Los prompts no se utilizan para entrenamiento.

Primera petición

Envía una finalización de chat simple para verificar la conectividad. El endpoint admite estructuras JSON estándar de OpenAI. Reemplaza el marcador con tu clave real.

curl https://api.llmapisource.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Si la clave no es válida, recibes un error 401. Si no tienes crédito prepago, recibes un error 402. El identificador del modelo es siempre uncensored.

SDK de Python

Instala el paquete oficial de OpenAI y configura la URL base para enrutar las peticiones a nuestra infraestructura. Esto funciona con cualquier cliente de Python compatible con OpenAI.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmapisource.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Asegúrate de que el base_url incluya la ruta completa a /v1. El nombre del modelo debe configurarse como uncensored para acceder a la instancia dedicada.

SDK de Node.js

Para entornos Node.js, configura el cliente de manera similar. La estructura refleja la interfaz estándar de OpenAI, lo que facilita la migración.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmapisource.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Pasa la apiKey apiKey y establece basePath basePath en https://api.llmapisource.com/v1. Esto asegura que todos los completions se enruten a nuestro modelo sin censura.

Habilitar streaming

Establece stream: true en tu petición para recibir Eventos Enviados por Servidor (SSE). Esto te permite procesar tokens a medida que se generan, reduciendo la latencia percibida para respuestas largas.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Maneja los eventos de streaming para actualizar tu interfaz en tiempo real. Cada fragmento contiene un delta parcial del completion.

Límites, errores y contexto

Nuestra infraestructura aplica límites específicos para garantizar la estabilidad. La ventana de contexto admite hasta 100,000 tokens para prompt y completion combinados.

  • Límite de peticiones: 300 peticiones por minuto por clave (devuelve 429).
  • Tamaño del cuerpo: Máximo 8 MB por petición.
  • Precios: $0.25/1M tokens de entrada, $1.00/1M tokens de salida.

Se bloquean las peticiones que contienen contenido sexual con menores. Se permite todo el contenido adulto legal restante.

Ficha técnica de la API

Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
AutenticaciónAuthorization: Bearer YOUR_KEY
Base URLhttps://api.llmapisource.com/v1
EndpointsPOST /v1/chat/completions · GET /v1/models
ID del modelouncensored
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Modo JSONresponse_format: {"type": "json_object"}
Ventana de contexto100.000 tokens (entrada + salida)
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Límite de peticiones300 por minuto por clave
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Tamaño de peticiónhasta 8 MB
Concurrencia8 peticiones a la vez por clave
Caducidadel crédito pagado no caduca, sin suscripción
Bono+5 % desde $50, +10 % desde $100
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior
AccesoGoogle o correo y contraseña
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores

Códigos de error

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas y respuestas

¿Es este un modelo de OpenAI?

No. Ejecutamos un modelo de pesos abiertos dedicado optimizado para generación sin restricciones. No es GPT, Claude ni ningún otro modelo de proveedor, pero utiliza el mismo formato de API.

¿Necesito una tarjeta de crédito para la prueba?

No. Las cuentas nuevas reciben $0.50 de crédito de prueba válido por 7 días usando solo un correo electrónico y una contraseña. No se requiere tarjeta para comenzar.

¿Puedo usar esto para llamadas a funciones?

Sí. La API admite llamadas a funciones y herramientas a través del parámetro estándar <code>tools</code> en el endpoint de finalización de chat.