VI ▾
Lấy khóa API

Trang chủTài liệu

Hướng dẫn nhanh LLM API | LLM API Source

Đưa API LLM không kiểm duyệt của chúng tôi vào hệ thống hiện có của bạn chỉ bằng cách thay đổi base_url. Hướng dẫn nhanh này bao gồm xác thực, truyền phát (streaming), gọi hàm và giới hạn để bạn có thể triển khai từ đầu đến khi đưa vào sản xuất chỉ trong vài phút.

URL gốc
https://api.llmapisource.com/v1
Mô hình
không kiểm duyệt

URL cơ bản và Xác thực

Để sử dụng API LLM, hãy trỏ client của bạn đến https://api.llmapisource.com/v1. Xác thực sử dụng khóa API tiêu chuẩn được truyền trong tiêu đề Authorization: Bearer <key>. Bạn có thể tạo hoặc xoay khóa trên bảng điều khiển; việc thu hồi khóa sẽ vô hiệu hóa khóa cũ ngay lập tức.

  • Không cần số điện thoại hoặc thẻ tín dụng cho bản dùng thử.
  • Mỗi tài khoản chỉ giữ một khóa hoạt động tại một thời điểm.
  • Các prompt không được sử dụng để huấn luyện.

Yêu cầu đầu tiên

Gửi một yêu cầu chat completion đơn giản để xác minh kết nối. Endpoint này hỗ trợ các cấu trúc JSON tiêu chuẩn của OpenAI. Thay thế phần giữ chỗ bằng khóa thực tế của bạn.

curl https://api.llmapisource.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Nếu khóa không hợp lệ, bạn sẽ nhận lỗi 401. Nếu bạn không có tín dụng trả trước, bạn sẽ nhận lỗi 402. Định danh mô hình luôn là uncensored.

SDK Python

Cài đặt gói OpenAI chính thức và định cấu hình base_url để định tuyến các yêu cầu đến cơ sở hạ tầng của chúng tôi. Điều này hoạt động với bất kỳ client Python tương thích OpenAI nào.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmapisource.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Đảm bảo base_url bao gồm đường dẫn đầy đủ đến /v1. Tên mô hình phải được đặt thành uncensored để truy cập phiên bản chuyên dụng.

SDK Node.js

Đối với môi trường Node.js, hãy định cấu hình client tương tự. Cấu trúc này giống với giao diện OpenAI tiêu chuẩn, giúp việc di chuyển trở nên dễ dàng.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmapisource.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Truyền apiKey và đặt basePath thành https://api.llmapisource.com/v1. Điều này đảm bảo tất cả các kết quả hoàn thành được định tuyến đến mô hình không kiểm duyệt của chúng tôi.

Bật truyền phát

Đặt stream: true trong yêu cầu của bạn để nhận Sự kiện được gửi bởi máy chủ (SSE). Điều này cho phép bạn xử lý các token khi chúng được tạo, giảm độ trễ cảm nhận được cho các phản hồi dài.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Xử lý các sự kiện stream để cập nhật giao diện người dùng theo thời gian thực. Mỗi chunk chứa một phần delta của kết quả hoàn thành.

Giới hạn, Lỗi và Ngữ cảnh

Cơ sở hạ tầng của chúng tôi áp dụng các giới hạn cụ thể để đảm bảo sự ổn định. Cửa sổ ngữ cảnh hỗ trợ tối đa 100.000 token cho prompt và kết quả hoàn thành cộng lại.

  • Giới hạn tốc độ: 300 yêu cầu mỗi phút trên mỗi khóa (trả về 429).
  • Kích thước nội dung: Tối đa 8 MB mỗi yêu cầu.
  • Giá cả: $0.25/1M token đầu vào, $1.00/1M token đầu ra.

Các yêu cầu liên quan đến nội dung khiêu dâm với trẻ vị thành niên sẽ bị chặn. Tất cả các nội dung người lớn hợp pháp khác đều được phép.

Thông số API

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
Xác thựcAuthorization: Bearer YOUR_KEY
Base URLhttps://api.llmapisource.com/v1
EndpointPOST /v1/chat/completions · GET /v1/models
ID mô hìnhuncensored
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Chế độ JSONresponse_format: {"type": "json_object"}
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Kích thước yêu cầutối đa 8 MB
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Thưởng+5% từ $50, +10% từ $100
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ
Đăng nhậpGoogle hoặc email và mật khẩu
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Đây có phải là mô hình OpenAI không?

Không. Chúng tôi chạy một mô hình trọng số mở chuyên dụng, được tối ưu hóa cho việc tạo nội dung không giới hạn. Đây không phải là GPT, Claude hay mô hình của nhà cung cấp khác, nhưng nó sử dụng cùng định dạng API.

Tôi có cần thẻ tín dụng cho bản dùng thử không?

Không. Tài khoản mới nhận $0.50 tín dụng dùng thử có hiệu lực trong 7 ngày chỉ bằng email và mật khẩu. Không cần thẻ để bắt đầu.

Tôi có thể dùng tính năng gọi hàm không?

Có. API hỗ trợ gọi hàm và công cụ thông qua tham số <code>tools</code> tiêu chuẩn trong endpoint chat completion.