홈문서
LLM API 시작하기 가이드 | LLM API Source
base_url 변경 하나로 기존 스택에 무검열 LLM API를 통합하세요. 이 시작 가이드는 인증, 스트리밍, 함수 호출 및 한계를 다루어 몇 분 안에 프로덕션에 배포할 수 있도록 합니다.
- 기본 URL
- https://api.llmapisource.com/v1
- 모델
- 무검열
Base URL 및 인증
llm api를 사용하려면 클라이언트를 https://api.llmapisource.com/v1로 설정하세요. 인증은 Authorization: Bearer <key> 헤더를 통해 전달되는 표준 API 키를 사용합니다. 대시보드에서 키를 생성하거나 회전할 수 있으며, 키를 취소하면 이전 키가 즉시 무효화됩니다.
- 체험을 위해 전화번호나 신용카드가 필요하지 않습니다.
- 각 계정은 동시에 활성 키를 하나만 보유합니다.
- 프롬프트는 학습에 사용되지 않습니다.
첫 번째 요청
연결성을 확인하기 위해 간단한 채팅 완료를 전송하세요. 엔드포인트는 표준 OpenAI JSON 구조를 지원합니다. 자리 표시자를 실제 키로 바꾸세요.
curl https://api.llmapisource.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'키가 유효하지 않으면 401 오류가 발생합니다. 선불 크레딧이 없으면 402 오류가 발생합니다. 모델 식별자는 항상 uncensored입니다.
Python SDK
공식 OpenAI 패키지를 설치하고 base URL을 설정하여 요청을 당사 인프라로 라우팅하세요. 이는 모든 OpenAI 호환 Python 클라이언트와 함께 작동합니다.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmapisource.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)base_url에 /v1의 전체 경로가 포함되어야 합니다. 전용 인스턴스에 액세스하려면 모델 이름을 uncensored로 설정해야 합니다.
Node SDK
Node.js 환경에서는 클라이언트를 유사하게 구성하세요. 구조는 표준 OpenAI 인터페이스를 반영하여 마이그레이션을 쉽게 만듭니다.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmapisource.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);apiKey를 전달하고 basePath를 https://api.llmapisource.com/v1로 설정하세요. 이렇게 하면 모든 완료가 당사 무검열 모델로 라우팅됩니다.
스트리밍 활성화
요청에 stream: true를 설정하여 서버 전송 이벤트(SSE)를 받으세요. 이렇게 하면 토큰이 생성되는 대로 처리하여 긴 응답의 지각된 지연 시간을 줄일 수 있습니다.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)스트림 이벤트를 처리하여 UI를 실시간으로 업데이트하세요. 각 청크에는 완료의 부분적 델타가 포함됩니다.
한계, 오류 및 컨텍스트
당사 인프라는 안정성을 위해 특정 한계를 적용합니다. 컨텍스트 창은 프롬프트와 완료를 합쳐 최대 100,000 토큰을 지원합니다.
- 속도 제한: 키당 분당 300개 요청 (429 반환).
- 본문 크기: 요청당 최대 8 MB.
- 가격: 입력 토큰 100만 개당 $0.25, 출력 토큰 100만 개당 $1.00.
미성년자가 관련된 성적인 콘텐츠 요청은 차단됩니다. 기타 합법적인 성인 콘텐츠는 허용됩니다.
API 사양
크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.
| 항목 | 내용 |
|---|---|
| 형식 | OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작 |
| 인증 | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmapisource.com/v1 |
| 엔드포인트 | POST /v1/chat/completions · GET /v1/models |
| 모델 ID | uncensored |
| 파라미터 | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| 함수 호출 | 지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송 |
| JSON 모드 | response_format: {"type": "json_object"} |
| 컨텍스트 창 | 100,000 토큰 (입력 + 출력) |
| 스트리밍 | 지원 — SSE, 마지막 청크에 토큰 사용량 포함 |
| 최대 출력 | 100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음) |
| 속도 제한 | 키당 분당 300회 |
| 응답 헤더 | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| 요청 크기 | 최대 8 MB |
| 동시 요청 | 키당 동시 8개 |
| 유효기간 | 유료 크레딧은 만료되지 않으며 구독 없음 |
| 보너스 | $50 이상 +5%, $100 이상 +10% |
| 가격 | 입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00 |
| 무료 체험 | $0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용 |
| 충전 | USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액 |
| 과금 | 선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료 |
| 키 | 계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효 |
| 로그인 | Google 또는 이메일과 비밀번호 |
| 콘텐츠 | 성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부 |
오류 코드
오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.
| 코드 | 유형 | 의미 |
|---|---|---|
400 | bad_request | 잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과 |
401 | missing_key · invalid_key · key_revoked | 키 없음·잘못됨·새 키로 교체됨 |
402 | no_credit | 잔액 없음 — 충전하면 즉시 재개 |
403 | content_blocked | 미성년자 관련 성적 콘텐츠 — 거부, 과금 없음 |
404 | not_found | 알 수 없는 엔드포인트 |
413 | request_too_large | 본문 8 MB 초과 |
429 | rate_limited · concurrency | 분당 300회 또는 동시 8개 초과 — 잠시 후 재시도 |
503 | upstream_busy | 모델 혼잡 — 몇 초 후 재시도 |
질문과 답변
이것은 OpenAI 모델인가요?
아닙니다. 당사는 제한 없는 생성에 최적화된 전용 오픈 웨이트 모델을 실행합니다. GPT나 Claude, 기타 벤더의 모델은 아니지만 동일한 API 형식을 사용합니다.
체험을 위해 신용카드가 필요한가요?
아닙니다. 새 계정은 이메일과 비밀번호만으로 7일 유효한 $0.50의 무료 체험 크레딧을 받습니다. 시작하기 위해 카드가 필요하지 않습니다.
이것으로 함수 호출을 사용할 수 있나요?
네. API는 채팅 완료 엔드포인트의 표준 <code>tools</code> 매개변수를 통해 함수 호출을 지원합니다.