LLM API 시작하기: OpenAI 호환 엔드포인트
수분 안에 무검열 LLM API로 텍스트 생성을 시작하세요. 이 시작 가이드에서는 애플리케이션에 원본 모델 출력을 통합하는 데 필요한 OpenAI 호환 엔드포인트, SDK 설정 및 스트리밍 옵션을 다룹니다.
인증 및 기본 URL
llm api 제공자 서비스를 사용하려면 API 키가 필요합니다. 이메일과 비밀번호만으로 API 키 받기 페이지에서 가입하세요. 키는 즉시 표시됩니다. 무료 체험 크레딧에는 전화번호나 신용카드가 필요하지 않습니다. 키를 안전하게 보관하세요. 언제든지 재생성할 수 있으며, 이전 키는 무효화됩니다.
클라이언트를 기본 URL로 구성하세요. 이렇게 하면 모든 요청이 무검열 모델로 라우팅됩니다. 엔드포인트 구조는 표준 OpenAI 채팅 완성 인터페이스를 따릅니다.
- 기본 URL:
https://api.comparellmapi.com/v1 - 헤더:
Authorization: Bearer YOUR_API_KEY
이 설정은 모든 OpenAI 호환 SDK와 함께 작동합니다. 기본 URL만 조정하고 키를 주입하면 됩니다.
첫 번째 요청
연결성을 테스트하기 위해 간단한 텍스트 완성 요청을 보내세요. 이는 API 키가 유효하고 크레딧이 사용 가능함을 확인합니다. 원본 모델에 접근하려면 모델 ID uncensored를 사용하세요. 엔드포인트는 메시지가 포함된 JSON 본문을 받는 POST 요청을 허용합니다.
요청 본문이 8 MB 미만인지 확인하세요. 이 한도를 초과하면 서버가 요청을 거부합니다. 대부분의 텍스트 기반 애플리케이션에서는 단일 턴이나 짧은 대화도 이 제약 내에 잘 맞습니다.
curl https://api.comparellmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'성공하면 생성된 텍스트가 포함된 JSON 응답을 받습니다. 이는 llm api pricing 구조가 귀하의 사용량에 적용됨을 확인합니다. 각 토큰은 귀하의 잔액에 포함됩니다.
Python SDK 통합
가장 쉬운 통합을 위해 공식 OpenAI Python 라이브러리를 사용하세요. pip를 통해 패키지를 설치한 후 클라이언트를 기본 URL로 구성하세요. 이렇게 하면 chat.completions.create()와 같은 익숙한 메서드를 사용할 수 있습니다.
모델을 uncensored로 설정하세요. 표준 형식으로 메시지를 전달하세요. SDK는 직렬화 및 오류 파싱을 자동으로 처리합니다.
from openai import OpenAI
client = OpenAI(base_url="https://api.comparellmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)이 접근 방식은 백엔드 서비스나 스크립트에 이상적입니다. 라이브러리는 재시도 및 기본 오류 처리를 관리합니다. 응답 콘텐츠에서 생성된 텍스트를 확인하세요. 청구 투명성을 위해 토큰 사용 데이터에도 접근할 수 있습니다.
Node.js SDK 설정
JavaScript 또는 TypeScript 환경에서는 OpenAI Node SDK가 원활하게 작동합니다. 패키지를 설치하고 기본 URL로 클라이언트를 초기화하세요. 이는 표준 API 인터페이스와의 호환성을 유지합니다.
시스템 및 사용자 메시지를 정의합니다. 모델 ID는 uncensored로 유지됩니다. SDK는 완료 결과를 담은 프러미스를 반환합니다. API 속도 제한 또는 크레딧 부족을 관리하기 위해 오류를 적절히 처리합니다.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.comparellmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);이 방법은 웹 서버나 Node.js 애플리케이션에 적합합니다. 코드 구조는 Python 예제와 일치하여 언어 간 일관성을 보장합니다. Express 라우트나 서버리스 함수에 쉽게 통합할 수 있습니다.
스트리밍 응답 (SSE)
실시간 애플리케이션의 경우 stream 매개변수를 true로 설정하여 스트리밍을 활성화합니다. 서버는 일련의 SSE를 전송합니다. 각 이벤트에는 응답의 일부 청크가 포함됩니다.
이것은 사용자의 지각된 지연 시간을 줄입니다. 클라이언트는 생성되는 대로 토큰을 받습니다. 이는 채팅 인터페이스나 실시간 텍스트 생성에 유용합니다.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)SSE 스트림을 구문 분석하여 각 토큰을 추출하세요. 텍스트를 누적하여 완전한 응답을 구성하세요. chatgpt api 비용 및 기타 제공자는 스트리밍에 대해 유사하게 청구하지만, 우리의 무검열 모델은 이 모드에 대한 추가 요금 없이 원본 출력을 제공합니다. 스트림 종료 이벤트를 모니터링하여 응답을 완료하세요.
제한, 오류 및 컨텍스트
원활한 통합을 위해 운영 한도를 이해하세요. API 키당 분당 300개의 요청이 허용됩니다. 이를 초과하면 429 속도 제한 오류가 발생합니다. 재시도하기 전에 기다리세요.
흔한 오류로는 유효하지 않은 키에 대한 401과 부족해진 크레딧에 대한 402가 있습니다. 선불 잔액이 충분한지 확인합니다. 컨텍스트 창은 프롬프트와 완성을 위해 최대 100,000개의 토큰을 지원합니다. 잘림을 피하기 위해 토큰 사용량을 신중하게 관리하십시오.
자세한 llm api 가격 책정 정보는 가격 페이지를 참조하세요. 각 토큰은 입력 및 출력 비율에 따라 청구됩니다. 숨겨진 요금이 없습니다. 이 투명성은 애플리케이션에 대한 예산을 정확하게 책정하는 데 도움이 됩니다.
API 사양
크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.
| 항목 | 내용 |
|---|---|
| 형식 | OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작 |
| 엔드포인트 | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.comparellmapi.com/v1 |
| 모델 ID | uncensored |
| 인증 | Authorization: Bearer YOUR_KEY |
| 컨텍스트 창 | 100,000 토큰 (입력 + 출력) |
| JSON 모드 | response_format: {"type": "json_object"} |
| 파라미터 | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| 최대 출력 | 100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음) |
| 함수 호출 | 지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송 |
| 스트리밍 | 지원 — SSE, 마지막 청크에 토큰 사용량 포함 |
| 동시 요청 | 키당 동시 8개 |
| 응답 헤더 | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| 속도 제한 | 키당 분당 300회 |
| 요청 크기 | 최대 8 MB |
| 보너스 | $50 이상 +5%, $100 이상 +10% |
| 충전 | USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액 |
| 무료 체험 | $0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용 |
| 가격 | 입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00 |
| 유효기간 | 유료 크레딧은 만료되지 않으며 구독 없음 |
| 과금 | 선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료 |
| 로그인 | Google 또는 이메일과 비밀번호 |
| 콘텐츠 | 성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부 |
| 키 | 계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효 |
오류 코드
오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.
| 코드 | 유형 | 의미 |
|---|---|---|
400 | bad_request | 잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과 |
401 | missing_key · invalid_key · key_revoked | 키 없음·잘못됨·새 키로 교체됨 |
402 | no_credit | 잔액 없음 — 충전하면 즉시 재개 |
403 | content_blocked | 미성년자 관련 성적 콘텐츠 — 거부, 과금 없음 |
404 | not_found | 알 수 없는 엔드포인트 |
413 | request_too_large | 본문 8 MB 초과 |
429 | rate_limited · concurrency | 분당 300회 또는 동시 8개 초과 — 잠시 후 재시도 |
503 | upstream_busy | 모델 혼잡 — 몇 초 후 재시도 |
질문과 답변
API 키를 어떻게 재설정합니까?
계정 대시보드에서 언제든지 API 키를 재생성할 수 있습니다. 새 키를 생성하면 이전 키가 즉시 무효화되므로 애플리케이션을 새 키로 업데이트하세요. 키가 유출된 것으로 의심될 때 유용합니다.
크레딧이 부족하면 어떻게 됩니까?
선불 잔액이 0이 되면 이후 요청에서 402 오류가 발생합니다. 암호화폐(USDT 또는 USDC)로 $10부터 충전할 수 있습니다. $50 또는 $100과 같은 큰 금액을 충전하면 보너스 크레딧이 자동으로 추가됩니다.
무검열 모델은 상업적 사용에 적합한가요?
네, 이 모델은 콘텐츠 거부 없이 합법적인 성인 및 창작 용도를 위해 설계되었습니다. 미성년자가 포함된 콘텐츠에는 적합하지 않습니다. 이 모델은 오픈 웨이트 모델이며 자체 서버에서 실행되어 애플리케이션에 원본 텍스트 출력을 제공합니다.
키는 양식 하나만 작성하면 받을 수 있습니다
계정을 생성하고, 키를 복사하고, 기본 URL을 변경하세요. 설정은 이것뿐입니다.