Compare LLM APIDokumentacja
Szybki start LLM API: Endpointy kompatybilne z OpenAI
Zacznij generować tekst za pomocą naszego LLM API bez cenzury w kilka minut. Ten szybki start obejmuje endpointy kompatybilne z OpenAI, konfigurację SDK i opcje strumieniowania, które potrzebujesz do integracji surowych wyników modelu z Twoją aplikacją.
Uwierzytelnianie i URL bazowy
Aby rozpocząć korzystanie z usług dostawcy llm api, potrzebujesz klucza API. Zarejestruj się na stronie Pobierz klucz API podając tylko adres e-mail i hasło. Twój klucz pojawi się natychmiast. Nie jest wymagany numer telefonu ani karta kredytowa dla kredytu próbnego. Chroń swój klucz; możesz go wygenerować ponownie w dowolnym momencie, co unieważni poprzedni klucz.
Skonfiguruj klienta tak, aby wskazywał nasz URL bazowy. Zapewnia to, że wszystkie zapytania są kierowane do naszego modelu bez cenzury. Struktura endpointu odzwierciedla standardowy interfejs chat completions OpenAI.
- URL bazowy:
https://api.comparellmapi.com/v1 - Nagłówek:
Authorization: Bearer YOUR_API_KEY
Ta konfiguracja działa z dowolnym SDK kompatybilnym z OpenAI. Musisz tylko dostosować URL bazowy i wstrzyknąć swój klucz.
Twoje pierwsze zapytanie
Wyślij proste zapytanie o uzupełnienie tekstu, aby przetestować łączność. Potwierdza to, że Twój klucz API jest ważny i kredyty są dostępne. Użyj identyfikatora modelu uncensored, aby uzyskać dostęp do surowego modelu. Endpoint akceptuje żądania POST z ciałem JSON zawierającym wiadomości.
Upewnij się, że ciało Twojego zapytania mieści się w 8 MB. Jeśli przekroczysz ten limit, serwer odrzuci zapytanie. Dla większości aplikacji tekstowych jedna tura lub krótka rozmowa mieszczą się dobrze w tym ograniczeniu.
curl https://api.comparellmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'W przypadku powodzenia otrzymasz odpowiedź JSON z wygenerowanym tekstem. Potwierdza to, że struktura cennika llm api dotyczy Twojego użycia. Każdy token liczy się do Twojego przedpłaconego salda.
Integracja z Python SDK
Użyj oficjalnej biblioteki OpenAI Python dla najłatwiejszej integracji. Zainstaluj pakiet przez pip, a następnie skonfiguruj klienta z naszym URL bazowym. Pozwala to na używanie znanych metod takich jak chat.completions.create().
Ustaw model na uncensored. Przekaż swoje wiadomości w standardowym formacie. SDK obsługuje serializację i parsowanie błędów automatycznie.
from openai import OpenAI
client = OpenAI(base_url="https://api.comparellmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)To podejście jest idealne dla usług backendowych lub skryptów. Biblioteka zarządza ponownymi próbami i podstawową obsługą błędów. Pamiętaj, aby sprawdzić zawartość odpowiedzi pod kątem wygenerowanego tekstu. Możesz również uzyskać dostęp do danych o użyciu tokenów dla przejrzystości rozliczeń.
Konfiguracja Node.js SDK
W środowiskach JavaScript lub TypeScript SDK Node.js OpenAI działa bezproblemowo. Zainstaluj pakiet i zainicjuj klienta z naszym URL bazowym. To zapewnia kompatybilność ze standardowym interfejsem API.
Zdefiniuj swoje wiadomości systemowe i użytkownika. Identyfikator modelu pozostaje uncensored. SDK zwraca obietnicę z wynikiem uzupełnienia. Obsłuż błędy odpowiednio, aby zarządzać limitami API lub niewystarczającymi kredytami.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.comparellmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Ta metoda jest odpowiednia dla serwerów sieciowych lub aplikacji Node.js. Struktura kodu odzwierciedla przykład Pythona, zapewniając spójność między językami. Możesz łatwo zintegrować to z trasami Express lub funkcjami serverless.
Odpowiedzi strumieniowe (SSE)
Dla aplikacji w czasie rzeczywistym włącz strumieniowanie, ustawiając parametr stream na true. Serwer wysyła serię zdarzeń wysłanych przez serwer (SSE). Każde zdarzenie zawiera częściowy fragment odpowiedzi.
Zmniejsza to postrzeganą opóźnienie dla użytkowników. Klient otrzymuje tokeny, gdy są generowane. Jest to przydatne dla interfejsów czatu lub generowania tekru na żywo.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Sparsuj strumień SSE, aby wyodrębnić każdy token. Kumuluj tekst, aby utworzyć pełną odpowiedź. Koszt chatgpt api i innych dostawców często jest podobny przy strumieniowaniu, ale nasz model bez cenzury oferuje surowe dane wyjściowe bez dodatkowych opłat za ten tryb. Monitoruj zdarzenie końca strumienia, aby sfinalizować odpowiedź.
Limity, błędy i kontekst
Zrozum limity operacyjne, aby zapewnić płynną integrację. Masz dozwolone 300 zapytań na minutę na klucz API. Jeśli przekroczysz ten limit, otrzymasz błąd limitu zapytań 429. Poczekaj przed ponowną próbą.
Typowe błędy to 401 dla nieprawidłowych kluczy i 402 za niewystarczający kredyt. Upewnij się, że Twoje saldo przedpłacone jest wystarczające. Okno kontekstu obsługuje do 100 000 tokenów dla prompta i uzupełnienia. Zarządzaj zużyciem tokenów ostrożnie, aby uniknąć ucięcia.
Szczegółowe ceny llm api znajdziesz na stronie z cenami. Każdy token jest rozliczany zgodnie z stawkami za dane wejściowe i wyjściowe. Nie ma ukrytych opłat. Ta przejrzystość pomaga Ci planować budżet dla swojej aplikacji.
Parametry API
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.comparellmapi.com/v1 |
| ID modelu | uncensored |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Tryb JSON | response_format: {"type": "json_object"} |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Rozmiar zapytania | do 8 MB |
| Bonus | +5% od $50, +10% od $100 |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Logowanie | Google albo e-mail i hasło |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Jak zresetować klucz API?
Możesz wygenerować ponownie klucz API w dowolnym momencie w panelu konta. Wygenerowanie nowego klucza natychmiast unieważnia stary, więc zaktualizuj aplikacje, aby używały nowego klucza. Jest to przydatne, jeśli podejrzewasz, że klucz został skompromitowany.
Co się stanie, gdy zabraknie kredytów?
Gdy stan przedpłaconego salda osiągnie zero, otrzymasz błąd 402 przy kolejnych zapytaniach. Możesz doładować konto od $10 za pomocą kryptowalut (USDT lub USDC). Bonusowe kredyty są dodawane automatycznie przy większych doładowaniach $50 lub $100.
Czy model bez cenzury nadaje się do użytku komercyjnego?
Tak, model jest przeznaczony do prawnego użytku dorosłego i kreatywnego bez odrzucania treści. Nie nadaje się do treści dotyczących małoletnich. Model ma otwarte wagi i działa na naszych serwerach, dostarczając surowy tekst wyjściowy dla Twoich aplikacji.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień URL bazowy. To cała konfiguracja.