Compare LLM APIDokumentation
LLM-API-Schnellstart: OpenAI-kompatible Endpunkte
Generiere mit unserer unzensierten LLM-API in wenigen Minuten Text. Dieser Schnellstart behandelt die OpenAI-kompatiblen Endpunkte, die SDK-Einrichtung und die Streaming-Optionen, die du benötigst, um rohe Modellausgaben in deine Anwendung zu integrieren.
Authentifizierung und Basis-URL
Um die Dienste des LLM-API-Anbieters zu nutzen, benötigst du einen API-Schlüssel. Melde dich auf der Seite API-Schlüssel erhalten nur mit E-Mail und Passwort an. Dein Schlüssel wird sofort angezeigt. Für das kostenlose Testguthaben werden keine Telefonnummer oder Kreditkarte benötigt. Bewahre deinen Schlüssel sicher auf; du kannst ihn jederzeit neu generieren, wodurch der vorherige Schlüssel ungültig wird.
Konfiguriere deinen Client so, dass er auf unsere Basis-URL zeigt. Dies stellt sicher, dass alle Anfragen an unser unzensiertes Modell geroutet werden. Die Endpunktstruktur spiegelt die Standard-Oberfläche für Chat-Vervollständigungen von OpenAI wider.
- Basis-URL:
https://api.comparellmapi.com/v1 - Header:
Authorization: Bearer YOUR_API_KEY
Diese Einrichtung funktioniert mit jedem OpenAI-kompatiblen SDK. Du musst nur die Basis-URL anpassen und deinen Schlüssel einfügen.
Deine erste Anfrage
Sende eine einfache Text-Vervollständigungsanfrage, um die Konnektivität zu testen. Dies bestätigt, dass dein API-Schlüssel gültig ist und Guthaben verfügbar sind. Verwende die Modell-ID uncensored, um auf das rohe Modell zuzugreifen. Der Endpunkt akzeptiert POST-Anfragen mit einem JSON-Body, der Nachrichten enthält.
Stelle sicher, dass dein Anfrage-Body 8 MB nicht überschreitet. Wenn du dieses Limit überschreitest, lehnt der Server die Anfrage ab. Für die meisten textbasierten Anwendungen passt eine einzelne Runde oder ein kurzer Konversationsverlauf gut in diese Einschränkung.
curl https://api.comparellmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Bei Erfolg erhältst du eine JSON-Antwort mit dem generierten Text. Dies bestätigt, dass die llm api pricing-Struktur für deine Nutzung gilt. Jedes Token zählt zu deinem Prepaid-Guthaben.
Python-SDK-Integration
Verwende die offizielle OpenAI Python-Bibliothek für die einfachste Integration. Installiere das Paket über pip und konfiguriere den Client mit unserer Basis-URL. So kannst du vertraute Methoden wie chat.completions.create() nutzen.
Setze das Modell auf uncensored. Übergebe deine Nachrichten im Standardformat. Das SDK übernimmt die Serialisierung und Fehleranalyse automatisch.
from openai import OpenAI
client = OpenAI(base_url="https://api.comparellmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Dieser Ansatz ist ideal für Backend-Dienste oder Skripte. Die Bibliothek verwaltet Wiederholungen und grundlegende Fehlerbehandlung. Denke daran, den Antwortinhalt auf den generierten Text zu überprüfen. Du kannst auch Token-Nutzungsdaten für mehr Transparenz bei der Abrechnung abrufen.
Node.js-SDK-Einrichtung
Für JavaScript- oder TypeScript-Umgebungen funktioniert das OpenAI Node SDK nahtlos. Installiere das Paket und initialisiere den Client mit unserer Basis-URL. Dies gewährleistet die Kompatibilität mit der Standard-API-Schnittstelle.
Definiere deine System- und Benutzer-Nachrichten. Die Modell-ID bleibt uncensored. Das SDK gibt ein Promise mit dem Vervollständigungsergebnis zurück. Behandle Fehler angemessen, um API-Limits oder unzureichendes Guthaben zu verwalten.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.comparellmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Diese Methode ist für Webserver oder Node.js-Anwendungen geeignet. Die Code-Struktur spiegelt das Python-Beispiel wider, um Konsistenz über Sprachen hinweg zu gewährleisten. Du kannst dies problemlos in Express-Routen oder serverlose Funktionen integrieren.
Streaming-Antworten (SSE)
Aktiviere für Echtzeitanwendungen das Streaming, indem du den Parameter stream auf true setzt. Der Server sendet eine Reihe von Server-Sent Events (SSE). Jedes Ereignis enthält einen Teilchunk der Antwort.
Dies reduziert die wahrgenommene Latenz für Benutzer. Der Client empfängt Token, sobald sie generiert werden. Dies ist nützlich für Chat-Oberflächen oder Live-Textgenerierung.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Analysiere den SSE-Stream, um jedes Token zu extrahieren. Sammle den Text, um die vollständige Antwort zu bilden. Die chatgpt api cost und andere Anbieter berechnen für Streaming oft ähnlich, aber unser unzensiertes Modell bietet rohe Ausgaben ohne zusätzliche Gebühren für diesen Modus. Überwache das Stream-End-Ereignis, um die Antwort abzuschließen.
Limits, Fehler und Kontext
Verstehe die Betriebslimits, um eine reibungslose Integration zu gewährleisten. Du darfst 300 Anfragen pro Minute pro API-Schlüssel senden. Wenn du dieses Limit überschreitest, erhältst du einen 429-Ratenlimit-Fehler. Warte, bevor du es erneut versuchst.
Häufige Fehler sind 401 für ungültige Schlüssel und 402 für unzureichendes Guthaben. Stelle sicher, dass dein Prepaid-Guthaben ausreicht. Das Kontextfenster unterstützt bis zu 100.000 Token für Prompt plus Vervollständigung. Verwalte deine Token-Nutzung sorgfältig, um Verkürzungen zu vermeiden.
Für detaillierte llm api pricing sieh dir die Preisseite an. Jedes Token wird gemäß den Eingabe- und Ausgabesätzen berechnet. Es fallen keine versteckten Gebühren an. Diese Transparenz hilft dir, dein Budget für deine Anwendung genau zu planen.
Funktionen und Limits
Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Base-URL | https://api.comparellmapi.com/v1 |
| Modell-ID | uncensored |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| JSON-Modus | response_format: {"type": "json_object"} |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Anfragegröße | bis 8 MB |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Anmeldung | Google oder E-Mail und Passwort |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Wie setze ich meinen API-Schlüssel zurück?
Du kannst deinen API-Schlüssel jederzeit im Dashboard deines Kontos neu generieren. Das Erzeugen eines neuen Schlüssels widerruft den alten sofort, also aktualisiere deine Anwendungen, um den neuen Schlüssel zu verwenden. Das ist nützlich, wenn du vermutest, dass der Schlüssel kompromittiert wurde.
Was passiert, wenn mein Guthaben aufgebraucht ist?
Wenn dein Prepaid-Guthaben den Nullstand erreicht, erhältst du bei nachfolgenden Anfragen einen 402-Fehler. Du kannst ab 10 $ per Kryptowährung (USDT oder USDC) aufladen. Bonusguthaben wird automatisch für größere Aufladungen von 50 $ oder 100 $ hinzugefügt.
Ist das unzensierte Modell für die kommerzielle Nutzung geeignet?
Ja, das Modell ist für legale Erwachsenen- und kreative Anwendungsfälle ohne Inhaltsfilterung konzipiert. Es ist nicht für Inhalte mit Minderjährigen geeignet. Das Modell ist ein Open-Weight-Modell, das auf unseren eigenen Servern läuft und rohe Textausgaben für deine Anwendungen bereitstellt.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.