Compare LLM APIDocs
Début rapide API LLM : Endpoints compatibles OpenAI
Commencez à générer du texte avec notre API LLM sans censure en quelques minutes. Ce guide couvre les endpoints compatibles OpenAI, la configuration du SDK et les options de streaming dont vous avez besoin pour intégrer les sorties brutes du modèle dans votre application.
Authentification et URL de base
Pour commencer à utiliser les services du fournisseur d'api LLM, vous avez besoin d'une clé API. Inscrivez-vous sur la page Obtenir la clé API avec simplement un e-mail et un mot de passe. Votre clé apparaît immédiatement. Aucun numéro de téléphone ni carte bancaire n'est requis pour le crédit d'essai. Gardez votre clé en sécurité ; vous pouvez la régénérer à tout moment, ce qui invalide la clé précédente.
Configurez votre client pour pointer vers notre URL de base. Cela garantit que toutes les requêtes sont acheminées vers notre modèle sans censure. La structure de l'endpoint imite l'interface standard des complétions de chat OpenAI.
- URL de base :
https://api.comparellmapi.com/v1 - En-tête :
Authorization: Bearer YOUR_API_KEY
Cette configuration fonctionne avec n'importe quel SDK compatible OpenAI. Vous n'avez besoin que de modifier l'URL de base et d'injecter votre clé.
Votre première requête
Envoyez une requête simple de complétion de texte pour tester la connectivité. Cela confirme que votre clé API est valide et que des crédits sont disponibles. Utilisez l'ID de modèle uncensored pour accéder au modèle brut. L'endpoint accepte les requêtes POST avec un corps JSON contenant des messages.
Assurez-vous que le corps de votre requête reste inférieur à 8 Mo. Si vous dépassez cette limite, le serveur rejettera la requête. Pour la plupart des applications textuelles, un seul tour ou une courte conversation s'inscrit bien dans cette contrainte.
curl https://api.comparellmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Si la requête réussit, vous recevez une réponse JSON contenant le texte généré. Cela confirme que la structure de prix de l'API LLM s'applique à votre utilisation. Chaque token compte pour votre solde prépayé.
Intégration SDK Python
Utilisez la bibliothèque Python officielle OpenAI pour l'intégration la plus simple. Installez le package via pip, puis configurez le client avec notre URL de base. Cela vous permet d'utiliser des méthodes familières comme chat.completions.create().
Définissez le modèle sur uncensored. Transmettez vos messages au format standard. Le SDK gère la sérialisation et l'analyse des erreurs automatiquement.
from openai import OpenAI
client = OpenAI(base_url="https://api.comparellmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Cette approche est idéale pour les services backend ou les scripts. La bibliothèque gère les nouvelles tentatives et la gestion des erreurs de base. N'oubliez pas de vérifier le contenu de la réponse pour le texte généré. Vous pouvez également accéder aux données d'utilisation des tokens pour une transparence de facturation.
Configuration SDK Node.js
Pour les environnements JavaScript ou TypeScript, le SDK Node.js OpenAI fonctionne sans problème. Installez le package et initialisez le client avec notre URL de base. Cela maintient la compatibilité avec l'interface API standard.
Définissez vos messages système et utilisateur. L'ID de modèle reste uncensored. Le SDK retourne une promesse avec le résultat de la complétion. Gérez les erreurs de manière appropriée pour gérer les limites de l'API ou les crédits insuffisants.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.comparellmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Cette méthode convient aux serveurs web ou aux applications Node.js. La structure du code imite l'exemple Python, assurant la cohérence entre les langages. Vous pouvez l'intégrer facilement dans les routes Express ou les fonctions serverless.
Réponses en streaming (SSE)
Pour les applications en temps réel, activez le streaming en définissant le paramètre stream sur true. Le serveur envoie une série d'événements envoyés par le serveur (SSE). Chaque événement contient un segment partiel de la réponse.
Cela réduit la latence perçue pour les utilisateurs. Le client reçoit des tokens au fur et à mesure de leur génération. Cela est utile pour les interfaces de chat ou la génération de texte en direct.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Analysez le flux SSE pour extraire chaque token. Accumulez le texte pour former la réponse complète. Le cout de l'api chatgpt et d'autres fournisseurs facturent souvent de manière similaire pour le streaming, mais notre modèle sans censure offre une sortie brute sans frais supplémentaires pour ce mode. Surveillez l'événement de fin de flux pour finaliser la réponse.
Limites, erreurs et contexte
Comprenez les limites opérationnelles pour garantir une intégration fluide. Vous pouvez effectuer 300 requêtes par minute par clé API. Si vous dépassez ce seuil, vous recevez une erreur de limite de débit 429. Attendez avant de réessayer.
Les erreurs courantes incluent 401 pour les clés invalides et 402 pour les crédits insuffisants. Assurez-vous que votre solde prépayé est suffisant. La fenêtre de contexte prend en charge jusqu'à 100 000 tokens pour le prompt plus la complétion. Gérez votre utilisation des tokens soigneusement pour éviter la troncature.
Pour des détails sur le prix de l'API LLM, consultez la page de tarification. Chaque token est facturé selon les tarifs d'entrée et de sortie. Aucun frais caché ne s'applique. Cette transparence vous aide à budgétiser précisément votre application.
Fonctions et limites
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.comparellmapi.com/v1 |
| ID du modèle | uncensored |
| Authentification | Authorization: Bearer YOUR_KEY |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Mode JSON | response_format: {"type": "json_object"} |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Concurrence | 8 requêtes simultanées par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite de débit | 300 requêtes par minute et par clé |
| Taille | jusqu'à 8 Mo par requête |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Connexion | Google ou e-mail et mot de passe |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Comment réinitialiser ma clé API ?
Vous pouvez régénérer votre clé API à tout moment depuis le tableau de bord de votre compte. La génération d'une nouvelle clé révoque immédiatement l'ancienne, alors mettez à jour vos applications pour utiliser la nouvelle clé. Cela est utile si vous pensez que la clé a été compromise.
Que se passe-t-il si je manque de crédits ?
Lorsque votre solde prépayé atteint zéro, vous recevrez une erreur 402 sur les requêtes suivantes. Vous pouvez recharger à partir de 10 $ en utilisant des cryptomonnaies (USDT ou USDC). Des crédits bonus sont ajoutés automatiquement pour les recharges plus importantes de 50 $ ou 100 $.
Le modèle sans censure est-il adapté à un usage commercial ?
Oui, le modèle est conçu pour des cas d'utilisation adultes et créatifs licites sans refus de contenu. Il n'est pas adapté aux contenus impliquant des mineurs. Le modèle est à poids ouverts et s'exécute sur nos propres serveurs, fournissant une sortie de texte brut pour vos applications.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.