FR ▾

Compare LLM APIDocs

Début rapide API LLM : Endpoints compatibles OpenAI

Commencez à générer du texte avec notre API LLM sans censure en quelques minutes. Ce guide couvre les endpoints compatibles OpenAI, la configuration du SDK et les options de streaming dont vous avez besoin pour intégrer les sorties brutes du modèle dans votre application.

Authentification et URL de base

Pour commencer à utiliser les services du fournisseur d'api LLM, vous avez besoin d'une clé API. Inscrivez-vous sur la page Obtenir la clé API avec simplement un e-mail et un mot de passe. Votre clé apparaît immédiatement. Aucun numéro de téléphone ni carte bancaire n'est requis pour le crédit d'essai. Gardez votre clé en sécurité ; vous pouvez la régénérer à tout moment, ce qui invalide la clé précédente.

Configurez votre client pour pointer vers notre URL de base. Cela garantit que toutes les requêtes sont acheminées vers notre modèle sans censure. La structure de l'endpoint imite l'interface standard des complétions de chat OpenAI.

  • URL de base : https://api.comparellmapi.com/v1
  • En-tête : Authorization: Bearer YOUR_API_KEY

Cette configuration fonctionne avec n'importe quel SDK compatible OpenAI. Vous n'avez besoin que de modifier l'URL de base et d'injecter votre clé.

Votre première requête

Envoyez une requête simple de complétion de texte pour tester la connectivité. Cela confirme que votre clé API est valide et que des crédits sont disponibles. Utilisez l'ID de modèle uncensored pour accéder au modèle brut. L'endpoint accepte les requêtes POST avec un corps JSON contenant des messages.

Assurez-vous que le corps de votre requête reste inférieur à 8 Mo. Si vous dépassez cette limite, le serveur rejettera la requête. Pour la plupart des applications textuelles, un seul tour ou une courte conversation s'inscrit bien dans cette contrainte.

curl https://api.comparellmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Si la requête réussit, vous recevez une réponse JSON contenant le texte généré. Cela confirme que la structure de prix de l'API LLM s'applique à votre utilisation. Chaque token compte pour votre solde prépayé.

Intégration SDK Python

Utilisez la bibliothèque Python officielle OpenAI pour l'intégration la plus simple. Installez le package via pip, puis configurez le client avec notre URL de base. Cela vous permet d'utiliser des méthodes familières comme chat.completions.create().

Définissez le modèle sur uncensored. Transmettez vos messages au format standard. Le SDK gère la sérialisation et l'analyse des erreurs automatiquement.

from openai import OpenAI

client = OpenAI(base_url="https://api.comparellmapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Cette approche est idéale pour les services backend ou les scripts. La bibliothèque gère les nouvelles tentatives et la gestion des erreurs de base. N'oubliez pas de vérifier le contenu de la réponse pour le texte généré. Vous pouvez également accéder aux données d'utilisation des tokens pour une transparence de facturation.

Configuration SDK Node.js

Pour les environnements JavaScript ou TypeScript, le SDK Node.js OpenAI fonctionne sans problème. Installez le package et initialisez le client avec notre URL de base. Cela maintient la compatibilité avec l'interface API standard.

Définissez vos messages système et utilisateur. L'ID de modèle reste uncensored. Le SDK retourne une promesse avec le résultat de la complétion. Gérez les erreurs de manière appropriée pour gérer les limites de l'API ou les crédits insuffisants.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.comparellmapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Cette méthode convient aux serveurs web ou aux applications Node.js. La structure du code imite l'exemple Python, assurant la cohérence entre les langages. Vous pouvez l'intégrer facilement dans les routes Express ou les fonctions serverless.

Réponses en streaming (SSE)

Pour les applications en temps réel, activez le streaming en définissant le paramètre stream sur true. Le serveur envoie une série d'événements envoyés par le serveur (SSE). Chaque événement contient un segment partiel de la réponse.

Cela réduit la latence perçue pour les utilisateurs. Le client reçoit des tokens au fur et à mesure de leur génération. Cela est utile pour les interfaces de chat ou la génération de texte en direct.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Analysez le flux SSE pour extraire chaque token. Accumulez le texte pour former la réponse complète. Le cout de l'api chatgpt et d'autres fournisseurs facturent souvent de manière similaire pour le streaming, mais notre modèle sans censure offre une sortie brute sans frais supplémentaires pour ce mode. Surveillez l'événement de fin de flux pour finaliser la réponse.

Limites, erreurs et contexte

Comprenez les limites opérationnelles pour garantir une intégration fluide. Vous pouvez effectuer 300 requêtes par minute par clé API. Si vous dépassez ce seuil, vous recevez une erreur de limite de débit 429. Attendez avant de réessayer.

Les erreurs courantes incluent 401 pour les clés invalides et 402 pour les crédits insuffisants. Assurez-vous que votre solde prépayé est suffisant. La fenêtre de contexte prend en charge jusqu'à 100 000 tokens pour le prompt plus la complétion. Gérez votre utilisation des tokens soigneusement pour éviter la troncature.

Pour des détails sur le prix de l'API LLM, consultez la page de tarification. Chaque token est facturé selon les tarifs d'entrée et de sortie. Aucun frais caché ne s'applique. Cette transparence vous aide à budgétiser précisément votre application.

Fonctions et limites

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.comparellmapi.com/v1
ID du modèleuncensored
AuthentificationAuthorization: Bearer YOUR_KEY
Fenêtre de contexte100 000 tokens (entrée + sortie)
Mode JSONresponse_format: {"type": "json_object"}
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Concurrence8 requêtes simultanées par clé
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Limite de débit300 requêtes par minute et par clé
Taillejusqu'à 8 Mo par requête
Bonus+5 % dès 50 $, +10 % dès 100 $
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
Validitéle crédit payé n'expire jamais, sans abonnement
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
ConnexionGoogle ou e-mail et mot de passe
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé
Clésune clé active par compte ; une nouvelle remplace l'ancienne

Codes d'erreur

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes

Questions et réponses

Comment réinitialiser ma clé API ?

Vous pouvez régénérer votre clé API à tout moment depuis le tableau de bord de votre compte. La génération d'une nouvelle clé révoque immédiatement l'ancienne, alors mettez à jour vos applications pour utiliser la nouvelle clé. Cela est utile si vous pensez que la clé a été compromise.

Que se passe-t-il si je manque de crédits ?

Lorsque votre solde prépayé atteint zéro, vous recevrez une erreur 402 sur les requêtes suivantes. Vous pouvez recharger à partir de 10 $ en utilisant des cryptomonnaies (USDT ou USDC). Des crédits bonus sont ajoutés automatiquement pour les recharges plus importantes de 50 $ ou 100 $.

Le modèle sans censure est-il adapté à un usage commercial ?

Oui, le modèle est conçu pour des cas d'utilisation adultes et créatifs licites sans refus de contenu. Il n'est pas adapté aux contenus impliquant des mineurs. Le modèle est à poids ouverts et s'exécute sur nos propres serveurs, fournissant une sortie de texte brut pour vos applications.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.

Obtenir une clé API