ES ▾

Compare LLM APIDocumentación

Inicio rápido de la API LLM: Endpoints compatibles con OpenAI

Empieza a generar texto con nuestra API LLM sin censura en minutos. Esta guía rápida cubre los endpoints compatibles con OpenAI, la configuración del SDK y las opciones de streaming que necesitas para integrar las salidas del modelo sin procesar en tu aplicación.

Autenticación y URL base

Para empezar a usar los servicios del proveedor de API LLM, necesitas una clave de API. Regístrate en la página Obtener clave de API con solo un correo electrónico y una contraseña. Tu clave aparece inmediatamente. No se requiere número de teléfono ni tarjeta de crédito para el crédito de prueba. Mantén tu clave segura; puedes regenerarla en cualquier momento, lo que invalida la clave anterior.

Configura tu cliente para apuntar a nuestra URL base. Esto asegura que todas las peticiones se enruten a nuestro modelo sin censura. La estructura del endpoint refleja la interfaz estándar de finalización de chat de OpenAI.

  • URL base: https://api.comparellmapi.com/v1
  • Cabecera: Authorization: Bearer YOUR_API_KEY

Esta configuración funciona con cualquier SDK compatible con OpenAI. Solo necesitas ajustar la URL base e inyectar tu clave.

Tu primera petición

Envía una petición simple de finalización de texto para probar la conectividad. Esto confirma que tu clave de API es válida y que hay créditos disponibles. Usa el ID del modelo uncensored para acceder al modelo sin procesar. El endpoint acepta peticiones POST con un cuerpo JSON que contiene mensajes.

Asegúrate de que el cuerpo de tu petición no supere los 8 MB. Si excedes este límite, el servidor rechazará la petición. Para la mayoría de las aplicaciones basadas en texto, una sola vuelta o una conversación corta se ajusta bien a esta restricción.

curl https://api.comparellmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Si tienes éxito, recibirás una respuesta JSON con el texto generado. Esto confirma que la estructura de precios de la API LLM se aplica a tu uso. Cada token cuenta para tu saldo prepago.

Integración con SDK de Python

Usa la biblioteca oficial de Python de OpenAI para la integración más sencilla. Instala el paquete vía pip, luego configura el cliente con nuestra URL base. Esto te permite usar métodos familiares como chat.completions.create().

Establece el modelo en uncensored. Pasa tus mensajes en el formato estándar. El SDK maneja la serialización y el análisis de errores automáticamente.

from openai import OpenAI

client = OpenAI(base_url="https://api.comparellmapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Este enfoque es ideal para servicios backend o scripts. La biblioteca gestiona reintentos y manejo básico de errores. Recuerda verificar el contenido de la respuesta para obtener el texto generado. También puedes acceder a los datos de uso de tokens para transparencia en la facturación.

Configuración del SDK de Node.js

Para entornos JavaScript o TypeScript, el SDK de Node.js de OpenAI funciona perfectamente. Instala el paquete e inicializa el cliente con nuestra URL base. Esto mantiene la compatibilidad con la interfaz de API estándar.

Define tus mensajes de sistema y usuario. El ID del modelo sigue siendo uncensored. El SDK devuelve una promesa con el resultado de la finalización. Maneja los errores apropiadamente para gestionar los límites de la API o créditos insuficientes.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.comparellmapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Este método es adecuado para servidores web o aplicaciones Node.js. La estructura del código refleja el ejemplo de Python, asegurando la consistencia entre lenguajes. Puedes integrar esto en rutas de Express o funciones sin servidor fácilmente.

Respuestas en streaming (SSE)

Para aplicaciones en tiempo real, habilita el streaming estableciendo el parámetro stream en true. El servidor envía una serie de Eventos Enviados por el Servidor (SSE). Cada evento contiene un fragmento parcial de la respuesta.

Esto reduce la latencia percibida para los usuarios. El cliente recibe tokens a medida que se generan. Esto es útil para interfaces de chat o generación de texto en vivo.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Analiza el flujo SSE para extraer cada token. Acumula el texto para formar la respuesta completa. El costo de la API chatgpt y otros proveedores a menudo cobran de manera similar por el streaming, pero nuestro modelo sin censura ofrece salida sin procesar sin tarifas adicionales por este modo. Monitorea el evento de fin de flujo para finalizar la respuesta.

Límites, errores y contexto

Entiende los límites operativos para asegurar una integración fluida. Tienes permitido realizar 300 peticiones por minuto por clave de API. Si excedes esto, recibirás un error de límite de peticiones 429. Espera antes de reintentar.

Los errores comunes incluyen 401 para claves inválidas y 402 para créditos insuficientes. Asegúrate de que tu saldo prepago sea suficiente. La ventana de contexto admite hasta 100.000 tokens para prompt más finalización. Gestiona tu uso de tokens cuidadosamente para evitar truncamiento.

Para más detalles sobre precios de la API LLM, consulta la página de precios. Cada token se cobra según las tarifas de entrada y salida. No hay tarifas ocultas. Esta transparencia te ayuda a presupuestar con precisión para tu aplicación.

Funciones y límites

Una tabla con cada límite, función y precio.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.comparellmapi.com/v1
ID del modelouncensored
AutenticaciónAuthorization: Bearer YOUR_KEY
Ventana de contexto100.000 tokens (entrada + salida)
Modo JSONresponse_format: {"type": "json_object"}
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Concurrencia8 peticiones a la vez por clave
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Límite de peticiones300 por minuto por clave
Tamaño de peticiónhasta 8 MB
Bono+5 % desde $50, +10 % desde $100
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
Caducidadel crédito pagado no caduca, sin suscripción
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
AccesoGoogle o correo y contraseña
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior

Códigos de error

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas y respuestas

¿Cómo restablezco mi clave de API?

Puedes regenerar tu clave de API en cualquier momento desde el panel de tu cuenta. Generar una nueva clave revoca inmediatamente la anterior, así que actualiza tus aplicaciones para usar la nueva clave. Esto es útil si sospechas que la clave fue comprometida.

¿Qué sucede si me quedo sin créditos?

Cuando tu saldo prepago llega a cero, recibirás un error 402 en las peticiones siguientes. Puedes recargar desde $10 usando criptomonedas (USDT o USDC). Se añaden créditos bonus automáticamente para recargas mayores de $50 o $100.

¿Es el modelo sin censura adecuado para uso comercial?

Sí, el modelo está diseñado para casos de uso adultos y creativos lícitos sin rechazos de contenido. No es adecuado para contenido que involucre menores. El modelo es de pesos abiertos y se ejecuta en nuestros propios servidores, proporcionando salida de texto sin procesar para tus aplicaciones.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Esa es toda la configuración.

Obtener clave de API