IT ▾

Compare LLM APIDocumentazione

Guida rapida API LLM: Endpoint compatibili con OpenAI

Inizia a generare testo con la nostra API LLM senza censura in pochi minuti. Questa guida rapida copre gli endpoint compatibili con OpenAI, la configurazione degli SDK e le opzioni di streaming necessarie per integrare gli output grezzi del modello nella tua applicazione.

Autenticazione e URL di base

Per iniziare a utilizzare i servizi del provider llm api, hai bisogno di una chiave API. Iscriviti nella pagina Ottieni chiave API con solo email e password. La tua chiave appare immediatamente. Non è richiesto il numero di telefono o la carta di credito per il credito di prova. Mantieni la tua chiave sicura; puoi rigenerarla in qualsiasi momento, il che invalida la chiave precedente.

Configura il tuo client per puntare al nostro URL di base. Questo garantisce che tutte le richieste vengano instradate al nostro modello senza censura. La struttura dell'endpoint riflette l'interfaccia standard delle chat completions di OpenAI.

  • URL di base: https://api.comparellmapi.com/v1
  • Intestazione: Authorization: Bearer YOUR_API_KEY

Questa configurazione funziona con qualsiasi SDK compatibile con OpenAI. Devi solo regolare l'URL di base e iniettare la tua chiave.

La tua prima richiesta

Invia una semplice richiesta di completamento del testo per testare la connettività. Questo conferma che la tua chiave API è valida e che i crediti sono disponibili. Usa l'ID del modello uncensored per accedere al modello grezzo. L'endpoint accetta richieste POST con un corpo JSON contenente messaggi.

Assicurati che il corpo della tua richiesta sia inferiore a 8 MB. Se superi questo limite, il server rifiuterà la richiesta. Per la maggior parte delle applicazioni basate su testo, un singolo turno o una breve conversazione rientra bene in questo vincolo.

curl https://api.comparellmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Se ha successo, ricevi una risposta JSON con il testo generato. Questo conferma che la struttura di llm api pricing si applica al tuo utilizzo. Ogni token conta per il tuo saldo prepagato.

Integrazione SDK Python

Usa la libreria ufficiale OpenAI Python per l'integrazione più semplice. Installa il pacchetto tramite pip, quindi configura il client con il nostro URL di base. Questo ti permette di utilizzare metodi familiari come chat.completions.create().

Imposta il modello su uncensored. Passa i tuoi messaggi nel formato standard. L'SDK gestisce la serializzazione e l'analisi degli errori automaticamente.

from openai import OpenAI

client = OpenAI(base_url="https://api.comparellmapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Questo approccio è ideale per servizi backend o script. La libreria gestisce i tentativi di ripetizione e la gestione degli errori di base. Ricorda di controllare il contenuto della risposta per il testo generato. Puoi anche accedere ai dati di utilizzo dei token per la trasparenza sulla fatturazione.

Configurazione SDK Node.js

Per ambienti JavaScript o TypeScript, l'SDK Node di OpenAI funziona perfettamente. Installa il pacchetto e inizializza il client con il nostro URL di base. Questo mantiene la compatibilità con l'interfaccia API standard.

Definisci i tuoi messaggi di sistema e utente. L'ID del modello rimane uncensored. L'SDK restituisce una promise con il risultato del completamento. Gestisci gli errori in modo appropriato per gestire i limiti API o i crediti insufficienti.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.comparellmapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Questo metodo è adatto per server web o applicazioni Node.js. La struttura del codice riflette l'esempio Python, garantendo coerenza tra i linguaggi. Puoi integrarlo facilmente nelle route Express o nelle funzioni serverless.

Risposte in streaming (SSE)

Per applicazioni in tempo reale, abilita lo streaming impostando il parametro stream su true. Il server invia una serie di eventi inviati dal server (SSE). Ogni evento contiene un frammento parziale della risposta.

Questo riduce la latenza percepita per gli utenti. Il client riceve i token man mano che vengono generati. Questo è utile per interfacce chat o generazione di testo in diretta.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Analizza lo stream SSE per estrarre ogni token. Accumula il testo per formare la risposta completa. Il costo dell'API chatgpt e di altri provider spesso addebitano importi simili per lo streaming, ma il nostro modello senza censura offre output grezzo senza costi aggiuntivi per questa modalità. Monitora l'evento di fine stream per finalizzare la risposta.

Limiti, errori e contesto

Comprendi i limiti operativi per garantire un'integrazione fluida. Hai diritto a 300 richieste al minuto per chiave API. Se li superi, ricevi un errore di limite di richieste 429. Attendi prima di riprovare.

Gli errori comuni includono 401 per chiavi non valide e 402 per crediti insufficienti. Assicurati che il tuo saldo prepagato sia sufficiente. La finestra di contesto supporta fino a 100.000 token per prompt più completamento. Gestisci attentamente l'utilizzo dei token per evitare la troncatura.

Per dettagli su llm api pricing, consulta la pagina dei prezzi. Ogni token viene addebitato in base ai tassi di input e output. Non ci sono tariffe nascoste. Questa trasparenza ti aiuta a budgettare con precisione per la tua applicazione.

Scheda tecnica dell'API

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.comparellmapi.com/v1
ID modellouncensored
AutenticazioneAuthorization: Bearer YOUR_KEY
Finestra di contesto100.000 token (input + output)
Modalità JSONresponse_format: {"type": "json_object"}
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Concorrenza8 richieste contemporanee per chiave
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Limite di frequenza300 richieste al minuto per chiave
Dimensionefino a 8 MB per richiesta
Bonus+5% da $50, +10% da $100
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
Scadenzail credito pagato non scade, nessun abbonamento
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
AccessoGoogle oppure e-mail e password
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande e risposte

Come reimposto la mia chiave API?

Puoi rigenerare la tua chiave API in qualsiasi momento dal cruscotto del tuo account. La generazione di una nuova chiave revoca immediatamente quella vecchia, quindi aggiorna le tue applicazioni per utilizzare la nuova chiave. Questo è utile se sospetti che la chiave sia stata compromessa.

Cosa succede se rimango senza crediti?

Quando il tuo saldo prepagato raggiunge zero, riceverai un errore 402 sulle richieste successive. Puoi ricaricare a partire da $10 utilizzando criptovalute (USDT o USDC). Crediti bonus vengono aggiunti automaticamente per ricariche superiori a $50 o $100.

Il modello senza censura è adatto per uso commerciale?

Sì, il modello è progettato per casi d'uso adulti e creativi leciti senza rifiuti sui contenuti. Non è adatto per contenuti che coinvolgono minori. Il modello è a pesi aperti ed eseguito sui nostri server, fornendo output di testo grezzo per le tue applicazioni.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, cambia l'URL di base. È tutta qui la configurazione.

Ottieni la chiave API