IT ▾
Ottieni la chiave API

Guida rapida per utenti Ollama

Inizia con l'API Ollama senza censura in pochi minuti. Inserisci il nostro URL base e la chiave per iniziare a inviare richieste con il tuo codice SDK OpenAI esistente.

Prerequisiti

Per usare questa API hai bisogno di un account attivo con una chiave API valida. Iscriviti alla pagina Ottieni chiave API usando Google o email e password. Non serve il numero di telefono. Ti serve anche un SDK del linguaggio supportato installato sulla tua macchina. Questa guida copre Python e Node.js, i client più comuni per endpoint compatibili con OpenAI. L'API serve un singolo modello senza censura identificato da uncensored. Accetta testo e restituisce testo. Non ci sono funzionalità di embedding, immagini o audio. Tutte le richieste vanno a https://api.ollamaapi.cc/v1.

Installa SDK

Installa l'SDK ufficiale per il tuo linguaggio preferito. Per Python usa pip. Per Node.js usa npm. Queste librerie gestiscono automaticamente il protocollo HTTP, la serializzazione JSON e lo streaming. Non hai bisogno di scrivere richieste HTTP grezze a meno che tu non preferisca questo livello di controllo. Gli SDK sono ben documentati e ampiamente usati in ambienti di produzione. Assicurati che il tuo ambiente soddisfi i requisiti dell'SDK. Si raccomandano Python 3.8+ e Node.js 18+. Mantieni le dipendenze aggiornate per evitare problemi di compatibilità con i nuovi parametri del modello.

Configura Client

Imposta l'URL base sul nostro endpoint. Questa è l'unica modifica di configurazione necessaria per passare da OpenAI al nostro servizio senza censura. Passa la tua chiave API come intestazione di autorizzazione. L'SDK gestirà il resto. Non cambiare il nome del modello in gpt-4 o simili; usa uncensored. L'API segue rigorosamente il protocollo chat-completions di OpenAI. Qualsiasi client che funziona con OpenAI funzionerà qui con queste due modifiche. Questo rende la migrazione o i test A/B semplici. Puoi eseguire entrambe le API fianco a fianco per confrontare i risultati.

Invia la prima richiesta

Invia una richiesta POST a /v1/chat/completions. Include l'ID del modello, il prompt di sistema e il messaggio dell'utente. L'API restituisce una risposta testuale. Se hai credito, la richiesta va a buon fine. Se non hai credito, ricevi un errore 402. Se la tua chiave non è valida, ricevi un 401. Questi errori sono standard e facili da gestire nel codice. Il modello non rifiuta contenuti adulti leciti, rendendolo utile per la scrittura creativa, la ricerca sulla sicurezza o la chat senza censura. Controlla il tuo saldo nella dashboard se non sei sicuro del credito residuo.

Risposte in Streaming

Abilita lo streaming impostando stream: true. L'API restituisce i token man mano che vengono generati. Questo riduce la latenza percepita per gli utenti. L'ultimo chunk contiene l'utilizzo totale dei token per la fatturazione. Lo streaming è supportato da tutti gli SDK ufficiali. È essenziale per le interfacce chat dove vuoi mostrare il testo mentre viene scritto. Il server invia Server-Sent Events (SSE). La tua libreria client gestisce l'analisi. Non hai bisogno di gestire manualmente il flusso di eventi a meno che tu non stia costruendo un client personalizzato.

Limiti, Errori e Contesto

La finestra di contesto è di 100.000 token in totale, con un output massimo di 32.000 token. Le richieste sono limitate a 300 al minuto e 8 richieste parallele per chiave. Il corpo della richiesta deve essere inferiore a 8 MB. Gli errori includono 401 per chiavi non valide, 402 per credito insufficiente e 429 per limiti di richieste. Questi sono codici HTTP standard. Gestiscili con grazia nella tua applicazione. Il modello blocca i contenuti sessuali che coinvolgono minori. Tutti gli altri contenuti sono consentiti. Il credito non scade mai, quindi puoi mettere in pausa l'uso senza perdere fondi. Usa la pagina di supporto per problemi di rimborso.

cURL

curl https://api.ollamaapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.ollamaapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.ollamaapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Inizia con il credito di prova

E-mail e password, la chiave compare subito sullo schermo.

Ottieni la chiave API

Domande e risposte

È l'API ufficiale di Ollama?

No. Siamo un servizio indipendente che ospita un singolo modello senza censura. Non siamo affiliati a Ollama, OpenAI o altri fornitori. Utilizziamo il protocollo compatibile con OpenAI per facilità d'uso.

Quali metodi di pagamento sono accettati?

Accettiamo solo criptovalute: USDT (TRC20) o USDC (Base). Il minimo per ricaricare è $10. Non sono supportate carte di credito, PayPal o bonifici bancari. Il credito non scade mai.

Posso usarlo per progetti commerciali?

Sì. Non ci sono limitazioni d'uso oltre ai limiti di richieste. Il modello non rifiuta contenuti leciti, rendendolo adatto per applicazioni commerciali. Consulta la pagina dei prezzi per i prezzi attuali dei token.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, cambia l'URL base. È tutta qui la configurazione.

Ottieni la chiave API

Scheda tecnica dell'API

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
AutenticazioneAuthorization: Bearer YOUR_KEY
ID modellouncensored
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.ollamaapi.cc/v1
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Finestra di contesto100.000 token (input + output)
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Modalità JSONresponse_format: {"type": "json_object"}
Concorrenza8 richieste contemporanee per chiave
Limite di frequenza300 richieste al minuto per chiave
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Dimensionefino a 8 MB per richiesta
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
Bonus+5% da $50, +10% da $100
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Scadenzail credito pagato non scade, nessun abbonamento
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori
AccessoGoogle oppure e-mail e password

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi