Guida rapida per utenti Ollama
Inizia con l'API Ollama senza censura in pochi minuti. Inserisci il nostro URL base e la chiave per iniziare a inviare richieste con il tuo codice SDK OpenAI esistente.
Prerequisiti
Per usare questa API hai bisogno di un account attivo con una chiave API valida. Iscriviti alla pagina Ottieni chiave API usando Google o email e password. Non serve il numero di telefono. Ti serve anche un SDK del linguaggio supportato installato sulla tua macchina. Questa guida copre Python e Node.js, i client più comuni per endpoint compatibili con OpenAI. L'API serve un singolo modello senza censura identificato da uncensored. Accetta testo e restituisce testo. Non ci sono funzionalità di embedding, immagini o audio. Tutte le richieste vanno a https://api.ollamaapi.cc/v1.
Installa SDK
Installa l'SDK ufficiale per il tuo linguaggio preferito. Per Python usa pip. Per Node.js usa npm. Queste librerie gestiscono automaticamente il protocollo HTTP, la serializzazione JSON e lo streaming. Non hai bisogno di scrivere richieste HTTP grezze a meno che tu non preferisca questo livello di controllo. Gli SDK sono ben documentati e ampiamente usati in ambienti di produzione. Assicurati che il tuo ambiente soddisfi i requisiti dell'SDK. Si raccomandano Python 3.8+ e Node.js 18+. Mantieni le dipendenze aggiornate per evitare problemi di compatibilità con i nuovi parametri del modello.
Configura Client
Imposta l'URL base sul nostro endpoint. Questa è l'unica modifica di configurazione necessaria per passare da OpenAI al nostro servizio senza censura. Passa la tua chiave API come intestazione di autorizzazione. L'SDK gestirà il resto. Non cambiare il nome del modello in gpt-4 o simili; usa uncensored. L'API segue rigorosamente il protocollo chat-completions di OpenAI. Qualsiasi client che funziona con OpenAI funzionerà qui con queste due modifiche. Questo rende la migrazione o i test A/B semplici. Puoi eseguire entrambe le API fianco a fianco per confrontare i risultati.
Invia la prima richiesta
Invia una richiesta POST a /v1/chat/completions. Include l'ID del modello, il prompt di sistema e il messaggio dell'utente. L'API restituisce una risposta testuale. Se hai credito, la richiesta va a buon fine. Se non hai credito, ricevi un errore 402. Se la tua chiave non è valida, ricevi un 401. Questi errori sono standard e facili da gestire nel codice. Il modello non rifiuta contenuti adulti leciti, rendendolo utile per la scrittura creativa, la ricerca sulla sicurezza o la chat senza censura. Controlla il tuo saldo nella dashboard se non sei sicuro del credito residuo.
Risposte in Streaming
Abilita lo streaming impostando stream: true. L'API restituisce i token man mano che vengono generati. Questo riduce la latenza percepita per gli utenti. L'ultimo chunk contiene l'utilizzo totale dei token per la fatturazione. Lo streaming è supportato da tutti gli SDK ufficiali. È essenziale per le interfacce chat dove vuoi mostrare il testo mentre viene scritto. Il server invia Server-Sent Events (SSE). La tua libreria client gestisce l'analisi. Non hai bisogno di gestire manualmente il flusso di eventi a meno che tu non stia costruendo un client personalizzato.
Limiti, Errori e Contesto
La finestra di contesto è di 100.000 token in totale, con un output massimo di 32.000 token. Le richieste sono limitate a 300 al minuto e 8 richieste parallele per chiave. Il corpo della richiesta deve essere inferiore a 8 MB. Gli errori includono 401 per chiavi non valide, 402 per credito insufficiente e 429 per limiti di richieste. Questi sono codici HTTP standard. Gestiscili con grazia nella tua applicazione. Il modello blocca i contenuti sessuali che coinvolgono minori. Tutti gli altri contenuti sono consentiti. Il credito non scade mai, quindi puoi mettere in pausa l'uso senza perdere fondi. Usa la pagina di supporto per problemi di rimborso.
cURL
curl https://api.ollamaapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.ollamaapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.ollamaapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Inizia con il credito di prova
E-mail e password, la chiave compare subito sullo schermo.
Domande e risposte
È l'API ufficiale di Ollama?
No. Siamo un servizio indipendente che ospita un singolo modello senza censura. Non siamo affiliati a Ollama, OpenAI o altri fornitori. Utilizziamo il protocollo compatibile con OpenAI per facilità d'uso.
Quali metodi di pagamento sono accettati?
Accettiamo solo criptovalute: USDT (TRC20) o USDC (Base). Il minimo per ricaricare è $10. Non sono supportate carte di credito, PayPal o bonifici bancari. Il credito non scade mai.
Posso usarlo per progetti commerciali?
Sì. Non ci sono limitazioni d'uso oltre ai limiti di richieste. Il modello non rifiuta contenuti leciti, rendendolo adatto per applicazioni commerciali. Consulta la pagina dei prezzi per i prezzi attuali dei token.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL base. È tutta qui la configurazione.
Scheda tecnica dell'API
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| ID modello | uncensored |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.ollamaapi.cc/v1 |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Finestra di contesto | 100.000 token (input + output) |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Modalità JSON | response_format: {"type": "json_object"} |
| Concorrenza | 8 richieste contemporanee per chiave |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Dimensione | fino a 8 MB per richiesta |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Bonus | +5% da $50, +10% da $100 |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Accesso | Google oppure e-mail e password |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |