Guide de démarrage pour les utilisateurs d'Ollama
Commencez avec l'API Ollama sans censure en quelques minutes. Ajoutez simplement notre URL de base et votre clé pour commencer à envoyer des requêtes avec votre code SDK OpenAI existant.
Prérequis
Pour utiliser cette API, vous avez besoin d'un compte actif avec une clé API valide. Inscrivez-vous sur la page Obtenir la clé API en utilisant Google ou un e-mail et un mot de passe. Aucun numéro de téléphone n'est requis. Vous devez également disposer d'un SDK de langage pris en charge installé sur votre machine. Ce guide couvre Python et Node.js, les clients les plus courants pour les endpoints compatibles OpenAI. L'API sert un seul modèle sans censure identifié par uncensored. Il accepte le texte et retourne du texte. Il n'y a pas de fonctionnalités d'embedding, d'image ou d'audio. Toutes les requêtes sont envoyées à https://api.ollamaapi.cc/v1.
Installer le SDK
Installez le SDK officiel pour votre langage préféré. Pour Python, utilisez pip. Pour Node.js, utilisez npm. Ces bibliothèques gèrent automatiquement le protocole HTTP, la sérialisation JSON et le streaming. Vous n'avez pas besoin d'écrire des requêtes HTTP brutes sauf si vous préférez ce niveau de contrôle. Les SDK sont bien documentés et largement utilisés en production. Assurez-vous que votre environnement correspond aux exigences du SDK. Python 3.8+ et Node.js 18+ sont recommandés. Maintenez vos dépendances à jour pour éviter les problèmes de compatibilité avec les nouveaux paramètres de modèle.
Configurer le client
Définissez l'URL de base sur notre endpoint. C'est le seul changement de configuration nécessaire pour passer d'OpenAI à notre service sans censure. Transmettez votre clé API en tant qu'en-tête d'autorisation. Le SDK s'occupera du reste. Ne modifiez pas le nom du modèle en gpt-4 ou similaire ; utilisez uncensored. L'API suit strictement le protocole de chat-completions d'OpenAI. Tout client qui fonctionne avec OpenAI fonctionnera ici avec ces deux modifications. Cela rend la migration ou les tests A/B simples. Vous pouvez exécuter les deux API côte à côte pour comparer les sorties.
Envoyer la première requête
Effectuez une requête POST vers /v1/chat/completions. Incluez l’ID du modèle, le prompt système et le message de l’utilisateur. L’API renvoie une réponse textuelle. Si vous disposez de crédit, la requête aboutit. Si vous n’avez pas de crédit, vous obtenez une erreur 402. Si votre clé est invalide, vous obtenez une erreur 401. Ces erreurs sont standard et faciles à gérer dans le code. Le modèle n’accepte pas le contenu adulte légal, ce qui le rend utile pour l’écriture créative, la recherche en sécurité ou le chat sans censure. Consultez votre solde sur le tableau de bord si vous avez un doute sur le crédit restant.
Réponses en streaming
Activez le streaming en définissant stream: true. L'API retourne les tokens au fur et à mesure de leur génération. Cela réduit la latence perçue pour les utilisateurs. Le dernier chunk contient l'utilisation totale des tokens pour la facturation. Le streaming est pris en charge par tous les SDK officiels. Il est essentiel pour les interfaces de chat où vous souhaitez afficher le texte au fur et à mesure de son écriture. Le serveur envoie des Server-Sent Events (SSE). Votre bibliothèque cliente gère l'analyse. Vous n'avez pas besoin de gérer le flux d'événements manuellement sauf si vous construisez un client personnalisé.
Limites, erreurs et contexte
La fenêtre de contexte est de 100 000 tokens au total, avec une sortie maximale de 32 000 tokens. Les requêtes sont limitées à 300 par minute et à 8 requêtes simultanées par clé. Le corps de la requête doit être inférieur à 8 Mo. Les erreurs incluent 401 pour les clés invalides, 402 pour le crédit insuffisant et 429 pour les limites de débit. Ce sont des codes HTTP standard. Gérez-les correctement dans votre application. Le modèle bloque le contenu sexuel impliquant des mineurs. Tout autre contenu est autorisé. Le crédit n'expire jamais, vous pouvez donc suspendre l'utilisation sans perdre vos fonds. Utilisez la page de support pour les problèmes de remboursement.
cURL
curl https://api.ollamaapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.ollamaapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.ollamaapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Commencez avec le crédit d'essai
E-mail et mot de passe, la clé s'affiche tout de suite à l'écran.
Questions et réponses
S'agit-il de l'API officielle Ollama ?
Non. Nous sommes un service indépendant hébergeant un seul modèle sans censure. Nous ne sommes pas affiliés à Ollama, OpenAI ou tout autre fournisseur. Nous utilisons le protocole compatible OpenAI pour faciliter l'utilisation.
Quels modes de paiement sont acceptés ?
Nous acceptons uniquement les cryptomonnaies : USDT (TRC20) ou USDC (Base). Le rechargement minimum est de 10 $. Les cartes de crédit, PayPal et les virements bancaires ne sont pas pris en charge. Le crédit n'expire jamais.
Puis-je l'utiliser pour des projets commerciaux ?
Oui. Il n’y a pas de restrictions d’utilisation au-delà des limites de débit. Le modèle n’accepte pas le contenu légal, ce qui le rend adapté aux applications commerciales. Consultez la page des tarifs pour connaître les tarifs actuels par token.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.
Fiche technique de l'API
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Authentification | Authorization: Bearer YOUR_KEY |
| ID du modèle | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.ollamaapi.cc/v1 |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Mode JSON | response_format: {"type": "json_object"} |
| Concurrence | 8 requêtes simultanées par clé |
| Limite de débit | 300 requêtes par minute et par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Taille | jusqu'à 8 Mo par requête |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Connexion | Google ou e-mail et mot de passe |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |