Schnellstart für Ollama-Nutzer
Starte in Minuten mit der unzensierten Ollama-API. Füge unsere Basis-URL und deinen Schlüssel ein, um Anfragen mit deinem bestehenden OpenAI-SDK-Code zu senden.
Voraussetzungen
Um diese API zu nutzen, benötigst du ein aktives Konto mit einem gültigen API-Schlüssel. Registriere dich auf der API-Schlüssel erhalten-Seite mit Google oder einer E-Mail und einem Passwort. Eine Telefonnummer ist nicht erforderlich. Du musst außerdem ein unterstütztes Language SDK auf deinem Rechner installiert haben. Diese Anleitung deckt Python und Node.js ab, die gängigsten Clients für OpenAI-kompatible Endpunkte. Die API bietet ein einzelnes unzensiertes Modell mit der ID uncensored. Sie akzeptiert Text und gibt Text zurück. Es gibt keine Embedding-, Bild- oder Audio-Funktionen. Alle Anfragen gehen an https://api.ollamaapi.cc/v1.
SDK installieren
Installiere das offizielle SDK für deine bevorzugte Sprache. Für Python verwende pip. Für Node.js verwende npm. Diese Bibliotheken verarbeiten das HTTP-Protokoll, die JSON-Serialisierung und das Streaming automatisch. Du musst keine rohen HTTP-Anfragen schreiben, es sei denn, du bevorzugst diese Ebene der Kontrolle. Die SDKs sind gut dokumentiert und werden in Produktionsumgebungen häufig eingesetzt. Stelle sicher, dass deine Umgebung den SDK-Anforderungen entspricht. Python 3.8+ und Node.js 18+ werden empfohlen. Halte deine Abhängigkeiten auf dem neuesten Stand, um Kompatibilitätsprobleme mit neueren Modellparametern zu vermeiden.
Client konfigurieren
Lege die Basis-URL auf unseren Endpunkt fest. Dies ist die einzige Konfigurationsänderung, die erforderlich ist, um von OpenAI zu unserem unzensierten Dienst zu wechseln. Übergebe deinen API-Schlüssel als Autorisierungsheader. Das SDK erledigt den Rest. Ändere den Modellnamen nicht zu gpt-4 oder Ähnlichem; verwende uncensored. Die API hält sich strikt an das OpenAI-Chat-Completion-Protokoll. Jeder Client, der mit OpenAI funktioniert, funktioniert hier mit diesen zwei Änderungen. Dies macht Migrationen oder A/B-Tests einfach. Du kannst beide APIs nebeneinander ausführen, um Ausgaben zu vergleichen.
Erste Anfrage senden
Sende eine POST-Anfrage an /v1/chat/completions. Füge die Modell-ID, den System-Prompt und die Benutzer-Nachricht hinzu. Die API gibt eine Textantwort zurück. Wenn du Guthaben hast, gelingt die Anfrage. Fehlt dir das Guthaben, erhältst du einen 402-Fehler. Ist dein Schlüssel ungültig, erhältst du einen 401-Fehler. Diese Fehler sind standardisiert und einfach im Code zu behandeln. Das Modell lehnt rechtlich zulässige erwachsene Inhalte nicht ab, was es für kreatives Schreiben, Sicherheitsforschung oder unzensiertes Chat-Nutzen wertvoll macht. Prüfe dein Guthaben im Dashboard, wenn du unsicher bezüglich der verbleibenden Credits bist.
Streaming-Antworten
Aktiviere das Streaming, indem du stream: true setzt. Die API gibt Token zurück, sobald sie generiert werden. Dies reduziert die wahrgenommene Latenz für Nutzer. Das letzte Chunk enthält die gesamte Token-Nutzung für die Abrechnung. Streaming wird von allen offiziellen SDKs unterstützt. Es ist essenziell für Chat-Oberflächen, in denen du Text so anzeigen möchtest, wie er geschrieben wird. Der Server sendet Server-Sent Events (SSE). Deine Client-Bibliothek übernimmt das Parsing. Du musst den Event-Stream nicht manuell verwalten, es sei denn, du baust einen benutzerdefinierten Client.
Limits, Fehler und Kontext
Das Kontextfenster umfasst insgesamt 100.000 Token, mit einem maximalen Output von 32.000 Token. Anfragen sind auf 300 pro Minute und 8 parallele Anfragen pro Schlüssel begrenzt. Der Anfragetextkörper muss unter 8 MB liegen. Fehler umfassen 401 für ungültige Schlüssel, 402 für unzureichendes Guthaben und 429 für Ratenlimits. Dies sind Standard-HTTP-Codes. Verarbeite sie in deiner Anwendung angemessen. Das Modell blockiert sexuelle Inhalte, die Minderjährige betreffen. Alle anderen Inhalte sind erlaubt. Das Guthaben verfällt nie, sodass du die Nutzung pausieren kannst, ohne Geld zu verlieren. Nutze die Support-Seite bei Rückerstattungsproblemen.
cURL
curl https://api.ollamaapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.ollamaapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.ollamaapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Starte mit Testguthaben
E-Mail und Passwort, der Schlüssel erscheint sofort auf dem Bildschirm.
Fragen und Antworten
Ist dies die offizielle Ollama-API?
Nein. Wir sind ein unabhängiger Dienst, der ein einzelnes unzensiertes Modell hostet. Wir stehen nicht in Verbindung mit Ollama, OpenAI oder einem anderen Anbieter. Wir nutzen das OpenAI-kompatible Protokoll für einfache Nutzung.
Welche Zahlungsmethoden werden akzeptiert?
Wir akzeptieren nur Krypto: USDT (TRC20) oder USDC (Base). Mindest-Aufladung sind $10. Keine Kreditkarten, PayPal oder Banküberweisungen werden unterstützt. Guthaben verfällt nie.
Kann ich dies für kommerzielle Projekte nutzen?
Ja. Es gibt keine Nutzungseinschränkungen außer den Ratenlimits. Das Modell lehnt rechtmäßige Inhalte nicht ab, was es für kommerzielle Anwendungen geeignet macht. Prüfe die Preisseite für aktuelle Token-Raten.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.
API-Spezifikation
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Modell-ID | uncensored |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Base-URL | https://api.ollamaapi.cc/v1 |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| JSON-Modus | response_format: {"type": "json_object"} |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Anfragegröße | bis 8 MB |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Anmeldung | Google oder E-Mail und Passwort |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |