NL ▾
API-sleutel aanvragen

Snelstart voor Ollama-gebruikers

Kom in enkele minuten op gang met de ongecensureerde Ollama API. Voeg onze basis-URL en sleutel toe om verzoeken te sturen met je bestaande OpenAI SDK-code.

Vereisten

Om deze API te gebruiken, heb je een actief account met een geldige API-sleutel nodig. Meld je aan op de API-sleutel verkrijgen pagina met Google of een e-mailadres en wachtwoord. Er is geen telefoonnummer nodig. Je hebt ook een ondersteund taal-SDK geïnstalleerd op je machine nodig. Deze gids behandelt Python en Node.js, de meest voorkomende clients voor OpenAI-compatibele endpoints. De API biedt één ongecensureerd model aan geïdentificeerd door uncensored. Het accepteert tekst en retourneert tekst. Er zijn geen embedding-, afbeeldings- of audiofuncties. Alle verzoeken gaan naar https://api.ollamaapi.cc/v1.

SDK installeren

Installeer de officiële SDK voor je voorkeurstaal. Voor Python gebruik je pip. Voor Node.js gebruik je npm. Deze bibliotheken verwerken het HTTP-protocol, JSON-serialisatie en streaming automatisch. Je hoeft geen ruwe HTTP-verzoeken te schrijven tenzij je die controle wilt. De SDKs zijn goed gedocumenteerd en veel gebruikt in productieomgevingen. Zorg dat je omgeving voldoet aan de SDK-eisen. Python 3.8+ en Node.js 18+ worden aanbevolen. Houd je afhankelijkheden up-to-date om compatibiliteitsproblemen met nieuwere modelparameters te voorkomen.

Client configureren

Stel de basis-URL in op onze endpoint. Dit is de enige configuratiewijziging die nodig is om van OpenAI naar onze ongecensureerde service te schakelen. Geef je API-sleutel door als de autorisatieheader. De SDK regelt de rest. Verander de modelnaam niet in gpt-4 of iets dergelijks; gebruik uncensored. De API volgt strikt het OpenAI chat-completions-protocol. Elke client die werkt met OpenAI, werkt hier met deze twee wijzigingen. Dit maakt migratie of A/B-testen eenvoudig. Je kunt beide API's naast elkaar draaien om de uitvoer te vergelijken.

Eerste verzoek versturen

Dien een POST-verzoek in naar /v1/chat/completions. Voeg de model-ID, system prompt en gebruikersbericht toe. De API retourneert een tekstantwoord. Als je tegoed hebt, slaagt het verzoek. Als je geen tegoed hebt, krijg je een 402-fout. Als je sleutel ongeldig is, krijg je een 401. Deze fouten zijn standaard en eenvoudig af te handelen in code. Het model weigert wettelijke volwassen content niet, wat het nuttig maakt voor creatief schrijven, veiligheidsonderzoek of ongecensureerd chatten. Controleer je saldo op het dashboard als je niet zeker bent van je resterende tegoed.

Streaming responsen

Schakel streaming in door stream: true in te stellen. De API retourneert tokens zodra ze worden gegenereerd. Dit vermindert de waargenomen latentie voor gebruikers. Het laatste blok bevat het totale tokengebruik voor facturering. Streaming wordt ondersteund door alle officiële SDK's. Het is essentieel voor chatinterfaces waar je tekst wilt tonen terwijl deze wordt geschreven. De server stuurt Server-Sent Events (SSE). Je clientbibliotheek verwerkt de parsing. Je hoeft de event stream niet handmatig te beheren, tenzij je een aangepaste client bouwt.

Limieten, fouten en context

Het contextvenster is 100.000 tokens in totaal, met een max. uitvoer van 32.000 tokens. Verzoeken zijn beperkt tot 300 per minuut en 8 gelijktijdige verzoeken per sleutel. De requestbody moet kleiner zijn dan 8 MB. Fouten omvatten 401 voor ongeldige sleutels, 402 voor onvoldoende tegoed en 429 voor rate limits. Dit zijn standaard HTTP-codes. Afhandel ze soepel in je applicatie. Het model blokkeert seksuele content met minderjarigen. Alle andere content is toegestaan.tegoed vervalt nooit, dus je kunt gebruik pauzeren zonder geld te verliezen. Gebruik de supportpagina voor restitutieproblemen.

cURL

curl https://api.ollamaapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.ollamaapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.ollamaapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Begin met proeftegoed

E-mail en wachtwoord, de sleutel staat meteen op het scherm.

API-sleutel aanvragen

Vragen en antwoorden

Is dit de officiële Ollama API?

Nee. Wij zijn een onafhankelijke dienst met één ongecensureerd model. Wij zijn niet gelieerd aan Ollama, OpenAI of andere leveranciers. Wij gebruiken het OpenAI-compatible protocol voor gebruiksgemak.

Welke betaalmethoden worden geaccepteerd?

Wij accepteren alleen crypto: USDT (TRC20) of USDC (Base). Minimale opwaardering is $10. Geen creditcards, PayPal of bankoverschrijvingen. Prepaid tegoed vervalt nooit.

Kan ik dit gebruiken voor commerciële projecten?

Ja. Er zijn geen gebruiksbeperkingen behalve de rate limits. Het model weigert wettelijke content niet, wat het geschikt maakt voor commerciële toepassingen. Bekijk de prijspagina voor huidige token tarieven.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, verander de base URL. Dat is de hele setup.

API-sleutel aanvragen

API-specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
AuthenticatieAuthorization: Bearer YOUR_KEY
Model-IDuncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.ollamaapi.cc/v1
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Contextvenster100.000 tokens (invoer + uitvoer)
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
JSON-modusresponse_format: {"type": "json_object"}
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Rate limit300 verzoeken per minuut per sleutel
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Verzoekgroottetot 8 MB
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Bonus+5% vanaf $50, +10% vanaf $100
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Geldigheidbetaald tegoed verloopt niet, geen abonnement
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd
InloggenGoogle of e-mail en wachtwoord

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw