PL ▾
Pobierz klucz API

Szybki start dla użytkowników Ollama

Zacznij korzystać z API Ollama bez cenzury w kilka minut. Wstaw nasz bazowy URL i klucz, aby rozpocząć wysyłanie zapytań za pomocą istniejącego kodu SDK OpenAI.

Wymagania wstępne

Aby korzystać z tego API, potrzebujesz aktywnego konta z ważnym kluczem API. Zarejestruj się na stronie Pobierz klucz API, używając Google lub adresu e-mail i hasła. Nie jest wymagany numer telefonu. Musisz również mieć zainstalowane w swoim środowisku obsługiwane SDK językowe. Ten przewodnik dotyczy Pythona i Node.js, najczęstszych klientów dla endpointów kompatybilnych z OpenAI. API obsługuje jeden bezcenzurowany model oznaczony jako uncensored. Przyjmuje tekst i zwraca tekst. Nie ma funkcji embeddingów, obrazów ani audio. Wszystkie zapytania kierowane są do https://api.ollamaapi.cc/v1.

Zainstaluj SDK

Zainstaluj oficjalne SDK dla preferowanego języka. Dla Python użyj pip. Dla Node.js użyj npm. Biblioteki te obsługują automatycznie protokół HTTP, serializację JSON i strumieniowanie. Nie musisz pisać surowych żądań HTTP, chyba że wolisz taki poziom kontroli. SDK są dobrze udokumentowane i szeroko stosowane w środowiskach produkcyjnych. Upewnij się, że Twoje środowisko spełnia wymagania SDK. Zalecany jest Python 3.8+ i Node.js 18+. Aktualizuj zależności, aby uniknąć problemów z kompatybilnością z nowymi parametrami modelu.

Skonfiguruj klienta

Ustaw bazowy URL na nasz endpoint. To jedyna zmiana konfiguracji potrzebna do przełączenia się z OpenAI na nasz serwis bez cenzury. Przekaż swój klucz API jako nagłówek autoryzacji. SDK obsłuży resztę. Nie zmieniaj nazwy modelu na gpt-4 ani podobną; użyj uncensored. API ściśle przestrzega protokołu chat-completions OpenAI. Każdy klient, który działa z OpenAI, zadziała tutaj po tych dwóch zmianach. Ułatwia to migrację lub testy A/B. Możesz uruchomić oba API obok siebie, aby porównać wyniki.

Wyślij pierwsze zapytanie

Wyślij żądanie POST do /v1/chat/completions. Dołącz identyfikator modelu, prompt systemowy i wiadomość użytkownika. API zwraca odpowiedź tekstową. Jeśli masz kredyt, zapytanie się powiedzie. Jeśli brakuje środków, otrzymasz błąd 402. Jeśli klucz jest nieprawidłowy, otrzymasz błąd 401. Te błędy są standardowe i łatwe do obsłużenia w kodzie. Model nie odrzuca legalnej treści dla dorosłych, co czyni go przydatnym do pisania twórczego, badań bezpieczeństwa lub czatu bez cenzury. Sprawdź saldo na panelu, jeśli nie jesteś pewien pozostałych środków.

Odpowiedzi strumieniowe

Włącz strumieniowanie, ustawiając stream: true. API zwraca tokeny w miarę ich generowania. Zmniejsza to postrzeganą latencję dla użytkowników. Ostatni fragment zawiera całkowite zużycie tokenów do rozliczeń. Strumieniowanie jest obsługiwane przez wszystkie oficjalne SDK. Jest kluczowe dla interfejsów czatu, gdzie chcesz pokazywać tekst w miarę jego pisania. Serwer wysyła zdarzenia wysłane przez serwer (SSE). Twoja biblioteka klienta obsługuje parsowanie. Nie musisz ręcznie zarządzać strumieniem zdarzeń, chyba że budujesz niestandardowego klienta.

Limity, błędy i kontekst

Okno kontekstu ma 100 000 tokenów łącznie, z maksymalną wyjściową liczbą 32 000 tokenów. Zapytania są ograniczone do 300 na minutę i 8 równoległych zapytań na klucz. Ciało zapytania musi być mniejsze niż 8 MB. Błędy obejmują 401 dla nieprawidłowych kluczy, 402 dla niewystarczających środków oraz 429 dla limitów zapytań. Są to standardowe kody HTTP. Obsłuż je poprawnie w swojej aplikacji. Model blokuje treści seksualne z udziałem małoletnich. Pozostałe treści są dozwolone. Kredyt nigdy nie wygasa, więc możesz wstrzymać używanie bez utraty środków. Skorzystaj ze strony pomocy w sprawach zwrotu.

cURL

curl https://api.ollamaapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.ollamaapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.ollamaapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Strumieniowanie

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Zacznij od kredytu próbnego

E-mail i hasło, klucz od razu na ekranie.

Pobierz klucz API

Pytania i odpowiedzi

Czy to oficjalny API Ollama?

Nie. Jesteśmy niezależną usługą hostującą pojedynczy model bez cenzury. Nie jesteśmy powiązani z Ollama, OpenAI ani żadnym innym dostawcą. Korzystamy z protokołu kompatybilnego z OpenAI dla łatwości użycia.

Jakie metody płatności są akceptowane?

Akceptujemy tylko krypto: USDT (TRC20) lub USDC (Base). Minimalne doładowanie to $10. Nie obsługujemy kart kredytowych, PayPal ani przelewów bankowych. Kredyt nigdy nie wygasa.

Czy mogę używać tego do projektów komercyjnych?

Tak. Nie ma ograniczeń użytkowych poza limitami zapytań. Model nie odrzuca legalnej treści, co czyni go odpowiednim do zastosowań komercyjnych. Sprawdź stronę cenową, aby uzyskać aktualne stawki za tokeny.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień bazowy URL. To cała konfiguracja.

Pobierz klucz API

Parametry API

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
UwierzytelnianieAuthorization: Bearer YOUR_KEY
ID modeluuncensored
EndpointyPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.ollamaapi.cc/v1
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Tryb JSONresponse_format: {"type": "json_object"}
Równoległe zapytaniado 8 jednocześnie na klucz
Limit zapytań300 zapytań na minutę na klucz
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Rozmiar zapytaniado 8 MB
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
Bonus+5% od $50, +10% od $100
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Kluczejeden aktywny klucz na konto; nowy zastępuje stary
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane
LogowanieGoogle albo e-mail i hasło

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund