RU ▾
Получить API-ключ

Быстрый старт для пользователей Ollama

Начните работу с API без цензуры Ollama за считанные минуты. Укажите базовый URL и ключ, чтобы отправлять запросы с помощью вашего кода на SDK OpenAI.

Предварительные требования

Для работы с API вам нужен активный аккаунт с валидным API-ключом. Зарегистрируйтесь на странице Получить API-ключ через Google или email с паролем. Номер телефона не требуется. Также вам нужно установить SDK для поддерживаемого языка. Это руководство охватывает Python и Node.js — самые популярные клиенты для эндпоинтов, совместимых с OpenAI. API обслуживает одну модель без цензуры с идентификатором uncensored. Она принимает текст и возвращает текст. Эмбеддингов, изображений или аудио нет. Все запросы отправляются на https://api.ollamaapi.cc/v1.

Установка SDK

Установите официальный SDK для выбранного языка. Для Python используйте pip. Для Node.js — npm. Эти библиотеки автоматически обрабатывают HTTP-протокол, сериализацию JSON и потоковую передачу. Вам не нужно писать сырые HTTP-запросы, если вы не предпочитаете такой уровень контроля. SDK хорошо документированы и широко используются в продакшене. Убедитесь, что ваша среда соответствует требованиям SDK. Рекомендуется Python 3.8+ и Node.js 18+. Обновляйте зависимости, чтобы избежать проблем с новыми параметрами модели.

Настройка клиента

Установите базовый URL для нашего эндпоинта. Это единственное изменение в конфигурации, необходимое для перехода с OpenAI на наш сервис без цензуры. Передайте ваш API-ключ в заголовке авторизации. SDK сделает всё остальное. Не меняйте имя модели на gpt-4 или подобное; используйте uncensored. API строго следует протоколу OpenAI chat-completions. Любой клиент, работающий с OpenAI, будет работать здесь с этими двумя изменениями. Это упрощает миграцию или A/B-тестирование. Вы можете запустить оба API параллельно для сравнения результатов.

Отправка первого запроса

Отправьте POST-запрос к /v1/chat/completions. Укажите идентификатор модели, системный промпт и сообщение пользователя. API возвращает текстовый ответ. Если у вас есть кредит, запрос выполняется успешно. При отсутствии кредита вы получите ошибку 402. При недействительном ключе — ошибку 401. Эти ошибки стандартны и легко обрабатываются в коде. Модель не отказывает в законном контенте для взрослых, что делает её полезной для творческого письма, исследований в области безопасности или общения без цензуры. Проверьте баланс на панели управления, если не уверены в остатке кредитов.

Потоковая передача ответов

Включите потоковую передачу, установив stream: true. API возвращает токены по мере их генерации. Это снижает воспринимаемую задержку для пользователей. Последний фрагмент содержит общее количество использованных токенов для биллинга. Потоковая передача поддерживается всеми официальными SDK. Это необходимо для чат-интерфейсов, где нужно показывать текст по мере его появления. Сервер отправляет Server-Sent Events (SSE). Ваша клиентская библиотека обрабатывает парсинг. Вам не нужно управлять потоком событий вручную, если вы не создаете собственный клиент.

Лимиты, ошибки и контекст

Контекстное окно составляет 100 000 токенов в сумме, с максимальным выводом 32 000 токенов. Запросы ограничены 300 в минуту и 8 параллельными запросами на ключ. Тело запроса должно быть меньше 8 МБ. Ошибки включают 401 для недействительных ключей, 402 для недостаточного кредита и 429 для лимитов запросов. Это стандартные коды HTTP. Обрабатывайте их корректно в вашем приложении. Модель блокирует сексуальный контент с участием несовершеннолетних. Весь остальной контент разрешен. Кредит никогда не сгорает, поэтому вы можете приостановить использование без потери средств. Обратитесь на страницу поддержки для вопросов по возврату средств.

cURL

curl https://api.ollamaapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.ollamaapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.ollamaapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Потоковая передача

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Начните с пробного баланса

E-mail и пароль — ключ сразу на экране.

Получить API-ключ

Вопросы и ответы

Это официальный API Ollama?

Нет. Мы — независимый сервис, размещающий одну модель без цензуры. Мы не связаны с Ollama, OpenAI или любым другим поставщиком. Мы используем протокол, совместимый с OpenAI, для удобства использования.

Какие способы оплаты принимаются?

Мы принимаем только криптовалюту: USDT (TRC20) или USDC (Base). Минимальная сумма пополнения — $10. Кредитные карты, PayPal и банковские переводы не поддерживаются. Баланс не сгорает.

Могу ли я использовать это для коммерческих проектов?

Да. Ограничений по использованию нет, кроме лимитов запросов. Модель не отказывает в законном контенте, что делает её подходящей для коммерческих приложений. Проверьте страницу цен для получения текущих тарифов на токены.

Ваш ключ — в одной форме от вас

Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.

Получить API-ключ

Характеристики API

Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.

ПараметрЗначение
Формат APIсовместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ
АвторизацияAuthorization: Bearer YOUR_KEY
ID моделиuncensored
ЭндпоинтыPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.ollamaapi.cc/v1
Параметрыtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Контекстное окно100 000 токенов (вход и ответ вместе)
Вызов функцийда — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool
Максимум ответадо остатка окна в 100 000 токенов; max_tokens необязателен (отдельного лимита нет)
Потоковая передачада — server-sent events, последний фрагмент содержит расход токенов
JSON-режимresponse_format: {"type": "json_object"}
Параллельные запросыдо 8 одновременно на ключ
Лимит запросов300 запросов в минуту на ключ
Заголовки ответаX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Размер запросадо 8 МБ
Оплатапредоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны
Бонус+5% от $50, +10% от $100
Цена$0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных
Пробный баланс$0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения
Срок действияоплаченный баланс не сгорает, без подписки
ПополнениеUSDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500
Ключиодин активный ключ на аккаунт; новый заменяет старый
Контентконтент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён
ВходGoogle или e-mail и пароль

Коды ошибок

Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.

КодТипЧто значит
400bad_requestневерный JSON, пустые сообщения, неверный параметр или превышено окно контекста
401missing_key · invalid_key · key_revokedнет ключа, ключ неверный или заменён новым
402no_creditбаланс пуст — пополните, работа продолжится сразу
403content_blockedсексуальный контент с несовершеннолетними — отказ, без оплаты
404not_foundнеизвестный эндпоинт
413request_too_largeтело запроса больше 8 МБ
429rate_limited · concurrencyбольше 300/мин или 8 параллельно — подождите и повторите
503upstream_busyмодель занята — повторите через несколько секунд