Быстрый старт для пользователей Ollama
Начните работу с API без цензуры Ollama за считанные минуты. Укажите базовый URL и ключ, чтобы отправлять запросы с помощью вашего кода на SDK OpenAI.
Предварительные требования
Для работы с API вам нужен активный аккаунт с валидным API-ключом. Зарегистрируйтесь на странице Получить API-ключ через Google или email с паролем. Номер телефона не требуется. Также вам нужно установить SDK для поддерживаемого языка. Это руководство охватывает Python и Node.js — самые популярные клиенты для эндпоинтов, совместимых с OpenAI. API обслуживает одну модель без цензуры с идентификатором uncensored. Она принимает текст и возвращает текст. Эмбеддингов, изображений или аудио нет. Все запросы отправляются на https://api.ollamaapi.cc/v1.
Установка SDK
Установите официальный SDK для выбранного языка. Для Python используйте pip. Для Node.js — npm. Эти библиотеки автоматически обрабатывают HTTP-протокол, сериализацию JSON и потоковую передачу. Вам не нужно писать сырые HTTP-запросы, если вы не предпочитаете такой уровень контроля. SDK хорошо документированы и широко используются в продакшене. Убедитесь, что ваша среда соответствует требованиям SDK. Рекомендуется Python 3.8+ и Node.js 18+. Обновляйте зависимости, чтобы избежать проблем с новыми параметрами модели.
Настройка клиента
Установите базовый URL для нашего эндпоинта. Это единственное изменение в конфигурации, необходимое для перехода с OpenAI на наш сервис без цензуры. Передайте ваш API-ключ в заголовке авторизации. SDK сделает всё остальное. Не меняйте имя модели на gpt-4 или подобное; используйте uncensored. API строго следует протоколу OpenAI chat-completions. Любой клиент, работающий с OpenAI, будет работать здесь с этими двумя изменениями. Это упрощает миграцию или A/B-тестирование. Вы можете запустить оба API параллельно для сравнения результатов.
Отправка первого запроса
Отправьте POST-запрос к /v1/chat/completions. Укажите идентификатор модели, системный промпт и сообщение пользователя. API возвращает текстовый ответ. Если у вас есть кредит, запрос выполняется успешно. При отсутствии кредита вы получите ошибку 402. При недействительном ключе — ошибку 401. Эти ошибки стандартны и легко обрабатываются в коде. Модель не отказывает в законном контенте для взрослых, что делает её полезной для творческого письма, исследований в области безопасности или общения без цензуры. Проверьте баланс на панели управления, если не уверены в остатке кредитов.
Потоковая передача ответов
Включите потоковую передачу, установив stream: true. API возвращает токены по мере их генерации. Это снижает воспринимаемую задержку для пользователей. Последний фрагмент содержит общее количество использованных токенов для биллинга. Потоковая передача поддерживается всеми официальными SDK. Это необходимо для чат-интерфейсов, где нужно показывать текст по мере его появления. Сервер отправляет Server-Sent Events (SSE). Ваша клиентская библиотека обрабатывает парсинг. Вам не нужно управлять потоком событий вручную, если вы не создаете собственный клиент.
Лимиты, ошибки и контекст
Контекстное окно составляет 100 000 токенов в сумме, с максимальным выводом 32 000 токенов. Запросы ограничены 300 в минуту и 8 параллельными запросами на ключ. Тело запроса должно быть меньше 8 МБ. Ошибки включают 401 для недействительных ключей, 402 для недостаточного кредита и 429 для лимитов запросов. Это стандартные коды HTTP. Обрабатывайте их корректно в вашем приложении. Модель блокирует сексуальный контент с участием несовершеннолетних. Весь остальной контент разрешен. Кредит никогда не сгорает, поэтому вы можете приостановить использование без потери средств. Обратитесь на страницу поддержки для вопросов по возврату средств.
cURL
curl https://api.ollamaapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.ollamaapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.ollamaapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Потоковая передача
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Начните с пробного баланса
E-mail и пароль — ключ сразу на экране.
Вопросы и ответы
Это официальный API Ollama?
Нет. Мы — независимый сервис, размещающий одну модель без цензуры. Мы не связаны с Ollama, OpenAI или любым другим поставщиком. Мы используем протокол, совместимый с OpenAI, для удобства использования.
Какие способы оплаты принимаются?
Мы принимаем только криптовалюту: USDT (TRC20) или USDC (Base). Минимальная сумма пополнения — $10. Кредитные карты, PayPal и банковские переводы не поддерживаются. Баланс не сгорает.
Могу ли я использовать это для коммерческих проектов?
Да. Ограничений по использованию нет, кроме лимитов запросов. Модель не отказывает в законном контенте, что делает её подходящей для коммерческих приложений. Проверьте страницу цен для получения текущих тарифов на токены.
Ваш ключ — в одной форме от вас
Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.
Характеристики API
Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.
| Параметр | Значение |
|---|---|
| Формат API | совместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ |
| Авторизация | Authorization: Bearer YOUR_KEY |
| ID модели | uncensored |
| Эндпоинты | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.ollamaapi.cc/v1 |
| Параметры | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Контекстное окно | 100 000 токенов (вход и ответ вместе) |
| Вызов функций | да — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool |
| Максимум ответа | до остатка окна в 100 000 токенов; max_tokens необязателен (отдельного лимита нет) |
| Потоковая передача | да — server-sent events, последний фрагмент содержит расход токенов |
| JSON-режим | response_format: {"type": "json_object"} |
| Параллельные запросы | до 8 одновременно на ключ |
| Лимит запросов | 300 запросов в минуту на ключ |
| Заголовки ответа | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Размер запроса | до 8 МБ |
| Оплата | предоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны |
| Бонус | +5% от $50, +10% от $100 |
| Цена | $0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных |
| Пробный баланс | $0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения |
| Срок действия | оплаченный баланс не сгорает, без подписки |
| Пополнение | USDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500 |
| Ключи | один активный ключ на аккаунт; новый заменяет старый |
| Контент | контент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён |
| Вход | Google или e-mail и пароль |
Коды ошибок
Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.
| Код | Тип | Что значит |
|---|---|---|
400 | bad_request | неверный JSON, пустые сообщения, неверный параметр или превышено окно контекста |
401 | missing_key · invalid_key · key_revoked | нет ключа, ключ неверный или заменён новым |
402 | no_credit | баланс пуст — пополните, работа продолжится сразу |
403 | content_blocked | сексуальный контент с несовершеннолетними — отказ, без оплаты |
404 | not_found | неизвестный эндпоинт |
413 | request_too_large | тело запроса больше 8 МБ |
429 | rate_limited · concurrency | больше 300/мин или 8 параллельно — подождите и повторите |
503 | upstream_busy | модель занята — повторите через несколько секунд |