Hướng dẫn nhanh cho người dùng Ollama
Bắt đầu với API Ollama không kiểm duyệt trong vài phút. Chỉ cần thay đổi URL cơ sở và khóa để bắt đầu gửi yêu cầu bằng mã SDK OpenAI hiện có của bạn.
Yêu cầu tiên quyết
Để sử dụng API này, bạn cần một tài khoản hoạt động với khóa API hợp lệ. Đăng ký trên trang Lấy khóa API bằng Google hoặc email và mật khẩu. Không cần số điện thoại. Bạn cũng cần cài đặt SDK ngôn ngữ được hỗ trợ trên máy của mình. Hướng dẫn này bao gồm Python và Node.js, các client phổ biến nhất cho các endpoint tương thích OpenAI. API phục vụ một mô hình không kiểm duyệt duy nhất được xác định bởi uncensored. Nó chấp nhận văn bản và trả về văn bản. Không có tính năng embedding, hình ảnh hoặc âm thanh. Tất cả yêu cầu đều gửi đến https://api.ollamaapi.cc/v1.
Cài đặt SDK
Cài đặt SDK chính thức cho ngôn ngữ bạn chọn. Với Python, hãy dùng pip. Với Node.js, hãy dùng npm. Các thư viện này xử lý giao thức HTTP, tuần tự hóa JSON và truyền phát tự động. Bạn không cần viết các yêu cầu HTTP thô trừ khi bạn thích mức độ kiểm soát đó. Các SDK được tài liệu hóa tốt và được sử dụng rộng rãi trong môi trường sản xuất. Đảm bảo môi trường của bạn khớp với yêu cầu của SDK. Khuyến nghị Python 3.8+ và Node.js 18+. Giữ các phụ thuộc của bạn cập nhật để tránh các vấn đề tương thích với các tham số mô hình mới hơn.
Cấu hình máy khách
Đặt URL cơ sở thành endpoint của chúng tôi. Đây là thay đổi cấu hình duy nhất cần thiết để chuyển từ OpenAI sang dịch vụ không kiểm duyệt của chúng tôi. Truyền khóa API của bạn dưới dạng tiêu đề xác thực. SDK sẽ xử lý phần còn lại. Không thay đổi tên mô hình thành gpt-4 hoặc tương tự; hãy dùng uncensored. API tuân thủ nghiêm ngặt giao thức chat-completions của OpenAI. Bất kỳ client nào hoạt động với OpenAI đều sẽ hoạt động ở đây với hai thay đổi này. Điều này giúp việc di chuyển hoặc kiểm tra A/B trở nên đơn giản. Bạn có thể chạy cả hai API song song để so sánh kết quả đầu ra.
Gửi yêu cầu đầu tiên
Gửi yêu cầu POST đến /v1/chat/completions. Bao gồm ID mô hình, prompt hệ thống và tin nhắn của người dùng. API trả về phản hồi dạng văn bản. Nếu bạn có tín dụng, yêu cầu sẽ thành công. Nếu thiếu tín dụng, bạn sẽ nhận lỗi 402. Nếu khóa không hợp lệ, bạn sẽ nhận lỗi 401. Các lỗi này là tiêu chuẩn và dễ xử lý trong mã. Mô hình không từ chối nội dung người lớn hợp pháp, rất hữu ích cho viết sáng tạo, nghiên cứu bảo mật hoặc trò chuyện không kiểm duyệt. Kiểm tra số dư trên bảng điều khiển nếu bạn không chắc về tín dụng còn lại.
Phản hồi truyền phát
Bật truyền phát bằng cách đặt stream: true. API trả về các token khi chúng được tạo. Điều này giảm độ trễ cảm nhận đối với người dùng. Chunk cuối cùng chứa tổng mức sử dụng token để tính phí. Truyền phát được hỗ trợ bởi tất cả các SDK chính thức. Nó rất quan trọng cho các giao diện trò chuyện nơi bạn muốn hiển thị văn bản khi nó được viết. Máy chủ gửi các Sự kiện được gửi bởi Máy chủ (SSE). Thư viện client của bạn xử lý việc phân tích cú pháp. Bạn không cần quản lý luồng sự kiện thủ công trừ khi bạn đang xây dựng một client tùy chỉnh.
Giới hạn, Lỗi và Ngữ cảnh
Cửa sổ ngữ cảnh có tổng cộng 100.000 token, với tối đa 32.000 token đầu ra. Các yêu cầu bị giới hạn ở 300 mỗi phút và 8 yêu cầu đồng thời mỗi khóa. Thân yêu cầu phải dưới 8 MB. Lỗi bao gồm 401 cho khóa không hợp lệ, 402 cho tín dụng không đủ và 429 cho giới hạn tốc độ. Đây là các mã HTTP tiêu chuẩn. Hãy xử lý chúng một cách tinh tế trong ứng dụng của bạn. Mô hình chặn nội dung tình dục liên quan đến trẻ vị thành niên. Tất cả nội dung khác đều được phép. Tín dụng không bao giờ hết hạn, vì vậy bạn có thể tạm dừng sử dụng mà không mất tiền. Sử dụng trang hỗ trợ cho các vấn đề hoàn tiền.
cURL
curl https://api.ollamaapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.ollamaapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.ollamaapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Truyền phát
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Bắt đầu với tín dụng dùng thử
Email và mật khẩu, khóa hiện ngay trên màn hình.
Hỏi đáp
Đây có phải là API Ollama chính thức không?
Không. Chúng tôi là dịch vụ độc lập lưu trữ một mô hình không kiểm duyệt. Chúng tôi không liên kết với Ollama, OpenAI hoặc nhà cung cấp nào khác. Chúng tôi sử dụng giao thức tương thích OpenAI để dễ sử dụng.
Những phương thức thanh toán nào được chấp nhận?
Chúng tôi chỉ chấp nhận tiền điện tử: USDT (TRC20) hoặc USDC (Base). Nạp tiền tối thiểu là $10. Không hỗ trợ thẻ tín dụng, PayPal hoặc chuyển khoản ngân hàng. Tín dụng không bao giờ hết hạn.
Tôi có thể sử dụng cho các dự án thương mại không?
Có. Không có hạn chế sử dụng nào ngoài giới hạn tốc độ. Mô hình không từ chối nội dung hợp pháp, phù hợp cho các ứng dụng thương mại. Xem trang giá để biết tỷ lệ token hiện tại.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ quá trình thiết lập.
Thông số API
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| Xác thực | Authorization: Bearer YOUR_KEY |
| ID mô hình | uncensored |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.ollamaapi.cc/v1 |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Cửa sổ ngữ cảnh | 100.000 token (đầu vào + đầu ra) |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Kích thước yêu cầu | tối đa 8 MB |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Thưởng | +5% từ $50, +10% từ $100 |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
| Đăng nhập | Google hoặc email và mật khẩu |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |