เริ่มต้นสำหรับผู้ใช้ Ollama
เริ่มต้นใช้งาน API Ollama แบบไม่เซ็นเซอร์ในไม่กี่นาที เพิ่ม URL พื้นฐานและคีย์ของคุณเพื่อเริ่มส่งคำขอด้วยโค้ด SDK OpenAI ที่มีอยู่
ข้อกำหนดเบื้องต้น
ในการใช้งาน API นี้ คุณต้องมีบัญชีที่ใช้งานอยู่และคีย์ API ที่ถูกต้อง ไปที่หน้า รับคีย์ API เพื่อสมัครสมาชิกโดยใช้ Google หรืออีเมลพร้อมรหัสผ่าน ไม่จำเป็นต้องใช้หมายเลขโทรศัพท์ คุณยังต้องติดตั้ง SDK ภาษาที่รองรับบนเครื่องของคุณ คู่มือนี้ครอบคลุม Python และ Node.js ซึ่งเป็นไคลเอนต์ที่พบบ่อยที่สุดสำหรับเอนด์พอยต์ที่เข้ากันได้กับ OpenAI API นี้ให้บริการโมเดลแบบไม่เซ็นเซอร์เพียงโมเดลเดียวที่ระบุโดย uncensored API รับข้อความและส่งกลับข้อความ ไม่มีฟีเจอร์ embeddings รูปภาพ หรือเสียง คำขอทั้งหมดไปยัง https://api.ollamaapi.cc/v1
ติดตั้ง SDK
ติดตั้ง SDK ทางการสำหรับภาษาที่คุณต้องการ สำหรับ Python ใช้ pip สำหรับ Node.js ใช้ npm ไลบรารีเหล่านี้จัดการโปรโตคอล HTTP การทำ serialization JSON และการสตรีมมิงโดยอัตโนมัติ คุณไม่จำเป็นต้องเขียนคำขอ HTTP แบบดิบเว้นแต่คุณจะชอบระดับการควบคุมนี้ SDK มีการบันทึกเอกสารอย่างดีและใช้งานทั่วไปในสภาพแวดล้อมการผลิต ตรวจสอบให้แน่ใจว่าสภาพแวดล้อมของคุณตรงกับข้อกำหนดของ SDK แนะนำ Python 3.8+ และ Node.js 18+ อัปเดต dependencies ของคุณให้ทันสมัยเพื่อหลีกเลี่ยงปัญหาความเข้ากันได้กับพารามิเตอร์โมเดลใหม่
กำหนดค่าไคลเอนต์
ตั้งค่า URL พื้นฐานไปยังเอนด์พอยต์ของเรา นี่คือการเปลี่ยนแปลงการกำหนดค่าเพียงอย่างเดียวที่จำเป็นในการเปลี่ยนจาก OpenAI มาบริการไม่เซ็นเซอร์ของเรา ส่งคีย์ API ของคุณเป็นหัวเรื่องการตรวจสอบสิทธิ์ SDK จะจัดการส่วนที่เหลือ ไม่ต้องเปลี่ยนชื่อโมเดลเป็น gpt-4 หรือคล้ายกัน; ใช้ uncensored API ปฏิบัติตามโปรโตคอล chat-completions ของ OpenAI อย่างเคร่งครัด ไคลเอนต์ใดๆ ที่ทำงานกับ OpenAI จะทำงานที่นี่ด้วยการเปลี่ยนแปลงสองประการนี้ ทำให้การย้ายหรือการทดสอบ A/B ง่ายขึ้น คุณสามารถรัน API ทั้งสองข้างเคียงเพื่อเปรียบเทียบผลลัพธ์
ส่งคำขอแรก
ส่งคำขอ POST ไปยัง /v1/chat/completions รวม ID โมเดล พรอมต์ระบบ และข้อความผู้ใช้ API คืนข้อความตอบกลับ หากมีเครดิต คำขอจะสำเร็จ หากไม่มีเครดิต คุณจะได้รับการผิดพลาด 402 หากคีย์ของคุณไม่ถูกต้อง คุณจะได้รับการผิดพลาด 401 ข้อผิดพลาดเหล่านี้เป็นมาตรฐานและจัดการได้ง่ายในโค้ด โมเดลไม่ปฏิเสธเนื้อหาผู้ใหญ่ที่ถูกต้องตามกฎหมาย ทำให้มีประโยชน์สำหรับการเขียนเชิงสร้างสรรค์ การวิจัยความปลอดภัย หรือแชทแบบไม่เซ็นเซอร์ ตรวจสอบยอดเงินของคุณบนแดชบอร์ดหากคุณไม่แน่ใจเกี่ยวกับเครดิตที่เหลือ
การตอบสนองแบบสตรีมมิง
เปิดใช้งานสตรีมมิงโดยการตั้งค่า stream: true API ส่งโทเคนออกมาเมื่อมีการสร้างข้อความ ซึ่งช่วยลดความล่าช้าที่ผู้ใช้รู้สึก โมดูลสุดท้ายมีการใช้งานโทเคนรวมสำหรับการเรียกเก็บเงิน สตรีมมิงรองรับโดย SDK ทางการทั้งหมด สิ่งจำเป็นสำหรับอินเทอร์เฟซแชทที่คุณต้องการแสดงข้อความเมื่อพิมพ์ เซิร์ฟเวอร์ส่งเหตุการณ์ส่งจากเซิร์ฟเวอร์ (SSE) ไลบรารีไคลเอนต์ของคุณจัดการการแยกวิเคราะห์ คุณไม่จำเป็นต้องจัดการสตรีมเหตุการณ์ด้วยตนเอง เว้นแต่คุณจะสร้างไคลเอนต์แบบกำหนดเอง
ขีดจำกัด ข้อผิดพลาด และหน้าต่างบริบท
หน้าต่างบริบทมีโทเคนรวม 100,000 โทเคน พร้อมการส่งออกสูงสุด 32,000 โทเคน คำขอจำกัดไว้ที่ 300 คำขอต่อนาทีและ 8 คำขอพร้อมกันต่อคีย์ ร่างคำขอต้องมีขนาดไม่เกิน 8 MB ข้อผิดพลาดรวมถึง 401 สำหรับคีย์ที่ไม่ถูกต้อง 402 สำหรับเครดิตไม่เพียงพอ และ 429 สำหรับขีดจำกัดอัตรา นี่คือรหัส HTTP มาตรฐาน จัดการอย่างเหมาะสมในแอปพลิเคชันของคุณ โมเดลบล็อกเนื้อหาทางเพศที่เกี่ยวข้องกับเด็กอายุต่ำกว่า 18 ปี เนื้อหาอื่น ๆ ทั้งหมดได้รับอนุญาต เครดิตไม่หมดอายุ ดังนั้นคุณสามารถหยุดการใช้งานโดยไม่สูญเสียเงิน ใช้หน้าการสนับสนุนสำหรับปัญหาการคืนเงิน
cURL
curl https://api.ollamaapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.ollamaapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.ollamaapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);สตรีมมิง
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)เริ่มต้นด้วยเครดิตทดลองใช้
อีเมลและรหัสผ่าน คีย์แสดงบนหน้าจอทันที
ถาม-ตอบ
นี่คือ API Ollama ทางการหรือไม่?
ไม่ เราเป็นบริการอิสระที่โฮสต์โมเดลไม่เซ็นเซอร์เพียงตัวเดียว เราไม่เกี่ยวข้องกับ Ollama, OpenAI หรือผู้ขายรายอื่น เราใช้โปรโตคอลที่เข้ากันได้กับ OpenAI เพื่อความสะดวก
รับชำระเงินด้วยวิธีใดบ้าง?
เรารับเฉพาะคริปโต: USDT (TRC20) หรือ USDC (Base) เติมเงินขั้นต่ำ $10 ไม่รองรับบัตรเครดิต PayPal หรือการโอนเงินผ่านธนาคาร เครดิตไม่หมดอายุ
ฉันใช้สำหรับโครงการเชิงพาณิชย์ได้หรือไม่?
ได้ ไม่มีข้อจำกัดการใช้งานนอกจากขีดจำกัดอัตรา โมเดลไม่ปฏิเสธเนื้อหาที่ถูกต้องตามกฎหมาย จึงเหมาะสำหรับแอปพลิเคชันเชิงพาณิชย์ ดูหน้าราคาสำหรับอัตราโทเคนปัจจุบัน
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน URL พื้นฐาน นั่นคือการตั้งค่าทั้งหมด
ข้อมูลจำเพาะ API
ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน
| รายการ | ค่า |
|---|---|
| รูปแบบ API | รองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์ |
| การยืนยันตัวตน | Authorization: Bearer YOUR_KEY |
| ID โมเดล | uncensored |
| เอนด์พอยต์ | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.ollamaapi.cc/v1 |
| พารามิเตอร์ | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| หน้าต่างบริบท | 100,000 โทเคน (อินพุตรวมเอาต์พุต) |
| การเรียกใช้ฟังก์ชัน | รองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool |
| เอาต์พุตสูงสุด | ได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก) |
| สตรีมมิง | รองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้ |
| โหมด JSON | response_format: {"type": "json_object"} |
| คำขอพร้อมกัน | สูงสุด 8 คำขอพร้อมกันต่อคีย์ |
| ขีดจำกัดอัตรา | 300 คำขอต่อนาทีต่อคีย์ |
| เฮดเดอร์ของคำตอบ | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| ขนาดคำขอ | ไม่เกิน 8 MB |
| การคิดเงิน | เครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน |
| โบนัส | +5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100 |
| ราคา | $0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต |
| เครดิตทดลองใช้ฟรี | $0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก |
| อายุเครดิต | เครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน |
| เติมเงิน | USDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500 |
| คีย์ | หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม |
| เนื้อหา | อนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์ |
| เข้าสู่ระบบ | Google หรืออีเมลและรหัสผ่าน |
รหัสข้อผิดพลาด
ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน
| รหัส | ประเภท | ความหมาย |
|---|---|---|
400 | bad_request | JSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท |
401 | missing_key · invalid_key · key_revoked | ไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว |
402 | no_credit | เครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที |
403 | content_blocked | เนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน |
404 | not_found | ไม่รู้จักเอนด์พอยต์ |
413 | request_too_large | ขนาดเกิน 8 MB |
429 | rate_limited · concurrency | เกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่ |
503 | upstream_busy | โมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที |