Inicio rápido para usuarios de Ollama
Comienza con la API de Ollama sin censura en minutos. Inserta nuestra URL base y clave para empezar a enviar peticiones con tu código SDK de OpenAI existente.
Requisitos previos
Para usar esta API, necesitas una cuenta activa con una clave de API válida. Regístrate en la página Obtener clave de API con Google o con correo electrónico y contraseña. No se requiere número de teléfono. También necesitas un SDK de un lenguaje compatible instalado en tu máquina. Esta guía cubre Python y Node.js, los clientes más comunes para endpoints compatibles con OpenAI. La API sirve un único modelo sin censura identificado por uncensored. Acepta texto y devuelve texto. No hay funciones de incrustaciones, imágenes ni audio. Todas las peticiones van a https://api.ollamaapi.cc/v1.
Instalar SDK
Instala el SDK oficial para tu lenguaje preferido. Para Python, usa pip. Para Node.js, usa npm. Estas bibliotecas manejan automáticamente el protocolo HTTP, la serialización JSON y el streaming. No necesitas escribir peticiones HTTP en bruto a menos que prefieras ese nivel de control. Los SDKs están bien documentados y se usan ampliamente en entornos de producción. Asegúrate de que tu entorno cumpla con los requisitos del SDK. Se recomiendan Python 3.8+ y Node.js 18+. Mantén tus dependencias actualizadas para evitar problemas de compatibilidad con parámetros de modelo más nuevos.
Configurar cliente
Establece la URL base en nuestro endpoint. Este es el único cambio de configuración necesario para pasar de OpenAI a nuestro servicio sin censura. Pasa tu clave de API como cabecera de autorización. El SDK se encargará del resto. No cambies el nombre del modelo a gpt-4 ni similar; usa uncensored. La API sigue estrictamente el protocolo de chat-completions de OpenAI. Cualquier cliente que funcione con OpenAI funcionará aquí con estos dos cambios. Esto hace que la migración o las pruebas A/B sean sencillas. Puedes ejecutar ambas APIs lado a lado para comparar salidas.
Enviar primera petición
Realiza una petición POST a /v1/chat/completions. Incluye el ID del modelo, el prompt del sistema y el mensaje del usuario. La API devuelve una respuesta de texto. Si tienes crédito, la petición se realiza con éxito. Si no tienes crédito, obtendrás un error 402. Si tu clave no es válida, obtendrás un 401. Estos errores son estándar y fáciles de manejar en el código. El modelo no rechaza contenido adulto lícito, lo que lo hace útil para escritura creativa, investigación de seguridad o chat sin censura. Consulta tu saldo en el panel si no estás seguro de los créditos restantes.
Respuestas en streaming
Activa el streaming estableciendo stream: true. La API devuelve tokens a medida que se generan. Esto reduce la latencia percibida para los usuarios. El fragmento final contiene el uso total de tokens para la facturación. El streaming es compatible con todos los SDK oficiales. Es esencial para interfaces de chat donde deseas mostrar el texto a medida que se escribe. El servidor envía Server-Sent Events (SSE). Tu biblioteca cliente se encarga del análisis. No necesitas gestionar el flujo de eventos manualmente a menos que estés construyendo un cliente personalizado.
Límites, errores y contexto
La ventana de contexto es de 100.000 tokens en total, con un máximo de salida de 32.000 tokens. Las peticiones están limitadas a 300 por minuto y 8 peticiones simultáneas por clave. El cuerpo de la petición debe ser inferior a 8 MB. Los errores incluyen 401 para claves no válidas, 402 por crédito insuficiente y 429 por límites de peticiones. Estos son códigos HTTP estándar. Manejalos de forma elegante en tu aplicación. El modelo bloquea contenido sexual que involucre a menores. Se permite todo lo demás. El crédito no caduca, así que puedes pausar el uso sin perder fondos. Usa la página de soporte para problemas de reembolso.
cURL
curl https://api.ollamaapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.ollamaapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.ollamaapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Empieza con crédito de prueba
Correo y contraseña; la clave aparece al instante en pantalla.
Preguntas y respuestas
¿Es esta la API oficial de Ollama?
No. Somos un servicio independiente que aloja un único modelo sin censura. No estamos afiliados a Ollama, OpenAI ni a ningún otro proveedor. Utilizamos el protocolo compatible con OpenAI para facilitar su uso.
¿Qué métodos de pago se aceptan?
Solo aceptamos criptomonedas: USDT (TRC20) o USDC (Base). La recarga mínima es de $10. No admitimos tarjetas de crédito, PayPal ni transferencias bancarias. El crédito no caduca.
¿Puedo usarlo para proyectos comerciales?
Sí. No hay restricciones de uso más allá de los límites de peticiones. El modelo no rechaza contenido lícito, lo que lo hace adecuado para aplicaciones comerciales. Consulta la página de precios para conocer las tarifas actuales por token.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave y cambia la URL base. Eso es toda la configuración.
Ficha técnica de la API
Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| Autenticación | Authorization: Bearer YOUR_KEY |
| ID del modelo | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.ollamaapi.cc/v1 |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Modo JSON | response_format: {"type": "json_object"} |
| Concurrencia | 8 peticiones a la vez por clave |
| Límite de peticiones | 300 por minuto por clave |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Tamaño de petición | hasta 8 MB |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Bono | +5 % desde $50, +10 % desde $100 |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
| Acceso | Google o correo y contraseña |
Códigos de error
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |