ES ▾
Obtener clave de API

Inicio rápido para usuarios de Ollama

Comienza con la API de Ollama sin censura en minutos. Inserta nuestra URL base y clave para empezar a enviar peticiones con tu código SDK de OpenAI existente.

Requisitos previos

Para usar esta API, necesitas una cuenta activa con una clave de API válida. Regístrate en la página Obtener clave de API con Google o con correo electrónico y contraseña. No se requiere número de teléfono. También necesitas un SDK de un lenguaje compatible instalado en tu máquina. Esta guía cubre Python y Node.js, los clientes más comunes para endpoints compatibles con OpenAI. La API sirve un único modelo sin censura identificado por uncensored. Acepta texto y devuelve texto. No hay funciones de incrustaciones, imágenes ni audio. Todas las peticiones van a https://api.ollamaapi.cc/v1.

Instalar SDK

Instala el SDK oficial para tu lenguaje preferido. Para Python, usa pip. Para Node.js, usa npm. Estas bibliotecas manejan automáticamente el protocolo HTTP, la serialización JSON y el streaming. No necesitas escribir peticiones HTTP en bruto a menos que prefieras ese nivel de control. Los SDKs están bien documentados y se usan ampliamente en entornos de producción. Asegúrate de que tu entorno cumpla con los requisitos del SDK. Se recomiendan Python 3.8+ y Node.js 18+. Mantén tus dependencias actualizadas para evitar problemas de compatibilidad con parámetros de modelo más nuevos.

Configurar cliente

Establece la URL base en nuestro endpoint. Este es el único cambio de configuración necesario para pasar de OpenAI a nuestro servicio sin censura. Pasa tu clave de API como cabecera de autorización. El SDK se encargará del resto. No cambies el nombre del modelo a gpt-4 ni similar; usa uncensored. La API sigue estrictamente el protocolo de chat-completions de OpenAI. Cualquier cliente que funcione con OpenAI funcionará aquí con estos dos cambios. Esto hace que la migración o las pruebas A/B sean sencillas. Puedes ejecutar ambas APIs lado a lado para comparar salidas.

Enviar primera petición

Realiza una petición POST a /v1/chat/completions. Incluye el ID del modelo, el prompt del sistema y el mensaje del usuario. La API devuelve una respuesta de texto. Si tienes crédito, la petición se realiza con éxito. Si no tienes crédito, obtendrás un error 402. Si tu clave no es válida, obtendrás un 401. Estos errores son estándar y fáciles de manejar en el código. El modelo no rechaza contenido adulto lícito, lo que lo hace útil para escritura creativa, investigación de seguridad o chat sin censura. Consulta tu saldo en el panel si no estás seguro de los créditos restantes.

Respuestas en streaming

Activa el streaming estableciendo stream: true. La API devuelve tokens a medida que se generan. Esto reduce la latencia percibida para los usuarios. El fragmento final contiene el uso total de tokens para la facturación. El streaming es compatible con todos los SDK oficiales. Es esencial para interfaces de chat donde deseas mostrar el texto a medida que se escribe. El servidor envía Server-Sent Events (SSE). Tu biblioteca cliente se encarga del análisis. No necesitas gestionar el flujo de eventos manualmente a menos que estés construyendo un cliente personalizado.

Límites, errores y contexto

La ventana de contexto es de 100.000 tokens en total, con un máximo de salida de 32.000 tokens. Las peticiones están limitadas a 300 por minuto y 8 peticiones simultáneas por clave. El cuerpo de la petición debe ser inferior a 8 MB. Los errores incluyen 401 para claves no válidas, 402 por crédito insuficiente y 429 por límites de peticiones. Estos son códigos HTTP estándar. Manejalos de forma elegante en tu aplicación. El modelo bloquea contenido sexual que involucre a menores. Se permite todo lo demás. El crédito no caduca, así que puedes pausar el uso sin perder fondos. Usa la página de soporte para problemas de reembolso.

cURL

curl https://api.ollamaapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.ollamaapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.ollamaapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Empieza con crédito de prueba

Correo y contraseña; la clave aparece al instante en pantalla.

Obtener clave de API

Preguntas y respuestas

¿Es esta la API oficial de Ollama?

No. Somos un servicio independiente que aloja un único modelo sin censura. No estamos afiliados a Ollama, OpenAI ni a ningún otro proveedor. Utilizamos el protocolo compatible con OpenAI para facilitar su uso.

¿Qué métodos de pago se aceptan?

Solo aceptamos criptomonedas: USDT (TRC20) o USDC (Base). La recarga mínima es de $10. No admitimos tarjetas de crédito, PayPal ni transferencias bancarias. El crédito no caduca.

¿Puedo usarlo para proyectos comerciales?

Sí. No hay restricciones de uso más allá de los límites de peticiones. El modelo no rechaza contenido lícito, lo que lo hace adecuado para aplicaciones comerciales. Consulta la página de precios para conocer las tarifas actuales por token.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave y cambia la URL base. Eso es toda la configuración.

Obtener clave de API

Ficha técnica de la API

Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
AutenticaciónAuthorization: Bearer YOUR_KEY
ID del modelouncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.ollamaapi.cc/v1
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Ventana de contexto100.000 tokens (entrada + salida)
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Modo JSONresponse_format: {"type": "json_object"}
Concurrencia8 peticiones a la vez por clave
Límite de peticiones300 por minuto por clave
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Tamaño de peticiónhasta 8 MB
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
Bono+5 % desde $50, +10 % desde $100
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Caducidadel crédito pagado no caduca, sin suscripción
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores
AccesoGoogle o correo y contraseña

Códigos de error

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos