ES ▾
Obtener clave de API

getdeepseekapi.comDocumentación

API DeepSeek: Primera solicitud en cinco minutos

Obtén tu primera respuesta en cinco minutos apuntando tu cliente compatible con OpenAI a nuestra URL base y autenticándote con la clave generada durante el registro.

URL base y autenticación

Nuestra API sigue la interfaz estándar de OpenAI, por lo que solo necesitas cambiar dos valores en la configuración de tu cliente. Establece la URL base en https://api.getdeepseekapi.com/v1 y usa la clave de API que se muestra inmediatamente después de crear tu cuenta en la página Obtener clave de API. No se requiere número de teléfono ni tarjeta de crédito para comenzar, y recibes $0,50 en crédito de prueba que dura siete días.

Cada cuenta permite solo una clave activa a la vez. Si rotas tu clave, la anterior se revoca inmediatamente. Esto simplifica la gestión de secretos en entornos de desarrollo y producción sin necesidad de ámbitos de permisos complejos.

Enviar una finalización de chat

Realiza una petición POST estándar a /v1/chat/completions para recibir una respuesta de texto. El endpoint acepta un array messages que contiene tu prompt del sistema y la consulta del usuario, junto con un identificador de model configurado como uncensored. Este modelo se ejecuta en nuestros propios servidores GPU y está ajustado para responder sin rechazos de contenido para uso adulto lícito.

Asegúrate de que el cuerpo de la petición no supere los 8 MB. Si la clave es inválida o ha caducado, el servidor devuelve un error 401. Si se agota tu crédito prepago, recibirás un error 402 que requiere una recarga. Puedes añadir fondos a partir de $10 mediante cripto (USDT o USDC).

curl https://api.getdeepseekapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Instalar y usar el SDK de Python

Usar la biblioteca oficial de Python de OpenAI es la forma más rápida de integrar. Instala el paquete mediante pip, luego configura el cliente con tu URL base personalizada y tu clave de API. El parámetro model debe establecerse en uncensored para garantizar que te estás comunicando con nuestra instancia específica.

Este enfoque funciona con cualquier SDK compatible con OpenAI, incluidos los usados para Node.js o Go. El cliente maneja la serialización y los reintentos automáticamente. Recuerda que el id del modelo no es un nombre de proveedor como GPT-4; es un identificador específico para nuestro modelo sin censura.

from openai import OpenAI

client = OpenAI(base_url="https://api.getdeepseekapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Integración con Node.js

Para entornos JavaScript, instala el SDK de OpenAI y configúralo de forma similar al ejemplo de Python. Establece baseUrl hacia nuestro endpoint y proporciona tu clave de API. El SDK de Node admite patrones síncronos y asíncronos.

Al construir la petición, especifica model: 'uncensored' en los parámetros. Esto asegura que el cliente envíe peticiones al endpoint del modelo correcto. El SDK maneja respuestas de streaming y no streaming de manera uniforme, permitiéndote intercambiar implementaciones sin cambiar la lógica central de la petición.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.getdeepseekapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Habilitar streaming (SSE)

Establece el parámetro stream en true para recibir una respuesta de Server-Sent Events (SSE). El servidor envía una serie de fragmentos, cada uno con una parte del texto generado. Esto reduce la latencia percibida en respuestas largas y permite que el cliente muestre los tokens a medida que se generan.

Asegúrate de que el código de tu cliente maneje correctamente el evento de finalización del streaming. El streaming no cambia la facturación ni el conteo de tokens; aún se te cobra por cada 1M de tokens de entrada y salida. La ventana de contexto total sigue limitada a 100.000 tokens para el prompt y la respuesta combinados.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Límites, errores y ventana de contexto

Tu clave de API está limitada a 300 peticiones por minuto. Si superas este umbral, el servidor devuelve un error 429 indicando un límite de peticiones. El cuerpo de cada petición no debe exceder los 8 MB. La ventana de contexto admite 100.000 tokens para la suma del prompt y la respuesta, lo que significa que debes considerar ambas longitudes al diseñar tu aplicación.

Los errores comunes incluyen 401 para claves inválidas, 402 por crédito prepago insuficiente y 429 por límites de peticiones. Puedes regenerar tu clave de API en cualquier momento desde la configuración de tu cuenta, lo que invalida inmediatamente la clave antigua. Esto es útil si sospechas una filtración o necesitas rotar credenciales entre entornos.

Funciones y límites

Una tabla con cada límite, función y precio.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
EndpointsPOST /v1/chat/completions · GET /v1/models
AutenticaciónAuthorization: Bearer YOUR_KEY
ID del modelouncensored
Base URLhttps://api.getdeepseekapi.com/v1
Ventana de contexto100.000 tokens (entrada + salida)
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Modo JSONresponse_format: {"type": "json_object"}
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Límite de peticiones300 por minuto por clave
Tamaño de peticiónhasta 8 MB
Concurrencia8 peticiones a la vez por clave
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Caducidadel crédito pagado no caduca, sin suscripción
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
Bono+5 % desde $50, +10 % desde $100
AccesoGoogle o correo y contraseña
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior

Códigos de error

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas y respuestas

¿Cuál es el tamaño de la ventana de contexto?

La ventana de contexto es de 100.000 tokens, calculada como la suma de los tokens del prompt de entrada y los tokens de respuesta de salida. No son 100.000 tokens disponibles exclusivamente para la entrada.

¿Este servicio admite llamadas a funciones?

Sí, el endpoint <code>/v1/chat/completions</code> admite llamadas a funciones y herramientas. Puedes definir herramientas en tu petición y el modelo devolverá argumentos estructurados para ellas.

¿Cómo manejo un error 402?

Un error 402 indica que el saldo de tu crédito prepago es cero. Puedes recargar tu cuenta a partir de $10 usando criptomonedas (USDT o USDC). Los créditos no caducan.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Esa es toda la configuración.

Obtener clave de API