getdeepseekapi.comDocumentación
API DeepSeek: Primera solicitud en cinco minutos
Obtén tu primera respuesta en cinco minutos apuntando tu cliente compatible con OpenAI a nuestra URL base y autenticándote con la clave generada durante el registro.
URL base y autenticación
Nuestra API sigue la interfaz estándar de OpenAI, por lo que solo necesitas cambiar dos valores en la configuración de tu cliente. Establece la URL base en https://api.getdeepseekapi.com/v1 y usa la clave de API que se muestra inmediatamente después de crear tu cuenta en la página Obtener clave de API. No se requiere número de teléfono ni tarjeta de crédito para comenzar, y recibes $0,50 en crédito de prueba que dura siete días.
Cada cuenta permite solo una clave activa a la vez. Si rotas tu clave, la anterior se revoca inmediatamente. Esto simplifica la gestión de secretos en entornos de desarrollo y producción sin necesidad de ámbitos de permisos complejos.
Enviar una finalización de chat
Realiza una petición POST estándar a /v1/chat/completions para recibir una respuesta de texto. El endpoint acepta un array messages que contiene tu prompt del sistema y la consulta del usuario, junto con un identificador de model configurado como uncensored. Este modelo se ejecuta en nuestros propios servidores GPU y está ajustado para responder sin rechazos de contenido para uso adulto lícito.
Asegúrate de que el cuerpo de la petición no supere los 8 MB. Si la clave es inválida o ha caducado, el servidor devuelve un error 401. Si se agota tu crédito prepago, recibirás un error 402 que requiere una recarga. Puedes añadir fondos a partir de $10 mediante cripto (USDT o USDC).
curl https://api.getdeepseekapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Instalar y usar el SDK de Python
Usar la biblioteca oficial de Python de OpenAI es la forma más rápida de integrar. Instala el paquete mediante pip, luego configura el cliente con tu URL base personalizada y tu clave de API. El parámetro model debe establecerse en uncensored para garantizar que te estás comunicando con nuestra instancia específica.
Este enfoque funciona con cualquier SDK compatible con OpenAI, incluidos los usados para Node.js o Go. El cliente maneja la serialización y los reintentos automáticamente. Recuerda que el id del modelo no es un nombre de proveedor como GPT-4; es un identificador específico para nuestro modelo sin censura.
from openai import OpenAI
client = OpenAI(base_url="https://api.getdeepseekapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integración con Node.js
Para entornos JavaScript, instala el SDK de OpenAI y configúralo de forma similar al ejemplo de Python. Establece baseUrl hacia nuestro endpoint y proporciona tu clave de API. El SDK de Node admite patrones síncronos y asíncronos.
Al construir la petición, especifica model: 'uncensored' en los parámetros. Esto asegura que el cliente envíe peticiones al endpoint del modelo correcto. El SDK maneja respuestas de streaming y no streaming de manera uniforme, permitiéndote intercambiar implementaciones sin cambiar la lógica central de la petición.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.getdeepseekapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Habilitar streaming (SSE)
Establece el parámetro stream en true para recibir una respuesta de Server-Sent Events (SSE). El servidor envía una serie de fragmentos, cada uno con una parte del texto generado. Esto reduce la latencia percibida en respuestas largas y permite que el cliente muestre los tokens a medida que se generan.
Asegúrate de que el código de tu cliente maneje correctamente el evento de finalización del streaming. El streaming no cambia la facturación ni el conteo de tokens; aún se te cobra por cada 1M de tokens de entrada y salida. La ventana de contexto total sigue limitada a 100.000 tokens para el prompt y la respuesta combinados.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Límites, errores y ventana de contexto
Tu clave de API está limitada a 300 peticiones por minuto. Si superas este umbral, el servidor devuelve un error 429 indicando un límite de peticiones. El cuerpo de cada petición no debe exceder los 8 MB. La ventana de contexto admite 100.000 tokens para la suma del prompt y la respuesta, lo que significa que debes considerar ambas longitudes al diseñar tu aplicación.
Los errores comunes incluyen 401 para claves inválidas, 402 por crédito prepago insuficiente y 429 por límites de peticiones. Puedes regenerar tu clave de API en cualquier momento desde la configuración de tu cuenta, lo que invalida inmediatamente la clave antigua. Esto es útil si sospechas una filtración o necesitas rotar credenciales entre entornos.
Funciones y límites
Una tabla con cada límite, función y precio.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Autenticación | Authorization: Bearer YOUR_KEY |
| ID del modelo | uncensored |
| Base URL | https://api.getdeepseekapi.com/v1 |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Modo JSON | response_format: {"type": "json_object"} |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Límite de peticiones | 300 por minuto por clave |
| Tamaño de petición | hasta 8 MB |
| Concurrencia | 8 peticiones a la vez por clave |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Bono | +5 % desde $50, +10 % desde $100 |
| Acceso | Google o correo y contraseña |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
Códigos de error
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿Cuál es el tamaño de la ventana de contexto?
La ventana de contexto es de 100.000 tokens, calculada como la suma de los tokens del prompt de entrada y los tokens de respuesta de salida. No son 100.000 tokens disponibles exclusivamente para la entrada.
¿Este servicio admite llamadas a funciones?
Sí, el endpoint <code>/v1/chat/completions</code> admite llamadas a funciones y herramientas. Puedes definir herramientas en tu petición y el modelo devolverá argumentos estructurados para ellas.
¿Cómo manejo un error 402?
Un error 402 indica que el saldo de tu crédito prepago es cero. Puedes recargar tu cuenta a partir de $10 usando criptomonedas (USDT o USDC). Los créditos no caducan.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Esa es toda la configuración.