getdeepseekapi.comDocumentação
API DeepSeek: Primeira requisição em cinco minutos
Obtenha sua primeira resposta em cinco minutos apontando seu cliente compatível com OpenAI para nossa URL base e autenticando com a chave gerada no cadastro.
URL Base e Autenticação
Nossa API segue a interface padrão da OpenAI, então você só precisa alterar dois valores na configuração do seu cliente. Defina a URL base como https://api.getdeepseekapi.com/v1 e use a chave de API exibida imediatamente após criar sua conta na página Get API key. Não é necessário número de telefone ou cartão de crédito para começar, e você recebe $0.50 em crédito de teste grátis que dura sete dias.
Cada conta permite apenas uma chave ativa por vez. Se você rotacionar sua chave, a anterior é revogada imediatamente. Isso simplifica o gerenciamento de segredos entre ambientes de desenvolvimento e produção sem precisar de escopos de permissão complexos.
Enviar Conclusão de Chat
Faça uma requisição POST padrão para /v1/chat/completions para receber uma resposta de texto. O endpoint aceita um array messages contendo seu prompt de sistema e consulta do usuário, junto com um identificador model definido como uncensored. Este modelo é executado em nossos próprios servidores GPU e é ajustado para responder sem recusas de conteúdo para uso adulto lícito.
Certifique-se de que o corpo da sua requisição fique abaixo de 8 MB. Se a chave for inválida ou expirada, o servidor retorna um erro 401. Se seu crédito pré-pago se esgotar, você receberá um erro 402 exigindo recarga. Você pode adicionar fundos a partir de US$ 10 via criptomoeda (USDT ou USDC).
curl https://api.getdeepseekapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Instalar e Usar o SDK Python
Usar a biblioteca oficial Python da OpenAI é a maneira mais rápida de integrar. Instale o pacote via pip, em seguida configure o cliente com sua URL base personalizada e chave de API. O parâmetro model deve ser definido como uncensored para garantir que você está se comunicando com nossa instância específica.
Esta abordagem funciona com qualquer SDK compatível com OpenAI, incluindo aqueles usados para Node.js ou Go. O cliente lida com serialização e retentativas automaticamente. Lembre-se de que o id do modelo não é um nome de fornecedor como GPT-4; é um identificador específico para nosso modelo sem censura.
from openai import OpenAI
client = OpenAI(base_url="https://api.getdeepseekapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integração Node.js
Para ambientes JavaScript, instale o SDK OpenAI e configure-o de forma semelhante ao exemplo Python. Defina o baseUrl para nosso endpoint e forneça sua chave de API. O SDK Node suporta padrões síncronos e assíncronos.
Ao construir a requisição, especifique model: 'uncensored' nos parâmetros. Isso garante que o cliente envie requisições para o endpoint do modelo correto. O SDK lida com respostas de streaming e não-streaming de forma uniforme, permitindo que você troque as implementações sem alterar a lógica principal da requisição.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.getdeepseekapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Habilitar Streaming (SSE)
Defina o parâmetro stream como true para receber uma resposta do tipo Server-Sent Events (SSE). O servidor envia uma série de blocos, cada um contendo uma parte do texto gerado. Isso reduz a latência percebida para respostas longas e permite que o cliente exiba tokens conforme são produzidos.
Certifique-se de que o código do seu cliente lide corretamente com o evento de término do stream. O streaming não altera o preço ou a contagem de tokens; você ainda é cobrado por 1M tokens para entrada e saída. A janela de contexto total permanece limitada a 100.000 tokens para o prompt e a conclusão combinados.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites, Erros e Janela de Contexto
Sua chave de API está limitada a 300 requisições por minuto. Se você exceder esse limite, o servidor retorna um erro 429 indicando limite de requisições. O corpo de cada requisição não deve exceder 8 MB. A janela de contexto suporta 100.000 tokens para a soma do prompt e da conclusão, significando que você deve considerar os comprimentos de entrada e saída ao projetar seu aplicativo.
Erros comuns incluem 401 para chaves inválidas, 402 para crédito pré-pago insuficiente e 429 para limites de taxa. Você pode regenerar sua chave de API a qualquer momento nas configurações da sua conta, o que invalida imediatamente a chave antiga. Isso é útil se você suspeitar de um vazamento ou precisar rotacionar credenciais entre ambientes.
Recursos e limites
Uma tabela com cada limite, recurso e preço.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Autenticação | Authorization: Bearer YOUR_KEY |
| ID do modelo | uncensored |
| Base URL | https://api.getdeepseekapi.com/v1 |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Modo JSON | response_format: {"type": "json_object"} |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Limite de taxa | 300 requisições por minuto por chave |
| Tamanho | até 8 MB por requisição |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Validade | crédito pago não expira, sem assinatura |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Login | Google ou e-mail e senha |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
Códigos de erro
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
Qual o tamanho da janela de contexto?
A janela de contexto é de 100.000 tokens, calculada como a soma dos tokens do prompt de entrada e dos tokens de conclusão de saída. Não são 100.000 tokens disponíveis exclusivamente para entrada.
Este serviço suporta chamada de funções?
Sim, o endpoint <code>/v1/chat/completions</code> suporta chamada de ferramentas e funções. Você pode definir ferramentas na sua requisição e o modelo retornará argumentos estruturados para elas.
Como lidar com o erro 402?
Um erro 402 indica que o saldo de crédito pré-pago está zerado. Você pode recarregar sua conta a partir de US$ 10 usando criptomoedas (USDT ou USDC). Os créditos nunca expiram.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.