DeepSeek API: eerste verzoek in vijf minuten
Krijg je eerste respons binnen vijf minuten door je bestaande OpenAI-compatible client naar onze base URL te wijzen en te authenticeren met de sleutel die je tijdens het aanmaken hebt gegenereerd.
Base URL en authenticatie
Onze API volgt de standaard OpenAI-interface, dus je hoeft slechts twee waarden in je clientconfiguratie aan te passen. Stel de basis-URL in op https://api.getdeepseekapi.com/v1 en gebruik de API-sleutel die direct na het aanmaken van je account op de API-sleutel ophalen-pagina wordt weergegeven. Er is geen telefoonnummer of creditcard nodig om te beginnen, en je ontvangt $0,50 aan proeftegoed dat zeven dagen geldig is.
Elk account staat slechts één actieve sleutel tegelijk toe. Als je je sleutel draait, wordt de vorige onmiddellijk ingetrokken. Dit vereenvoudigt het beheer van geheimen in ontwikkel- en productiemilieu's zonder dat complexe rechtenbereiken nodig zijn.
Chat completion verzenden
Dien een standaard POST-verzoek in op /v1/chat/completions om een tekstantwoord te ontvangen. De endpoint accepteert een messages-array met je systeemprompt en gebruikersvraag, samen met een model-identificatie ingesteld op uncensored. Dit model draait op onze eigen GPU-servers en is afgestemd om zonder inhoudelijke weigeringen te antwoorden voor wettelijk volwassen gebruik.
Zorg dat je request body onder de 8 MB blijft. Als de sleutel ongeldig of verlopen is, retourneert de server een 401-fout. Als je prepaid tegoed op is, ontvang je een 402-fout die een top-up vereist. Je kunt tegoed toevoegen vanaf $10 via crypto (USDT of USDC).
curl https://api.getdeepseekapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK installeren en gebruiken
Het gebruik van de officiële OpenAI Python-bibliotheek is de snelste manier tot integratie. Installeer het pakket via pip en configureer de client met je aangepaste base URL en API-sleutel. De model-parameter moet ingesteld zijn op uncensored om zeker te weten dat je met onze specifieke instantie communiceert.
Deze aanpak werkt met elke OpenAI-compatible SDK, waaronder die voor Node.js of Go. De client behandelt serialisatie en retries automatisch. Onthoud dat de model id geen leveranciersnaam is zoals GPT-4; het is een specifieke identifier voor ons ongecensureerde model.
from openai import OpenAI
client = OpenAI(base_url="https://api.getdeepseekapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node.js-integratie
Voor JavaScript-omgevingen installeer je de OpenAI SDK en configureer je deze vergelijkbaar met het Python-voorbeeld. Stel de baseUrl in op ons endpoint en lever je API-sleutel. De Node SDK ondersteunt zowel synchronische als asynchrone patronen.
Bij het samenstellen van het verzoek specificeer je model: 'uncensored' in de parameters. Dit zorgt ervoor dat de client verzoeken naar het juiste model endpoint stuurt. De SDK behandelt streaming en non-streaming responsen uniform, zodat je implementaties kunt wisselen zonder de kernverzoeklogica te wijzigen.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.getdeepseekapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming (SSE) inschakelen
Stel de stream-parameter in op true om een Server-Sent Events (SSE)-respons te ontvangen. De server stuurt een reeks chunks, elk met een deel van de gegenereerde tekst. Dit vermindert de waargenomen latentie voor lange responsen en stelt de client in staat tokens weer te geven zodra ze worden gegenereerd.
Zorg dat je clientcode het stream-terminatiegebeurtenis correct afhandelt. Streaming verandert niet de prijsstelling of token-telling; je wordt nog steeds per 1M tokens voor input en output gefactureerd. Het totale contextvenster blijft beperkt tot 100.000 tokens voor de gecombineerde prompt en completion.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limieten, fouten en contextvenster
Je API-sleutel is beperkt tot 300 verzoeken per minuut. Als je deze drempel overschrijdt, retourneert de server een 429-fout die een rate limit aangeeft. Elke request body mag niet groter zijn dan 8 MB. Het contextvenster ondersteunt 100.000 tokens voor de som van de prompt en de completion, wat betekent dat je rekening moet houden met zowel input- als outputlengtes bij het ontwerpen van je applicatie.
Veelvoorkomende fouten zijn 401 voor ongeldige sleutels, 402 voor onvoldoende prepaid tegoed en 429 voor rate limits. Je kunt je API-sleutel op elk moment regenereren vanuit je accountinstellingen, wat de oude sleutel onmiddellijk ongeldig maakt. Dit is handig als je een lek vermoedt of referenties wilt draaien tussen milieu's.
API-specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Model-ID | uncensored |
| Base URL | https://api.getdeepseekapi.com/v1 |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON-modus | response_format: {"type": "json_object"} |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Verzoekgrootte | tot 8 MB |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Inloggen | Google of e-mail en wachtwoord |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Wat is de grootte van het contextvenster?
Het contextvenster is 100.000 tokens, berekend als de som van de input-prompttokens en de output-completietokens. Het zijn niet 100.000 tokens die uitsluitend voor input beschikbaar zijn.
Ondersteunt deze service tool calling?
Ja, het <code>/v1/chat/completions</code> endpoint ondersteunt tool en function calling. Je kunt tools definiëren in je verzoek en het model retourneert gestructureerde argumenten daarvoor.
Hoe ga ik om met een 402-fout?
Een 402-fout geeft aan dat je saldo voor prepaid tegoed nul is. Je kunt je account opwaarderen vanaf $10 met crypto (USDT of USDC). Credits vervallen nooit.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele setup.