getdeepseekapi.comDocumenti
API DeepSeek: Prima richiesta in cinque minuti
Ottieni la tua prima risposta in cinque minuti puntando il tuo client compatibile con OpenAI esistente al nostro URL di base e autenticandoti con la chiave generata durante la registrazione.
URL di base e autenticazione
La nostra API segue l'interfaccia standard OpenAI, quindi devi solo modificare due valori nella configurazione del tuo client. Imposta l'URL di base su https://api.getdeepseekapi.com/v1 e usa la chiave API visualizzata subito dopo aver creato il tuo account nella pagina Ottieni chiave API. Non sono necessari numero di telefono o carta di credito per iniziare, e ricevi $0,50 di credito di prova che dura sette giorni.
Ogni account consente solo una chiave attiva alla volta. Se ruoti la tua chiave, quella precedente viene immediatamente revocata. Questo semplifica la gestione dei segreti negli ambienti di sviluppo e produzione senza bisogno di ambiti di autorizzazione complessi.
Invia un completamento di chat
Esegui una richiesta POST standard a /v1/chat/completions per ricevere una risposta testuale. L'endpoint accetta un array messages contenente il tuo system prompt e la query dell'utente, insieme a un identificatore model impostato su uncensored. Questo modello gira sui nostri server GPU ed è ottimizzato per rispondere senza blocchi dei contenuti per un uso adulto lecito.
Assicurati che il corpo della richiesta rimanga sotto gli 8 MB. Se la chiave non è valida o è scaduta, il server restituisce un errore 401. Se il tuo credito prepagato è esaurito, ricevi un errore 402 che richiede una ricarica. Puoi aggiungere fondi a partire da $10 tramite criptovalute (USDT o USDC).
curl https://api.getdeepseekapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Installa e usa l'SDK Python
La libreria ufficiale OpenAI Python è il metodo più veloce. Installa il pacchetto e configura il client con URL e chiave API. Imposta model su uncensored per usare la nostra istanza.
Questo approccio funziona con qualsiasi SDK compatibile con OpenAI, inclusi quelli usati per Node.js o Go. Il client gestisce la serializzazione e i ritentativi automaticamente. Ricorda che l'ID del modello non è un nome del fornitore come GPT-4; è un identificatore specifico per il nostro modello senza censura.
from openai import OpenAI
client = OpenAI(base_url="https://api.getdeepseekapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integrazione Node.js
Per gli ambienti JavaScript, installa l'SDK OpenAI e configuralo in modo simile all'esempio Python. Imposta baseUrl sul nostro endpoint e fornisci la tua chiave API. L'SDK Node supporta sia pattern sincroni che asincroni.
Specifica model: 'uncensored' nei parametri. Questo assicura che il client invii richieste all'endpoint corretto. L'SDK gestisce streaming e non-streaming uniformemente.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.getdeepseekapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Abilita lo streaming (SSE)
Imposta il parametro stream su true per ricevere una risposta Server-Sent Events (SSE). Il server invia una serie di chunk, ciascuno contenente una parte del testo generato. Questo riduce la latenza percepita per le risposte lunghe e consente al client di visualizzare i token man mano che vengono prodotti.
Assicurati che il codice del tuo client gestisca correttamente l'evento di terminazione dello streaming. Lo streaming non modifica il pricing o il conteggio dei token; vieni ancora addebitato per 1M di token per input e output. La finestra di contesto totale rimane limitata a 100.000 token per il prompt e la completion combinati.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limiti, errori e finestra di contesto
La tua chiave API è limitata a 300 richieste al minuto. Se superi questa soglia, il server restituisce un errore 429 che indica un limite di richieste. Il corpo di ogni richiesta non deve superare gli 8 MB. La finestra di contesto supporta 100.000 token per la somma del prompt e del completamento, il che significa che devi tenere conto delle lunghezze sia dell'input che dell'output quando progetti la tua applicazione.
Gli errori comuni includono 401 per chiavi non valide, 402 per credito prepagato insufficiente e 429 per i limiti di richieste. Puoi rigenerare la tua chiave API in qualsiasi momento dalle impostazioni del tuo account, il che invalida immediatamente la vecchia chiave. Questo è utile se sospetti una perdita o devi ruotare le credenziali tra gli ambienti.
Scheda tecnica dell'API
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| ID modello | uncensored |
| Base URL | https://api.getdeepseekapi.com/v1 |
| Finestra di contesto | 100.000 token (input + output) |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Modalità JSON | response_format: {"type": "json_object"} |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Dimensione | fino a 8 MB per richiesta |
| Concorrenza | 8 richieste contemporanee per chiave |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Bonus | +5% da $50, +10% da $100 |
| Accesso | Google oppure e-mail e password |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
Qual è la dimensione della finestra di contesto?
La finestra di contesto è di 100.000 token, calcolati come somma dei token del prompt di input e dei token di completamento di output. Non sono 100.000 token disponibili esclusivamente per l'input.
Questo servizio supporta la chiamata di funzioni?
Sì, l'endpoint <code>/v1/chat/completions</code> supporta la chiamata di funzioni e strumenti. Puoi definire gli strumenti nella tua richiesta e il modello restituirà argomenti strutturati per essi.
Come gestisco un errore 402?
Un errore 402 indica che il saldo del tuo credito prepagato è zero. Puoi ricaricare il tuo account a partire da $10 utilizzando criptovalute (USDT o USDC). I crediti non scadono mai.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL di base. È tutta qui la configurazione.