DE ▾
API-Schlüssel erhalten

deepseek4api.comDokumentation

DeepSeek V4 API: Erste Anfrage in fünf Minuten

Starte mit der unzensierten DeepSeek V4 API-Alternative in weniger als fünf Minuten. Diese Anleitung zeigt dir, wie du dich authentifizierst, deine erste Anfrage sendest und Streaming-Antworten über standardmäßige OpenAI-kompatible Clients verarbeitest.

Base-URL
https://api.deepseek4api.com/v1
Modell
unzensiert

Authentifizierung & Basis-URL

Unsere API verwendet die Standard-API-Schlüssel-Authentifizierung. Du kannst einen Schlüssel sofort auf der Seite API-Schlüssel erhalten generieren, indem du deine E-Mail-Adresse und dein Passwort eingibst. Für das Testguthaben wird keine Kreditkarte benötigt; es enthält $0,50 gültiges Guthaben für 7 Tage. Sobald du deinen Schlüssel hast, konfiguriere deinen Client für die Verwendung unserer Basis-URL: https://api.deepseek4api.com/v1.

Setze den Authorization-Header auf Bearer YOUR_API_KEY. Diese Basis-URL funktioniert mit jedem OpenAI-kompatiblen SDK. Die Modell-ID, die du in deinen Anfragen angeben musst, ist uncensored. So stellst du sicher, dass du mit unserem Open-Weight-Modell für uneingeschränkte Antworten interagierst und nicht mit einer herstellerspezifischen Variante.

Einfache Chat-Vervollständigung

Sende eine Standard-Chat-Vervollständigungsanfrage, um Text zu generieren. Die API akzeptiert eine Liste von Nachrichten mit den Feldern role und content. Unten findest du ein einfaches cURL-Beispiel für eine einfache Textabfrage. Dies funktioniert für jeden OpenAI-kompatiblen Client durch Anpassung der Basis-URL und der Modell-ID.

curl https://api.deepseek4api.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Ersetze YOUR_API_KEY durch deinen generierten Schlüssel. Die Antwort enthält ein Standard-choices-Array mit dem generierten Text. Beachte, dass dieser Endpunkt Function Calling unterstützt, sodass du strukturierte Ausgaben in deine Anwendungen integrieren kannst.

Python SDK-Integration

Nutze das offizielle OpenAI Python SDK. Konfiguriere die Basis-URL und den API-Schlüssel. Der Modellname ist uncensored. So behältst du deinen Client-Code beim Wechsel des Backends.

from openai import OpenAI

client = OpenAI(base_url="https://api.deepseek4api.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Stelle sicher, dass das openai-Paket installiert ist. Der obige Code demonstriert eine synchrone Anfrage. Für asynchrone Anwendungen kannst du den AsyncOpenAI-Client mit derselben Konfiguration verwenden. Diese Methode ist ideal für Backend-Dienste, bei denen du eine zuverlässige Textgenerierung ohne Streaming benötigst.

Node SDK-Nutzung

Für Node.js nutze das openai-Paket. Initialisiere den Client mit baseURL und API-Schlüssel. Die Modell-ID ist uncensored.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.deepseek4api.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Diese Einrichtung ermöglicht es dir, unzensierte LLM-Funktionen in deine JavaScript- oder TypeScript-Projekte zu integrieren. Das SDK übernimmt die JSON-Serialisierung und HTTP-Anfragen automatisch. Du kannst diese grundlegende Einrichtung erweitern, um Tools oder Function Calling einzuschließen, wenn deine Anwendung strukturierte Datenausgaben erfordert.

Streaming-Antworten

Aktiviere für die Echtzeit-Textgenerierung das Streaming in deinem Client. Setze stream: true in deinen Anfrageparametern. Die API sendet Server-Sent Events (SSE), sodass du Token verarbeiten kannst, während sie generiert werden. Dies reduziert die wahrgenommene Latenz für Endbenutzer.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Verarbeite die Stream-Ereignisse in deinem Code, um Text inkremental anzuzeigen. Streaming funktioniert mit sowohl Python- als auch Node-SDKs. Stelle sicher, dass dein Client die Stream-Verbindung schließt, wenn die Antwort abgeschlossen ist oder ein Fehler auftritt. Diese Funktion ist entscheidend für Chat-Schnittstellen, bei denen sofortiges Feedback wichtig ist.

Limits, Fehler & Kontext

Die API erzwingt ein 100.000-Token-Kontextfenster für Prompt und Vervollständigung zusammen. Anfragekörper dürfen 8 MB nicht überschreiten. Du bist auf 300 Anfragen pro Minute pro API-Schlüssel begrenzt. Wenn du dieses Limit überschreitest, erhältst du einen 429-Ratenlimit-Fehler.

Authentifizierungsfehler geben 401 zurück, wenn der Schlüssel ungültig ist. Abrechnungfehler geben 402 zurück, wenn dein Prepaid-Guthaben aufgebraucht ist. Im Gegensatz zu Abonnements verfallen unsere Pay as you go-Guthaben nie. Generiere deinen Schlüssel jederzeit über das Dashboard neu, wodurch der alte Schlüssel sofort widerrufen wird. Dies gewährleistet ein sicheres Zugriffsmanagement ohne Ausfallzeiten.

Funktionen und Limits

Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
AuthentifizierungAuthorization: Bearer YOUR_KEY
Base-URLhttps://api.deepseek4api.com/v1
Modell-IDuncensored
EndpunktePOST /v1/chat/completions · GET /v1/models
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
JSON-Modusresponse_format: {"type": "json_object"}
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Ratenlimit300 Anfragen pro Minute und Schlüssel
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Anfragegrößebis 8 MB
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Bonus+5 % ab $50, +10 % ab $100
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt
AnmeldungGoogle oder E-Mail und Passwort

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Ersetzt dieser Dienst DeepSeek V4?

Nein, wir sind ein unabhängiger Dienst, der eine unzensierte Alternative bietet. Wir stellen nicht das offizielle DeepSeek V4-Modell von DeepSeek bereit. Unser Modell ist eine Open-Weight-Variante, die für uneingeschränkte Antworten optimiert ist und mit Standard-OpenAI-API-Clients kompatibel ist.

Was passiert, wenn ich das Limit von 300 Anfragen pro Minute überschreite?

Du erhältst einen <code>429</code>-Fehler „Too Many Requests“. Dein API-Schlüssel bleibt gültig, und du kannst es nach dem Zurücksetzen des Ratenlimits erneut versuchen. Du kannst deinen Schlüssel jederzeit neu generieren, wodurch der vorherige Schlüssel ungültig wird.

Ist das Testguthaben erneuerbar?

Das kostenlose Testguthaben von $0,50 ist 7 Tage gültig und steht einmal pro Person zur Verfügung. Es erfordert keine Kreditkarte. Um die Nutzung nach dem Testzeitraum fortzusetzen, kannst du Prepaid-Guthaben ab $10 kaufen, das verfällt nie.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.