DeepSeek
DeepSeek

DeepSeek

DeepSeek ist eine KI-Chat- und Entwicklerplattform auf Basis der Open-Weight-V4-Familie. Der unabhängige Test erklärt Flash vs. Pro, aktuelle API-Preise, 1M Kontext, Reasoning, Tools, Datenschutz, Self-Hosting und Alternativen.

76

Views

0

Likes

Jan 2026

Added

chat.deepseek.com

Website

Tags

DeepSeekDeepSeek V4V4 FlashV4 ProKI ChatReasoning ModellLLM APIOpen Weight

Product Preview

A quick visual look at DeepSeek before you visit the official site.

Published 1/21/2026
DeepSeek screenshot

Editorial Review

About DeepSeek

DeepSeek ist zugleich KI-Assistent für Endnutzer und Modellplattform für Entwickler. Im August 2026 besteht die aktuelle API-Linie aus deepseek-v4-flash für niedrige Kosten und hohen Durchsatz sowie deepseek-v4-pro für anspruchsvolleres Reasoning und agentische Aufgaben. Beide bieten ein Kontextfenster von einer Million Tokens, Thinking- und Non-Thinking-Modus, Tool Calls, JSON-Ausgabe, OpenAI-kompatible Chat Completions und einen Anthropic-kompatiblen Endpunkt.

Ältere Artikel vermischen häufig V3 von 2024 oder den R1-Reasoner von 2025 mit dem heute bereitgestellten Modell. R1s Reinforcement-Learning-Ansatz bleibt technisch relevant, ist aber kein anderer Name für V4. Die alten API-Aliase deepseek-chat und deepseek-reasoner sollten nach dem 24. Juli 2026 nicht mehr erreichbar sein. Neue Integrationen müssen die expliziten V4-IDs verwenden.

DeepSeek V4 Entscheidung zwischen Web API und Self Hosting mit Evaluations Datenschutz und Produktionskontrollen
Originalgrafik von AIDreamHub auf Basis der DeepSeek-V4-API-, Model-Card- und Datenschutzdokumentation; keine Aufnahme der Bedienoberfläche.

Aktueller V4- und API-Stand

EntscheidungV4 FlashV4 ProPraktische Bedeutung
Modell-IDdeepseek-v4-flashdeepseek-v4-proExplizite ID statt alter Aliase pinnen
Modellgröße284B gesamt / 13B aktiv1,6T gesamt / 49B aktivMoE-Parameterzahl ersetzt keinen Aufgabentest
Kontext / maximale Ausgabe1M / bis 384K1M / bis 384KKapazität garantiert keinen zuverlässigen Abruf
ModiThinking und Non-Thinking; Thinking StandardThinking und Non-Thinking; Thinking StandardEinfache Jobs auch ohne Thinking testen
Concurrency beim Review2.500500Für Volumen zuerst Flash evaluieren

Die OpenAI-kompatible Basis-URL lautet https://api.deepseek.com, das Anthropic-Format liegt unter https://api.deepseek.com/anthropic. Die Kompatibilität reduziert Migrationsarbeit, macht Reasoning-Felder, Tool-Zustand, Tokenzählung und Verhalten aber nicht identisch mit anderen Anbietern.

Kosten pro akzeptiertem Ergebnis statt Token-Schlagzeile

Am 20. August 2026 nennt die offizielle Preisliste für V4 Flash je Million Tokens 0,0028 US-Dollar Cache-Hit-Input, 0,14 US-Dollar Cache-Miss-Input und 0,28 US-Dollar Output. Für V4 Pro sind es 0,003625, 0,435 und 0,87 US-Dollar. Eine reale Kalkulation umfasst auch Reasoning, Wiederholungen, Tool-Ergebnisse, nicht gecachte Präfixe, Speicherung, Evaluation und menschliche Prüfung. Maßgeblich bleiben die Live-Preisseite und das aktive Konto.

Stabile Systemanweisungen und Referenzblöcke können Cache-Hits ermöglichen. Messen Sie die Quote, statt irrelevanten Kontext nur wegen des Rabatts anzuhängen. Billige Tokens können teure Nacharbeit erzeugen.

WorkloadStartWann eskalieren?Messgröße
Klassifikation, Extraktion, UmschreibenFlash ohne ThinkingSchema- oder Faktenqualität verfehlt ZielKosten und Latenz pro akzeptiertem Datensatz
WissensassistentFlash plus RetrievalSchwierige Evidenzsynthese scheitertBelege, Abstention, Korrekturzeit
Coding-/Tool-AgentFlash mit Thinking pilotierenPro löst Repo-weite Planung nachweislich besserTests, Diff, Toolfehler, Rollback
Mathematik, komplexe AnalysePro mit ThinkingZweitprüfung bleibt nötigAufgabenerfolg statt Antwortlänge
Sehr lange DokumenteRetrieval-Baseline zuerstLanges Fenster erhöht die AnnahmequotePositionsabruf, Widersprüche, Gesamtkosten

Thinking und Tool Use brauchen einen Zustandsvertrag

Thinking ist in V4 standardmäßig aktiv. DeepSeek ordnet den Reasoning-Aufwand derzeit high oder max zu; temperature, top_p und ähnliche Sampling-Parameter wirken im Thinking-Modus nicht. Führt eine Thinking-Antwort einen Tool Call aus, muss ihr reasoning_content im Folgeturn zurückgegeben werden. Ohne Tool Call ist die alte Reasoning-Spur nicht nötig.

  1. Nur minimale Tools und Argumente bereitstellen.
  2. Identität, Berechtigung, Betrag und Geschäftsregeln serverseitig prüfen.
  3. Codeausführung, Nachrichten, Käufe, Löschung und Produktionseingriffe bestätigen lassen.
  4. Schleifen, Tokens, Laufzeit und Budget hart begrenzen.
  5. Modell-ID, Thinking, Argumente, Freigaben und tatsächliches Ergebnis protokollieren.
  6. Vor Modell-, Prompt- oder Retrieval-Wechseln einen festen Evaluationssatz wiederholen.

Der Beta-Strict-Modus verbessert JSON-Schema-Konformität. Er weiß jedoch nicht, ob ein Nutzer berechtigt oder eine Aktion geschäftlich korrekt ist. Syntax ist keine Autorisierung.

Eine Million Tokens sind Kapazität, kein Gedächtnisversprechen

V4 senkt mit komprimierter und spärlicher Attention KV-Cache- und Rechenaufwand bei langen Sequenzen. Model Card und die unabhängige Hugging-Face-Analyse sehen darin einen Vorteil für Agenten mit wachsenden Tool-Traces.

Die Annahme von 1M Tokens garantiert weder das Finden einer Klausel in der Mitte noch den Umgang mit widersprüchlichen Versionen oder Prompt Injection. Testen Sie Fakten an Anfang, Mitte und Ende, fordern Sie Belegstellen und vergleichen Sie Vollkontext mit Retrieval plus kürzerem, prüfbarem Kontext.

Web, gehostete API oder Open Weights

OberflächeGuter FitGrenzeZusatzkontrolle
Web/AppExploration, Entwurf, EinzelanalyseVerbraucherbedingungen und KontolimitsKeine Secrets; wichtige Aussagen prüfen
Hosted APIProdukte, Automatisierung, AgentenAnbieterabhängigkeit, Preisänderung, DatenpflichtenServer-Key, Budgets, Evals, Aufbewahrung
V4 Self-HostingHoher Kontrollbedarf plus verteilte InfrastrukturWeder Flash noch Pro sind Laptop-ModelleKapazität, Hardening, Monitoring, Patches
Destilliertes/älteres ModellKleinere Hardware, enge AufgabeAndere Fähigkeit, Kontext, LizenzExakten Checkpoint nennen

Die V4 Model Cards veröffentlichen Gewichte unter MIT. Dennoch umfasst Pro insgesamt 1,6 Billionen und Flash 284 Milliarden MoE-Parameter. Self-Hosting benötigt verteilte Beschleuniger, Serving-Software, Präzisions-/Quantisierungsentscheidungen und Sicherheitsbetrieb. Open Weights gewähren keine Rechte an Eingabedaten und beseitigen keine Betreiberpflichten.

Datenschutz und Governance

DeepSeeks Verbraucher-Datenschutzerklärung nennt Prompts, Dateien, Fotos, Feedback und Chatverlauf als mögliche Daten und beschreibt direkte Verarbeitung und Speicherung personenbezogener Daten in der Volksrepublik China. Die Verarbeitung von Endnutzerdaten in Anwendungen von Open-Platform-Entwicklern fällt laut Erklärung nicht unter diesen Verbraucherhinweis; der Entwickler muss selbst informieren. Chat-Regeln beantworten daher nicht automatisch API-Fragen zu Region und Aufbewahrung.

  • Daten vor Versand klassifizieren; keine Schlüssel, Credentials oder unnötigen sensiblen Daten senden.
  • Mandantenrechte vor Retrieval und jedem Tool Call prüfen.
  • Controller-/Processor-Rollen, Region, Aufbewahrung, Löschung und Logzugriff dokumentieren.
  • Vertrauliche oder regulierte Nutzung rechtlich, sicherheitlich und im Einkauf prüfen.
  • Flüssige Antworten über autoritative Systeme und Quellen verifizieren.

Vergleich mit benachbarten Optionen

OptionWarum Shortlist?Zu testenGeeignete Evaluation
DeepSeek V4Niedrige Listenpreise, Open Weights, 1M Kontext, duales ReasoningDaten-Governance, State, Self-Host-GrößeKosten pro akzeptiertem Long-Context-/Agent-Job
OpenAI-PlattformBreite multimodale APIs, Tools und ProdukteModelle, Funktionen, Preise, Closed-Weight-AbhängigkeitIdentische Tasks und Evidenz-Gates
Anthropic ClaudeCoding-Agenten und Anthropic-ÖkosystemFormatkompatibilität ist keine VerhaltensgleichheitRepo-Erfolg, Toolsicherheit, Korrekturzeit
Google GeminiGoogle-/Cloud-Integration, Multimodalität, langer KontextUnterschiede nach Oberfläche, Region, ModellDokument-, Medien- und Cloud-Workloads
Qwen/andere Self-Host-FamilieMehr Größen und eventuell besserer Hardware-FitCheckpoint-spezifische Qualität und LizenzPrivate Tasks auf Zielhardware

Unser Urteil: DeepSeeks belastbarer Vorteil ist nicht ein pauschaler Sieg über ein geschlossenes Modell, sondern die Kombination aus günstiger Hosted API, offenen V4-Gewichten und effizientem Langkontext. Beginnen Sie mit Flash und routen Sie nur nachweislich schwierige Fälle zu Pro. Self-Hosting lohnt sich erst, wenn Kontrolle oder dauerhafte Last die Infrastrukturkosten überwiegen.

Häufige Fragen

Ist DeepSeek kostenlos?

Der Chat kann kostenlosen Zugang mit veränderlichen Limits bieten. Die API ist nutzungsbasiert. Self-Hosting verursacht Hardware-, Betriebs-, Strom- und Sicherheitskosten.

Soll ich deepseek-chat oder deepseek-reasoner weiter nutzen?

Nein, nicht für neue Integrationen. DeepSeek plante die Abschaltung nach dem 24. Juli 2026. Verwenden Sie die expliziten V4-IDs und prüfen Sie die Live-Modellliste.

Flash oder Pro?

Starten Sie für Extraktion, Support, reguläres Coding und Volumen mit Flash. Wechseln Sie nur, wenn Pro in einer repräsentativen Evaluation genügend mehr akzeptierte Ergebnisse liefert.

Ersetzt 1M Kontext RAG?

Nein. Retrieval kann Aktualität, Rechte, sichtbare Belege, Latenz und Debugging verbessern. Vergleichen Sie beide Ansätze mit denselben realen Aufgaben.

Kann DeepSeek lokal laufen?

V4-Gewichte sind offen, die vollständigen Modelle benötigen jedoch große verteilte Infrastruktur. Kleinere DeepSeek-Derivate sind nicht gleich der aktuellen V4-API.

Eignet sich DeepSeek für vertrauliche Daten?

Prüfen Sie Vertrag, Kontrollen, Verarbeitungsregion, Aufbewahrung, Löschung und Recht. Minimieren Sie Daten und senden Sie keine Secrets. Self-Hosting beseitigt Governance nicht.

Geprüfte Quellen

Unabhängig geprüft am 20. August 2026. Preise, Modell-IDs, Limits, Richtlinien und Verfügbarkeit ändern sich; vor Beschaffung oder Produktion sind offizielle Dokumentation und aktives Konto zu prüfen.

Ready to try DeepSeek?

Visit the official website to get started

Visit DeepSeek

Quick Info

Added
1/21/2026
Published
1/21/2026
Updated
9/8/2026

Share This Tool

Have an AI tool to share?

Submit it to AI Dreamhub

Get your product in front of people actively exploring AI tools.

Submit Your Tool
Gemini

Gemini

Gemini ist Googles AI-Assistent für Schreiben, Planung, Brainstorming, Recherche, multimodale Hilfe und Produktivität im Google-Ökosystem. Besonders sinnvoll für Nutzer von Search, Docs, Gmail, Drive, YouTube, Android und Workspace.

GeminiGoogle AIAI assistant
1090
ChatGPT

ChatGPT

ChatGPT ist OpenAIs revolutionärer KI-Chatbot, angetrieben von GPT-4. Er kann Fragen beantworten, Inhalte schreiben, Code generieren und bei verschiedenen Aufgaben helfen.

ai-chatfree
900
Claude

Claude

Claude ist Anthropics KI-Assistent und Modellplattform für Schreiben, Recherche, Codierung, Analyse, Agenten und vernetzte Arbeit. In diesem Leitfaden werden aktuelle Claude-Modelle, Produktoberflächen, Planentscheidungen, Alternativen, Datenschutz und Bewertung erläutert.

Claude AIAnthropic ClaudeKI Chat
1070
Grok

Grok

Grok ist xAIs AI-Assistent für Chat, Coding-Hilfe, Bilderstellung und Echtzeitantworten aus Web und X. Nützlich für Nutzer mit Live-Kontextbedarf, aber Modelle, Bildfunktionen und Limits können je nach Abo, Region und xAI-Policy variieren.

GrokxAIAI assistant
920