News
DeepSeek stellt optimiertes V4 Pro Modell vor, veröffentlicht Open-Source-Agentensoftware und ändert API-Preise
Das Wichtigste in Kürze
- DeepSeek hat eine verbesserte Version seines V4 Pro Modells veröffentlicht, das höhere Werte in Agenten-Benchmarks erzielt, jedoch in den Gesamt-Rankings hinter führenden Modellen zurückbleibt.
- Das Unternehmen hat DeepSeek Harness, eine Open-Source-Agentensoftware, vorgestellt, die Sprachmodelle durch ein modulares Plugin-System in autonome Agenten verwandelt.
- Die API-Preise wurden erhöht, wobei neue zeitbasierte Tarife die Nutzung außerhalb der chinesischen Geschäftszeiten kostengünstiger gestalten. Wiederholte Datenabrufe werden teurer.
DeepSeek optimiert V4 Pro, veröffentlicht Agenten-Software als Open Source und passt API-Preise an
DeepSeek hat die Testphase seines Flaggschiffprodukts abgeschlossen, seine proprietäre Agenten-Software als Open Source freigegeben und gleichzeitig Preisanpassungen für seine API angekündigt. Diese Entwicklungen markieren einen wichtigen Schritt in der Strategie des Unternehmens im Bereich der Künstlichen Intelligenz.
Verbesserungen im V4 Pro Modell
Der DeepSeek-V4-Pro-Endpunkt liefert nun den Build V4-Pro-0813. Der Modellname, die Parameteranzahl und das Kontextfenster von einer Million Tokens bleiben unverändert. DeepSeek versichert, dass bestehende Integrationen ohne Anpassungen weiter funktionieren werden. Das Modell ist in der App und im Web unter dem "Expert Mode" verfügbar. Eine neue Funktion ist die native Unterstützung der OpenAI Responses API mit Codex-Integration. Die Inferenz-Anstrengung kann in drei Stufen eingestellt werden: "niedrig", "hoch" und "maximal", wobei DeepSeek die mittlere Einstellung für den täglichen Agenten-Einsatz empfiehlt.
Laut DeepSeeks eigener Vergleichstabelle stiegen die Terminal Bench 2.1-Werte von 72,1 auf 87,9 und die DeepSWE-Werte von 12,8 auf 62,7. In mehreren Agenten-Benchmarks übertraf das Modell Claude Opus 4.8.
Die Analyse von Artificial Analysis bestätigt diese Verbesserungen, ordnet sie jedoch in einen breiteren Kontext ein. Der V4 Pro steigt im Intelligence Index von 45 auf 53 Punkte und liegt damit gleichauf mit GLM-5.2. Dies ist jedoch weiterhin hinter Muse Spark (57), Qwen 3.8 Max (58) und Kimi K3 (60). Claude Opus 5 führt die Liste mit 63 Punkten an. DeepSeek hat die Gewichte für den neuen Build noch nicht veröffentlicht, und die April-Vorschauversion ist weiterhin auf Hugging Face verfügbar.
Das Update reagierte auch auf die Annäherung des kleineren V4 Flash Modells an das Flaggschiff. Ende Juli veröffentlichte DeepSeek das Update 0731 für V4 Flash, welches im Artificial Analysis Intelligence Index praktisch der Pro Preview entsprach, jedoch zu einem Bruchteil der Kosten.
DeepSeek Harness: Open-Source-Agentensoftware
Parallel zum Modell-Update wurde DeepSeek Harness v0.1 als Developer Preview unter der MIT-Lizenz veröffentlicht. Diese Open-Source-Agentensoftware wird als Alternative zu OpenAIs Codex und Claude positioniert. Sie basiert auf dem neu veröffentlichten Cordis Plugin-System, bei dem alle Funktionen, von Tools und Sandboxes bis hin zu Sessions und der Benutzeroberfläche, als austauschbare Plugins konzipiert sind. Ein kontinuierliches Sitzungsprotokoll erfasst jede Anfrage, jeden Tool-Aufruf und jedes Ergebnis. Ausführungen können fortgesetzt, verzweigt und wiederholt werden.
Ein Minimalmodus reduziert die Funktionen auf die Shell und den Datei-Editor, eine Konfiguration, die DeepSeek für seine eigenen Benchmark-Läufe nutzt. Die Software wird über npx über eine lokale Weboberfläche gestartet, wobei DeepSeek auf Kompatibilitätsprobleme hinweist. Das Projekt wird von Cui Tianyi geleitet, der im März 2026 von der quantitativen Handelsfirma Jane Street zu DeepSeek wechselte. Als das Team Anfang August einen Aufruf für Beta-Tester veröffentlichte, meldeten sich innerhalb von drei Tagen 712 Projekte an.
Anpassungen der API-Preise
Die neuen Tarife treten am 16. August um 16:00 Uhr UTC in Kraft. DeepSeek hatte die Umstellung auf Spitzen- und Nebenzeitenpreise bereits Ende Juni angekündigt, jedoch ohne spezifische Zahlen oder ein Datum zu nennen. Zeitbasierte Tarife existieren bereits seit Februar 2025, als das Unternehmen Rabatte auf V3 und R1 während der Nachtstunden anbot.
Die Nutzung außerhalb der Spitzenzeiten kostet die Hälfte. Die Spitzenzeiten liegen zwischen 1:00 und 4:00 Uhr UTC sowie zwischen 6:00 und 10:00 Uhr UTC, was den chinesischen Arbeitszeiten entspricht. Für Nutzer in Europa fällt fast der gesamte Nachmittag in den günstigeren Tarif.
Während der Nebenzeiten steigt der V4 Pro Input von 0,435 $ auf 0,66 $ pro Million Tokens, und der Output erhöht sich von 0,87 $ auf 1,98 $. In den Spitzenzeiten verdoppeln sich diese Tarife auf 1,32 $ bzw. 3,96 $. Cache-Treffer erfahren die stärkste Erhöhung, von 0,003625 $ auf 0,022 $ in der Nebensaison und 0,044 $ in der Hauptsaison. Dies reduziert den Cache-Rabatt von etwa einem Hundertzwanzigstel auf ein Dreißigstel des regulären Input-Preises. Für Agenten, die wiederholt dieselben Dateien lesen, stellt dies den kostspieligsten Aspekt der Änderung dar.
Die neuen Preise machen teilweise die Preissenkung, die DeepSeek im Mai eingeführt hatte, rückgängig. Cache-Treffer werden tatsächlich teurer sein als vor dieser Reduzierung. Die Preiserhöhung erfolgt zu einem Zeitpunkt, an dem das Unternehmen neues Kapital beschafft und einen Börsengang vorbereitet.
Ausblick
Die strategischen Entscheidungen von DeepSeek, das V4 Pro Modell zu verbessern, die Agenten-Software als Open Source bereitzustellen und gleichzeitig die API-Preise anzupassen, spiegeln eine dynamische Entwicklung im KI-Markt wider. Die Erhöhung der Preise, insbesondere für Cache-Treffer, könnte auf eine steigende Nachfrage und die Notwendigkeit zur Kapazitätsfinanzierung hindeuten, während die Open-Source-Veröffentlichung von DeepSeek Harness das Ökosystem um das Unternehmen erweitern und die Akzeptanz fördern könnte.
Bibliographie
- DeepSeek API Docs. (2026, 13. August). DeepSeek-V4-Pro GA Release. Abgerufen von https://api-docs.deepseek.com/news/news260813/
- Franzen, C. (2026, 13. August). DeepSeek Harness launches as open source rival to Claude Code, alongside V4-Pro on API with higher prices. VentureBeat. Abgerufen von https://venturebeat.com/technology/deepseek-harness-launches-as-open-source-rival-to-claude-code-alongside-v4-pro-on-api-with-higher-prices
- Kemper, J. (2026, 13. August). Deepseek ships improved V4 Pro, open-sources its agent software, and raises API prices. The Decoder. Abgerufen von https://the-decoder.com/deepseek-launches-an-improved-v4-pro-model-raises-api-prices-and-makes-its-agent-software-open-source/
- Plumb, T. (2026, 14. August). DeepSeek raises some V4 prices by more than 10x as AI demand strains capacity. InfoWorld. Abgerufen von https://www.infoworld.com/article/4209439/deepseek-raises-some-v4-prices-by-more-than-10x-as-ai-demand-strains-capacity.html
- Reuters. (2026, 13. August). DeepSeek releases official V4 Pro model as it steps up expansion. The Economic Times. Abgerufen von https://economictimes.indiatimes.com/tech/artificial-intelligence/deepseek-releases-official-v4-pro-model-as-it-steps-up-expansion/articleshow/133214362.cms
- WalletInvestor.com. (2026, 13. August). DeepSeek ships V4-Pro and open-sources its agent software while raising API prices. Abgerufen von https://walletinvestor.com/news/ai-news/deepseek-ships-v4-pro-and-open-sources-its-agent-software-while-raising-api-prices/
- Yu, C. (2026, 13. August). China's DeepSeek upgrades its V4 Pro model. China Daily. Abgerufen von https://www.chinadaily.com.cn/a/202608/13/WS6a7d2bf7a31073853ec531ce.html
Weitere News-Artikel
Alle ansehen- DeepSeek V4 Vorstellung: Fortschritte in KI-Modellen und Kontextverarbeitung
- DeepSeek verändert die Landschaft der Künstlichen Intelligenz
- Deepseek und die Veränderungen im KI-Markt
- DeepSeek Verbot auf australischen Regierungsgeräten aufgrund von Sicherheitsrisiken
- DeepSeek und die Zukunft des Wettbewerbs im KI-Markt
- Deepsite 2.0: Fortschritte in der KI-gestützten Webentwicklung durch Prompt-Nutzung
KI, die in Deutschland zu Hause ist.
Testen Sie Mindverse Studio oder sprechen Sie mit unserem Team über Ihren Anwendungsfall.