Zurück zur Blog -Liste

DeepSeek V4.1-Flash ist da: Agent-Benchmarks zum Flash-Preis

9/10/2026
Autor: Q Yang
Kategorie: AI
DeepSeek V4.1-Flash ist da: Agent-Benchmarks zum Flash-Preis

DeepSeek hat am 10. September 2026 V4.1-Flash veröffentlicht, und die Botschaft ist unmissverständlich: Agenten-Leistung auf Flaggschiff-Niveau, native Bildverständnis und eine Preistabelle, die aktuelle Top-Modelle wie Luxusartikel aussehen lässt. Das Modell läuft als deepseek-flash auf der DeepSeek-API, die Open-Source-Gewichte und der Tech-Report liegen bereits auf Hugging Face – und es verdrängt den eigenen Flaggschiff-Kollegen: Ab dem 14. September werden alle V4-Pro-Anfragen an V4.1-Flash weitergeleitet.

Eine neue Architektur, kein Refresh

V4.1-Flash ist kein weiteres Point-Release der V4-Linie. Es ist das kleinste Mitglied einer völlig neuen Architekturfamilie: ein Mixture-of-Experts mit 552 Milliarden Parametern auf Basis dessen, was DeepSeek einen Causal Encoder–Decoder nennt – mit einer ungewöhnlich asymmetrischen Aufteilung: rund 8B aktive Parameter für die Eingabeverarbeitung und 16B für die Ausgabe.

Zwei Dinge machen dieses Release mehr als einen Spezifikationssprung:

  • Natives Bildverständnis. Die Übergangsversion V4-Flash-Vision-Exp testete seit dem 21. August Bildeingaben; V4.1-Flash macht Multimodalität zur First-Class-Fähigkeit statt zum Aufsatz.
  • Radikale KV-Cache-Diät. Das Modell speichert nur 890 Bytes KV-Cache pro Token – 3,9-mal weniger als V4-Flash und rund 437-mal weniger als das ursprüngliche DeepSeek-V1. Der HBM-Bedarf sinkt auf ein Viertel, der SSD-Speicher auf ein Achtel der Vorgängergeneration.

DeepSeek-V4.1-Flash führt bei drei von vier Agent-Benchmarks gegen Kimi-K3, GLM-5.3, Claude Opus 5 und GPT5.6-Sol

Bild: DeepSeeks offizielle Agent-Benchmark-Ergebnisse vom 10. September 2026.

Benchmarks: Es gewinnt dort, wo Agenten arbeiten

In DeepSeeks veröffentlichter Vergleichstabelle schlägt V4.1-Flash nicht nur das eigene Pro-Modell, sondern mehrere Flaggschiffe genau bei den Aufgaben, die Agenten wirklich erledigen:

BenchmarkV4.1-FlashV4-Pro (0813)Claude Opus 5GPT5.6-Sol
DeepSWE v1.174,262,774,073,0
CyberGym88,183,384,5
Automation-Bench54,843,250,345,8
Terminal-Bench 3.030,011,843,334,4
Codeforces (Rating)34713348

Der ehrliche Vorbehalt: Bei reinen Wissens-Benchmarks liegen die etablierten Flaggschiffe vorn. GPQA Diamond liegt bei 90,9 (GPT5.6-Sol: 94,1), der HLE-Wert von 36,8 reicht nicht an Opus 5 mit 56,3 heran. V4.1-Flash konkurriert dort, wo Code, Terminal und mehrstufige Agentenarbeit leben – und gewinnt dort meistens.

Vollständige Benchmark-Tabelle: DeepSeek-V4.1-Flash gegen V4-Pro, V4-Flash, GLM-5.3, Kimi K3, GPT5.6-Sol und Claude Opus 5

Bild: DeepSeeks vollständige offizielle Benchmark-Vergleichstabelle.

Die Preistabelle ist die eigentliche Schlagzeile

Offizielle Preistabelle der DeepSeek-V4.1-Flash-API: Off-Peak- und Peak-Preise pro Million Token

Bild: DeepSeek-V4.1-Flash-API-Preise, gültig ab 04:00 UTC am 10. September 2026.

In der Off-Peak-Zeit zahlen Sie 0,15 $ pro Million Input-Token und 0,60 $ pro Million Output-Token – und „Off-Peak" umfasst alles außer 01:00–04:00 und 06:00–10:00 UTC an Werktagen; Wochenenden und Feiertage sind durchgehend Off-Peak. Bei Cache-Treffern sinken die Input-Kosten auf 0,003 $ pro Million Token – die Zahl, die für Agent-Workloads zählt, die den gleichen Kontext den ganzen Tag immer wieder lesen.

Die Community hat bereits nachgerechnet: Ein beliebter Thread auf r/singularity berichtet, V4.1-Flash erreiche auf dem OpenDesign Arena 98 % des Scores von GPT-6 „Astra" bei 1,4 % der Kosten.

Warum sich das leistet: vier Generationen KV-Cache-Diät

Globaler KV-Cache pro Token über DeepSeek-Generationen, von 389.120 Bytes bei V1 bis 890 Bytes bei V4.1-Flash

Bild: KV-Cache pro Token über vier Modellgenerationen von DeepSeek.

Die Serving-Kosten sind der stille Burggraben. DeepSeek hat den KV-Cache pro Token von 389.120 Bytes (V1, 2023) auf 890 Bytes komprimiert, und die Architektur von V4.1-Flash reduziert HBM auf ein Viertel und SSD auf ein Achtel des Vorgängers. Billiger Cache ist der Grund, warum ein Cache-Hit-Preis von 0,003 $ wirtschaftlich funktioniert und nicht nur Marketing ist.

Der V4-Pro wird still abgeschaltet

Der kühnste Teil der Ankündigung steht in einem winzigen Absatz: Ab dem 14. September, 04:00 UTC, werden alle V4-Pro-Anfragen zu V4.1-Flash-Preisen an V4.1-Flash weitergeleitet, bis ein V4.1-Pro erscheint. Die alten Modellnamen V4-Flash und V4-Flash-Vision-Exp leiten bereits weiter. DeepSeek hält kein Premium-Tier aus Nostalgie am Leben – das Flash-Tier ist inzwischen die Strategie.

Community-Reaktion: beeindruckt, mit Vorbehalten

Der Hacker-News-Thread zur V4-Flash-Linie fängt beide Lager ein. Fans betonen: „DSV4-Modelle sind extrem günstig zu servieren. Ihre Verbesserung hat viele Downstream-Effekte." Skeptiker halten entgegen, dass billige Token nicht effiziente Token sind – „Sie können DeepSeek eine Stunde an einer harten Aufgabe werken lassen oder Opus fünf Minuten" – und Stresstests des 1M-Kontexts der V4-Linie zeigen Qualitätsverlust bei sehr großen Repositories. Beides stimmt: V4.1-Flash bietet spektakulären Wert pro Token, ob sich dieser Wert realisiert, entscheidet das Token-Budget Ihres Agenten.

So probieren Sie es aus

Das Modell läuft als deepseek-flash auf der DeepSeek-API (alte Modellnamen werden während der Übergangszeit weitergeleitet). Open-Source-Gewichte und Tech-Report gibt es auf Hugging Face, und die Partner CodeBuddy (via WorkBuddy) und OpenCode unterstützen das Modell seit dem ersten Tag.

Ressourcen

  1. Offizielle Ankündigung: https://api-docs.deepseek.com/news/news260910
  2. Gewichte & Tech-Report: https://huggingface.co/deepseek-ai
  3. r/LocalLLaMA-Diskussion: https://www.reddit.com/r/LocalLLaMA/comments/1wan3nl/deepseek_flash_41_is_already_being_tested_via_api/
  4. OpenDesign-Arena-Thread zu Kosten/Nutzen: https://www.reddit.com/r/singularity/comments/1wbmy11/deepseek_v41_flash_reaches_98_of_astras_score_at/
Teilen Sie diesen Artikel

Hinterlasse deinen Kommentar

  • No comments yet.
Ad
Ad not loaded or not displayed

Empfohlene KI -Werkzeuge

Sorgfältig ausgewählte KI -Tools zur Verbesserung Ihrer Arbeit, Ihres Studiums und Ihrer Live -Effizienz.

SAM TTS

Erleben Sie die nostalgische Microsoft SAM-Stimme aus Windows XP in Ihrem Browser.

23.2K
SPONSORED
Grayscale Image

Grayscale Image ist ein kostenloses Online-Tool zur professionellen Umwandlung von Farbfotos in Schwarz-Weiß-Bilder.

SPONSORED
Image to Image AI

KI-gestützte Bildtransformation für professionelle kreative Workflows.

SPONSORED
Circle Crop Image

Circle Crop Image ist ein kostenloses Online-Tool zur Erstellung runder Bilder.

SPONSORED
 Lipsync Studio

Transformieren Sie Ihre Videos mit fortschrittlicher Lipsync-Technologie.

61.2K
SPONSORED
OpenArt

OpenArt ist ein vielseitiger KI-Bild- und Video-Generator.

SPONSORED

Verwandte Artikel

2025, Rückblick auf die Entwicklung künstlicher Intelligenz
AI
4/24/2025
2025, Rückblick auf die Entwicklung künstlicher Intelligenz
Autor: Q Yang

Wenn wir heute, im Jahr 2025, auf die Entwicklung der künstlichen Intelligenz zurückblicken, können wir sehen, wie diese revolutionäre Technologie jeden Aspekt der menschlichen Gesellschaft umgestaltet hat. Von den ersten theoretischen Konzepten bis hin zu den heutigen praktischen Anwendungen hat jeder Fortschritt in der KI-Technologie unser Leben verändert. Lassen Sie uns diese faszinierende Reise gemeinsam Revue passieren.

Jüngste Fortschritte und zukünftige Trends in der KI im Jahr 2025
AI
5/7/2025
Jüngste Fortschritte und zukünftige Trends in der KI im Jahr 2025
Autor: Yang

In den Jahren 2024 und Anfang 2025 hat das Feld der künstlichen Intelligenz (KI) bedeutende Fortschritte gemacht, die sich auf verschiedene Bereiche auswirken. KI-Modelle haben in verschiedenen Benchmark-Tests beeindruckende Leistungssteigerungen gezeigt, was eine neue Stufe ihrer Fähigkeiten zur Bewältigung komplexer Aufgaben markiert <sup>[1]</sup>. Von der Gesundheitsversorgung bis zum Transportwesen durchdringt KI den Alltag in bisher ungekannter Geschwindigkeit <sup>[1]</sup>. Auch in der Wirtschaft zeigt die Übernahme und Investition in KI ein starkes Wachstum, insbesondere im Bereich der generativen KI <sup>[1]</sup>. Die USA bleiben bei der Entwicklung von KI-Modellen führend, doch China holt schnell bei der Qualität auf <sup>[1]</sup>. Gleichzeitig entwickelt sich ein verantwortungsvolles KI-Ökosystem weiter, wobei ethische Überlegungen und Regulierung zunehmend an Bedeutung gewinnen <sup>[1]</sup>. Weltweit ist die allgemeine Zuversicht in Bezug auf KI gestiegen, auch wenn zwischen verschiedenen Regionen weiterhin Unterschiede bestehen <sup>[1]</sup>.

DeepSeek V4.1-Flash ist da: Agent-Benchmarks zum Flash-Preis
AI
9/10/2026
DeepSeek V4.1-Flash ist da: Agent-Benchmarks zum Flash-Preis
Autor: Q Yang

DeepSeeks 552B-MoE beherrscht nativ Bilder und schlägt den V4-Pro bei Agent-Benchmarks – ab 0,15 $ / 0,60 $.

Die beliebtesten KI -Tools

LogoAi
30% offCode:aiwithme

Erstellen Sie mühelos ein beeindruckendes Logo mit LogoAi.

Typeless

Sprechen Sie natürlich, und Typeless verwandelt Ihre Worte in ausgefeilte Nachrichten, E-Mails und Dokumente, die sich anfühlen, als hätten Sie sie sorgfältig getippt.

627.7K
Magic Patterns

Magic Patterns ist ein KI-Design-Tool für Produktteams.

Base44

Base44 ist eine KI-gestützte Plattform zur Erstellung voll funktionsfähiger Apps ohne Programmierkenntnisse.

105.8K
Midjourney API by PiAPI
5% offCode:AIWITHME

Transformieren Sie Text in atemberaubende Bilder mit der Midjourney API.

FLUX API - PiAPI
5% offCode:AIWITHME

FLUX API von PiAPI bietet fortschrittliche Bildgenerierungsfähigkeiten.

Klap
30% offCode:AIWITHME

Klap verwandelt lange Videos mühelos in ansprechende Shorts.

458.4K
Pollo AI

Pollo AI ist ein vielseitiger KI-Bilder- und Video-Generator.