284B całkowitych, 13B aktywnych
Rzadka mieszanka ekspertów: tylko około 13B parametrów aktywuje się na token, dlatego odpowiada szybko i kosztuje tak niewiele.
DeepSeek V4 Flash to tańsza wersja rodziny V4: około 284B całkowitych parametrów z tylko 13B aktywnych na token, oknem kontekstowym 1 miliona tokenów i hybrydową uwagą, zbudowaną do długich uruchomień agentów. Kompilacja 0731, wydana 31 lipca 2026 roku, zachowała tę samą strukturę i ponownie przeprowadzono post-trening, a DeepSeek podaje, że teraz przewyższa własną wersję V4-Pro w dziewięciu testach porównawczych agentów. Na avots.ai uruchamiasz ją w systemie płatności za użycie, bez konta DeepSeek i subskrypcji, a to samo saldo obejmuje również Claude Opus 5, GPT-5.6, Gemini i ponad 40 modeli obrazów, wideo i muzyki.
Rzadka mieszanka ekspertów: tylko około 13B parametrów aktywuje się na token, dlatego odpowiada szybko i kosztuje tak niewiele.
Pełny milion tokenów w jednej rozmowie, z bardzo dużymi wynikami, więc całe repozytoria i zestawy dokumentów mieszczą się w jednym przebiegu.
Za milion tokenów na liście DeepSeek, z buforowanym wejściem za 0,0028 USD, więc powtarzający się kontekst w pętlach agentów jest prawie darmowy.
DeepSeek zgłosił dla kompilacji 0731, wraz z 70.3 na Toolathlon verified i 76.7 na Cybergym.
W niezależnym indeksie Artificial Analysis Intelligence, w porównaniu do mediany 25 dla porównywalnych modeli.
Brak wejścia obrazu w tym modelu. Aby wysłać zrzuty ekranu i skany, przełącz się na Qwen3.7 lub Gemini na tym samym saldzie.
| DeepSeek V4 Flash | DeepSeek V4-Pro | Qwen3.7 Flash | |
|---|---|---|---|
| Cena za 1M wejścia / wyjścia | $0.14 / $0.28 | $0.435 / $0.87 | $0.03 / $0.13 |
| Parametry | 284B całkowitych, 13B aktywnych | około 1.6T całkowitych, 49B aktywnych | nieopublikowane |
| Okno kontekstowe | 1M tokenów | 1M tokenów | 1M tokenów |
| Terminal-Bench 2.1 | 82.7 | nieopublikowane | nieopublikowane |
| Toolathlon zweryfikowany | 70.3 | nieopublikowane | nieopublikowane |
| Wejście obrazu | nie | nie | tak |
| Na avots.ai | płatność za użycie | płatność za użycie | płatność za użycie |
Wyniki agentów są zgłaszane przez dostawców i bardzo wrażliwe na środowisko testowe, więc traktuj je jako wskazówkę, a nie ostateczny werdykt. Niewątpliwa jest różnica w cenie: Flash działa za około jedną trzecią ceny V4-Pro za token, a Qwen3.7 Flash jest tańszy od obu, dodając jednocześnie wejście obrazu. Wszystkie trzy znajdują się w tym samym selektorze.
Identyczna architektura i rozmiar jak w wersji podglądowej. Wszystkie zyski pochodzą z ponownego post-treningu, a nie z nowego modelu bazowego.
DeepSeek zgłasza 54.4 na DeepSWE, 54.2 na NL2Repo i 25.2 na Agents' Last Exam, co jest jego najsilniejszym zestawem agentów do tej pory.
Wejście z pamięci podręcznej za 0,0028 USD za milion tokenów sprawia, że pętle narzędziowe, które ponownie wysyłają to samo zapytanie, są naprawdę tanie.
Obsługiwane są wysokie i maksymalne poziomy wysiłku rozumowania, dzięki czemu poświęcasz więcej myślenia tylko na te wywołania, które tego wymagają.
Zarejestruj się na app.avots.ai za pomocą adresu e-mail, Google lub Telegramu. Zajmuje to minutę.
1000 tokenów kosztuje 0,99 EUR. Brak planu do wyboru, brak odnowienia, saldo pozostaje, dopóki go nie wykorzystasz.
Wybierz DeepSeek V4 Flash w selektorze modeli lub pozwól Agentowi Avots kierować za Ciebie. Każda odpowiedź pokazuje swój koszt tokenów.
app.avots.ai na komputerach i urządzeniach mobilnych, bez konieczności instalacji.
V4 Flash w @AvotsAIbot, to samo saldo, z dowolnego telefonu.
Używaj go w Claude Desktop, Cursor lub Cline za pośrednictwem serwera MCP.
API kompatybilne z OpenAI przyjmuje Twojego istniejącego klienta, jeden klucz dla każdego modelu.
1000 tokenów kosztuje 0,99 EUR, a odpowiedź Flash kosztuje ich garść. To samo saldo odblokowuje Claude Opus 5, GPT-5.6, Gemini, wideo Veo i obrazy Nano Banana, bez żadnej subskrypcji.
Zarejestruj się i czatuj ✦Cała rodzina, V4-Pro i V4-Flash, otwarte wagi i kontekst 1M.
Każdy LLM na avots.ai i który wybrać do danego zadania.
Poziomy Max, Plus i Flash od Alibaba, kontekst 1M, wizja w małych modelach.
Pionierski otwarty model Moonshot, numer jeden w kodowaniu, kontekst 1M.
Najnowszy flagowiec Anthropic, kontekst 1M, 96% SWE-bench Verified.
Czego użyć zamiast ChatGPT Plus i jak jedno saldo go zastępuje.
avots.ai uruchamia ponad 40 modeli AI do czatu, obrazów, wideo i audio na jednym saldzie. Zobacz pełną listę na stronie Narzędzia lub otwórz aplikację i zacznij tworzyć.