Zgłoś błąd
X
Zanim wyślesz zgłoszenie, upewnij się że przyczyną problemów nie jest dodatek blokujący reklamy.
Błędy w spisie treści artykułu zgłaszaj jako "błąd w TREŚCI".
Typ zgłoszenia
Treść zgłoszenia
Twój email (opcjonalnie)
Nie wypełniaj tego pola
Załóż konto
EnglishDeutschукраїнськийFrançaisEspañol中国

DeepSeek V4.1 Flash wyprzedza GPT-5.6 Sol i Claude Opus 5 w części testów. Koszty użytkowania są znacznie mniejsze

Maciej Lewczuk | 11-09-2026 14:35 |

DeepSeek V4.1 Flash wyprzedza GPT-5.6 Sol i Claude Opus 5 w części testów. Koszty użytkowania są znacznie mniejszeDeepSeek ponownie mocno naciska na efektywność modeli AI. V4.1 Flash jest pierwszym przedstawicielem nowej architektury Causal Encoder-Decoder, która rozdziela przetwarzanie wejścia i generowanie odpowiedzi. Model ma 552 mld parametrów w backbone'ie MoE, ale podczas prefill aktywuje tylko 8 mld z nich. Jednocześnie DeepSeek ograniczył rozmiar KV cache, zmniejszając wymagania dotyczące HBM do jednej czwartej poprzedniej generacji i SSD do jednej ósmej.

DeepSeek V4.1 Flash wykorzystuje architekturę Causal Encoder-Decoder. Ta pozwala aktywować 8 mld parametrów podczas prefill i 16 mld podczas generowania odpowiedzi. Ogranicza też zapotrzebowanie na KV cache, HBM i SSD, a w części benchmarków jest lepszy od GPT-5.6 Sol i Claude Opus 5.

DeepSeek V4.1 Flash wyprzedza GPT-5.6 Sol i Claude Opus 5 w części testów. Koszty użytkowania są znacznie mniejsze [1]

GPT-6 Astra przechodzi całą grę Portal bez ludzkiej pomocy. Wystarczyło 3336 wywołań narzędzi i 571 dolarów w tokenach

Model DeepSeek V4.1 Flash wykorzystuje 40-warstwowy Transformer podzielony na 20-warstwowy enkoder przyczynowy i 20-warstwowy dekoder. Model ma 552 mld parametrów w backbone'ie MoE (to główna część modelu z wieloma „ekspertami”, z których aktywowana jest tylko potrzebna część), a dodatkowe 196 mld parametrów przypisano pamięci Engram (dodatkowa pamięć modelu, która przechowuje informacje potrzebne do szybszego przetwarzania wiedzy). Podczas prefill (etap przetwarzania promptu przez model przed rozpoczęciem generowania odpowiedzi) aktywuje 8 mld parametrów na token, natomiast podczas generowania odpowiedzi 16 mld. To rozwiązanie ma ograniczyć koszt pracy z dużymi kontekstami i długimi sesjami agentowymi. Istotną zmianą jest również sposób zarządzania KV cache (pamięć podręczna przechowująca informacje z wcześniejszych tokenów, aby model nie musiał przetwarzać ich ponownie). Causal Encoder-Decoder (architektura, która rozdziela przetwarzanie wejścia od generowania odpowiedzi) pozwala wyprowadzać globalny cache dekodera z końcowych stanów enkodera. DeepSeek wykorzystuje przy tym Compressed Sparse Attention 2 (mechanizm uwagi, który ogranicza liczbę analizowanych elementów, zmniejszając zużycie pamięci i obliczeń), pamięć KV w formacie FP4 oraz SWA Bounded Replay (mechanizm ograniczający zakres ponownie przetwarzanych informacji, aby zmniejszyć zużycie pamięci i obliczeń). W efekcie cache ma rozmiar około 890 bajtów na token, a producent deklaruje czterokrotnie niższe zapotrzebowanie na HBM i ośmiokrotnie niższe na SSD względem V4 Flash.

DeepSeek V4.1 Flash wyprzedza GPT-5.6 Sol i Claude Opus 5 w części testów. Koszty użytkowania są znacznie mniejsze [2]

Natywny transfer haseł i passkeyów w menedżerach w Androidzie. Google, 1Password, Bitwarden i Dashlane już go obsługują

Wyniki benchmarków są mocne, ale nie oznaczają jednoznacznego zwycięstwa nad wszystkimi flagowymi modelami. V4.1 Flash uzyskał 90,6 pkt w Terminal-Bench 2.1, 74,2 w DeepSWE v1.1, 88,1 w CyberGym i 54,8 w AutomationBench, wyprzedzając w części tych testów GPT-5.6 Sol oraz Claude Opus 5. Jednocześnie w Terminal-Bench 4.0 uzyskał 31,2 pkt wobec 51,8 Claude Opus 5 i 39,9 GPT-5.6 Sol, a w Humanity's Last Exam osiągnął 36,8 pkt, pozostając za obydwoma modelami. Wyniki pochodzą z testów przedstawionych przez DeepSeek, dlatego należy traktować je jako dane producenta. DeepSeek udostępnił V4.1 Flash przez API i publikuje jego wagi na licencji MIT. Firma zapowiedziała również wycofywanie V4 Pro. Od 14 września żądania kierowane do tego modelu będą przekierowywane do V4.1 Flash do czasu premiery V4.1 Pro.

DeepSeek V4.1 Flash wyprzedza GPT-5.6 Sol i Claude Opus 5 w części testów. Koszty użytkowania są znacznie mniejsze [3]

DeepSeek V4.1 Flash wyprzedza GPT-5.6 Sol i Claude Opus 5 w części testów. Koszty użytkowania są znacznie mniejsze [4]

DeepSeek V4.1 Flash wyprzedza GPT-5.6 Sol i Claude Opus 5 w części testów. Koszty użytkowania są znacznie mniejsze [5]

Źródło: DeepSeek
Bądź na bieżąco - obserwuj PurePC.pl na Google News
Zgłoś błąd
Liczba komentarzy: 5

Komentarze:

x Wydawca serwisu PurePC.pl informuje, że na swoich stronach www stosuje pliki cookies (tzw. ciasteczka). Kliknij zgadzam się, aby ta informacja nie pojawiała się więcej. Kliknij polityka cookies, aby dowiedzieć się więcej, w tym jak zarządzać plikami cookies za pośrednictwem swojej przeglądarki.