vLLM
Bielik.AI wdraża DFlash: draft models dla 11B i Minitron 7B mają wyraźnie skrócić inferencję
Rynek LLM dojrzewa i coraz rzadziej wygrywa ten, kto dorzuci więcej parametrów. Coraz częściej liczy się czas odpowiedzi, koszt serwowania i to, czy model da się realnie utrzymać w produkcji, a nie tylko pokazać inwestorom. W tym kontekście ruch Bielik.AI wygląda sensownie. Zamiast budować narrację wokół „większego” modelu, zespół sięga po techniki, które mają skrócić inferencję bez istotnego pogorszenia jakości. To już obszar bardziej inżynieryjny niż wizerunkowy.
NVIDIA właśnie pokazała, po co komu RTX 5090 poza grami. Ten model AI potrafi generować tekst z absurdalną szybkością
Google DeepMind wypuściło DiffusionGemma w momencie, gdy rynek lokalnego AI zaczyna wreszcie schodzić z poziomu marketingu do realnych ograniczeń sprzętu. Klasyczne modele autoregresyjne nadal się sprawdzają, ale na desktopie i stacji roboczej często marnują potencjał GPU, bo generują tekst token po tokenie. NVIDIA błyskawicznie to podchwyciła i ogłosiła pełne wsparcie dla nowego modelu na platformach RTX i DGX. Przypadek?




























Karty graficzne GeForce RTX 5090 kosztują ponad 25 000 zł. To nie żart, lecz smutna rzeczywistość
10 lat temu Apple zrezygnowało z mini-jacka i wywołało burzę. Dziś jego brak prawie nikogo nie dziwi
Test NVIDIA DLSS 5 w NBA 2K27 na GeForce RTX 5080 oraz GeForce RTX 5070 Ti Laptop. Szykuje się rewolucja w renderingu grafiki 3D
NVIDIA DLSS 5 zadebiutuje w tym tygodniu. Jakość renderowania neuronowego widzieliśmy na przykładzie karty GeForce RTX 5060
AMD FSR Frame Generation 4.0.1 nadal ma problem z frame pacingiem, mimo zmian które miały temu zaradzić