inferencja AI
SK Hynix i Sandisk formalizują standard HBF (High Bandwidth Flash) dla rynku AI inference
Hierarchia pamięci w serwerach AI zmienia się w zawrotnym tempie. SK Hynix i Sandisk ogłosiły formalne uruchomienie konsorcjum standaryzacyjnego dla technologii HBF (High Bandwidth Flash) pod auspicjami Open Compute Project. Nowy standard ma zapełnić lukę między ultraszybką, ale pojemnościowo ograniczoną pamięcią HBM a tanimi dyskami SSD, i zrobić to akurat wtedy, gdy rynek inferencji AI zaczyna odczuwać realne wąskie gardła pamięciowe.
Startup Taalas HC1 wpisuje modele AI bezpośrednio w krzem. 16 000 tokenów na sekundę i dzięsieciokrotnie niższe koszty niż GPU
Kanadyjski startup Taalas wyszedł z ukrycia z radykalnym podejściem do akceleracji AI. Zamiast budować kolejną elastyczną platformę obliczeniową, firma dosłownie wytrawiła parametry modeli językowych w strukturze krzemowego układu. Efekt? ponad 16 000 tokenów na sekundę dla Llama 3.1 8B. To dziesięć razy więcej niż potrafią najpotężniejsze systemy konkurencji, przy jednoczesnym dziesięciokrotnym obniżeniu kosztów eksploatacji.


























Czy procesor z czterema rdzeniami jeszcze daje radę? Test procesora Intel Core i3-12100F z pamięciami RAM DDR4 i DDR5
Test procesora AMD Ryzen 5 5500X3D - Najtańszy procesor z pamięcią 3D V-Cache dla platformy AM4. Tylko czy sensowny?
Test NVIDIA DLSS 5 w NBA 2K27 na GeForce RTX 5080 oraz GeForce RTX 5070 Ti Laptop. Szykuje się rewolucja w renderingu grafiki 3D
NVIDIA DLSS 5 zadebiutuje w tym tygodniu. Jakość renderowania neuronowego widzieliśmy na przykładzie karty GeForce RTX 5060
AMD FSR Frame Generation 4.0.1 nadal ma problem z frame pacingiem, mimo zmian które miały temu zaradzić