utworzone przez Redakcja | cze 23, 2026
Modele Krea 2 Base i Turbo zostały skwantyzowane w formatach FP8, MXFP8, NVFP4, INT8 i ConvRot INT8, umożliwiając uruchomienie ich na różnych klasach kart graficznych. Wszystkie pliki są dostępne bezpłatnie na HuggingFace i działają z ComfyUI.
utworzone przez Redakcja | maj 21, 2026
Deweloper stworzył ggufy – nowe narzędzie ułatwiające konwersję i kwantyzację modeli obrazów AI z intuicyjnym interfejsem graficznym i CLI. Program wyróżnia się niskim zużyciem RAM i obsługą głównych formatów oraz typów danych.
utworzone przez Redakcja | maj 12, 2026
Badacz porównał wydajność różnych typów kwantyzacji danych, w tym INT8 i nowego MXFP8. Wyniki pokazują, że GGUF Q8 oferuje najlepszą jakość, a INT8 ConvRot wypada lepiej niż MXFP8.
utworzone przez Redakcja | maj 9, 2026
Naukowcy zaproponowali BitCal-TTS, lekką metodę sterowania czasem obliczeniowym dla skwantyzowanych modeli rozumowania. Rozwiązanie łączy monitorowanie niepewności tokenów z dynamiczną realokacją zaufania modelu, aby uniknąć przedwczesnego zakończenia generowania...
utworzone przez Redakcja | maj 9, 2026
Nowa metoda kwantyzacji PolarQuant Q5 umożliwia zmniejszenie rozmiaru modelu LTX-2.3 o 88% przy prawie całkowitym zachowaniu jakości (podobieństwo cosinusowe: 0.9986). Projekt dostępny jest na GitHubie i HuggingFace.