utworzone przez Redakcja | wrz 12, 2026
Naukowcy opracowali metodę PFS, która losowo łączy heurystyczne przeszukiwanie z rozszerzaniem węzłów minimalnych, by szybciej znajdować rozwiązania w algorytmach ograniczonego wyszukiwania. Podejście to przyspiesza osiąganie rozwiązań gdy postęp jest blokowany przez...
utworzone przez Redakcja | wrz 5, 2026
Naukowcy przedstawili framework GrowPage, który traktuje pojemność pamięci KV jako zasób przydzielany dynamicznie podczas wnioskowania modeli językowych. System dostosowuje budżet pamięci do rzeczywistych potrzeb każdego zapytania, eliminując ograniczenia statycznych...
utworzone przez Redakcja | wrz 4, 2026
Naukowcy opracowali mechanizm Speculative Macro Commit (SMC), który przyspiesza działanie agentów LLM korzystających z narzędzi poprzez równoległe przewidywanie i wykonywanie przyszłych akcji przez szybszy model pomocniczy. System wykorzystuje bibliotekę makr z...
utworzone przez Redakcja | sie 26, 2026
Naukowcy proponują framework STEP-KTODER, który usprawnia generowanie kodu przez modele AI, definiując kroki jako funkcje modułowe i automatycznie oceniając ich poprawność testami jednostkowymi. Metoda łączy nadzór procesowy na poziomie funkcji z oceną wynikową całego...
utworzone przez Redakcja | sie 15, 2026
Badacze proponują architekturę Dual-Flow Transformer, która rozdziela obliczenia fazy prefill i decode w dużych modelach językowych, pozwalając przydzielać dodatkowe zasoby obliczeniowe wyłącznie do generowania tokenów bez zwiększania kosztów przetwarzania...