utworzone przez Redakcja | wrz 15, 2026
Naukowcy zaproponowali Generalized Agent Iteration (GAI) – zunifikowany formalny framework opisujący zarówno iteracyjne doskonalenie polityki, jak i rekurencyjne samodoskonalenie jako dwa przypadki jednego paradygmatu uczenia. To pierwsza próba formalnego ujęcia...
utworzone przez Redakcja | wrz 15, 2026
Badacze proponują rozdzielenie faz zbieżności i różnorodności w wielocelowej optymalizacji bayesowskiej, co ma poprawić efektywność przy ograniczonych budżetach obliczeniowych. Metoda najpierw skupia się na zbliżeniu do frontu Pareto, a następnie dywersyfikuje...
utworzone przez Redakcja | wrz 15, 2026
Naukowcy zaprezentowali ZGCM-1 – w pełni otwarty model językowy o rozmiarze 7B, trenowany od podstaw z naciskiem na efektywność. Model łączy wewnętrzne rozumowanie z aktywnym korzystaniem z zewnętrznych narzędzi, obsługując kontekst do 256K...
utworzone przez Redakcja | wrz 14, 2026
Badacze odkryli, że edytowanie modeli grafów wiedzy w celu promowania pożądanych odpowiedzi często wypiera inne poprawne wyniki. Tylko w 23% przypadków udało się wprowadzić zmiany bez szkody dla pozostałych poprawnych odpowiedzi.
utworzone przez Redakcja | wrz 14, 2026
Naukowcy opracowali DU-NO – dwupiętrowy operator neuronowy w kształcie litery U, który modeluje fale przybrzeżne z dokładnością porównywalną do klasycznych solverów, używając znacznie mniejszej liczby parametrów niż dotychczasowe modele...