Artificial Analysis i IBM opublikowały pierwszy benchmark ITBench-AA oceniający agentyczne modele AI w zadaniach IT dla przedsiębiorstw. Czołowe modele osiągają wyniki poniżej 50%, co pokazuje, jak wiele jeszcze brakuje do praktycznego zastosowania AI w środowiskach korporacyjnych.
To streszczenie zostało przygotowane przy pomocy narzędzi AI na podstawie źródła. Pełną treść znajdziesz w oryginalnym artykule.



Co o tym myślisz?
Zaloguj się, aby dołączyć do dyskusji.
Zaloguj się do dzis.ai
Komentuj, zachowaj swoją passę, dołącz do dyskusji.
G Kontynuuj z Google