Claude Opus 4.8 osiąga 89% skuteczności na benchmarku WorkBench, podczas gdy w 2024 roku GPT-4 radził sobie tylko z 43% zadań. Jednocześnie odsetek szkodliwych działań spadł z 26% do zaledwie 2,5%, co pokazuje, że bezpieczeństwo i wydajność agentów AI idą w parze.
To streszczenie zostało przygotowane przy pomocy narzędzi AI na podstawie źródła. Pełną treść znajdziesz w oryginalnym artykule.



Co o tym myślisz?
Zaloguj się, aby dołączyć do dyskusji.
Zaloguj się do dzis.ai
Komentuj, zachowaj swoją passę, dołącz do dyskusji.
G Kontynuuj z Google