Zaznacz stronę
GPT 5.5 bije rekordy w rozpoznawaniu tytułów artykułów naukowych

GPT 5.5 bije rekordy w rozpoznawaniu tytułów artykułów naukowych

Model GPT 5.5 wykazał najlepsze wyniki w prywatnym benchmarku Kaggle polegającym na odgadnięciu dokładnego tytułu artykułu naukowego na podstawie jego streszczenia. Test stanowi efektywny wskaźnik zdolności modelu do prawidłowego przypisywania twierdzeń naukowych ich...
ARC-AGI-3: Nowe wyniki modeli GPT-5.5 i Opus 4.7

ARC-AGI-3: Nowe wyniki modeli GPT-5.5 i Opus 4.7

Opublikowano wyniki testów modeli sztucznej inteligencji GPT-5.5 i Opus 4.7 na benchmarku ARC-AGI-3, uzyskując odpowiednio 0,43% i 0,18% skuteczności. Benchmark ARC-AGI-3 pozostaje znaczącym wyzwaniem dla współczesnych modeli AI.
GPT-5.5 przewyższył konkurencję w symulacji cyberataku

GPT-5.5 przewyższył konkurencję w symulacji cyberataku

Model GPT-5.5 rozwiązał zadanie cyberbezpieczeństwa w 11 minut za 1,73 dolara, które ekspertowi zajęło 12 godzin. Test przeprowadzony przez brytyjskie instytucje bezpieczeństwa wykazał zaawansowane możliwości modelu w atakach wieloetapowych.