Zaznacz stronę
ARC-AGI-3: Nowe wyniki modeli GPT-5.5 i Opus 4.7

ARC-AGI-3: Nowe wyniki modeli GPT-5.5 i Opus 4.7

Opublikowano wyniki testów modeli sztucznej inteligencji GPT-5.5 i Opus 4.7 na benchmarku ARC-AGI-3, uzyskując odpowiednio 0,43% i 0,18% skuteczności. Benchmark ARC-AGI-3 pozostaje znaczącym wyzwaniem dla współczesnych modeli AI.