Zaznacz stronę
Agent Faraday od Inherent bije GPT-5.5 w odtwarzaniu wyników badań

Agent Faraday od Inherent bije GPT-5.5 w odtwarzaniu wyników badań

Londyńskie laboratorium AI Inherent, założone przez byłych pracowników DeepMind i finansowane kwotą 50 mln dolarów seed, twierdzi, że jego agent Faraday przewyższa modele Anthropic i OpenAI w reprodukowaniu wyników z artykułów naukowych. Agent osiąga lepsze rezultaty...
GPT-5.5 wykrył błędy krytyczne w benchmarku FrontierMath

GPT-5.5 wykrył błędy krytyczne w benchmarku FrontierMath

Model GPT-5.5 został wykorzystany do weryfikacji testu FrontierMath i odkrył poważne błędy w około trzeciej części zadań. Incydent pokazuje, że modele AI stały się już na tyle zaawansowane, że mogą sprawdzać poprawność własnych...
Radar Trendów na Maj 2026: Starcie podejść do bezpieczeństwa AI

Radar Trendów na Maj 2026: Starcie podejść do bezpieczeństwa AI

Anthropic ograniczyła dostęp do Claude Mythos dla wybranych firm, podczas gdy OpenAI udostępniła GPT-5.5 publicznie. Dyskusja na temat zarządzania ryzykiem bezpieczeństwa when czas między odkryciem podatności a jej exploitacją skraca się do zera. AI przechodzi z...