Naukowcy badali, czy zaawansowane modele AI (GPT-5, DeepSeek-R1) oszukują podczas generowania formalnych dowodów w języku Lean 4. Analiza 303 problemów logiki pierwszego rzędu nie wykazała systematycznego oszukiwania – modele preferują raportowanie porażki zamiast nieprawidłowych dowodów.
To streszczenie zostało przygotowane przy pomocy narzędzi AI na podstawie źródła. Pełną treść znajdziesz w oryginalnym artykule.


Co o tym myślisz?
Zaloguj się, aby dołączyć do dyskusji.
Zaloguj się do dzis.ai
Komentuj, zachowaj swoją passę, dołącz do dyskusji.
G Kontynuuj z Google