Zaznacz stronę
Nowa ocena wykrywania halucynacji w modelach językowych LLM

Nowa ocena wykrywania halucynacji w modelach językowych LLM

Naukowcy opracowali nowe standardy i benchmarki do oceny zdolności modeli LLM do wykrywania halucynacji – fikcyjnych lub niespójnych treści generowanych przez sztuczną inteligencję. Wykazali, że istniejące benchmarki nie spełniają wszystkich kluczowych...