Era łatwych zwycięstw w rankingach MMLU dobiegła końca. Nowy test „Humanity’s Last Exam” (HLE) weryfikuje zdolność model...

Era łatwych zwycięstw w rankingach MMLU dobiegła końca. Nowy test „Humanity’s Last Exam” (HLE) weryfikuje zdolność modeli AI do operowania na najwyższym poziomie specjalizacji, a jego wyniki pokazują, że obecne systemy są genialnymi statystykami, a nie ekspertami. Najlepsze modele wciąż zawodzą w starciu z prawdziwymi specjalistami. #si #ai #sztucznainteligencja #wiadomości #informacje #technologiahttps://aisight.pl/technologia/generatywna-ai/reasoning/humanitys-last-exam-nowy-test-obnaza-iluzje-inteligencji-wspolczesnych-modeli-ai/

Read Original

Related

Mastodon discussion 22m ago

Нарисованный очаг LLM: почему красивые схемы без предметной модели не греютУ Алексея Толстого в «Золотом ключике, или Пр...

Нарисованный очаг LLM: почему красивые схемы без предметной модели не греютУ Алексея Толстого в «Золотом ключике, или Приключениях Буратино» есть сцена, которая неожиданно хорошо о...