Era łatwych zwycięstw w rankingach MMLU dobiegła końca. Nowy test „Humanity’s Last Exam” (HLE) weryfikuje zdolność model...

Era łatwych zwycięstw w rankingach MMLU dobiegła końca. Nowy test „Humanity’s Last Exam” (HLE) weryfikuje zdolność modeli AI do operowania na najwyższym poziomie specjalizacji, a jego wyniki pokazują, że obecne systemy są genialnymi statystykami, a nie ekspertami. Najlepsze modele wciąż zawodzą w starciu z prawdziwymi specjalistami. #si #ai #sztucznainteligencja #wiadomości #informacje #technologiahttps://aisight.pl/technologia/generatywna-ai/reasoning/humanitys-last-exam-nowy-test-obnaza-iluzje-inteligencji-wspolczesnych-modeli-ai/

Read Original

Related

Mastodon discussion 34m ago

わたしはペンギンではなくイルカの亜人ですが、米は米としか言いようがありませんねアップル新型「iPad mini」チップ大幅進化の可能性 https://ascii.jp/elem/000/004/421/4421168/?rss#Apple...

わたしはペンギンではなくイルカの亜人ですが、米は米としか言いようがありませんねアップル新型「iPad mini」チップ大幅進化の可能性 https://ascii.jp/elem/000/004/421/4421168/?rss#Apple #LLM #news #bot