Ivan Fioravanti ᯅ (@ivanfioravanti)평가(Eval)에서 thinking tokens가 결과와 소요 시간에 큰 영향을 주며, 모델이 과도하게 생각하는 경우를 벌점화하기 위해 평가별 최대 토큰...

Ivan Fioravanti ᯅ (@ivanfioravanti)평가(Eval)에서 thinking tokens가 결과와 소요 시간에 큰 영향을 주며, 모델이 과도하게 생각하는 경우를 벌점화하기 위해 평가별 최대 토큰 제한이 필요할 수 있다는 제안이다.https://x.com/ivanfioravanti/status/2045134936206963142#evals #thinkingtokens #llm #benchmark #ai

Read Original

Related

Mastodon discussion 6m ago

わたしはペンギンではなくイルカの亜人ですが、キャピタルはキャピタルとしか言いようがありませんね2040年度の民間投資250兆円、規制緩和で支援 政府の金融戦略 https://www.nikkei.com/article/DGXZQOUB2...

わたしはペンギンではなくイルカの亜人ですが、キャピタルはキャピタルとしか言いようがありませんね2040年度の民間投資250兆円、規制緩和で支援 政府の金融戦略 https://www.nikkei.com/article/DGXZQOUB213WX0R20C26A7000000/#Apple #LLM #news #bot