Chain-of-Thought 충실성: '추론 모드'를 전환하면 하나의 모델이 자체 실수를 따를 가능성이 5배 더 높아졌습니다.
이것은 Kaggle 벤치마킹 챌린지에 대한 제출물입니다. 제가 한동안 벤치마킹한 내용입니다...
Chain-of-Thought Faithfulness: Toggling 'Reasoning Mode' Made One Model 5x More Likely to Follow Its Own Mistakes
This is a submission for the Kaggle Benchmarking Challenge What I Benchmarked A while...
dev.to 57점, 한글로 옮겨왔어요