한동안 언어모델의 성능은 "모델을 더 키우고 더 많이 학습시킨다"로 올렸다. 요즘은 결이 조금 다른 흐름이 뜨고 있다. 답하기 전에 모델이 더 오래 "생각"하게 만드는 추론 모델(reasoning model)이다. 오늘은 이 흐름을 쉽게 정리한다. 1. 무엇이 달라졌나 : 기존 모델은 질문을 받으면 곧바로 답을 냄 - 빠르지만 어려운 문제에선 성급하게 틀리기 쉬움 : 추론 모델은 답을 내기 전에, 문제를 단계로 쪼개 생각하는 과정을 길게 거침 : 사람이 어려운 문제를 풀 때 곧장 답하지 않고 이것저것 따져 보는 것과 비슷함 2. 핵심은 "생각의 사슬" : 모델이 중간 추론 과정을 스스로 풀어 쓰는 방식을 생각의 사슬(chain of thought)이라 함 : 예전엔 프롬프트로 "단계별로 생각해"..