MakeAI블로그프로젝트 문의
← Blog

AX· 읽는 데 2분

2주 사이 새 모델 세 개: 어떤 모델을 쓸지보다 중요한 것

GPT-5.1, Gemini 3, Claude Opus 4.5가 11월에 연달아 나왔습니다. 모델이 이렇게 자주 바뀔 때 서비스를 어떻게 설계해야 하는지 정리했습니다.

11월 12일 GPT-5.1, 11월 18일 Gemini 3, 그리고 11월 말 Claude Opus 4.5까지. 2주 남짓한 사이에 주요 회사 세 곳이 모두 새 모델을 내놓았습니다. 발표마다 "가장 뛰어난 모델"이라는 말이 붙습니다.

이런 시기에 자주 받는 질문이 있습니다. "그래서 어떤 모델을 써야 하나요?"

솔직한 답은 **"지금 제일 좋은 모델은 몇 달 뒤에 바뀝니다"**입니다. 그래서 모델을 고르는 일보다, 모델을 바꿀 수 있게 만들어 두는 일이 더 중요합니다.

모델을 바꿀 수 있는 구조

1. 모델 호출을 한곳에 모읍니다

코드 여기저기서 특정 회사의 API를 직접 부르면, 모델을 바꿀 때 전부 고쳐야 합니다. 모델을 부르는 부분을 한 군데로 모아 두면 설정만 바꿔서 교체할 수 있습니다.

2. 평가 세트를 갖습니다

"새 모델이 더 좋은가?"는 벤치마크 점수가 아니라 우리 업무에서의 결과로 판단해야 합니다. 실제 질문 50개와 기대하는 답을 모아 두면, 새 모델이 나올 때마다 같은 시험을 볼 수 있습니다. 이것이 없으면 교체는 매번 감에 의존합니다.

3. 프롬프트를 코드와 분리합니다

모델마다 잘 듣는 지시 방식이 조금씩 다릅니다. 프롬프트가 코드에 박혀 있으면 조정이 곧 배포가 됩니다.

비싼 모델이 항상 답은 아닙니다

업무의 상당 부분은 가장 큰 모델이 필요하지 않습니다. 분류, 요약, 정해진 형식으로 뽑아내기 같은 일은 작고 빠른 모델이 비용 대비 더 낫습니다. 어려운 판단이 필요한 단계에만 큰 모델을 쓰는 식으로 나누면 비용이 크게 달라집니다.

정리

새 모델 소식에 매번 방향을 바꿀 필요는 없습니다. 교체 가능한 구조와 우리만의 평가 세트를 갖추고 있으면, 새 모델은 위협이 아니라 공짜로 얻는 성능 개선이 됩니다.