어떤 AI 모델을 써야 할까요?
실제로 하려는 일을 고르세요. 추천이 나오고, 더 쓸모 있게는 그 근거까지 나옵니다. 더 잘 아는 부분이 있다면 그 추천에 반대할 수 있도록요. GPT-5, Gemini, Grok 4, Claude, DeepSeek, Kimi를 매일 나란히 돌려 본 결과에 근거합니다.
1. 무엇을 하시나요?
2. 무엇이 가장 중요한가요? (선택)
—
두 번째 의견:
매일 나란히 써 보며 내린 정성적 판단이며, 2026년 8월 기준입니다 — 벤치마크 점수가 아닙니다. 전체 근거는 치트 시트.
짧게 말하면
- GPT-5 — 선배 동료. 짜임새 있는 글, 한 번에 도는 코드, 신중한 추론. 확신이 서지 않을 때의 올바른 기본값입니다.
- Gemini — 자료 조사 담당. 긴 문서 더미를 건네고 갈피를 잡아 달라고 하세요.
- Grok 4 — 늘 온라인인 쪽. 시사, 진짜 양방향 음성, 이미지와 영상 생성, 그리고 구슬리지 않아도 나오는 유머.
- Claude — 꼼꼼한 편집자. 여섯 중 문장이 가장 좋고, 확신이 없다고 말하는 데도 가장 거리낌이 없습니다.
- DeepSeek — 효율적인 일꾼. 화려하지 않지만 유능하고, 같은 프롬프트를 수백 번 돌릴 때의 가성비 선택입니다.
- Kimi — 긴 컨텍스트 가성비. 많은 양의 입력을 군말 없이 받고, 긴 컨텍스트 할증도 없습니다.
어떤 모델도 잘하지 못하는 것
확인하지 않은 인용, 글 속에 파묻힌 계산, 잘 알려지지 않은 API 세부 사항. 이런 상황에서는 여섯 모두 자신만만하게 틀린 답을 내놓습니다. 모델을 바꾼다고 해결되지는 않습니다 — 검증하는 습관이 해결합니다.
작업별로 고르는 편이 한 모델만 쓰기보다 나은 이유
모델 하나를 정해 계속 쓰는 쪽이, 가끔 잘못 고르는 것보다 오히려 더 비쌉니다. 가장 좋은 작업 흐름은 여러 모델을 이어서 씁니다. 활달한 모델로 초고를 쓰고, 엄격한 모델로 구조를 잡고, 세 번째 모델로 검토합니다. 이건 갈아타는 비용이 낮을 때만 성립합니다. 구독 네 개보다 멀티모델 앱이 낫다는 근거가 바로 이것입니다.
작업별 전체 근거는 여기에 있습니다: 치트 시트, 그리고 가장 많이 비교되는 두 모델은 더 길게 다룬 글이 있습니다: Grok 4 대 GPT-5.
이 글의 판단은 정성적이며 2026년 8월 기준입니다 — 모델의 능력은 빠르게 바뀌고, 저희 경험이 달라지면 이 글도 고칩니다. 무료 도구 전체