01 / 15석 달간 달라진 AI 선택지
감자나라 AI TALK
AI, 3개월 만에
다 바뀌었습니다
클로드 페이블 5.1 · GPT-5.6 · 제미나이 3.7 — 지금 갈아타야 할까요?
🥔 감자나라ai
01 / 15
- 클로드 페이블 5.1, GPT-5.6, 제미나이 3.7을 중심으로 최근 모델 변화를 비교합니다.
- 새 모델의 등장 자체보다 자신의 업무에서 서비스를 바꿀 이유가 생겼는지 살펴봅니다.
02 / 15모델은 바뀌고 결제는 그대로
여러분이 어제 쓴 AI는,
석 달 전 그 AI가 아닙니다
그런데 결제 문자는 똑같이 왔죠.
오른 게 하나도 없습니다.
🥔 감자나라ai
02 / 15
- 같은 AI 서비스를 계속 사용해도 내부 모델은 몇 달 사이 크게 달라질 수 있습니다.
- 강의는 모델 변화와 구독료 변화가 반드시 함께 일어나지는 않는다는 점에서 출발합니다.
03 / 1512주 동안 나온 주력 모델 일곱 개
지난 12주
이 기간에 나온 주력 모델이 일곱 개입니다
6월 9일
Claude Fable 5
Anthropic
6월 26일
GPT-5.6 — Sol · Terra · Luna
OpenAI
6월 30일
Claude Sonnet 5
Anthropic
7월 24일
Claude Opus 5
Anthropic
8월 13일
Gemini 3.7 Flash
Google
9월 1일
Claude Fable 5.1
Anthropic
석 달 만에 일곱 개 — 이 속도가 정상이 아닙니다.
🥔 감자나라ai
03 / 15
- 강의는 6월 9일 페이블 5부터 9월 1일 페이블 5.1까지 주력 모델 발표 일곱 건을 정리합니다.
- 중간에는 GPT-5.6, 소넷 5, 오퍼스 5, Grok 4.6, 제미나이 3.7 Flash가 포함됩니다.
- GPT-5.6은 6월 26일 프리뷰와 7월 일반 공개를 구분하며, 이 목록은 9월 2일 확인 기준입니다.
04 / 15성능 변화와 요금 변화의 구분
그런데
요금표는 하나도 안 움직였습니다
CLAUDE
$5 / $25
Opus 5의 API 단가.
전작 Opus 4.8과 1센트도 다르지 않습니다.
챗GPT
29,000원
Plus 월 요금 그대로.
Free · Go · Pro도 변동 없습니다.
제미나이
+0%
3.7 Flash는 3.6 Flash와 같은 가격 구조로 나왔습니다.
성능만 올리고, 값은 안 올렸습니다.
🥔 감자나라ai
04 / 15
- 강의 기준 오퍼스 5의 API 입력·출력 단가는 100만 토큰당 5달러·25달러로 전작과 같습니다.
- 한국 챗GPT Plus 월 요금은 29,000원, 제미나이 3.7 Flash의 가격 구조는 전작과 같다고 정리합니다.
- API 단가와 소비자 구독료는 서로 다른 요금 기준이며, 제시된 값은 2026년 9월 2일 자료입니다.
05 / 15가격 동결을 보는 경쟁 관점
반전 ①
착해서가 아니라, 올릴 수가 없어서입니다
지금이 정점
경쟁이 소비자에게 돌아온, 드문 구간입니다
🥔 감자나라ai
05 / 15
- 강의는 선두 모델이 자주 바뀌는 경쟁 상황을 요금 인상이 어려운 배경으로 해석합니다.
- 가격을 올리면 사용자가 경쟁 서비스로 이동할 수 있어 성능 개선이 소비자에게 돌아온다는 설명입니다.
06 / 15당시 지능지수 순위
그래서 지금 1등은
Artificial Analysis 지능 지수 — 184개 모델 중
🥔 감자나라ai
06 / 15
- Artificial Analysis 지능지수 v4.1.1의 2026년 9월 2일 수치로 페이블 5.1은 66점, 오퍼스 5는 63점, GPT-5.6 Sol은 61점입니다.
- Grok 4.6도 61점으로 공동 3위이며, 각 모델의 최고 설정을 비교한 순위입니다.
- 벤치마크 순위는 이후의 모델 변화나 사용자의 모든 업무 성과를 그대로 뜻하지 않습니다.
07 / 15지능지수와 태스크 비용
반전 ②
1위와 3위 차이는 5점입니다.
그런데 그 1위는, 똑같은 일 하나에
돈을 74배 씁니다.
🥔 감자나라ai
07 / 15
- 강의에서 제시한 지능지수 1위와 3위의 격차는 5점입니다.
- 별도의 태스크당 비용 비교는 페이블 5.1의 3.69달러와 GPT-5.6 Luna의 0.05달러로 약 74배 차이입니다.
- 비용 비교 대상인 Luna는 앞 장의 3위 Sol과 다른 모델이므로 두 비교를 구분해서 읽어야 합니다.
08 / 15차이가 드러나는 오래 도는 일
그럼 어디서 갈리나
갈리는 지점은 딱 하나 — 오래 도는 일
짧게 끝나는 일
요약 · 번역 · 검색 · 글쓰기
한 번 묻고 한 번 답받는 작업.
셋 다 똑같습니다.
차이를 못 느낍니다.
오래 도는 일
코딩 · 자동화 · 장문 리서치
여러 파일을 놓고 수십 단계를 스스로 밀고 가는 작업.
여기서 두 배로 벌어집니다.
중간에 포기하느냐, 끝까지 미느냐 — 세대 차이가 드러나는 유일한 자리입니다.
🥔 감자나라ai
08 / 15
- 강의는 짧은 요약·번역·검색·글쓰기에서 서비스 간 체감 차이가 작다고 평가합니다.
- 코딩·자동화·장문 리서치처럼 여러 단계를 이어가는 작업에서 세대 차이가 더 크게 드러난다고 설명합니다.
- 작업을 중간에 포기하는지, 끝까지 진행하는지를 선택 기준으로 제안합니다.
09 / 15제미나이의 장기 작업 지표 변화
숫자로 못 박기
제미나이가 한 세대 건너뛰자 벌어진 일
업무 자동화
30.4%
AutomationBench 성공률.
3.6 Flash는 17.0%였습니다 — 거의 두 배.
장기 개발 작업
65.3%
DeepSWE v1.1.
3.6 Flash는 48.6%였습니다.
실무 코드 품질
43.6%
FrontierCode 1.1.
3.6 Flash는 34.4%였습니다.
넉 달 만에 자동화 성공률이 두 배가 됐습니다.
요금은 그대로인 채로요.
🥔 감자나라ai
09 / 15
- 공식 모델카드 인용에서 AutomationBench 성공률은 3.6 Flash의 17.0%에서 3.7 Flash의 30.4%로 상승했습니다.
- DeepSWE v1.1은 48.6%에서 65.3%, FrontierCode 1.1은 34.4%에서 43.6%로 상승했습니다.
- 이는 각 벤치마크에서의 결과이며 모든 실무 작업의 성공률이 같은 비율로 오르는 뜻은 아닙니다.
10 / 15서비스마다 다른 활용 성격
회사별 성격
"제일 똑똑한 것"과 "제일 잘 맞는 것"은 다른 질문입니다
CLAUDE
오래 도는 일
코딩 · 에이전트 · 긴 문서.
지금 지능 지수 1위와 2위를 모두 가지고 있습니다.
챗GPT
넓은 생태계
음성 · 이미지 · 앱 연동 · Codex.
모델도 Sol · Terra · Luna 3형제로 나뉩니다.
제미나이
빠르고 길다
100만 토큰 컨텍스트.
구글 문서 · 메일 · 검색과 그냥 붙어 있습니다.
🥔 감자나라ai
10 / 15
- 클로드는 코딩·에이전트·긴 문서처럼 오래 이어지는 작업을 중심으로 소개합니다.
- 챗GPT는 음성·이미지·앱 연동·Codex와 Sol·Terra·Luna 모델 선택을 강점으로 정리합니다.
- 제미나이는 100만 토큰 컨텍스트와 구글 문서·메일·검색 연결을 중심으로 설명합니다.
11 / 15무료 이용자에게도 내려온 변화
그럼 나는?
돈 안 내는 분께도 그대로 내려왔습니다
챗GPT 무료
GPT-5.6 Luna
텍스트 대화 무제한.
3형제 중 가장 빠른 모델입니다.
제미나이 무료
Gemini 3.6 Flash
+ 3.1 Pro 일부.
딥리서치와 Canvas도 무료에 열려 있습니다.
클로드 무료
최신 세대 접근
웹 검색 · 파일 생성 · 커넥터까지 무료에 포함됩니다.
결제를 안 하셨어도, 석 달 전보다 좋은 걸 쓰고 계십니다.
🥔 감자나라ai
11 / 15
- 강의 당시 챗GPT 무료에는 GPT-5.6 Luna의 텍스트 대화를 무제한으로 제공한다고 정리합니다.
- 제미나이 무료는 3.6 Flash와 3.1 Pro 일부, 딥리서치와 Canvas 이용을 소개합니다.
- 클로드 무료에는 최신 세대 접근과 웹 검색·파일 생성·커넥터가 포함된다고 설명하며, 모두 원본 시점의 이용 범위입니다.
12 / 15업무별 선택 기준
정리표
내 작업엔 뭘 쓰면 되나
글쓰기 · 요약 · 번역
아무거나
셋 다 차이를 못 느낍니다
자료조사 · 리포트
챗GPT / 제미나이
검색 연동이 강합니다
구글 문서 · 메일
제미나이
워크스페이스에 붙어 있습니다
🥔 감자나라ai
12 / 15
- 가벼운 글쓰기·요약·번역은 현재 익숙한 서비스를 쓰고, 자료조사·리포트는 검색 연동을 기준으로 선택합니다.
- 코딩·자동화는 클로드, 긴 문서와 구글 문서·메일 업무는 제미나이를 강의의 후보로 제시합니다.
- 이미지·음성 작업은 챗GPT의 연결 기능을 활용하는 방향으로 정리합니다.
13 / 15유지·전환·병행의 판단
그래서, 갈아탈까요?
이 한 가지로 판단하시면 됩니다
그대로 계세요
대부분의 분
요약 · 번역 · 검색 · 가벼운 글쓰기가 주라면, 지금 쓰는 걸로 충분합니다.
갈아타세요
이 경험이 있다면
최근 석 달 안에 "얘가 중간에 포기하네"를 두 번 이상 느끼셨다면.
둘 다 쓰세요
월 6만원의 의미
겹치는 값이 아니라 성격이 다른 값입니다.
용도를 나누면 안 아깝습니다.
그전에 먼저 — 지금 쓰는 앱의 기본 모델이 구형은 아닌지 확인해 보세요.
생각보다 많습니다.
🥔 감자나라ai
13 / 15
- 요약·번역·검색·가벼운 글쓰기가 주된 용도라면 현재 서비스를 유지해도 충분하다는 판단입니다.
- 최근 석 달간 작업이 중간에 멈추는 경험이 두 번 이상 있었다면 다른 서비스를 시험해 보도록 제안합니다.
- 두 서비스를 병행할 때는 용도를 나누고, 그전에 현재 앱의 기본 모델이 구형인지 확인합니다.
14 / 15모델 선택의 세 가지 오해
못 박기
이 세 가지는 오해입니다
✕ 오해 ①
"벤치마크 1등 = 내 1등"
내 작업이 그 벤치마크와 닮았을 때만 1등입니다.
✕ 오해 ②
"새 모델이 무조건 낫다"
짧고 단순한 일은 구형이 더 빠릅니다.
새 모델은 생각을 오래 합니다.
✕ 오해 ③
"갈아타면 실력이 는다"
세대 교체는 천장을 올릴 뿐, 바닥은 여전히 본인이 올립니다.
셋 다 "모델을 바꾸면 결과가 바뀐다"는 같은 착각에서 나옵니다.
🥔 감자나라ai
14 / 15
- 벤치마크 1위가 자신의 업무에서도 항상 1위인 것은 아닙니다.
- 단순하고 짧은 작업에서는 구형 모델이 더 빠를 수 있어 최신 모델이 늘 유리하지는 않습니다.
- 모델 교체는 가능한 성능의 범위를 넓히지만 사용자의 판단과 활용 능력을 대신하지 않습니다.
15 / 15변화보다 내 작업을 기준으로
3개월 요약
주력 모델 일곱 개가 나왔고,
값은 하나도 안 올랐고,
대부분은 안 갈아타도 됩니다
올라간 건 성능이고, 안 올라간 건 요금입니다.
이런 시기가 길지는 않습니다.
지금 뭘 쓰고 계신가요? 갈아타신 분 계신가요? 댓글로 알려주세요.
🥔 감자나라ai
15 / 15
- 강의는 주력 모델 일곱 개가 등장하고 성능이 개선됐지만 대부분의 사용자가 반드시 갈아탈 필요는 없다고 정리합니다.
- 새 모델 소식과 실제 업무의 불편을 함께 살펴 자신의 사용 경험으로 선택합니다.