AI, 3개월 만에 다 바뀌었습니다 — 감자나라 AI TALK

강의 자료 · AI TALK

2026년 9월 2일 기준으로 클로드·챗GPT·제미나이의 세대 변화와 업무별 선택 기준을 정리한 강의입니다. 모델 순위와 실제 작업 적합성을 나누어, 지금 쓰는 서비스를 유지할지 바꿀지 판단합니다.

감자나라ai자료 날짜 슬라이드 15장

강의 원본을 옮긴 자료입니다. 제품 기능·가격·사건의 진행 상황은 원본에 표시된 시점을 기준으로 읽어 주세요.

이 강의의 목차 · 15장
  1. 석 달간 달라진 AI 선택지
  2. 모델은 바뀌고 결제는 그대로
  3. 12주 동안 나온 주력 모델 일곱 개
  4. 성능 변화와 요금 변화의 구분
  5. 가격 동결을 보는 경쟁 관점
  6. 당시 지능지수 순위
  7. 지능지수와 태스크 비용
  8. 차이가 드러나는 오래 도는 일
  9. 제미나이의 장기 작업 지표 변화
  10. 서비스마다 다른 활용 성격
  11. 무료 이용자에게도 내려온 변화
  12. 업무별 선택 기준
  13. 유지·전환·병행의 판단
  14. 모델 선택의 세 가지 오해
  15. 변화보다 내 작업을 기준으로

01 / 15석 달간 달라진 AI 선택지

감자나라 AI TALK

AI, 3개월 만에
다 바뀌었습니다

클로드 페이블 5.1 · GPT-5.6 · 제미나이 3.7 — 지금 갈아타야 할까요?

감자나라ai · 2026년 9월 2일 기준
🥔 감자나라ai
01 / 15
  • 클로드 페이블 5.1, GPT-5.6, 제미나이 3.7을 중심으로 최근 모델 변화를 비교합니다.
  • 새 모델의 등장 자체보다 자신의 업무에서 서비스를 바꿀 이유가 생겼는지 살펴봅니다.

02 / 15모델은 바뀌고 결제는 그대로

여러분이 어제 쓴 AI는,
석 달 전 그 AI가 아닙니다

그런데 결제 문자는 똑같이 왔죠.
오른 게 하나도 없습니다.

🥔 감자나라ai
02 / 15
  • 같은 AI 서비스를 계속 사용해도 내부 모델은 몇 달 사이 크게 달라질 수 있습니다.
  • 강의는 모델 변화와 구독료 변화가 반드시 함께 일어나지는 않는다는 점에서 출발합니다.

03 / 1512주 동안 나온 주력 모델 일곱 개

지난 12주

이 기간에 나온 주력 모델이 일곱 개입니다

날짜
모델
회사
6월 9일
Claude Fable 5
Anthropic
6월 26일
GPT-5.6 — Sol · Terra · Luna
OpenAI
6월 30일
Claude Sonnet 5
Anthropic
7월 24일
Claude Opus 5
Anthropic
8월 12일
Grok 4.6
xAI
8월 13일
Gemini 3.7 Flash
Google
9월 1일
Claude Fable 5.1
Anthropic

석 달 만에 일곱 개 — 이 속도가 정상이 아닙니다.

각 사 공식 발표 기준 · GPT-5.6은 6월 26일 프리뷰 후 7월 일반 공개 (2026-09-02 확인)
🥔 감자나라ai
03 / 15
  • 강의는 6월 9일 페이블 5부터 9월 1일 페이블 5.1까지 주력 모델 발표 일곱 건을 정리합니다.
  • 중간에는 GPT-5.6, 소넷 5, 오퍼스 5, Grok 4.6, 제미나이 3.7 Flash가 포함됩니다.
  • GPT-5.6은 6월 26일 프리뷰와 7월 일반 공개를 구분하며, 이 목록은 9월 2일 확인 기준입니다.

04 / 15성능 변화와 요금 변화의 구분

그런데

요금표는 하나도 안 움직였습니다

CLAUDE
$5 / $25

Opus 5의 API 단가.
전작 Opus 4.8과 1센트도 다르지 않습니다.

챗GPT
29,000원

Plus 월 요금 그대로.
Free · Go · Pro도 변동 없습니다.

제미나이
+0%

3.7 Flash는 3.6 Flash와 같은 가격 구조로 나왔습니다.

성능만 올리고, 값은 안 올렸습니다.

Anthropic · OpenAI 한국 요금 페이지 · Google DeepMind 모델카드 (2026-09-02 재확인 — 변동 없음)
🥔 감자나라ai
04 / 15
  • 강의 기준 오퍼스 5의 API 입력·출력 단가는 100만 토큰당 5달러·25달러로 전작과 같습니다.
  • 한국 챗GPT Plus 월 요금은 29,000원, 제미나이 3.7 Flash의 가격 구조는 전작과 같다고 정리합니다.
  • API 단가와 소비자 구독료는 서로 다른 요금 기준이며, 제시된 값은 2026년 9월 2일 자료입니다.

05 / 15가격 동결을 보는 경쟁 관점

반전 ①

착해서가 아니라, 올릴 수가 없어서입니다

1등이 바뀐다
한 자리를
3개월도 못 지킨다
→
값을 올리면
그 달에 바로
옆집으로 넘어간다
→
그래서
성능만 올리고
값은 못 올린다
지금이 정점

경쟁이 소비자에게 돌아온, 드문 구간입니다

🥔 감자나라ai
05 / 15
  • 강의는 선두 모델이 자주 바뀌는 경쟁 상황을 요금 인상이 어려운 배경으로 해석합니다.
  • 가격을 올리면 사용자가 경쟁 서비스로 이동할 수 있어 성능 개선이 소비자에게 돌아온다는 설명입니다.

06 / 15당시 지능지수 순위

그래서 지금 1등은

Artificial Analysis 지능 지수 — 184개 모델 중

Claude Fable 5.1
66점
Claude Opus 5
63점
GPT-5.6 Sol
61점

챗GPT가 1등일 거라고 생각하셨죠?

artificialanalysis.ai 지능 지수 v4.1.1 (2026-09-02) · 각 모델 최고 설정 기준 · Grok 4.6도 61점으로 공동 3위
🥔 감자나라ai
06 / 15
  • Artificial Analysis 지능지수 v4.1.1의 2026년 9월 2일 수치로 페이블 5.1은 66점, 오퍼스 5는 63점, GPT-5.6 Sol은 61점입니다.
  • Grok 4.6도 61점으로 공동 3위이며, 각 모델의 최고 설정을 비교한 순위입니다.
  • 벤치마크 순위는 이후의 모델 변화나 사용자의 모든 업무 성과를 그대로 뜻하지 않습니다.

07 / 15지능지수와 태스크 비용

반전 ②

1위와 3위 차이는 5점입니다.
그런데 그 1위는, 똑같은 일 하나에
돈을 74배 씁니다.

태스크당 실비용 — 페이블 5.1 $3.69 vs GPT-5.6 Luna $0.05 · artificialanalysis.ai · 1등 모델을 쓴다고 1등 결과가 나오지 않습니다
🥔 감자나라ai
07 / 15
  • 강의에서 제시한 지능지수 1위와 3위의 격차는 5점입니다.
  • 별도의 태스크당 비용 비교는 페이블 5.1의 3.69달러와 GPT-5.6 Luna의 0.05달러로 약 74배 차이입니다.
  • 비용 비교 대상인 Luna는 앞 장의 3위 Sol과 다른 모델이므로 두 비교를 구분해서 읽어야 합니다.

08 / 15차이가 드러나는 오래 도는 일

그럼 어디서 갈리나

갈리는 지점은 딱 하나 — 오래 도는 일

짧게 끝나는 일

요약 · 번역 · 검색 · 글쓰기

한 번 묻고 한 번 답받는 작업.
셋 다 똑같습니다.
차이를 못 느낍니다.

오래 도는 일

코딩 · 자동화 · 장문 리서치

여러 파일을 놓고 수십 단계를 스스로 밀고 가는 작업.
여기서 두 배로 벌어집니다.

중간에 포기하느냐, 끝까지 미느냐 — 세대 차이가 드러나는 유일한 자리입니다.

🥔 감자나라ai
08 / 15
  • 강의는 짧은 요약·번역·검색·글쓰기에서 서비스 간 체감 차이가 작다고 평가합니다.
  • 코딩·자동화·장문 리서치처럼 여러 단계를 이어가는 작업에서 세대 차이가 더 크게 드러난다고 설명합니다.
  • 작업을 중간에 포기하는지, 끝까지 진행하는지를 선택 기준으로 제안합니다.

09 / 15제미나이의 장기 작업 지표 변화

숫자로 못 박기

제미나이가 한 세대 건너뛰자 벌어진 일

업무 자동화
30.4%

AutomationBench 성공률.
3.6 Flash는 17.0%였습니다 — 거의 두 배.

장기 개발 작업
65.3%

DeepSWE v1.1.
3.6 Flash는 48.6%였습니다.

실무 코드 품질
43.6%

FrontierCode 1.1.
3.6 Flash는 34.4%였습니다.

넉 달 만에 자동화 성공률이 두 배가 됐습니다.
요금은 그대로인 채로요.

Google DeepMind Gemini 3.7 Flash 모델카드 (2026년 8월 13일)
🥔 감자나라ai
09 / 15
  • 공식 모델카드 인용에서 AutomationBench 성공률은 3.6 Flash의 17.0%에서 3.7 Flash의 30.4%로 상승했습니다.
  • DeepSWE v1.1은 48.6%에서 65.3%, FrontierCode 1.1은 34.4%에서 43.6%로 상승했습니다.
  • 이는 각 벤치마크에서의 결과이며 모든 실무 작업의 성공률이 같은 비율로 오르는 뜻은 아닙니다.

10 / 15서비스마다 다른 활용 성격

회사별 성격

"제일 똑똑한 것"과 "제일 잘 맞는 것"은 다른 질문입니다

CLAUDE

오래 도는 일

코딩 · 에이전트 · 긴 문서.
지금 지능 지수 1위와 2위를 모두 가지고 있습니다.

챗GPT

넓은 생태계

음성 · 이미지 · 앱 연동 · Codex.
모델도 Sol · Terra · Luna 3형제로 나뉩니다.

제미나이

빠르고 길다

100만 토큰 컨텍스트.
구글 문서 · 메일 · 검색과 그냥 붙어 있습니다.

🥔 감자나라ai
10 / 15
  • 클로드는 코딩·에이전트·긴 문서처럼 오래 이어지는 작업을 중심으로 소개합니다.
  • 챗GPT는 음성·이미지·앱 연동·Codex와 Sol·Terra·Luna 모델 선택을 강점으로 정리합니다.
  • 제미나이는 100만 토큰 컨텍스트와 구글 문서·메일·검색 연결을 중심으로 설명합니다.

11 / 15무료 이용자에게도 내려온 변화

그럼 나는?

돈 안 내는 분께도 그대로 내려왔습니다

챗GPT 무료

GPT-5.6 Luna

텍스트 대화 무제한.
3형제 중 가장 빠른 모델입니다.

제미나이 무료

Gemini 3.6 Flash

+ 3.1 Pro 일부.
딥리서치와 Canvas도 무료에 열려 있습니다.

클로드 무료

최신 세대 접근

웹 검색 · 파일 생성 · 커넥터까지 무료에 포함됩니다.

결제를 안 하셨어도, 석 달 전보다 좋은 걸 쓰고 계십니다.

🥔 감자나라ai
11 / 15
  • 강의 당시 챗GPT 무료에는 GPT-5.6 Luna의 텍스트 대화를 무제한으로 제공한다고 정리합니다.
  • 제미나이 무료는 3.6 Flash와 3.1 Pro 일부, 딥리서치와 Canvas 이용을 소개합니다.
  • 클로드 무료에는 최신 세대 접근과 웹 검색·파일 생성·커넥터가 포함된다고 설명하며, 모두 원본 시점의 이용 범위입니다.

12 / 15업무별 선택 기준

정리표

내 작업엔 뭘 쓰면 되나

작업
추천
이유
글쓰기 · 요약 · 번역
아무거나
셋 다 차이를 못 느낍니다
자료조사 · 리포트
챗GPT / 제미나이
검색 연동이 강합니다
코딩 · 자동화
클로드
오래 도는 작업 1위
긴 문서 통째로
제미나이
100만 토큰 컨텍스트
이미지 · 음성
챗GPT
생태계가 가장 넓습니다
구글 문서 · 메일
제미나이
워크스페이스에 붙어 있습니다
🥔 감자나라ai
12 / 15
  • 가벼운 글쓰기·요약·번역은 현재 익숙한 서비스를 쓰고, 자료조사·리포트는 검색 연동을 기준으로 선택합니다.
  • 코딩·자동화는 클로드, 긴 문서와 구글 문서·메일 업무는 제미나이를 강의의 후보로 제시합니다.
  • 이미지·음성 작업은 챗GPT의 연결 기능을 활용하는 방향으로 정리합니다.

13 / 15유지·전환·병행의 판단

그래서, 갈아탈까요?

이 한 가지로 판단하시면 됩니다

그대로 계세요

대부분의 분

요약 · 번역 · 검색 · 가벼운 글쓰기가 주라면, 지금 쓰는 걸로 충분합니다.

갈아타세요

이 경험이 있다면

최근 석 달 안에 "얘가 중간에 포기하네"를 두 번 이상 느끼셨다면.

둘 다 쓰세요

월 6만원의 의미

겹치는 값이 아니라 성격이 다른 값입니다.
용도를 나누면 안 아깝습니다.

그전에 먼저 — 지금 쓰는 앱의 기본 모델이 구형은 아닌지 확인해 보세요.
생각보다 많습니다.

🥔 감자나라ai
13 / 15
  • 요약·번역·검색·가벼운 글쓰기가 주된 용도라면 현재 서비스를 유지해도 충분하다는 판단입니다.
  • 최근 석 달간 작업이 중간에 멈추는 경험이 두 번 이상 있었다면 다른 서비스를 시험해 보도록 제안합니다.
  • 두 서비스를 병행할 때는 용도를 나누고, 그전에 현재 앱의 기본 모델이 구형인지 확인합니다.

14 / 15모델 선택의 세 가지 오해

못 박기

이 세 가지는 오해입니다

✕ 오해 ①

"벤치마크 1등 = 내 1등"

내 작업이 그 벤치마크와 닮았을 때만 1등입니다.

✕ 오해 ②

"새 모델이 무조건 낫다"

짧고 단순한 일은 구형이 더 빠릅니다.
새 모델은 생각을 오래 합니다.

✕ 오해 ③

"갈아타면 실력이 는다"

세대 교체는 천장을 올릴 뿐, 바닥은 여전히 본인이 올립니다.

셋 다 "모델을 바꾸면 결과가 바뀐다"는 같은 착각에서 나옵니다.

🥔 감자나라ai
14 / 15
  • 벤치마크 1위가 자신의 업무에서도 항상 1위인 것은 아닙니다.
  • 단순하고 짧은 작업에서는 구형 모델이 더 빠를 수 있어 최신 모델이 늘 유리하지는 않습니다.
  • 모델 교체는 가능한 성능의 범위를 넓히지만 사용자의 판단과 활용 능력을 대신하지 않습니다.

15 / 15변화보다 내 작업을 기준으로

3개월 요약

주력 모델 일곱 개가 나왔고,
값은 하나도 안 올랐고,
대부분은 안 갈아타도 됩니다

올라간 건 성능이고, 안 올라간 건 요금입니다.
이런 시기가 길지는 않습니다.

지금 뭘 쓰고 계신가요? 갈아타신 분 계신가요? 댓글로 알려주세요.

감자나라ai · 다음 영상에서 뵙겠습니다
🥔 감자나라ai
15 / 15
  • 강의는 주력 모델 일곱 개가 등장하고 성능이 개선됐지만 대부분의 사용자가 반드시 갈아탈 필요는 없다고 정리합니다.
  • 새 모델 소식과 실제 업무의 불편을 함께 살펴 자신의 사용 경험으로 선택합니다.

슬라이드 크게 보기

원본 크기에서는 화면을 좌우로 밀어 내용을 읽을 수 있습니다. ESC로 닫기.