무료 AI만으로 유료 AI를 대체할 수 있을까? ChatGPT·Gemini·Claude를 7가지 실제 업무에 써봤다
AI를 매일 쓰다 보면 구독료가 하나둘 늘어난다.
ChatGPT도 필요하고, Claude도 괜찮아 보이고, Gemini도 Google 서비스와 연결되는 기능이 많다. 각각 월 몇 만 원 수준이라고 생각하면 부담이 크지 않아 보이지만 두세 개를 동시에 결제하면 이야기가 달라진다.
그래서 궁금해졌다.
무료 버전만 사용해도 실제 업무를 끝까지 처리할 수 있을까?
단순히 질문 몇 개를 던져보고 답변 품질을 비교하는 테스트는 하지 않았다. 이번에는 ChatGPT, Gemini, Claude의 무료 버전에서 당시 사용할 수 있는 높은 성능 옵션을 이용해 하나의 프로젝트를 처음부터 끝까지 수행하게 했다.
프로젝트는 다음과 같다.
월 60만 원의 고정비를 가진 1인 가구의 지출을 얼마나 줄일 수 있을까?
최신 가격 조사부터 정부 보고서 분석, CSV 계산, 글 작성, 계산기 제작, 숨은 조건 찾기, 최종 보고서 작성까지 총 7단계로 진행했다.
결론부터 말하면 세 AI 모두 프로젝트를 끝내는 데는 성공했다.
그런데 결과는 놀라울 정도로 달랐다.
테스트 조건부터 동일하게 맞췄다
가상의 사용자는 33세 직장인, 부산 거주, 1인 가구, 월 실수령액 320만 원으로 설정했다.
월세와 식비처럼 크게 변하는 비용은 제외하고 매달 반복해서 나가는 비용만 정확히 60만 원으로 맞췄다.
| 항목 | 월 비용 | 조건 |
|---|---|---|
| 휴대폰 | 69,000원 | 월 데이터 15~20GB, 약정 종료 |
| 인터넷 | 38,500원 | 500Mbps, 약정 10개월 남음 |
| OTT A | 17,000원 | 주 1~2회 |
| OTT B | 13,900원 | 월 2~3회 |
| 음악 | 10,900원 | 거의 매일 |
| 유료 AI | 30,000원 | 주 4~5일 |
| 클라우드 | 11,900원 | 약 70GB 사용 |
| 헬스장 | 55,000원 | 월 약 6회 |
| 보험 | 87,000원 | 이번 실험에서는 유지 |
| 교통 | 65,000원 | 대중교통 출퇴근 |
| 정수기 렌탈 | 29,900원 | 18개월 남음 |
| 전자기기 할부 | 49,500원 | 10개월 남음 |
| 관리비 고정분 | 85,000원 | 절감 불가 가정 |
| 배달 멤버십 | 7,900원 | 월 2~3회 |
| 생산성 앱 | 15,000원 | 메모·PDF·문서 |
| 보안·백업 앱 | 4,900원 | 자동결제 |
| 전자책 | 9,600원 | 월 약 1권 |
| 합계 | 600,000원 | 연 720만 원 |
세 AI에는 가능한 한 동일한 조건과 동일한 작업을 줬다.
여기서 중요한 점은 정답을 맞히는 시험이 아니라 실제로 일을 맡겼다는 것이다.
Day 1. 최신 통신·OTT·AI 가격을 조사하게 했다
첫 번째 과제는 검색이었다.
통신비, OTT, AI 구독료 가운데 어디에서 고정비를 줄일 수 있을지 찾아달라고 했다.
세 서비스 모두 통신과 OTT, AI 구독을 주요 절감 후보로 잡았다. 하지만 접근 방식은 꽤 달랐다.
ChatGPT는 통신요금과 OTT 가격뿐 아니라 프로모션이 끝난 뒤의 가격을 반드시 확인해야 한다는 점을 반복해서 강조했다. 알뜰폰의 몇 달짜리 할인 가격을 24개월 동안 적용해서는 안 된다는 식이다. OTT 역시 개별 상품을 단순히 해지하기보다 묶음상품을 이용했을 때 얼마가 줄어드는지 계산했다.
Gemini는 훨씬 공격적이었다. 알뜰폰 프로모션, AI 경량 요금제, OTT 광고형 요금제 등을 바로 찾아서 월 8만 원대 절감 시나리오를 제시했다. 대신 상품과 가격을 매우 구체적으로 제시하는 만큼 실제 가입 전에 다시 검증해야 할 정보도 많았다.
Claude 역시 통신비를 가장 큰 절감 후보로 봤다. 재미있는 점은 최종 보고서를 만드는 과정에서 자신이 앞에서 사용했던 일부 통신정책 표현과 교통비 환급 조건이 부정확했다는 것을 다시 확인하고 스스로 정정했다는 점이다.
첫날부터 한 가지가 명확했다.
AI의 검색 결과는 ‘답’으로 쓰기보다 조사 시작점으로 사용하는 것이 안전하다.
특히 요금제, 정책, 할인처럼 자주 변하는 정보는 AI가 자신 있게 말한다고 해서 그대로 믿으면 안 된다.
Day 2. 정부·소비자원 PDF를 읽혀봤다
이번에는 그냥 검색하지 않고 공식 보고서를 찾아 읽고 실제 생활에 적용할 정보만 뽑으라고 했다.
세 AI가 고른 자료부터 달랐다.
ChatGPT는 공정거래위원회·한국소비자원 관련 2025년 구독경제 보고서를 중심으로 분석했다. 해지가 어렵다는 경험, 결제 단계에서 추가 비용이 붙는 문제, 거래정보 부족 같은 항목을 숫자와 함께 뽑고 이를 고정비 관리 규칙으로 바꿨다. 특히 자신이 PDF 이미지를 직접 읽은 것이 아니라 색인된 본문과 관련 자료를 교차 확인했다는 한계도 답변 안에 적었다.
Gemini는 가전 구독과 렌탈, 디지털 구독을 함께 묶어 설명하면서 총 구독비용, 중도해지, 자동결제, 유령 구독 같은 실생활 포인트로 바로 연결했다. 읽기는 쉬웠지만 보고서에서 확인한 사실과 모델이 추가한 일반적인 조언의 경계가 상대적으로 덜 분명했다.
Claude는 금융위원회의 2020년 구독경제 소비자보호 자료를 선택했다. 무료체험 후 자동결제, 복잡한 해지 절차 등의 사례를 구체적으로 설명했지만 동시에 문서가 2020년 자료라 오래됐다는 점을 스스로 지적했다.
무료 AI도 긴 자료를 읽고 요약하는 것은 충분히 가능했다.
다만 이번 테스트에서는 오히려 “어떤 PDF를 선택했느냐”가 요약 능력보다 더 중요했다.
Day 3. 똑같은 60만 원 CSV를 주고 절감액을 계산시켰다
여기서 결과가 크게 갈렸다.
동일한 17개 지출항목을 입력했는데 세 AI가 계산한 절감 가능액은 상당히 달랐다.
| AI | 제시한 대표 절감안 | 월 절감액 | 절감률 |
|---|---|---|---|
| ChatGPT | 현실적 시나리오 | 83,300원 | 약 13.9% |
| Gemini | 적극적 최적화안 | 206,300원 | 34.4% |
| Claude | 공격적 상시 시나리오 | 137,200원 | 22.9% |
ChatGPT는 최소·현실적·강화 세 단계로 나눴고, 현실적 기준으로 월 83,300원, 연 999,600원 정도를 제시했다. 휴대폰이나 헬스장처럼 실제 대체 상품이 확인되지 않은 값은 목표치라고 구분했다.
Gemini는 훨씬 많은 항목을 적극적으로 변경했다. 휴대폰을 알뜰폰으로 옮기고, 헬스장을 공공시설로 대체하고, 생산성 앱과 전자책 등을 무료 서비스로 바꾸는 식으로 월 206,300원 절감안을 만들었다.
Claude는 안전·균형·공격 세 시나리오를 만들었고 장기적으로 유지 가능한 공격 시나리오를 월 137,200원 절감으로 정리했다. 한시적인 교통 혜택까지 반영하면 더 큰 숫자가 나오지만, 최종 보고서에서는 지속 가능한 수치와 따로 분리했다.
여기가 이번 실험에서 가장 흥미로웠다.
AI들이 계산을 못한 것이 아니다
무엇을 ‘절약 가능한 비용’으로 판단했느냐가 달랐다.
예를 들어 월 5만5천 원 헬스장을 월 2만 원짜리 시설로 바꾸면 수학적으로는 3만5천 원이 절약된다.
하지만 그 시설이 실제로 사용 가능하고 위치와 시설 수준도 괜찮은지는 별개의 문제다.
AI에게 비용 최적화를 맡길 때는 따라서 숫자보다 먼저 가정을 확인해야 한다.
Day 4. 조사 결과를 실제 블로그 글로 쓰게 했다
네 번째에는 앞의 데이터를 가지고 사람이 읽을 만한 글을 만들어보라고 했다.
ChatGPT는 가장 보고서에 가까웠다. 왜 이 비용을 줄이는지, 계약이 남은 비용은 왜 건드리지 않는지 등을 차분하게 설명했고 ‘싼 상품 찾기’가 아니라 ‘실제 결제액과 이용량을 확인하라’는 방향으로 글을 구성했다.
Gemini는 생활정보 블로그에 가까웠다. 통신, OTT, 앱, 정부지원 등을 넓게 확장해서 읽을 거리는 많았지만 원래 제공한 데이터 밖으로 나가는 내용도 상당히 많았다.
Claude는 두 스타일의 중간 정도였다. 숫자를 유지하면서 실행 순서를 붙여 실제 절약 가이드 형태로 정리했다.
여기서는 AI가 초안을 만드는 능력 자체보다 얼마나 많이 덜어내야 사람이 쓴 글처럼 보이느냐가 더 중요했다.
AI에게 한 번에 긴 글을 만들어 달라고 하면 세 서비스 모두 비슷하게 제목, 소제목, 결론을 지나치게 깔끔하게 만드는 경향이 있었다.
Day 5. 코딩을 몰라도 계산기를 만들 수 있을까?
다섯 번째 과제는 조금 더 실무적이었다.
사용자가 자신의 현재 비용과 변경 후 비용을 입력하면
월 절감액, 연간 절감액, 절감률, 변경 후 고정비를 계산하는 HTML 계산기를 만들게 했다.
세 AI 모두 이 단계까지 수행했다.
ChatGPT는 기본 17개 항목을 넣은 계산기와 함께 고정비 분석용 Excel 형태까지 확장했다.
Gemini는 항목별 금액을 조정하면서 전체 절감액이 바뀌는 인터랙티브 형태를 만들었다.
Claude도 안전·균형·공격 시나리오를 직접 변경할 수 있는 계산기를 구성했고, 일부 정책 조건까지 조정할 수 있도록 만들었다.
이 단계에서는 무료 AI의 활용도가 꽤 높았다.
완성된 코드를 그대로 서비스에 올릴 수준인지는 별도 검토가 필요하지만, “아이디어 → 작동하는 프로토타입”까지 가는 비용은 사실상 0원이었다.
Day 6. 일부러 숨은 조건이 있는 요금제를 줘봤다
이번에는 실제 통신사 상품이 아닌 가상의 통신요금제 화면을 만들었다.
핵심은 화면에 크게 보이는 가격과 실제 비용이 다르게 설계했다는 것이다.
알뜰 25는 처음 6개월만 월 9,900원이고 이후에는 25,000원이다. 가입비 11,000원과 유심비 7,700원도 첫 달에 추가된다.
스마트 69와 라이트 45에는 25% 할인이 있지만 24개월 약정 조건이 붙는다.
세 AI가 계산한 24개월 비용의 핵심 결과는 같았다.
| 요금제 | 표시가격만 단순 계산 | 조건 반영 24개월 총비용 |
|---|---|---|
| 스마트 69 | 1,656,000원 | 1,242,000원 |
| 라이트 45 | 1,080,000원 | 810,000원 |
| 알뜰 25 | 237,600원 | 528,100원 |
여기서는 세 서비스 모두 주요 계산은 제대로 했다.
특히 알뜰 25는 광고에 보이는 9,900원을 24개월 동안 곱하면 237,600원밖에 안 나오지만 실제 설정한 조건을 넣으면 528,100원이었다.
차이가 29만 원 이상 난다.
AI에게 가격비교를 시킬 때도 마찬가지다.
표에서 가장 큰 숫자만 읽는지, 아래쪽 작은 조건까지 읽고 계산하는지가 훨씬 중요하다.
Day 7. 마지막으로 전체 프로젝트를 보고서로 만들게 했다
마지막 과제는 Day 1부터 Day 6까지 모든 결과를 한 번에 정리하는 것이었다.
여기서 다시 세 AI의 성향 차이가 드러났다.
ChatGPT의 최종 보고서는 비교적 보수적이었다. 현실적 시나리오를 월 83,300원 절감, 연 999,600원 절감으로 잡았다.
Gemini는 가장 공격적인 변경안을 적용해 월 206,300원, 연 2,475,600원 절감을 제시했다. 휴대폰, 헬스장, 교통, AI, 앱 등 여러 항목을 동시에 바꾼 결과다.
Claude는 장기적으로 지속 가능한 공격 시나리오를 월 137,200원, 연 1,646,400원 수준으로 정리했다. 그리고 앞에서 조사한 일부 시의성 정보가 부정확했다는 점을 최종 단계에서 다시 검토해 보고서에 정정 사항을 넣었다.
같은 사람, 같은 월 60만 원, 같은 데이터를 사용했는데 결과가:
8만3천 원 → 13만7천 원 → 20만6천 원
까지 벌어졌다.
이 숫자 하나만 봐도 AI의 결과를 그대로 정답으로 쓰면 안 되는 이유를 알 수 있다.
무료 AI는 실제로 어디까지 가능했나?
이번 프로젝트에서는 세 무료 AI 모두 다음 과정을 끝까지 수행했다.
최신 정보 검색 → PDF 분석 → CSV 계산 → 글 작성 → HTML 계산기 제작 → 이미지·조건 분석 → 최종 보고서 작성.
즉 이 정도의 개인 업무 프로젝트라면 무료 AI만으로도 완주 자체는 가능했다.
오히려 부족했던 것은 기능보다 신뢰성 관리였다.
최신 가격이 맞는지 다시 봐야 했고, AI가 임의로 가정한 가격이 있는지 확인해야 했고, 같은 데이터에서 왜 절감액이 두 배 이상 차이나는지도 사람이 판단해야 했다.
의외였던 점: 무료 AI의 가장 큰 비용은 ‘검증 시간’이었다
무료라서 돈은 들지 않는다.
하지만 결과를 검증하는 시간은 든다.
예를 들어 Gemini가 월 20만 원 이상을 절약할 수 있다고 제시하면 숫자만 보면 가장 좋은 결과처럼 보인다.
그런데 자세히 보면 헬스장을 훨씬 저렴한 시설로 바꾸고, 유료 앱을 무료 서비스로 대체하고, 교통 혜택까지 모두 적용한다.
그 선택들이 실제 생활에서도 가능한지를 확인하지 않으면 계산상 절감액과 현실 절감액은 달라진다.
반대로 지나치게 보수적인 AI는 실제로 줄일 수 있는 비용도 그대로 남겨둘 수 있다.
결국 중요한 것은:
AI가 얼마를 아낄 수 있다고 말했느냐가 아니라, 그 숫자를 어떤 가정으로 만들었느냐였다.
그래서 무료 AI가 유료 AI를 대체할 수 있었나?
이번 실험 범위에서는 그렇다.
최소한 자료 조사, 문서 요약, 데이터 계산, 글 작성, 간단한 코딩과 보고서 제작까지는 무료 버전만으로도 처리할 수 있었다.
다만 이것이 곧 “유료 AI는 필요 없다”는 뜻은 아니다.
매일 많은 파일을 반복해서 분석하거나 긴 프로젝트의 맥락을 계속 유지해야 하거나, 사용량 제한 때문에 작업이 끊기는 것이 곧 비용이 되는 사람이라면 이야기가 달라진다.
반대로 AI를 하루 종일 쓰지 않고 필요할 때 검색·문서작성·계산 정도에 사용하는 사람이라면, 먼저 무료 버전 세 개를 써보고 정말 부족한 기능이 생겼을 때 유료로 넘어가는 편이 합리적일 수 있다.
이번 테스트에서 느낀 세 AI의 차이
| AI | 실제 사용하면서 두드러진 특징 |
|---|---|
| ChatGPT | 가정과 계산을 비교적 보수적으로 나누고, 한계를 명시하는 편 |
| Gemini | 빠르게 많은 대안을 제시하고 적극적으로 비용을 줄이는 방향 |
| Claude | 여러 단계 결과를 다시 엮고, 마지막에 앞선 내용을 재검토하는 모습이 두드러짐 |
어느 하나가 모든 작업에서 압도적이라기보다 같은 문제를 해석하는 방식이 달랐다.
그래서 무료 AI를 사용할 때는 한 서비스만 믿기보다 중요한 계산이나 조사라면 다른 AI에 한 번 더 물어보는 것 자체가 검산 도구가 될 수 있다.
결론
이번 테스트에서 가장 기억에 남은 건 AI가 글을 얼마나 잘 쓰느냐가 아니었다.
같은 60만 원을 보고도 세 AI가 전혀 다른 절약안을 내놨다는 것이다.
이건 AI가 쓸모없다는 뜻이 아니다.
오히려 반대다.
검색하고, 계산하고, 표를 만들고, 긴 문서를 정리하고, 계산기까지 만드는 작업을 무료 버전만으로 며칠 전보다 훨씬 빠르게 할 수 있었다.
다만 결정까지 AI에게 넘기면 안 된다.
AI는 선택지를 빠르게 만들고 계산해주는 도구로 쓰고, 최종적으로 어떤 가정을 받아들일지는 사람이 판단하는 것이 가장 현실적이었다.
이번 프로젝트만 놓고 보면 무료 AI의 기능은 생각보다 충분했다.
그리고 유료 AI가 필요한 순간은 ‘답변이 없어서’라기보다 검증과 반복 작업에 쓰는 시간을 줄이고 싶을 때에 더 가까웠다.
