[태그:] Claude

  • AI 에이전트 완전정복 — 챗봇과 뭐가 다르고, 어떻게 써야 하나

    AI 에이전트 완전정복 — 챗봇과 뭐가 다르고, 어떻게 써야 하나

    회사 슬랙에 “Alex가 팀에 합류했습니다”라는 공지가 떴다. 인사팀이 아니다. 신입도 아니다. AI 에이전트다. 이름이 있고, 업무 범위도 있고, 채널에 초대도 됐다. 솔직히 이쯤 되면 헷갈린다. 챗봇이랑 뭐가 다른 건지, 어디까지 믿어야 되는 건지, 어떻게 써야 제대로 쓰는 건지.

    챗봇과 뭐가 다른가 — 한 줄로 정리하면

    핵심은 ‘자율성’이다. 챗봇은 질문 받고 답한다. 거기서 끝. 반면 AI 에이전트는 목표를 주면 스스로 계획 세우고, 도구 꺼내 쓰고, 결과 확인하고, 다음 단계까지 알아서 결정한다.

    “이번 달 경쟁사 가격 조사해줘”라는 지시 하나로 비교해보면 차이가 확 온다:

    • 챗봇: 어떻게 조사하면 되는지 방법을 알려준다
    • AI 에이전트: 웹 직접 뒤지고, 데이터 긁어오고, 스프레드시트 정리에 보고서까지 만든다

    구조적으로는 LLM(대형 언어 모델)에 도구 사용 능력(Tool Use)과 반복 실행 루프(ReAct 방식 등)를 얹은 형태다. 챗봇이 ‘대화 엔진’이라면, 에이전트는 ‘자율 실행 시스템’에 가깝다. 이 차이가 생각보다 크다.

    실제로 뭘 처리하나

    범위가 생각보다 넓다. 현재 AI 에이전트가 다루는 작업들:

    • 웹 검색 및 실시간 정보 수집
    • 코드 작성 및 직접 실행
    • 이메일·캘린더·문서 자동 관리
    • 외부 API 호출 및 데이터 가공
    • 파일 읽기·쓰기·분류·요약
    • 여러 단계로 이어지는 복합 업무 자동화

    Anthropic의 Claude는 컴퓨터 화면을 직접 보면서 마우스와 키보드까지 조작하는 ‘Computer Use’ 기능을 내놨다. OpenAI의 Operator는 브라우저를 에이전트가 직접 조작해서 예약·쇼핑·양식 작성을 처리한다. n8n이나 Make 같은 자동화 툴과 연결하면 수십 개 앱을 엮은 복잡한 워크플로우도 가능하다. 이쯤 되면 ‘도구’라는 말이 좀 부족하게 느껴지긴 한다.

    ‘AI 동료’라는 말이 위험한 이유

    기업들이 AI 에이전트에 이름을 붙이고 “디지털 동료”, “AI 팀원”으로 부르기 시작했다. 이해는 한다. 슬랙에 올라오고 메일도 보내니까. 근데 이 표현이 생각보다 큰 오해를 만든다.

    첫째, 에이전트는 책임지지 않는다. 잘못된 보고서 만들어도, 실수로 파일 날려도 사과 안 한다. 결과 책임은 여전히 사람한테 있다.

    둘째, 맥락 이해에 한계가 있다. 회사의 암묵적 문화, 동료 사이 역학, 팀 내 분위기 같은 건 에이전트가 파악하기 어렵다. “이 메일은 CC에 팀장 빼는 게 낫겠어”라는 판단은 아직 사람만 할 수 있다.

    셋째, 과신이 실수를 부른다. 동료처럼 느껴지면 검증을 건너뛰게 된다. 솔직히 이 부분이 가장 우려스럽다. 사람이라면 “잘 모르겠는데요”라고 하지만, 에이전트는 모를 때도 당당하다. 자신 있게 틀린 정보를 내놓는 건 현재 LLM의 고질적인 특성이다. AI 에이전트 출력물은 반드시 확인해야 한다.

    제대로 쓰는 법 — 잘 활용하는 팀의 공통점

    결국 핵심은 ‘강력한 도구’로 대하는 태도다. 전동 드릴이 강력해도 설계를 드릴한테 맡기지 않듯, 에이전트가 강력하다고 판단을 위임하면 안 된다.

    실제로 잘 쓰는 팀들이 하는 것들:

    • 지시를 구체적으로 작성한다. “마케팅 자료 만들어줘”보다 “경쟁사 A·B·C의 가격 페이지를 비교해서 3개 항목으로 요약한 표를 만들어줘”가 훨씬 낫다
    • 반복적이고 정형화된 업무부터 넣는다. 판단이 필요한 작업보다 룰이 명확한 작업부터. 이게 안전하다
    • 중간 결과를 반드시 본다. 최종 산출물만 보지 말고, 에이전트가 어떤 단계를 거쳤는지 확인하는 습관이 필요하다
    • 접근 권한을 최소화한다. 불필요한 권한을 주면 예상치 못한 사고로 이어진다

    툴 비교 — 뭘 골라야 하나

    목적에 따라 달라진다. 대표적인 선택지들:

    • Claude (Anthropic): 코딩, 문서 분석, 컴퓨터 직접 조작. 복잡한 멀티스텝 작업과 긴 문서 처리에 강하다
    • ChatGPT + GPT Actions: 외부 서비스 API 연동, 플러그인 생태계가 풍부하다. 범용 업무에 무난한 선택
    • Gemini (Google): Gmail, Docs, Drive 연동에 최적화돼 있다. 구글 워크스페이스 사용자라면 진입장벽이 낮다
    • n8n / Make: 코드 없이 AI 에이전트 워크플로우 구성 가능. 중소기업이나 비개발자에게 실용적이다
    • CrewAI / AutoGPT: 여러 에이전트를 팀처럼 구성해서 협력 실행. 개발자 친화적이고 복잡한 파이프라인 구축에 맞다

    뭘 고르든, 처음부터 큰 작업을 맡기기보다 작은 단위 테스트로 신뢰를 쌓아가는 게 현실적이다. 이건 어느 툴이나 마찬가지다.

    도입 전 반드시 체크할 것들

    도구가 좋다고 무작정 들이면 오히려 독이 된다. 조직에 AI 에이전트를 넣기 전에 확인해야 할 것들:

    • 에이전트가 접근할 수 있는 데이터 범위를 명확히 정했는가
    • 에이전트 출력물을 최종 검토할 담당자가 지정돼 있는가
    • 외부로 데이터를 전송하지 않는지 확인했는가 (사내 보안 정책과의 충돌 여부)
    • API 호출 기반 서비스라면 사용량에 따른 비용 급증 시나리오를 검토했는가
    • 에이전트가 실수했을 때 롤백하거나 수정할 프로세스가 마련돼 있는가

    AI 에이전트는 업무 방식을 바꿀 기술이다. 이건 맞다. 다만 그 변화를 제대로 이끌려면 도구를 이해하고, 한계를 직시하고, 인간의 판단이 어디서 들어가야 하는지 먼저 설계해야 한다. ‘동료’가 아니라 ‘강력한 도구’로 대할 때, 에이전트는 진짜 힘을 발휘한다.

    출처: MIT Tech Review AI

  • 2026 한국인을 위한 AI 챗봇 실전 비교: ChatGPT, 클로드, 제미니 한국어 50개 질문 테스트

    2026 한국인을 위한 AI 챗봇 실전 비교: ChatGPT, 클로드, 제미니 한국어 50개 질문 테스트

    매달 구독료 청구서가 세 장이다. ChatGPT Plus, Claude Pro, Gemini Advanced — 합치면 6만 원이 훌쩍 넘는다. 2023년 말 ChatGPT를 처음 쓰기 시작할 때만 해도 이렇게 될 줄은 몰랐는데. 결제할 때마다 ‘세 개 다 필요한 게 맞나?’라는 생각이 어김없이 든다.

    그래서 지난 두 달 동안 직접 테스트를 해봤다. 한국 독자 입장에서 실제로 궁금해하는 질문 50개를 정해놓고, 세 서비스에 똑같이 던졌다. 해외 테크 블로그처럼 영어 성능 위주가 아니다. ‘종합소득세 신고할 때 뭐가 공제되는지’, ‘전세금 반환 안 해주면 어떻게 하는지’ — 이런 질문들이다. 영어권 벤치마크로는 절대 안 잡히는 것들.

    테스트 환경과 기준

    2026년 4월 기준, 각 서비스 최신 모델 기준이다. ChatGPT는 GPT-5, Claude는 Claude Opus 4.6, Gemini는 Gemini 2.5 Pro. 전부 유료 구독 기준이고, 무료 버전과는 차이가 있다.

    50개 질문은 5개 카테고리로 나눴다.

    • 한국어 자연스러움 — 문체, 경어 처리, 일상 대화 10문항
    • 한국 법률/세무 — 실제 생활에서 많이 찾는 법률 10문항
    • 번역 품질 — 영한/한영 양방향 10문항
    • 한국 문화/역사 — 조선사, K-콘텐츠, 한국식 관용 표현 10문항
    • 코딩 + 한국어 주석 — 한국어 변수명과 주석이 필요한 실무 상황 10문항

    채점은 직접 했다. 세 서비스 답변을 라벨 없이 섞어서 ‘어느 게 더 정확한가’, ‘어느 게 더 자연스러운가’를 기록했다. 객관적인 벤치마크가 아니라 실사용 관점 평가다. 이 점은 미리 밝혀둔다.

    한국어 자연스러움: 반말에 반말로 받아치는 AI는 하나뿐

    가장 먼저 눈에 띈 차이는 말투였다. ‘친구 결혼식인데 뭐 입고 가?’라고 반말로 던졌을 때, Claude는 ‘결혼식이면 너무 화려한 건 피하고’로 자연스럽게 받아쳤다. ChatGPT는 존댓말로 돌아서고(‘결혼식 하객 스타일은…’), Gemini는 어정쩡하게 ‘~해요’체로 답했다.

    존댓말로 물으면 셋 다 존댓말로 답한다. 차이는 반말 질문에 말투를 맞춰주느냐는 거다.

    테스트 항목 ChatGPT Claude Gemini
    반말 질문에 반말 답변 2/10 8/10 3/10
    경어 단계 유지 9/10 10/10 8/10
    자연스러운 어미 변화 7/10 9/10 6/10
    신조어/줄임말 이해 6/10 8/10 7/10
    지역 방언 인식 5/10 6/10 5/10

    Claude가 한국어 자연스러움에서 확실히 앞섰다. ‘~거든요’, ‘~잖아요’ 같은 어미 뉘앙스를 가장 잘 살린다. ChatGPT는 번역투가 자주 보인다. ‘흥미로운 질문입니다’로 시작하는 영어식 리드가 대표적이다. Gemini는 빠르고 안정적인데 개성이 좀 약하다.

    ‘ㅇㅋ’, ‘ㄱㅅ’, ‘ㅈㅅ’ 같은 초성체는 셋 다 이해한다. 그런데 ‘갑분싸’, ‘낄끼빠빠’ 같은 신조어에서는 Claude만 맥락을 정확히 잡아냈다. 나머지 둘은 뜻은 알아도 답변에 어색하게 섞어냈다.

    한국 법률과 세무: 이 부분에서 점수가 갈렸다

    가장 꼼꼼히 들여다본 영역이다. 한국에 사는 사람이라면 누구나 한 번쯤 부딪히는 질문들이거든. 종합소득세 신고, 전세 계약, 상속세, 증여세, 건강보험료 피부양자 자격 같은 것들.

    ‘프리랜서 종합소득세 신고할 때 경비 처리 가능한 항목이 뭐야?’라고 물었다. 셋 다 기본 항목(사업장 임차료, 소모품비, 통신비 등)은 맞게 댔다. 차이는 세부사항에서 났다.

    • ChatGPT — 항목 나열 후 ‘자세한 건 세무사에게 문의하라’는 식으로 마무리. 홈택스 간편장부 대상자 여부는 언급 없음.
    • Claude — 기준경비율 대상자와 단순경비율 대상자 구분부터 설명. 수입금액 2,400만 원/7,500만 원 경계선까지 정확히 언급했고, 추정소득률 표까지 짚어줬다.
    • Gemini — 항목은 상세했는데 ‘2024년 기준’이라고 잘못된 날짜를 붙여서 답변. 2026년 변경 사항 반영이 부족했다.

    전세 계약 질문도 비슷한 양상이었다. ‘전세 보증금 반환 못 받으면 어떻게 하는지’를 물었을 때, Claude는 임차권등기명령 → 지급명령 → 강제집행 순서를 구체적으로 설명했다. 주택도시보증공사(HUG) 전세보증보험 청구 절차까지. ChatGPT는 ‘변호사 상담’을 먼저 권하는 경향이 강했다.

    법률/세무 카테고리 ChatGPT Claude Gemini
    종합소득세 (3문항) 2.3/3 2.8/3 2.1/3
    부동산 계약 (3문항) 2.0/3 2.9/3 1.9/3
    상속/증여 (2문항) 1.5/2 1.8/2 1.3/2
    4대 보험 (2문항) 1.7/2 1.9/2 1.6/2
    총점 7.5/10 9.4/10 6.9/10

    단, 어떤 AI든 법률 상담을 완전히 대체할 순 없다. 나도 실제 세무 처리는 세무사에게 확인받는다. AI는 ‘질문할 용어’를 정리하거나 ‘기본 개념을 이해’하는 데 쓰는 게 맞다. 그 이상을 기대하면 위험하다.

    번역 품질: 관용표현 하나에서 갈렸다

    영어 → 한국어, 한국어 → 영어 각각 10문장씩 테스트했다. 단순 직역이 아니라 맥락과 뉘앙스를 얼마나 살리는지를 봤다.

    인상적이었던 문장이 하나 있다. ‘He’s the kind of guy who’d give you the shirt off his back.’ 직역하면 ‘셔츠를 벗어줄 사람’이 되는데, 실제로는 ‘너무 마음씨 좋은 사람’이라는 뜻이다.

    • ChatGPT: ‘그는 자기 옷까지 벗어줄 만큼 착한 사람이에요.’ (직역 + 설명)
    • Claude: ‘남 도와주는 거라면 자기 옷까지 벗어줄 사람이에요.’ (자연스러운 의역)
    • Gemini: ‘그는 남을 위해 셔츠까지 벗어줄 수 있는 그런 사람입니다.’ (어색한 직역)

    한국어 → 영어 번역에서는 존댓말 처리가 핵심이었다. ‘바쁘신 와중에 시간 내주셔서 정말 감사드립니다’라는 비즈니스 이메일 문장을 번역했을 때, Claude만 ‘Thank you very much for taking the time to meet with me despite your busy schedule’로 비즈니스 톤을 정확히 살렸다. ChatGPT는 ‘Thank you for making time in your busy schedule’로 짧게 처리했고, Gemini는 ‘Thank you so much for taking the time out of your busy day’로 약간 캐주얼하게 나왔다.

    한국 문화와 역사: 의외로 Gemini가 강했다

    이 부분에서 예상 밖의 결과가 나왔다. ‘조선시대 암행어사 제도와 현대 감사원의 차이’, ‘BTS 이전과 이후 K팝 산업의 구조적 변화’, ‘한국 전통 음식 중 외국인에게 가장 설명하기 어려운 요리’ 같은 질문들이었다.

    역사 사실 관계에서는 Gemini가 가장 정확했다. 조선왕조실록 기반 사실들을 잘 기억하고 있었다. Google 검색 데이터 학습 덕분인지는 모르겠지만, 어쨌든 틀린 게 가장 적었다.

    Claude는 ‘문화적 뉘앙스’ 설명에서 빛났다. 청국장의 발효 개념을 서양의 블루치즈와 비교하면서 풀어내는 방식이 자연스러웠다. 외국인에게 한국 음식을 소개할 때 쓸 만한 표현들이 많이 나왔다.

    ChatGPT는 중간이었다. 정보량은 풍부한데 가끔 특정 왕의 재위 기간이나 사건 연도를 틀리는 경우가 있었다. ‘세종대왕이 집현전을 만들었다’ 같은 흔한 오류는 아니지만, 세부 연도에서 실수가 보였다.

    코딩: 한국어 주석 품질이 갈랐다

    코딩 실력 자체는 셋 다 훌륭하다. 파이썬이나 자바스크립트 기본 문제는 거의 차이가 없다. 차이는 ‘한국어 주석’에서 드러났다.

    ‘한국 주민등록번호 검증 함수를 만들어줘. 주석은 한국어로’라고 했을 때, 셋 다 코드는 만들어냈다. 그런데 주석 품질이 달랐다. Claude와 Gemini는 체크섬 계산 로직을 한국어로 정확히 설명했다. ChatGPT는 ‘주민번호 형식 검증’ 정도의 개괄적인 주석만 달았다. 한국 실무 개발자 입장에서는 Claude나 Gemini가 더 쓸 만하다.

    결국 어느 걸 써야 하나

    두 달 테스트 후 ChatGPT 구독을 해지했다. 대신 Claude와 Gemini 두 개만 남겼다. ChatGPT가 못해서가 아니다. Claude가 한국어 작업에서 확실히 앞서고, Gemini는 Google 생태계 연동(Gmail, 캘린더, 문서)에서 독보적이기 때문이다.

    일상적인 한국어 대화와 글쓰기라면 Claude를 추천한다. 블로그 초안, 이메일 번역, 보고서 요약에서 가장 자연스러운 결과물이 나온다. 월 29달러가 아깝지 않다.

    Google Workspace를 쓰는 직장인이라면 Gemini Advanced가 맞다. Gmail 초안 작성, Google 문서 요약, 캘린더 일정 관리가 하나로 묶인다. Gemini 2.5부터 한국어 품질도 크게 올라왔다.

    이미지 생성과 음성 모드가 중요하다면 ChatGPT Plus가 아직 강하다. DALL-E 3 기반 이미지 생성은 Claude에는 없는 기능이고, 실시간 음성 대화 품질도 가장 좋다.

    한 달 2만 원 이하로 쓰고 싶다면 Claude Pro 하나만 추천한다. 가장 다재다능하고 한국어 작업에서 실수가 적다.

    자주 묻는 질문

    Q1. 무료 버전만으로 충분할까?
    간단한 번역이나 요약이라면 충분하다. 긴 문서 처리, 파일 업로드, 고급 추론이 필요하면 유료가 필수다. 한 달에 30~40번 이상 쓴다면 유료 플랜이 시간 대비 가치가 확실히 높다.

    Q2. 한국어 음성 대화가 가장 자연스러운 서비스는?
    ChatGPT Plus 고급 음성 모드가 가장 자연스럽다. 한국어 억양과 톤까지 자연스럽게 구현한다. Claude는 음성 모드를 공식 지원하지 않고, Gemini는 ChatGPT보다 한 단계 떨어진다.

    Q3. 개인정보 보호 측면에서 가장 안전한 AI는?
    Claude(Anthropic)가 학습 데이터 사용 정책에서 가장 명확하다. 기본적으로 사용자 대화를 학습에 쓰지 않는다. ChatGPT는 설정에서 ‘대화 기록 끄기’를 선택해야 학습 제외가 된다. Gemini는 Google 계정 정책에 따라 달라지므로 개인정보 설정을 직접 확인해야 한다.

    Q4. 한국어 이미지 생성이 가장 좋은 AI는?
    ChatGPT의 DALL-E 3가 한국어 프롬프트를 가장 잘 이해한다. Gemini의 Imagen도 빠르지만 한글 텍스트 렌더링에서 오류가 자주 발생한다. Claude는 이미지 생성을 지원하지 않는다.

    Q5. 비즈니스용으로 가장 적합한 AI는?
    Claude Opus가 문서 작업 정확도에서 앞서고, Gemini는 Google Workspace 연동에서 앞서고, ChatGPT는 플러그인 생태계가 가장 넓다. 업무 스타일에 따라 다른데, 블로그나 보고서 중심이라면 Claude, Gmail을 많이 쓴다면 Gemini 쪽이 낫다.

    Q6. API로 자동화할 때 비용이 가장 저렴한 건?
    2026년 4월 기준, 입력 토큰 대비 비용은 Gemini 2.5 Flash가 가장 저렴하다. Claude Haiku도 비슷한 수준인데 Gemini Flash가 약간 더 싸다. 고품질 작업이라면 Claude Sonnet가 가성비가 좋고, 최고 품질은 Claude Opus다.

    Q7. 무료로 가장 성능 좋은 AI는?
    Gemini 무료 버전이 가장 강하다. Gemini 2.5 Flash를 무료로 쓸 수 있고, 하루 사용량도 넉넉한 편이다. Claude는 무료 버전 제한이 상대적으로 빡빡하다.

    세 개 다 써본 사람의 솔직한 결론

    한국어 AI 챗봇 시장은 이제 ‘하나만 쓰면 되는’ 단계를 지났다. 각 서비스가 강점 분야를 확실히 나눠 갖기 시작했다. 한국어 글쓰기와 법률/세무는 Claude, Google 생태계와 무료 활용은 Gemini, 이미지와 음성은 ChatGPT. 작업 성격이 다양하다면 두 개 조합이 합리적이고, 한두 가지 용도로만 쓴다면 해당 분야 선두 주자만 골라도 충분하다.

    결제 전에 먼저 정리해볼 게 있다. ‘내가 실제로 어떤 작업에 AI를 쓰는지’다. 유료 플랜 세 개를 다 써본 사람으로서 드리는 솔직한 조언이다. 한 달 무료 체험을 꼭 활용해서 직접 비교해보길 권한다.