[태그:] Gemini

  • AI 에이전트, 챗봇이랑 뭐가 다른가 — 작동 원리와 앱 5종 비교

    AI 에이전트, 챗봇이랑 뭐가 다른가 — 작동 원리와 앱 5종 비교

    챗봇은 답만 준다. AI 에이전트는 직접 한다. 이 차이가 사소해 보이지만, 실제로 써보면 완전히 다른 경험이다. iOS·안드로이드용 에이전틱 AI 앱들이 연달아 출시되면서 이 기술이 일반 소비자 손에 닿기 시작했다.

    챗봇과 AI 에이전트, 뭐가 다른가

    챗봇은 반응형(reactive)이다. 묻고, 받고, 끝. AI 에이전트는 자율형(autonomous)이다. 목표 하나를 던져주면 세부 작업으로 쪼개고, 순서를 정하고, 하나씩 실행한 다음 결과를 합친다. 중간에 뭔가 틀어지면 스스로 방향을 바꾼다.

    기술 구조로 보면 ReAct(Reasoning + Acting) 프레임워크가 핵심이다. 추론과 행동을 교대로 반복하면서 목표에 가까워지는 방식이다. 여기에 웹 검색, 코드 실행, 파일 조작, API 호출 같은 외부 도구 접근 권한이 붙으면 비로소 ‘에이전트’라고 부를 수 있다.

    스마트폰 에이전트가 실제로 뭘 하나

    모바일 에이전트의 활용 범위는 생각보다 실용적이다.

    • 일정·예약 관리: 캘린더를 읽고, 빈 시간을 찾아 미팅을 잡고, 참석자에게 초대장 발송까지 처리
    • 리서치 자동화: 여러 웹사이트를 돌며 정보를 수집하고, 요약본·비교표 형태로 정리
    • 앱 간 데이터 이동: 이메일에서 데이터를 뽑아 스프레드시트에 채우거나, 메모 앱 내용을 메신저로 전송
    • 쇼핑·가격 비교: 조건을 주면 여러 쇼핑몰을 뒤져 최저가 옵션 목록을 제시
    • 코드 실행: 데이터 처리나 계산이 필요한 작업은 직접 코드를 짜서 돌린 결과를 반환

    핵심은 멀티스텝 실행이다. 챗봇이 레시피를 알려준다면, 에이전트는 재료를 마트 앱 장바구니에 담는 데까지 간다. 이걸 직접 써보면 “아, 이게 진짜 다른 거구나” 하는 순간이 온다.

    주요 모바일 AI 에이전트 앱 5종 비교

    지금 설치해서 쓸 수 있는 앱들이다.

    • ChatGPT (OpenAI): Tasks 기능과 Operator 연동으로 예약·검색·폼 작성이 된다. 에이전트 기능 중 가장 범용적이고 iOS·안드로이드 모두 지원한다.
    • Claude (Anthropic): 긴 문서 처리와 코드 분석에 강하다. 컴퓨터 사용(computer use) 기능이 모바일로 확장되는 중이다.
    • Gemini (Google): 구글 워크스페이스·안드로이드 시스템과의 통합 깊이가 가장 깊다. 캘린더, 지메일, 구글 독스를 직접 조작한다.
    • Perplexity: 엄밀히는 에이전트보다 강화된 리서치 도구에 가깝다. 멀티스텝 검색과 요약 능력은 인상적이다.
    • OpenClaw: 오픈소스 AI 에이전트 생태계를 모바일로 끌어온 앱이다. MCP(Model Context Protocol) 서버와 연결해 커스터마이징 범위가 넓다. 개발자·파워유저용.

    처음 쓴다면 ChatGPT나 Gemini가 맞다. 커스텀 워크플로를 직접 짜고 싶다면 OpenClaw 같은 MCP 기반 앱이 훨씬 유연하다.

    알고 쓰면 다른, 현실적 한계들

    모바일 에이전트의 가장 큰 문제는 신뢰도(reliability)다. 멀티스텝 작업에서 중간 단계 하나가 어긋나면 이후 전체가 무너진다. 에러 복구 능력이 모델마다 달라서 같은 작업도 결과가 달라지기 일쑤다.

    • 환각(hallucination): 존재하지 않는 URL을 방문하거나, 없는 파일을 참조하는 일이 여전히 발생한다
    • 배터리·데이터 소모: 백그라운드에서 여러 도구를 동시에 호출하면 리소스 소비가 상당하다
    • 권한 범위: 어떤 앱·데이터에 접근하는지 사용자가 명확히 설정해야 한다
    • 루프 위험: 목표 달성 조건이 불명확하면 같은 작업을 반복하다 멈추지 않는 경우도 있다

    금융 거래, 계약서 발송 같은 고위험 작업은 아직 에이전트에 단독으로 맡기지 않는 게 안전하다. 솔직히 지금 기술 수준의 한계다.

    개인정보와 보안, 어디까지 믿을 수 있나

    에이전트가 강력할수록 접근 권한도 넓어진다. 이메일을 읽고, 파일을 열고, 앱을 조작하려면 해당 권한을 전부 줘야 한다. 문제는 이 권한이 어디에 어떻게 저장되는가다.

    확인해야 할 항목:

    • 에이전트가 수집한 데이터가 서버에 저장되는지, 온디바이스에서만 처리되는지
    • 서드파티 MCP 서버를 연결할 경우 해당 서버의 데이터 처리 정책 확인
    • OAuth 토큰 등 민감한 자격증명이 앱 내 어디에 보관되는지
    • 앱 삭제 시 수집된 데이터가 실제로 삭제되는지

    오픈소스 기반 에이전트 앱은 코드를 직접 확인할 수 있어 투명성 면에서 유리하다. 상용 앱은 편의성이 높지만 데이터 흐름이 불투명한 경우가 많다. 어느 쪽을 쓰든 권한 설정은 꼼꼼히 해두는 게 맞다.

    다음 수순은 OS 수준 통합

    모바일 AI 에이전트 시장의 다음 경쟁 축은 OS 수준 통합이다. 애플 인텔리전스와 구글 안드로이드 AI가 시스템 레이어에서 에이전트 기능을 직접 제공하기 시작하면, 서드파티 에이전트 앱들은 차별화 포인트를 더 좁은 버티컬—업무 자동화, 개발, 의료 등—에서 찾아야 한다.

    MCP 같은 표준 규격이 자리를 잡으면 에이전트끼리 서로를 호출하는 멀티에이전트 시스템이 일반화될 전망이다. 이렇게 되면 단일 앱이 아니라 목적에 맞는 에이전트 조합을 직접 구성하는 방식으로 흘러갈 것이다.

    결정적으로, 에이전트의 실용적 가치는 연결된 도구 수보다 실행 신뢰도에 달려 있다. 많이 하는 것보다 실수 없이 해내는 게 훨씬 어렵다. 그게 앞으로 이 시장이 풀어야 할 핵심 과제다.

    출처: Engadget

  • 2026 한국인을 위한 AI 챗봇 실전 비교: ChatGPT, 클로드, 제미니 한국어 50개 질문 테스트

    2026 한국인을 위한 AI 챗봇 실전 비교: ChatGPT, 클로드, 제미니 한국어 50개 질문 테스트

    매달 구독료 청구서가 세 장이다. ChatGPT Plus, Claude Pro, Gemini Advanced — 합치면 6만 원이 훌쩍 넘는다. 2023년 말 ChatGPT를 처음 쓰기 시작할 때만 해도 이렇게 될 줄은 몰랐는데. 결제할 때마다 ‘세 개 다 필요한 게 맞나?’라는 생각이 어김없이 든다.

    그래서 지난 두 달 동안 직접 테스트를 해봤다. 한국 독자 입장에서 실제로 궁금해하는 질문 50개를 정해놓고, 세 서비스에 똑같이 던졌다. 해외 테크 블로그처럼 영어 성능 위주가 아니다. ‘종합소득세 신고할 때 뭐가 공제되는지’, ‘전세금 반환 안 해주면 어떻게 하는지’ — 이런 질문들이다. 영어권 벤치마크로는 절대 안 잡히는 것들.

    테스트 환경과 기준

    2026년 4월 기준, 각 서비스 최신 모델 기준이다. ChatGPT는 GPT-5, Claude는 Claude Opus 4.6, Gemini는 Gemini 2.5 Pro. 전부 유료 구독 기준이고, 무료 버전과는 차이가 있다.

    50개 질문은 5개 카테고리로 나눴다.

    • 한국어 자연스러움 — 문체, 경어 처리, 일상 대화 10문항
    • 한국 법률/세무 — 실제 생활에서 많이 찾는 법률 10문항
    • 번역 품질 — 영한/한영 양방향 10문항
    • 한국 문화/역사 — 조선사, K-콘텐츠, 한국식 관용 표현 10문항
    • 코딩 + 한국어 주석 — 한국어 변수명과 주석이 필요한 실무 상황 10문항

    채점은 직접 했다. 세 서비스 답변을 라벨 없이 섞어서 ‘어느 게 더 정확한가’, ‘어느 게 더 자연스러운가’를 기록했다. 객관적인 벤치마크가 아니라 실사용 관점 평가다. 이 점은 미리 밝혀둔다.

    한국어 자연스러움: 반말에 반말로 받아치는 AI는 하나뿐

    가장 먼저 눈에 띈 차이는 말투였다. ‘친구 결혼식인데 뭐 입고 가?’라고 반말로 던졌을 때, Claude는 ‘결혼식이면 너무 화려한 건 피하고’로 자연스럽게 받아쳤다. ChatGPT는 존댓말로 돌아서고(‘결혼식 하객 스타일은…’), Gemini는 어정쩡하게 ‘~해요’체로 답했다.

    존댓말로 물으면 셋 다 존댓말로 답한다. 차이는 반말 질문에 말투를 맞춰주느냐는 거다.

    테스트 항목 ChatGPT Claude Gemini
    반말 질문에 반말 답변 2/10 8/10 3/10
    경어 단계 유지 9/10 10/10 8/10
    자연스러운 어미 변화 7/10 9/10 6/10
    신조어/줄임말 이해 6/10 8/10 7/10
    지역 방언 인식 5/10 6/10 5/10

    Claude가 한국어 자연스러움에서 확실히 앞섰다. ‘~거든요’, ‘~잖아요’ 같은 어미 뉘앙스를 가장 잘 살린다. ChatGPT는 번역투가 자주 보인다. ‘흥미로운 질문입니다’로 시작하는 영어식 리드가 대표적이다. Gemini는 빠르고 안정적인데 개성이 좀 약하다.

    ‘ㅇㅋ’, ‘ㄱㅅ’, ‘ㅈㅅ’ 같은 초성체는 셋 다 이해한다. 그런데 ‘갑분싸’, ‘낄끼빠빠’ 같은 신조어에서는 Claude만 맥락을 정확히 잡아냈다. 나머지 둘은 뜻은 알아도 답변에 어색하게 섞어냈다.

    한국 법률과 세무: 이 부분에서 점수가 갈렸다

    가장 꼼꼼히 들여다본 영역이다. 한국에 사는 사람이라면 누구나 한 번쯤 부딪히는 질문들이거든. 종합소득세 신고, 전세 계약, 상속세, 증여세, 건강보험료 피부양자 자격 같은 것들.

    ‘프리랜서 종합소득세 신고할 때 경비 처리 가능한 항목이 뭐야?’라고 물었다. 셋 다 기본 항목(사업장 임차료, 소모품비, 통신비 등)은 맞게 댔다. 차이는 세부사항에서 났다.

    • ChatGPT — 항목 나열 후 ‘자세한 건 세무사에게 문의하라’는 식으로 마무리. 홈택스 간편장부 대상자 여부는 언급 없음.
    • Claude — 기준경비율 대상자와 단순경비율 대상자 구분부터 설명. 수입금액 2,400만 원/7,500만 원 경계선까지 정확히 언급했고, 추정소득률 표까지 짚어줬다.
    • Gemini — 항목은 상세했는데 ‘2024년 기준’이라고 잘못된 날짜를 붙여서 답변. 2026년 변경 사항 반영이 부족했다.

    전세 계약 질문도 비슷한 양상이었다. ‘전세 보증금 반환 못 받으면 어떻게 하는지’를 물었을 때, Claude는 임차권등기명령 → 지급명령 → 강제집행 순서를 구체적으로 설명했다. 주택도시보증공사(HUG) 전세보증보험 청구 절차까지. ChatGPT는 ‘변호사 상담’을 먼저 권하는 경향이 강했다.

    법률/세무 카테고리 ChatGPT Claude Gemini
    종합소득세 (3문항) 2.3/3 2.8/3 2.1/3
    부동산 계약 (3문항) 2.0/3 2.9/3 1.9/3
    상속/증여 (2문항) 1.5/2 1.8/2 1.3/2
    4대 보험 (2문항) 1.7/2 1.9/2 1.6/2
    총점 7.5/10 9.4/10 6.9/10

    단, 어떤 AI든 법률 상담을 완전히 대체할 순 없다. 나도 실제 세무 처리는 세무사에게 확인받는다. AI는 ‘질문할 용어’를 정리하거나 ‘기본 개념을 이해’하는 데 쓰는 게 맞다. 그 이상을 기대하면 위험하다.

    번역 품질: 관용표현 하나에서 갈렸다

    영어 → 한국어, 한국어 → 영어 각각 10문장씩 테스트했다. 단순 직역이 아니라 맥락과 뉘앙스를 얼마나 살리는지를 봤다.

    인상적이었던 문장이 하나 있다. ‘He’s the kind of guy who’d give you the shirt off his back.’ 직역하면 ‘셔츠를 벗어줄 사람’이 되는데, 실제로는 ‘너무 마음씨 좋은 사람’이라는 뜻이다.

    • ChatGPT: ‘그는 자기 옷까지 벗어줄 만큼 착한 사람이에요.’ (직역 + 설명)
    • Claude: ‘남 도와주는 거라면 자기 옷까지 벗어줄 사람이에요.’ (자연스러운 의역)
    • Gemini: ‘그는 남을 위해 셔츠까지 벗어줄 수 있는 그런 사람입니다.’ (어색한 직역)

    한국어 → 영어 번역에서는 존댓말 처리가 핵심이었다. ‘바쁘신 와중에 시간 내주셔서 정말 감사드립니다’라는 비즈니스 이메일 문장을 번역했을 때, Claude만 ‘Thank you very much for taking the time to meet with me despite your busy schedule’로 비즈니스 톤을 정확히 살렸다. ChatGPT는 ‘Thank you for making time in your busy schedule’로 짧게 처리했고, Gemini는 ‘Thank you so much for taking the time out of your busy day’로 약간 캐주얼하게 나왔다.

    한국 문화와 역사: 의외로 Gemini가 강했다

    이 부분에서 예상 밖의 결과가 나왔다. ‘조선시대 암행어사 제도와 현대 감사원의 차이’, ‘BTS 이전과 이후 K팝 산업의 구조적 변화’, ‘한국 전통 음식 중 외국인에게 가장 설명하기 어려운 요리’ 같은 질문들이었다.

    역사 사실 관계에서는 Gemini가 가장 정확했다. 조선왕조실록 기반 사실들을 잘 기억하고 있었다. Google 검색 데이터 학습 덕분인지는 모르겠지만, 어쨌든 틀린 게 가장 적었다.

    Claude는 ‘문화적 뉘앙스’ 설명에서 빛났다. 청국장의 발효 개념을 서양의 블루치즈와 비교하면서 풀어내는 방식이 자연스러웠다. 외국인에게 한국 음식을 소개할 때 쓸 만한 표현들이 많이 나왔다.

    ChatGPT는 중간이었다. 정보량은 풍부한데 가끔 특정 왕의 재위 기간이나 사건 연도를 틀리는 경우가 있었다. ‘세종대왕이 집현전을 만들었다’ 같은 흔한 오류는 아니지만, 세부 연도에서 실수가 보였다.

    코딩: 한국어 주석 품질이 갈랐다

    코딩 실력 자체는 셋 다 훌륭하다. 파이썬이나 자바스크립트 기본 문제는 거의 차이가 없다. 차이는 ‘한국어 주석’에서 드러났다.

    ‘한국 주민등록번호 검증 함수를 만들어줘. 주석은 한국어로’라고 했을 때, 셋 다 코드는 만들어냈다. 그런데 주석 품질이 달랐다. Claude와 Gemini는 체크섬 계산 로직을 한국어로 정확히 설명했다. ChatGPT는 ‘주민번호 형식 검증’ 정도의 개괄적인 주석만 달았다. 한국 실무 개발자 입장에서는 Claude나 Gemini가 더 쓸 만하다.

    결국 어느 걸 써야 하나

    두 달 테스트 후 ChatGPT 구독을 해지했다. 대신 Claude와 Gemini 두 개만 남겼다. ChatGPT가 못해서가 아니다. Claude가 한국어 작업에서 확실히 앞서고, Gemini는 Google 생태계 연동(Gmail, 캘린더, 문서)에서 독보적이기 때문이다.

    일상적인 한국어 대화와 글쓰기라면 Claude를 추천한다. 블로그 초안, 이메일 번역, 보고서 요약에서 가장 자연스러운 결과물이 나온다. 월 29달러가 아깝지 않다.

    Google Workspace를 쓰는 직장인이라면 Gemini Advanced가 맞다. Gmail 초안 작성, Google 문서 요약, 캘린더 일정 관리가 하나로 묶인다. Gemini 2.5부터 한국어 품질도 크게 올라왔다.

    이미지 생성과 음성 모드가 중요하다면 ChatGPT Plus가 아직 강하다. DALL-E 3 기반 이미지 생성은 Claude에는 없는 기능이고, 실시간 음성 대화 품질도 가장 좋다.

    한 달 2만 원 이하로 쓰고 싶다면 Claude Pro 하나만 추천한다. 가장 다재다능하고 한국어 작업에서 실수가 적다.

    자주 묻는 질문

    Q1. 무료 버전만으로 충분할까?
    간단한 번역이나 요약이라면 충분하다. 긴 문서 처리, 파일 업로드, 고급 추론이 필요하면 유료가 필수다. 한 달에 30~40번 이상 쓴다면 유료 플랜이 시간 대비 가치가 확실히 높다.

    Q2. 한국어 음성 대화가 가장 자연스러운 서비스는?
    ChatGPT Plus 고급 음성 모드가 가장 자연스럽다. 한국어 억양과 톤까지 자연스럽게 구현한다. Claude는 음성 모드를 공식 지원하지 않고, Gemini는 ChatGPT보다 한 단계 떨어진다.

    Q3. 개인정보 보호 측면에서 가장 안전한 AI는?
    Claude(Anthropic)가 학습 데이터 사용 정책에서 가장 명확하다. 기본적으로 사용자 대화를 학습에 쓰지 않는다. ChatGPT는 설정에서 ‘대화 기록 끄기’를 선택해야 학습 제외가 된다. Gemini는 Google 계정 정책에 따라 달라지므로 개인정보 설정을 직접 확인해야 한다.

    Q4. 한국어 이미지 생성이 가장 좋은 AI는?
    ChatGPT의 DALL-E 3가 한국어 프롬프트를 가장 잘 이해한다. Gemini의 Imagen도 빠르지만 한글 텍스트 렌더링에서 오류가 자주 발생한다. Claude는 이미지 생성을 지원하지 않는다.

    Q5. 비즈니스용으로 가장 적합한 AI는?
    Claude Opus가 문서 작업 정확도에서 앞서고, Gemini는 Google Workspace 연동에서 앞서고, ChatGPT는 플러그인 생태계가 가장 넓다. 업무 스타일에 따라 다른데, 블로그나 보고서 중심이라면 Claude, Gmail을 많이 쓴다면 Gemini 쪽이 낫다.

    Q6. API로 자동화할 때 비용이 가장 저렴한 건?
    2026년 4월 기준, 입력 토큰 대비 비용은 Gemini 2.5 Flash가 가장 저렴하다. Claude Haiku도 비슷한 수준인데 Gemini Flash가 약간 더 싸다. 고품질 작업이라면 Claude Sonnet가 가성비가 좋고, 최고 품질은 Claude Opus다.

    Q7. 무료로 가장 성능 좋은 AI는?
    Gemini 무료 버전이 가장 강하다. Gemini 2.5 Flash를 무료로 쓸 수 있고, 하루 사용량도 넉넉한 편이다. Claude는 무료 버전 제한이 상대적으로 빡빡하다.

    세 개 다 써본 사람의 솔직한 결론

    한국어 AI 챗봇 시장은 이제 ‘하나만 쓰면 되는’ 단계를 지났다. 각 서비스가 강점 분야를 확실히 나눠 갖기 시작했다. 한국어 글쓰기와 법률/세무는 Claude, Google 생태계와 무료 활용은 Gemini, 이미지와 음성은 ChatGPT. 작업 성격이 다양하다면 두 개 조합이 합리적이고, 한두 가지 용도로만 쓴다면 해당 분야 선두 주자만 골라도 충분하다.

    결제 전에 먼저 정리해볼 게 있다. ‘내가 실제로 어떤 작업에 AI를 쓰는지’다. 유료 플랜 세 개를 다 써본 사람으로서 드리는 솔직한 조언이다. 한 달 무료 체험을 꼭 활용해서 직접 비교해보길 권한다.