하나투어 웍스AI 16억 토큰, 전사 에이전트 성과는 어떻게 읽어야 하나
배포·운영

하나투어 웍스AI 16억 토큰, 전사 에이전트 성과는 어떻게 읽어야 하나

누적 사용량을 월간 수치로 읽으면 평가가 달라진다. 호출 횟수와 실제 업무 결과를 함께 살펴봤다.

2026-10-01논의 1회 정리

기업이 AI를 전사에 도입했다고 말할 때, 토큰 사용량은 성과의 증거가 될까. 하나투어의 웍스AI 사례를 두고 클코단에서는 사용 규모와 에이전트의 실질적 역할에 의문을 제기하는 의견이 많았다. 공개된 수치와 기능을 다시 확인해보면 먼저 측정 기간부터 바로잡아야 한다.

16억 토큰은 한 달치가 아니라 누적치다

하나투어가 2026년 8월 13일 발표한 16억 토큰은 월간 사용량이 아니다. 회사 보도자료에 따르면 웍스AI를 전사에 도입한 뒤 7월 11일까지 누적된 사용량이다. 같은 기간 호출은 약 14만 회였고, 회사가 밝힌 회당 평균은 약 1만1000토큰이다. 도입 3개월 만의 임직원 이용률은 약 72%로 발표됐다. (hanatourcompany.com)

월 16억 토큰을 쓴 그룹사라고 생각하면 숫자가 작다는 반응이 나올 수 있다. 그러나 공개 자료의 기준은 한 달이 아니라 도입 후 누적 기간이다. 발표에는 개인별 사용 분포, 부서별 반복 이용률, 에이전트별 호출량이 없다. 16억이라는 총합만으로는 일부 직원에게 사용이 집중됐는지, 조직 전반에서 꾸준히 썼는지 가릴 수 없다.

클코단에서는 개인의 Claude Code 사용 경험과 비교해 기업 수치가 낮다는 의견도 나왔다. 비교 자체는 흥미롭지만 두 환경의 요청 한 건은 같은 작업 단위가 아니다. 앤트로픽은 Claude Code 세션에 파일 맥락, 도구 호출, 여러 차례의 추론이 포함돼 일반 채팅보다 토큰을 많이 쓸 수 있다고 설명한다. 기업의 문서 요약 호출과 코딩 세션을 총토큰만으로 비교하면 작업의 차이가 사라진다. (support.claude.com)

이용률과 에이전트 성과는 서로 다른 숫자다

72%는 임직원 이용률을 보여준다. 그들이 같은 기능을 계속 썼는지, 산출물이 검토를 통과했는지는 알 수 없다. 하나투어는 문서 요약·데이터 분석·기획서 작성에 웍스AI를 사용한다고 밝혔다. 직원이 만든 맞춤형 기능으로는 여행 일정표 작성, 고객만족도와 VOC 분석, 여행 상품 수요 분석을 제시했다. (hanatourcompany.com)

회사가 제시한 ‘근로시간 231일 절감’도 측정값의 성격을 구분해야 한다. 하나투어 설명에 따르면 대화 한 건당 5분을 아낀다고 가정한 뒤 실제 업무 기여도를 30%로 조정해 계산했다. 직원의 작업 시간을 전후로 직접 측정한 결과로 읽어서는 안 된다. 토큰은 처리량, 이용률은 접근 범위, 절감 시간은 가정에 따른 추정치다. (hanatourcompany.com)

그렇다고 주간 업무 요약이나 사내 규정 안내를 하찮은 과제로 치부할 근거도 없다. 반복 질문에 답하느라 지원 부서가 쓰던 시간을 줄였다면 조직에는 쓸모가 있다. 다만 효과를 판단하려면 같은 질문에 얼마나 정확히 답했는지, 담당자에게 다시 넘어간 건은 몇 개인지 알아야 한다. 클코단의 의문은 사용량보다 과제의 적합성과 지속 사용 여부에 가까웠다.

‘에이전트’라는 이름보다 수행 단계를 확인해야 한다

웍스AI의 공식 가이드는 역할을 미리 지정한 대화 도구도 에이전트라고 부른다. 도구를 연결하지 않아도 요약과 초안 작성에 쓸 수 있다. Notion이나 일정·메일 도구를 연결하면 외부 정보를 조회하거나 작업을 수행할 수도 있다. ‘에이전트’라는 명칭만으로 자율 실행 수준을 짐작하기 어려운 이유다. (wrks.ai)

앤트로픽의 기술 문서는 미리 정한 경로를 따르는 워크플로와 모델이 도구 사용 및 다음 단계를 선택하는 에이전트를 구분한다. 직원이 자료를 붙여 넣고 요약문을 받는 경우와 필요한 자료를 찾고 결과를 점검하는 경우는 운영 위험도 다르다.

하나투어 발표에는 맞춤형 기능의 종류가 나와 있지만 각 기능이 어느 단계까지 스스로 실행하는지는 공개돼 있지 않다. 단순해 보인다는 평가도, 완전한 자율 에이전트라는 평가도 여기서 멈춰야 한다. (anthropic.com)

고객용 H-AI와 내부 업무용 웍스AI도 구별할 필요가 있다. 하나투어는 H-AI를 여행 기획부터 상담까지 다루는 고객 서비스로 소개한다. 16억 토큰 발표는 임직원이 쓰는 웍스AI에 관한 것이다. 두 제품의 사용량을 하나의 에이전트 실적으로 합쳐 읽을 근거는 없다. (hanatourcompany.com)

작은 팀이라면 한 업무를 만들어 비교할 수 있다

공개된 웍스AI 가이드는 제작 순서를 구체적으로 보여준다. ‘나만의 에이전트’에서 만들기를 선택하고 모델과 이름을 정한 뒤 역할·제약·출력 형식을 프롬프트에 적는다. 필요한 참고 파일을 올리고 도구를 선택하면 해당 설정으로 대화할 수 있다. 팀 에이전트는 부서 구성원에게 공유할 수 있으며, 공식 에이전트의 공개에는 관리자 검토 절차가 있다. 이 설명은 제품 사용법이지 하나투어가 특정 기능을 만든 실제 순서라는 뜻은 아니다. (wrks.ai)

가령 소규모 여행팀이 일정표 초안을 시험한다면 출발일·예산·동행 조건을 입력으로 고정할 수 있다. 상품 조건표를 참고 파일로 넣고 출력에는 일자별 일정과 확인이 필요한 항목을 분리하도록 정한다. 결과물은 사람이 원본 조건표와 대조한다. 같은 요청을 도구 없는 초안 작성과 자료 조회를 허용한 방식으로 각각 처리하면 어느 단계에서 정확도와 비용이 달라지는지 확인할 수 있다. 이는 하나투어의 내부 설계를 재현한 사례가 아니라 공개 가이드로 구성할 수 있는 검증 방식이다. (wrks.ai)

Claude Code로 자체 도구를 만드는 팀에도 비교 기준은 같다. 요청 횟수 옆에 입력·출력·캐시 토큰, 실제 비용, 검토 후 채택된 결과를 함께 남겨야 한다. 앤트로픽의 사용량 문서는 캐시에서 읽은 입력과 새 입력을 구별한다. 같은 토큰 총량이라도 구성에 따라 비용이 달라질 수 있다. 실사용자들 사이에서도 긴 작업의 소모를 걱정하는 한편 결과물 단위로 비용을 보자는 반응이 있다. (platform.claude.com)

다음 발표에서 필요한 것은 더 큰 숫자가 아니다

하나투어 사례는 전사 이용률과 여러 업무 적용 사례를 공개했다. 하지만 공개 정보만으로는 기능별 재사용률이나 결과 품질을 판단할 수 없다. 기업의 보안과 승인 절차가 작업 범위를 제한할 수 있다는 클코단의 의견은 고려할 만하다. 그 제약 아래서도 무엇이 실제로 완료됐는지는 별도로 확인해야 한다.

16억 토큰이 적은가보다 더 날카로운 질문은 따로 있다. 14만 번의 호출 가운데 어떤 업무가 반복됐고, 그 결과를 사람이 얼마나 고쳐야 했는가. 그 답이 나오기 전까지 토큰은 전사 AI의 활동량을 보여줄 뿐 에이전트가 일을 끝냈다는 증거가 되지는 않는다.

하나투어웍스AI기업 AXAI 에이전트토큰 사용량Claude Code

참고 링크

자주 묻는 질문

Q

하나투어 웍스AI의 16억 토큰은 월간 사용량인가요?

아닙니다. 하나투어는 2026년 8월 보도자료에서 7월 11일까지의 누적 사용량이라고 밝혔습니다. 같은 기간 호출 횟수는 약 14만 회입니다.

Q

토큰 사용량이 많으면 AI 에이전트 성과도 큰가요?

토큰은 AI가 처리한 입력과 출력의 양을 보여주지만, 업무가 정확히 끝났는지는 보여주지 않습니다. 반복 이용률, 결과물 채택률, 검토·수정에 든 시간을 함께 봐야 합니다.

Q

웍스AI에서 업무 에이전트는 어떻게 만드나요?

공식 가이드에 따르면 모델을 고르고 역할과 출력 형식을 프롬프트에 적은 뒤, 필요한 경우 참고 파일과 도구를 연결합니다. 도구 없이 요약·초안 작성용으로 사용할 수도 있습니다.

같은 주제 더 보기