← 목록으로

"AI가 회계사보다 빠르고 정확"…정확도 100%·비용은 49분의 1

요약
  • 최신 AI 모델이 월말 결산 등 정형화된 회계 과제에서 공인회계사보다 더 빠르고 정확한 결과를 낸 것으로 나타났다.
  • 머코어 연구진의 논문에 따르면, 클로드 오퍼스 5는 모든 시도에서 정확도 100%를 기록했으며 비용도 회계사 대비 49분의 1 수준에 그쳤다.
  • 다만 이번 연구는 AI가 회계사 업무 전체를 대체한다는 의미는 아니며, 정형화된 특정 과제에 국한된 결과라고 연구진은 선을 그었다.
최첨단 AI 모델이 이제 초급 회계사, 심지어 연구 대상 중 가장 뛰어난 회계사보다 더 빠르고 정확한 것으로 나타났다. [사진=머코어] 최첨단 AI 모델이 이제 초급 회계사, 심지어 연구 대상 중 가장 뛰어난 회계사보다 더 빠르고 정확한 것으로 나타났다. [사진=머코어]

[디지털데일리 이상일기자] 최신 인공지능(AI) 모델이 월말 결산 등 정형화된 회계 과제에서 공인회계사(CPA)보다 빠르고 정확한 결과를 냈다는 연구가 나왔다. 다만 연구진은 회계사 업무 전체를 대체한다는 의미는 아니라고 선을 그었다.

AI 기반 채용 및 평가 스타트업인 머코어(Mercor) 아덴 바튼 연구원은 1일 '벤치마크를 위한 인간 기준점: AI, 이제 초급 회계사 능가' 논문을 통해 이같이 밝혔다.

논문을 위해 이번 연구에선 에이펙스(APEX) 회계 벤치마크 과제를 간소화해 주니어 회계사 12명에게 맡겼다. 에이펙스는 기업용 재무 플랫폼 램프(Ramp)와 머코어가 공동으로 개발해 지난 7월 발표한 AI 회계 에이전트 성능 평가 지표다.

참가자는 평균 경력 5년 반으로 모두 CPA 자격을 갖췄다. 이들은 실제와 유사한 월말 결산 시나리오 4개를 수행했다.

업무 파일에서 수치를 찾아 계산하고 결과표를 작성하는 방식이다. 연구는 당초 AI 활용에 따른 성과 향상을 측정하려 했다. 모델 단독 점수가 만점이어서 AI를 쓰지 않은 사람과 AI를 비교하는 방식으로 바꿨다.

회계사 정확도는 0%에서 약 90%까지 분포했다. 대부분 30~180분이 걸렸다. 평균 점수는 약 37%다. 클로드 오퍼스 5(Claude Opus 5)는 20차례 시도 모두 정확도 100%를 기록했다. 과제당 소요 시간은 10분 이내였다. 평가 기준 1개 충족당 비용은 클로드 오퍼스 5가 0.21달러(약 280원), 회계사가 10.35달러(약 1만4000원)였다. 미국 회계사 평균 임금 기준으로 49배 차이다.

모델 성능 변화도 빨랐다. 연구진에 따르면 18개월 전에는 최고 모델도 회계사 평균에 못 미쳤다. 오픈AI o3는 2025년 봄 회계사 평균을 넘었다. GPT-5는 약 69%를 기록했다. 최근 최첨단 모델은 100%에 근접했다. 큐원3.5-122B(Qwen3.5-122B) 등 일부 저가·개방형 모델은 여전히 회계사 평균 아래다.

연구진은 한계도 밝혔다. 과제는 꼼꼼함, 파일 검색, 지시 이행 등 AI가 강한 영역에 맞춰졌다. 고객 소통, 질문 제기, 맥락 구축 등은 측정하지 못했다. 동료 도움이나 축적된 업무 맥락도 없는 환경이었다.

그럼에도 연구진은 모델 발전이 멈추더라도 향후 몇 년간 회계 분야에 상당한 변화와 생산성 향상이 있을 것으로 내다봤다. 벤치마크 목표도 기존 업무 수행 측정에서 이전에 불가능했거나 비용 탓에 못하던 작업 측정으로 옮겨가야 한다고 제안했다.

그냥 목록으로
원문 보기 ↗