AI 콜센터 도입 비용, 견적서를 흔드는 5개 항목
같은 요구사항인데 견적 총액이 두 배 넘게 벌어집니다. 통화량·평균 통화시간·모델 등급·연동 범위·사람 경로 — 금액이 벌어지는 다섯 자리를 벤더 공개 정가로 분해했습니다.
견적서를 세 장 받았습니다.
요구사항은 같은 문서로 보냈는데 총액은 두 배 넘게 벌어져 있습니다. 어느 쪽이 부풀렸는지부터 묻고 싶어지지만, 실제로 금액이 벌어지는 자리는 대체로 정해져 있습니다. AI 콜센터 도입 비용은 총액 한 줄로 비교되는 물건이 아니라, 몇 개의 변수 위에 얹힌 함수에 가깝기 때문입니다.
이 글은 그 변수 가운데 견적을 가장 크게 흔드는 다섯 개를 분해한 것입니다. 가격표를 공개하는 글은 아닙니다. 아래에 나오는 금액은 전부 벤더가 웹에 공개한 정가이고, 기관명과 조회 시점을 문장 안에 적어 뒀습니다.

금액은 전부 벤더가 웹에 공개한 정가(2026-08-03 조회)이며, 특정 공급사의 실제 견적이나 계약 단가가 아닙니다.
1. 청구 단위는 통화 건수가 아니라 통화 분이다
견적을 검토할 때 대부분 월 통화 건수부터 씁니다. 그런데 통신 구간에서 실제로 청구되는 단위는 건수가 아니라 분입니다. 이 차이가 첫 번째 오차를 만듭니다.
Twilio가 공개한 한국 음성 요금표(2026년 8월 3일 조회 기준)를 보면 구조가 분명합니다.
Twilio 한국 음성 — 공개 정가 (2026-08-03 조회)
발신 · 유선 $0.0552 / 분
발신 · 이동전화 $0.0524 / 분
수신 $0.0040 / 분
번호 임대 $1.15 / 월 부터
녹취 $0.0025 / 분 (별도 과금)
눈에 띄는 건 발신과 수신의 격차입니다. 수신 분당 단가가 발신의 13분의 1 수준입니다. 같은 3만 콜이라도 인바운드 상담을 받는 조직과 아웃바운드로 거는 조직은 통신 원가의 출발선 자체가 다릅니다. 견적서 두 장을 비교하기 전에 인바운드와 아웃바운드 비중부터 맞춰야 하는 이유가 여기 있습니다.
통화 건수를 맞춰 놓고 채널 방향을 안 맞추면, 그 비교는 서로 다른 두 사업의 비교가 됩니다.
2. 평균 통화시간 30초가 만드는 차이
두 번째 변수는 평균 통화시간입니다. 여기서 견적이 가장 조용하게 흔들립니다.
평균 통화시간을 2분 30초로 잡은 견적과 3분으로 잡은 견적이 있다고 해 보겠습니다. 30초 차이입니다. 체감상 작아 보이지만 비율로는 20%이고, 분당 과금 구조에서 20%는 그대로 청구서에 옮겨 갑니다.
월 3만 콜 기준으로 계산하면 차이는 15,000분입니다. 위의 이동전화 발신 공개 정가를 그대로 적용하면 월 786달러 차이가 납니다. 통신 구간 하나에서만 그렇습니다. 모델 사용료와 녹취 보관료는 대체로 통화 시간에 비례하므로, 실제 총액에서는 이 20%가 여러 줄에 동시에 얹힙니다.
- 하나: 위 계산은 벤더 공개 정가를 그대로 대입한 값입니다. 특정 공급사의 실제 견적이나 계약 단가와는 무관합니다
- 둘: 그래서 평균 통화시간은 "예상치"가 아니라 "합의된 가정"이어야 합니다. 현재 상담 로그에서 뽑은 실측값을 양쪽에 똑같이 넣고 비교하는 편이 안전합니다
3. 모델 등급 한 칸이 세 배를 만든다
세 번째는 음성 모델 등급입니다. 견적서에는 보통 "실시간 음성 AI"라는 한 줄로만 적히는데, 그 한 줄 안에 세 배가 들어 있습니다.
OpenAI가 공개한 API 가격표(2026년 8월 3일 조회 기준)를 보면 이렇습니다.
| 항목 | 상위 등급 | 경량 등급 | 배수 |
|---|---|---|---|
| 실시간 오디오 입력 (100만 토큰) | gpt-realtime $32 | gpt-realtime-mini $10 | 3.2배 |
| 실시간 오디오 출력 (100만 토큰) | gpt-realtime $64 | gpt-realtime-mini $20 | 3.2배 |
| 음성 인식 (분당) | gpt-4o-transcribe $0.006 | gpt-4o-mini-transcribe $0.003 | 2배 |
| 음성 합성 (100만 자) | tts-1-hd $30 | tts-1 $15 | 2배 |
같은 1분짜리 통화를 처리해도 어느 칸을 골랐느냐에 따라 모델 원가가 세 배 갈립니다. 그리고 이 선택은 순수한 비용 문제가 아닙니다. 경량 등급은 단순 조회나 예약 확인처럼 발화 패턴이 좁은 통화에서는 차이를 거의 못 느끼지만, 사투리가 섞이거나 배경 소음이 있거나 고객이 말을 끊고 들어오는 통화에서는 인식 실패가 눈에 띄게 늘어납니다.
그래서 등급은 전체가 아니라 통화 유형별로 나눠 잡는 편이 맞습니다. 견적서에 "모델 등급"이 한 줄로만 적혀 있다면, 어떤 통화에 어떤 등급을 쓰는지부터 물어보시는 게 좋습니다.
한 가지 덧붙이면, 등급을 낮춰서 아낀 금액이 다른 줄에서 다시 나가는 경우가 있습니다. 인식이 실패하면 고객이 같은 말을 반복하고, 반복하는 만큼 통화 시간이 늘고, 늘어난 시간은 다시 분당 과금으로 돌아옵니다. 결국 사람으로 넘어가면 그 통화의 원가는 처음부터 사람이 받은 것보다 높아집니다. 경량 등급이 유리한 구간은 인식 실패율이 낮게 유지되는 통화 유형에 한정되고, 그 범위는 실제로 돌려 보기 전까지는 잘 안 보입니다.
4. 연동 범위가 견적서에서 가장 안 보인다
네 번째 변수는 금액이 가장 크게 벌어지면서 문서상으로는 가장 흐릿한 자리입니다. "CRM 연동 포함"이라는 여섯 글자가 뜻하는 범위가 회사마다 다릅니다.
읽기만 하는가, 쓰기까지 하는가
고객 정보를 조회해서 읽어 주는 것과, 통화 결과를 티켓으로 만들어 상태를 바꾸고 담당자를 배정하는 것은 완전히 다른 작업량입니다. 앞쪽은 조회 API 하나로 끝나지만, 뒤쪽은 실패했을 때 어떻게 되돌릴지까지 설계해야 합니다. 중복 티켓이 생기거나 상태가 어긋난 채 남는 사고가 여기서 나옵니다.
응답 시간을 누가 책임지는가
기간계 조회가 2초 걸리는 순간, 통화는 그 2초 동안 침묵합니다. 이걸 해결하는 방법은 두 가지입니다. 조회를 미리 걸어 두거나, 대기 중임을 말로 채우거나. 어느 쪽이든 설계와 테스트가 붙고, 견적서에서 이 줄이 빠져 있으면 그 금액은 나중에 변경 요청으로 돌아옵니다.
5. 사람 경로를 얼마나 열어 두느냐
다섯 번째는 자동화하지 않기로 한 부분의 비용입니다. 자동화 견적서인데 사람 이야기가 왜 나오냐고 하실 수 있는데, 실제 운영 원가에서 이 줄이 자주 가장 큽니다. 그리고 이건 벤더 견적서에 아예 안 적히는 경우가 많습니다. 벤더가 감추는 게 아니라 벤더의 범위 밖이기 때문입니다.
인계가 몇 초 안에 일어나야 하는가
자동화가 막혔을 때 사람으로 넘어가는 시간을 30초로 잡느냐 3분으로 잡느냐에 따라 필요한 대기 인원이 달라집니다. 30초를 지키려면 통화 시간대에 항상 여유 인력이 앉아 있어야 하고, 3분을 허용하면 대기열로 흡수할 수 있습니다. 견적서의 어느 줄에도 안 적히지만 조직도에는 즉시 반영되는 숫자입니다.
인계된 고객이 처음부터 다시 설명하는가
이 질문의 답이 "그렇다"이면 사람 상담사의 처리 시간이 늘어납니다. 자동화 구간에서 확보한 정보를 인계 화면으로 넘기는 작업은 4번에서 말한 연동 범위와 같은 줄에 있는데, 견적서에서는 대개 따로 떨어져 있거나 아예 빠져 있습니다. 자동화율은 올라갔는데 상담사 1건당 처리 시간도 같이 올라가는 사례가 여기서 나옵니다.
야간 운영 여부까지 포함하면 이 세 가지가 사람 경로의 원가를 결정합니다. 벤더 견적서에서는 안 보이니 도입 검토 문서 쪽에 따로 한 칸을 만들어 두시는 편이 낫습니다.
6. 이 계산이 통하지 않는 경우
지금까지의 분해는 통화량이 어느 정도 쌓인 조직을 전제로 합니다. 다음 세 경우에는 위 방식이 잘 안 맞습니다.
- 월 통화량이 수천 건 이하일 때. 이 구간에서는 분당 변동비 총합보다 연동·설계·운영 고정비가 훨씬 큽니다. 분당 단가를 소수점까지 비교해도 총액 순위가 안 바뀝니다. 이때는 고정비 항목만 놓고 비교하시는 게 낫습니다
- 통화가 규제 대상일 때. 금융권 본인확인이나 의료 정보가 오가는 통화는 녹취 보관 기간과 감사 요건이 아키텍처를 먼저 결정합니다. 변동비 최적화는 그다음 문제입니다
- 통화 목적이 비용 절감이 아닐 때. 아웃바운드 세일즈처럼 통화가 매출을 만드는 경우, 통화를 짧게 만드는 최적화는 목표와 반대 방향입니다
7. 정리 — 비교하기 전에 맞춰야 할 다섯 줄
견적서를 나란히 놓기 전에 다음 다섯 개를 양쪽에 똑같이 박아 넣으시면, 남는 차이가 진짜 실력 차이입니다.

다섯 줄을 고정하지 않은 채로 총액만 비교하면, 그 비교는 서로 다른 두 사업의 비교가 됩니다.
BringTalk는 도입 검토를 이 다섯 줄부터 시작합니다. 총액을 먼저 뽑지 않고, 현재 상담 로그에서 방향별 건수와 평균 통화시간 실측값을 뽑은 다음 통화 유형을 나눕니다. 그래야 어느 유형에 어느 등급을 쓸지, 어느 시스템에 쓰기 권한이 필요한지가 숫자로 정해집니다. 순서를 바꾸면 견적은 나오지만 그 견적이 왜 그 금액인지는 끝까지 설명되지 않습니다.
운영 중인 상담 로그를 기준으로 이 다섯 줄을 먼저 채워 보고 싶으시다면, 함께 정리해 드립니다.
공개 정가 기준선(2026-08-03 조회): Twilio 한국 발신 이동전화 분당 $0.0524 · 수신 분당 $0.0040 · OpenAI gpt-realtime 오디오 출력 100만 토큰 $64, 경량 등급은 그 3.2분의 1. 견적을 흔드는 건 이 단가가 아니라, 여기에 곱해지는 다섯 개의 가정입니다.
