Ringg, OpenAI의 GPT‑5.6 활용해 고객 전화 65% 자동화, 비용 90% 절감
OpenAI GPT‑5.6 기반 Ringg의 다국어 AI 에이전트가 음성, 채팅, WhatsApp, 웹 등에서 들어오는 요청의 3분의 2까지 해결하고, 월 700만 건 이상의 전화를 처리하면서 모델 비용을 약 90% 절감한다.
사건 개요, 주체 및 시점
2026년 9월 23일, Ringg는 최신 GPT‑5.6 모델을 기반으로 한 AI‑구동 컨택센터 플랫폼이 인간 개입 없이 일상적인 고객 전화를 최대 65 %까지 처리할 수 있다고 발표했다. 아시아‑태평양 및 오세아니아 지역에 기반을 둔 이 스타트업은 새로운 아키텍처가 음성, 채팅, WhatsApp, 웹 전반에 걸쳐 다국어 지원을 제공하며, 이전 GPT‑4.1 배포 대비 비용을 크게 절감한다고 주장한다.
배포 상세 내용
- 규모와 성능: 시스템은 매월 700만 건 이상의 연결 전화를 처리하며, 평균 고객 만족도(CSAT) 점수는 4.8점이다.
- 비용 효율성: 실시간 워크로드를 GPT‑4.1에서 GPT‑5.6으로 전환함으로써 Ringg는 모델 비용을 거의 90 % 절감했으며, 지연 시간과 품질은 유지한다.
- 모델 오케스트레이션: Ringg 플랫폼은 각 상호작용을 가장 적합한 OpenAI 모델에 라우팅한다. GPT‑4.1은 음성·채팅 트래픽 대부분을 담당하고, 속도·가격·성능이 더 적합할 경우 GPT‑5.6 “Luna”가 사용된다. GPT‑5.6 “Terra”는 통화 후 요약·감성 분류 등 분석 작업을, GPT‑5.6 “Sol”은 평가·프롬프트 튜닝 워크플로를 지원한다.
- 툴 통합: 에이전트는 CRM, 티켓 시스템, 결제 게이트웨이, 일정 관리 앱, 내부 API 등 기업용 도구를 호출해 정책 확인, 계정 조회, 예약 잡기, 전문가에게 전체 컨텍스트와 함께 핸드오프하는 등 다단계 작업을 수행한다.
- 지식 처리: 구조화된 필터링과 PDF·CSV 등 비정형 비즈니스 문서에 대한 의미 검색을 결합한 하이브리드 지식 시스템을 도입해 최신 기업 정보를 기반으로 질문에 답변한다.
- 평가 파이프라인: 프로덕션 배포 전, Ringg는 과거 대화 데이터와 시뮬레이션 흐름을 오프라인 평가 플랫폼에 투입한다. 결과는 프롬프트 개선 사이클에 반영돼 품질‑비용의 지속적인 순환을 만든다. 한 테스트에서 GPT‑5.6 “Terra”는 요약 정확도와 감성 분석에서 Google Gemini 2.5 Flash를 제치고, 지역 언어 입력에 대해 최대 97 % 정확도를 기록했다.
- 프로덕션 보호 장치: 라우팅 레이어가 지역별 지연 시간과 엔드포인트 상태를 모니터링해 성능 저하 노드에서 트래픽을 자동 전환한다. 버전 관리된 배포와 특화된 알림 시스템은 문제를 격리해 성능과 비용을 동시에 보호한다.
- 고객 성과:
- Policybazaar: 일일 57 000건 이상의 요청을 처리하며, 67 %의 전화를 인간 없이 해결한다. 평균 응답 시간은 8‑12분에서 60초 이하(≈ 88 % 개선)로 단축됐다.
- Practo: 3초 미만의 응답 시간으로 85 %의 최초 통화 해결률을 달성했으며, 운영 비용을 70 % 절감하고 하루 1 000건 이상의 예약을 처리한다.
- Groww: IPO·선물·옵션 관련 인바운드 문의의 72 %를 셀프서비스로 해결하고, 평균 처리 시간은 2분이다.
- 브라우저 에이전트: OpenAI의 컴퓨터 사용 기능을 활용해 Ringg는 웹 브라우저 내에서 KYC, IT 트러블슈팅, 사고 지원, 청구 처리 등을 안내하는 에이전트를 프로토타이핑 중이며, 음성·메시징·웹 채널 전반에 걸쳐 컨텍스트를 유지한다.
- 창업자 발언: “모델 품질만이 전부는 아니다. 낮은 지연 시간, 안정적인 툴 사용, 강력한 명령 수행 능력, 그리고 규모에 맞는 경제성이 모두 필요하다. OpenAI가 우리에게 필요한 균형을 제공했다”고 Ringg 공동창업자 Siddharth Tripathi가 말했다. 그는 또한 OpenAI의 전용 Slack 지원과 직접적인 엔지니어링 접근이 마이그레이션을 가속화하고 엔지니어링 불확실성을 크게 줄였다고 덧붙였다.
산업 현황 및 경쟁 구도
Ringg의 성과는 컨택센터 경제 구조의 전반적인 변화를 보여준다. 기업들은 인력 기반 확장 대신 고용량·다국어 상호작용을 저비용으로 처리할 수 있는 AI 에이전트로 전환하고 있다. 내부 벤치마크에 따르면 OpenAI의 GPT‑5.6 제품군은 Google Gemini 2.5 Flash보다 명령 준수, 툴 호출 신뢰성, 다국어 정확도 측면에서 우수한 것으로 나타났다—대규모 고객 서비스 배포에 핵심적인 평가 기준이다. 스타트업 지원에 집중한 OpenAI의 최근 전략, 즉 간소화된 API 접근성과 신속한 엔지니어링 지원이 지역 기업들의 실시간·성과 중심 자동화 수요를 충족시키면서 효과를 발휘하고 있다.



