Ringg corta custo em 90% com GPT-5.6 e resolve 65% das chamadas
Plataforma indiana integra modelos da OpenAI para voz, chat e WhatsApp e atinge nota 4,8 em sete milhões de atendimentos mensais.
Plataforma indiana integra modelos da OpenAI para voz, chat e WhatsApp e atinge nota 4,8 em sete milhões de atendimentos mensais.
A OpenAI e a Ringg anunciaram em 23 de setembro de 2026 que a plataforma indiana de atendimento reduziu os custos com modelos de inteligência artificial em cerca de 90% ao migrar operações em tempo real do GPT-4.1 para o GPT-5.6. O sistema automatiza tarefas por voz, chat, WhatsApp e web para clientes que compram seguros ou agendam consultas. A ferramenta encerra 65% das chamadas sem humano. O serviço atende empresas que precisam ampliar o suporte aos clientes sem elevar os custos e o atrito dos sistemas manuais.
A Ringg opera mais de 7 milhões de chamadas conectadas por mês e mantém nota média de satisfação de 4,8 entre os usuários. O volume cresceu na Índia. Para concluir pedidos sem travar a navegação, a camada de orquestração executa ações em CRMs, plataformas de tíquetes, sistemas de pagamento e APIs internas. A plataforma delega cada etapa a subagentes especializados em qualificação, suporte técnico, verificação de dados cadastrais, agendamento de serviços e encaminhamento para especialistas humanos.
O motor de conhecimento da plataforma combina filtros estruturados com busca semântica em bases de dados, planilhas CSV, arquivos em PDF e documentos corporativos. A triagem evita dados defasados. Quando uma conversa se estende e atinge a marca aproximada de 80.000 tokens, o sistema gera automaticamente um resumo estruturado com as informações essenciais. Esse mecanismo permite que o diálogo continue sem que o servidor precise reenviar todo o histórico anterior a cada nova interação com o usuário.
A arquitetura seleciona o modelo da OpenAI de acordo com a exigência de latência, capacidade de seguir comandos e impacto financeiro de cada solicitação. O GPT-4.1 ainda concentra a maior parte do tráfego em tempo real nas interações por voz e chat. A empresa aciona o GPT-5.6 Luna quando a tarefa pede menor tempo de resposta ou um custo unitário mais favorável. O corte financeiro guia as trocas.
Nos fluxos de pós-atendimento, a Ringg testou o GPT-5.6 Terra contra o Gemini 2.5 Flash para tarefas de resumo e classificação de sentimento das conversas. O Terra venceu a disputa. A ferramenta adotou o modelo após comprovar a precisão nas análises e a melhora na economia unitária, enquanto o GPT-5.6 Sol ficou responsável por avaliar resultados e sugerir ajustes em prompts. O cofundador da Ringg, Siddharth Tripathi, justificou a escolha: "A qualidade do modelo é apenas parte da equação. Também precisamos de baixa latência, uso confiável de ferramentas, acompanhamento rigoroso de instruções e economia que funcione em escala. A OpenAI nos deu o equilíbrio de que precisávamos".
Antes de liberar qualquer configuração em produção, a equipe testa os modelos contra conversas reais e fluxos simulados que alternam entre o inglês e termos de línguas regionais. A mistura linguística desafia os modelos. O comunicado divulgado pela OpenAI não informa, no entanto, qual porcentagem exata do tráfego total já opera sob o GPT-5.6 nem se a taxa de 65% de resolução se repete em todos os canais. A redução de 90% nos custos também se restringe às cargas de trabalho que a empresa considerou aptas para a migração sem sacrifício de velocidade.