CI&T, Databricks e uma das empresas líderes em análise de crédito

Ganhando eficiência e escala em gerenciamento de dados
O projeto em parceria com a marca impulsionou uma economia de 20M BRL em 18 meses, além de 75% em redução no tempo de implementação do cliente utilizando Databricks.

O Desafio

A parceria entre CI&T e a empresa do setor de análise de crédito começou em 2017 com o propósito de construir o Cadastro Positivo.

O score de crédito de pessoas físicas no Brasil sempre foi calculado a partir das contas não pagas, ou seja, a partir da inadimplência. Por sua vez, o Cadastro Positivo surgiu a partir de uma mudança na legislação visando contribuir para o score todas as contas pagas em dia pelo consumidor. Com um volume muito maior de dados a serem processados, a companhia tinha um desafio tecnológico de construir uma estrutura robusta de modo a suportar essa nova realidade.

Soluções

O trabalho em conjunto entre as duas empresas foi realizado em três frentes.
Nessas frentes, olhamos de maneira transversal a arquitetura de dados de nosso cliente, desde habilitar o Cadastro Positivo até recriar a infraestrutura legada anterior.
01.

A construção do Cadastro Positivo;

02.

Plataforma de Gestão de Dados: migração de uma solução com alto custo de licenciamento e baixa escalabilidade para uma mais moderna, econômica e com melhor lead time (entrega da solução) e;

03.

Plataforma de Análises:  desenvolvimento de tecnologia para democratização do score de crédito da empresa para seus clientes. Agora, grandes bancos, tem autonomia na criação de modelos de dados a partir de suas demandas, sem a centralização da provedora dos dados. 

Cadastro positivo: usando Databricks para aprendizagem rápida

Para aumentar o poder computacional dos clusters, a empresa tomou a decisão de ter uma infraestrutura híbrida, com parte do processamento dentro da infraestrutura on premises, e outra parte na nuvem.

Usando AWS houve uma escala da infraestrutura para processar dados, e o Databricks foi usado para remover atrito nas áreas de negócios em sua utilização de Big Data. Databricks é um parceiro que apoia a execução de códigos complexos.

Com facilidade, é possível criar um cluster poderoso de processamento de dados e um ambiente para formulação das regras e códigos do negócio, ou seja, a área de dados tem espaço para experimentar, sem a necessidade de uma preocupação imediata com a estrutura de dados. Com Databricks, os times de engenharia contruiam experimentos de forma ágil, para testes e aprendizagem, assim como os times de negócio o usaram para criar modelos de machine learning. 

Dessa forma, as áreas puderam experimentar de forma rápida novas soluções, novos modelos de crédito etc. A CI&T foi o conector entre as áreas para adoção do Databricks. Mais de 120 pessoas engenheiras trabalharam no projeto.

Saiba mais sobre nosso trabalho