CI&T, Databricks y una de las empresas líderes en análisis de crédito

Ganando eficiencia y escala en la gestión de datos
El proyecto en alianza con la marca produjo ahorros de 20 millones de reales 18 meses, además de una reducción del 75% del tiempo de implementación del cliente utilizando Databricks

EL DESAFÍO

La alianza entre CI&T y la empresa del sector de análisis de crédito comenzó en 2017 con el propósito de construir el Registro Positivo (Bando de Datos de Buenos Pagadores).

El puntaje de crédito de las personas en Brasil siempre se calculó a partir de las cuentas impagas, es decir, a partir de la morosidad. A su vez, el Registro Positivo surgió a partir de un cambio en la legislación con el objetivo de contribuir al puntaje de todas las cuentas pagadas en su día por el consumidor. Con un volumen mucho mayor de datos que serán procesados, la compañía se enfrentó al desafío tecnológico de construir una estructura robusta para soportar esta nueva realidad.

SOLUCIONES

El trabajo conjunto entre ambas empresas se realizó en tres frentes:
En estos frentes, observamos de manera transversal la arquitectura de datos de nuestro cliente, desde habilitar Registro Positivo hasta recrear la infraestructura heredada anterior.
01.

La construcción del Registro Positivo;

02.

Plataforma de Gestión de Datos: migración de una solución con un alto costo de licencia y baja escalabilidad a una más moderna, económica y con mejor lead time (entrega de la solución) y;

03.

Plataforma de Análisis: desarrollo de tecnología para democratizar el puntaje de crédito de la empresa para sus clientes. Ahora, los grandes bancos tienen autonomía para crear modelos de datos a partir de sus demandas, sin la centralización de la proveedora de datos.

Registro positivo: usando Databricks para aprendizaje rápido

Para aumentar el poder computacional de los clusters, la empresa tomó la decisión de tener una infraestructura híbrida, con parte del procesamiento dentro de la infraestructura on premises y otra parte en la nube.

El uso de AWS escaló la infraestructura para procesar datos y se utilizó Databricks para eliminar la fricción en las áreas de negocios en su utilización de Big Data. Databricks es un aliado que apoya la ejecución de códigos complejos.

Se puede crear fácilmente un cluster poderoso de procesamiento de datos y un entorno para formular reglas y códigos del negocio, es decir, el área de datos tiene espacio para experimentar, sin necesidad de una preocupación inmediata con la estructura de datos. Con Databricks, los equipos de ingeniería construyeron experimentos de forma ágil, para pruebas y aprendizajes, así como los equipos de negocio lo usaron para crear modelos de machine learning. 

De esta forma, las áreas pudieron experimentar de forma rápida nuevas soluciones, nuevos modelos de crédito, etc. CI&T fue el conector entre las áreas para la adopción de Databricks. Más de 120 ingenieros trabajaron en el proyecto.


Conoce nuestro trabajo