End-to-end Data Pipeline for Efficient Game Analytics
Questo articolo propone una pipeline di dati basata sul campionamento che sfrutta la distribuzione stabile di Zipf dei log di gioco per identificare e instradare efficientemente le "hot keys" dominanti senza il monitoraggio dell'intero flusso, ottenendo così un miglioramento del throughput del 209,7% e una riduzione significativa dell'utilizzo della CPU rispetto alle esistenti soluzioni di bilanciamento del carico.