El Informe de ROI de Markin para Equipos de Growth en EnterpriseLeer ahora
MARKIN

Reinforcement learning para marketing

También llamado: Contextual bandits

El reinforcement learning trata las decisiones del cliente como una secuencia, optimizando la recompensa acumulativa a largo plazo en lugar del siguiente clic. En marketing, generalmente aparece como contextual bandits, que equilibran la explotación de la mejor acción actual con la exploración de alternativas que podrían ser mejores.

Por qué es importante para el ARPU

Las secuencias importan para el ARPU: la acción que maximiza este mes puede suprimir el próximo trimestre. Optimizar la trayectoria es lo que separa el lifetime value de la conversión a corto plazo.