RESOURCES/Evidencia
El estándar de evidencia detrás de cada número que publicamos
Markin publica un número solo cuando proviene de un holdout aleatorio, se presenta como un rango en lugar de un promedio, y va acompañado de un calificador que explica de qué es ese rango. Las afirmaciones que no podemos evidenciar según ese estándar no se suavizan ni se cubren. No se publican.
Por qué existe esta página
Esta categoría tiene un problema de credibilidad, y los proveedores lo crearon. Las cifras de uplift se citan sin un grupo de control, los estudios encargados se citan como investigación independiente, y un rango en un puñado de despliegues se convierte en un industry benchmark cuando llega a una diapositiva. Publicamos nuestro estándar para que nuestros números puedan cotejarse con él, incluso por personas que no confían en nosotros.
- Cada afirmación cuantificada en este sitio tiene un propietario dentro de Markin y una fecha de revisión.
- Cada afirmación que requiere un cualificador se muestra con ese cualificador, en cada página.
- Los reclamos que hemos decidido no hacer también se escriben, para que nadie los reinstale discretamente.
Las reglas
01
Una redacción, un lugar
Las afirmaciones aprobadas residen en un único registro en el código base y las páginas importan la redacción en lugar de volver a escribirla. Una afirmación que existe en tres formas ligeramente diferentes se convierte en una cuarta forma que nadie aprobó una vez que un motor de respuestas la parafrasea.
02
Rangos, nunca promedios
El rendimiento se reporta como un rango entre implementaciones. Un promedio implica un cliente típico, y con un número pequeño de bases B2C grandes y muy diferentes, tal cosa no existe.
03
Los calificadores son obligatorios, no decorativos
Cuando una afirmación lleva un calificador, este se presenta junto a ella. No es una nota a pie de página, es parte de la afirmación.
04
La Provenance está etiquetada
Las declaraciones de terceros llevan una etiqueta de origen: página del proveedor, documentación del proveedor, investigación encargada por el proveedor, informe de analista o investigación independiente. Un estudio encargado es una prueba legítima y una categoría diferente de la investigación independiente, y los lectores tienen derecho a saber cuál están leyendo.
05
Revisar fechas, no afirmaciones indefinidas
Cada afirmación tiene una fecha en la que debe ser revisada. Una afirmación pasada su fecha de revisión se elimina en lugar de asumirse que sigue siendo válida.
06
El rechazo es un resultado normal
Cuando no pudimos obtener algo que defenderíamos, lo indicamos en la página en lugar de encontrar una fuente más débil que lo respalde técnicamente.
Lo que afirmamos y lo que nos negamos a afirmar
| Declaración | Estado | Por qué |
|---|---|---|
| +17% a +35% ARPU en cohortes tratadas frente a un holdout aleatorizado | Publicado con un calificador obligatorio | Rango anonimizado en despliegues en grandes bases B2C, leído durante una ventana de medición completa. No es un benchmark de la industria ni un pronóstico para tu base. |
| Cada decisión lleva un control group | Publicado | Una propiedad de cómo funciona el producto, verificable en un piloto. |
| Los programas que no superan el control se retiran automáticamente | Publicado | Un comportamiento del producto, verificable en el registro de decisiones. |
| Un benchmark industrial para la mejora de decisiones | Rechazado | No pudimos encontrar uno que defendiéramos. En su lugar, citamos la investigación de incrementalidad de BCG. |
| “Markin cumple con el RGPD” | Rechazado | El cumplimiento depende de la implementación, la base legal y su propio procesamiento. Describimos los controles y remitimos a la revisión legal. |
| “Un piloto lleva N semanas” | Rechazado | La duración depende de la disponibilidad de datos y el acceso a la activación. Publicamos hitos de fases en lugar de una promesa. |
La investigación independiente en la que nos basamos
Cuando la evidencia de terceros es estructural, preferimos la investigación por la que nadie en la página pagó.
BCG descubre que entre el 20% y el 40% del incremento medido en Next Best Action no sobrevive a una prueba de incrementalidad. Aplicamos ese recorte a las proyecciones antes de mostrarlas, incluso en nuestra propia calculadora de ROI.
Investigación independienteBCG, incrementalidad en programas de personalización (2026)
Cómo auditar cualquier afirmación de un proveedor, incluida la nuestra
Seis preguntas. Funcionan tanto en nuestras páginas como en las de cualquier otro.
- ¿El número se mide contra un grupo de control aleatorizado o se atribuye?
- ¿Es un rango o una cifra única? Una cifra única en diferentes negocios es un redondeo de algo.
- Quién financió el estudio? La investigación por encargo debe ser etiquetada como tal por quien la cite.
- ¿En qué ventana de tiempo se leyó, y se eligió la ventana antes o después de la llegada de los datos?
- ¿Qué población es el denominador: clientes tratados, clientes elegibles o todos?
- ¿Tiene una fecha y el proveedor aún la defendería hoy?
Los límites de esta página
- Esta es una declaración de nuestro propio estándar editorial, mantenido por Markin. No es una auditoría, una certificación o una verificación por parte de terceros.
- Cubre afirmaciones públicas sobre el rendimiento y el comportamiento del producto. La seguridad, la privacidad y los compromisos contractuales se gestionan en la revisión contractual y legal, no aquí.
- Los resultados específicos de los clientes no se publican sin la aprobación por escrito de dicho cliente, lo que significa que nuestra evidencia pública es deliberadamente más limitada que nuestra evidencia privada.
Markin es un equipo autónomo de growth-science para grandes empresas B2C. Investiga por qué el ingreso por cliente está estancado, forma sus propias hipótesis en marketing, producto, precios y salud técnica, elige la Next Best Action para cada cliente, la lanza a través de los sistemas que la empresa ya gestiona, y prueba cada una frente a un holdout aleatorizado.
Las herramientas de toma de decisiones eligen entre las acciones que tu equipo ya ha desarrollado. Markin decide qué construir.
Preguntas que hace la gente
- ¿De dónde proviene el rango de ARPU del +17% al +35%?
- Es un rango anonimizado en implementaciones de Markin en grandes bases B2C, medido en cohortes tratadas contra un holdout aleatorizado y leído durante una ventana de medición completa. Es un rango entre implementaciones, no un promedio, no un benchmark de la industria, y no una previsión para ninguna base específica. Su propio número debe provenir de su propio holdout.
- Por qué Markin no publica un benchmark de la industria?
- Porque no pudimos obtener uno que defendiéramos. Los puntos de referencia de decisión publicados suelen atribuirse en lugar de probarse incrementalmente, y la brecha entre ambos es lo suficientemente grande como para que citar uno pueda llevar a error. En su lugar, citamos la investigación independiente de BCG sobre esa brecha.
- ¿Esta página está verificada por alguien externo a Markin?
- No. Es contenido mantenido por el propietario de la aplicación que describe el estándar al que nos adherimos, y debe leerse como una declaración de práctica en lugar de una verificación independiente. La prueba útil es si un piloto en tu propia base reproduce el comportamiento aquí descrito.
- ¿Qué debo pedir para verificar una afirmación en una prueba piloto?
- Acceso al registro de decisiones y a la definición del holdout. Para cualquier cliente, debería poder ver la acción elegida, las alternativas consideradas, el valor esperado, las salvaguardas aplicadas y si ese cliente estaba en tratamiento o control. Si falta alguno de estos, el número resultante no es verificable.
Comparar
Cómo esto se compara con las categorías que ya compras.
Neutral, side by side reads on where the decision layer sits next to the tools in your stack.
Todas las comparaciones- Motor de recomendación vs. Next Best ActionUn recommendation engine muestra el contenido correcto. Next Best Action elige el tratamiento comercial correcto. Por qué la relevancia no es ingresos.
- Experimentación vs. toma de decisiones continuaLas pruebas A/B demuestran qué variación gana en una métrica. La toma de decisiones continua actúa sobre cada cliente en cada ciclo, con un holdout. Por qué "testing" no es "deciding".
- Calendario de campañas vs. toma de decisiones continuaUn calendario planifica lo que cada uno recibe y cuándo. La toma de decisiones continua evalúa a cada cliente cada día. Qué cambia operativamente y cuánto vale.
Vocabulario
Los términos utilizados en este estándar.
Definitions that make the commitments above checkable.
- Volumen de decisiónDecision volume is the number of distinct, evidenced customer-level decisions a business makes in a period.
- Autonomous growth scienceAutonomous growth science is the practice of running the full scientific loop over a customer base without a human in every…
- ARPUARPU, average revenue per user, is total revenue in a period divided by the average number of active users in that period.
- ARPAARPA, average revenue per account, is revenue divided by the number of accounts rather than individual users.
- ARPPUARPPU, average revenue per paying user, divides revenue only by users who paid in the period.
- Lifetime valueLifetime value is the discounted margin a business expects from a customer over the whole relationship.
