Eliminé los anuncios de Meta que más gastaban de una campaña. Para ser precisos, dupliqué la campaña sin esos anuncios y la corrí en paralelo.
El algoritmo seguía escalándolos aunque ninguno alcanzara el target.
Mi campaña de tROAS tenía 5 anuncios que se comían el 27% del presupuesto, y ninguno alcanzaba mi target de 30% de D0 ROAS. Day 0 es una lectura temprana, pero en mi propia prueba el D0 ROAS predijo el ROAS D28 mejor que el costo por compra.
El setup
- Dupliqué la campaña de tROAS: mismo geo, mismo objetivo de optimización, mismo presupuesto total
- Eliminé a los que más gastaban, los 5 anuncios que Meta seguía escalando a pesar del D0 bajo
- Corrí ambas durante 30 días, $18,3K en la original contra $17,5K en la de prueba
- Comparé qué eligió escalar cada algoritmo
¿El algoritmo encontraría mejores performers de D0 si sus favoritos no estuvieran disponibles?
Qué eligió cada algoritmo
Los cinco anuncios con más gasto de cada campaña. iOS subscription app, Meta tROAS, 30 días, nombres aleatorizados. La escala va de 0% a 40% de D0 ROAS, la marca punteada es el target de 30% de D0 y las barras verdes lo alcanzaron.
Ninguno de los cinco principales de la campaña original alcanzó el target. De los cinco principales de la campaña de prueba, cuatro lo alcanzaron.
La prueba ganó 4 de las 5 semanas. Más útil todavía, el algoritmo encontró 6 creativos nuevos por encima del target que nunca tuvieron una oportunidad en la campaña original.
El algoritmo tiene favoritos
El gasto concentrado es normal mucho más allá de mi cuenta, y en el reporte de optimización de creativos 2025 de AppsFlyer el top 2% de los creativos de gaming se llevó el 53% del gasto total.
Y sus favoritos no siempre son tus mejores performers en D0. Eliminarlos movió el gasto hacia otros anuncios, y varios de ellos funcionaron mejor. Encontré el mismo hábito por país en una auditoría tROAS de $383K donde los geos fallidos mantuvieron su presupuesto.
Si pruebas esto, mantén los presupuestos iguales. Si la campaña de prueba gasta menos, no puedes saber si la mejora vino de la mezcla de creativos o del nivel de gasto. Además, dos campañas que corren en paralelo comparten audiencia, así que interpreta esto como una señal fuerte y no como un split test limpio.