Referencia técnica · Paso 7b · Combinaciones — scoring
Cómo se puntúan y ordenan los combos. La maquinaria estadística (lift, p-value, IC, breakeven) reusa la del paso de lift aplicada al combo; lo específico acá es el FDR sobre el espacio de combos, la sinergia como diagnóstico, y el composite z_norm puro.
Cada combo se trata como una "regla" nueva y se le aplica la misma maquinaria del lift. Los combos son todos ALPHA (buscan concentrar aciertos).
El p-value binomial, el IC de Katz y el breakeven son las mismas fórmulas del Step 6, aplicadas ahora a la señal del combo. Lo que cambia es el eje del FDR (§2) y el ranking (§4).
La corrección de falso descubrimiento se aplica igual que en el lift, pero el denominador ya no es el universo de reglas — es el universo de combinaciones evaluadas, que es mucho mayor.
Con ~100 reglas de entrada, el 2-way evalúa del orden de C(100,2) ≈ 4.950 combos. Corregir sobre ese m_total exige p-values mucho más chicos que sobre m = 100 → previene los falsos descubrimientos que introduce la búsqueda combinatoria. Sin esto, el paso sería data snooping por diseño.
¿El combo rinde más de lo que se esperaría si sus reglas fueran independientes respecto al target? Es un diagnóstico — no entra al ranking.
sinergia genuina — el combo excede la suma de efectos
aditivo — los efectos son independientes
redundancia — las reglas capturan el mismo régimen
No entra al ranking porque una sinergia alta no siempre es económicamente valiosa — puede surgir de artefactos de baseline muy bajo o muestras chicas. El ranking primario usa el z_norm, más robusto (incluye n vía z_score).
El composite ordena los combos sobrevivientes. A diferencia del lift, acá es z_norm puro — sin mezclar información mutua.
Se usa z_norm puro porque mezclar assoc_lift o MI premiaría la co-ocurrencia de antecedentes (target-agnóstica), que suele indicar redundancia — no descubrimiento. El z_score ya incluye la magnitud del edge y la estabilidad estadística (vía n_eval) en un solo número. El composite ordena; el FDR decide.
Viene de 7a: medidas de interacción, generación AND, roles trigger/context, modo n_way=1.
Fuentes:
· domain/combinations/scoring.py — combo_lift, z_score, FDR (m_total=combos), _compute_synergy, composite z_norm, IC Katz
· domain/combinations/dedup.py — dedup Jaccard (similarity_threshold)
· domain/lift_selector/stats.py — compute_rule_pvalue, lift_confidence_interval, compute_breakeven_lift (reusadas)