La respuesta breve
La regla antigua dictaba: "para analizar un dato, primero hay que copiarlo". Sin embargo, Zero Copy anula esta premisa en muchos escenarios: permite consultar una tabla alojada en un almacén de datos externo sin necesidad de transferirla. Esta es una capacidad real, pero intercambia un tipo de costo por otro; en lugar de costos de almacenamiento y canalización, se incurre en costos de computación y se genera una dependencia de la disponibilidad de la fuente.
La decisión es correcta cuando se aborda como cualquier decisión arquitectónica: basándose en los requisitos de uso, no en tendencias.
Los cuatro parámetros decisivos
| Parámetro | Se inclina a Zero Copy | Se inclina a Ingestion |
|---|---|---|
| Freshness | Se requiere el dato más actualizado en todo momento | Ciclos programados son suficientes |
| Rendimiento | Análisis y segmentación, tolerancia de segundos | Operación en tiempo real, tiempo de respuesta constante |
| Volumen y frecuencia | Gran volumen, pocas consultas | Volumen moderado, muchas consultas |
| Gobernanza | La fuente mantiene una política robusta | Se necesita control total sobre la copia |
Esta tabla también explica por qué la mayoría de las organizaciones optan por una combinación: los flujos operativos se ingieren, mientras que los flujos analíticos pesados permanecen en su lugar.
Lo que el equipo mantiene bajo su responsabilidad, incluso con Zero Copy
El acceso virtual elimina la canalización, no el trabajo. Siguen siendo necesarios: el mapeo del esquema al modelo compartido, la decisión sobre las claves de identificación para la unificación del perfil, la gestión de cambios de esquema en la fuente y la monitorización de la disponibilidad. Un cambio de nombre de columna en el almacén externo interrumpirá una vista virtual, tal como interrumpe un ETL.
Por lo tanto, el acuerdo con el equipo de datos que gestiona la fuente forma parte de la implementación: notificación anticipada de cambios de esquema, una ventana de mantenimiento conocida y un presupuesto de consultas acordado.
Patrones híbridos que funcionan
Resumen interno, detalle externo – Se ingresan a la capa de unificación valores resumidos para cada cliente, y las líneas de detalle se mantienen en el almacén para acceso bajo demanda. Este es el patrón más común y generalmente el más económico.
Ventana activa y archivo frío – Los últimos 12 a 24 meses se copian internamente para un mejor rendimiento, y el historial más antiguo permanece accesible virtualmente.
Virtual primero, copia según la demanda – Se comienza con acceso virtual, se mide la frecuencia de uso real y se copia solo lo que se ha comprobado que se necesita con regularidad. Esta es la forma efectiva de evitar la copia de datos que nadie consultará.
La relación entre esta decisión y la distribución de responsabilidades entre sistemas se detalla en Datos 360 vs. Datos de CRM y en Fuente de la Verdad en la Organización.
Escenario: una empresa financiera con 400 millones de filas
Una empresa de servicios financieros deseaba segmentar clientes basándose en un historial de transacciones de siete años, aproximadamente 400 millones de filas en un data warehouse en la nube. El plan original era la ingesta completa a la capa de unificación.
El piloto cambió la decisión. Se determinó que las segmentaciones reales se basaban únicamente en tres cálculos: promedio mensual, tendencia de 90 días y clasificación de actividad, y todos ellos podían calcularse en el propio almacén. En lugar de transferir 400 millones de filas, se transfirieron tres columnas resumidas por cliente, actualizadas diariamente, mientras que el detalle permaneció virtualmente accesible para indagaciones puntuales.
Lo que se decidió aquí no fue "virtual vs. copia" sino a nivel de granularidad: la pregunta correcta era con qué resolución se necesitaban realmente los datos. Al responderla, la cuestión de la copia se volvió insignificante.
Riesgos comunes y acciones de prevención
| Riesgo | Cómo se manifiesta en la práctica | Acción de prevención |
|---|---|---|
| Costo de cómputo sorprendente | Consultas amplias con alta frecuencia | Medición durante el piloto y acuerdo previo |
| Dependencia de la disponibilidad de la fuente | Una falla en el almacén interrumpe la segmentación | Fallback o ventana activa copiada |
| Cambios de esquema | Las vistas se rompen sin previo aviso | Acuerdo de cambios y monitorización del esquema |
| Permisos no definidos | Exposición más amplia que la original | Identidad de consulta y política de exposición escrita |
| Granularidad incorrecta | Se transfieren detalles que nadie necesita | Decidir la resolución antes que el método |
Cómo medir el éxito
| Área | Qué se mide | Frecuencia de revisión |
|---|---|---|
| Rendimiento | Tiempo de respuesta para consultas de segmentación clave | Mensual |
| Costo | Costo de cómputo y movimiento por cada caso de uso | Mensual |
| Estabilidad | Fallos de consulta y disponibilidad de la fuente | Semanal |
| Valor | Segmentaciones y operaciones generadas en la práctica | Trimestral |
La elección de la combinación entre acceso virtual e ingesta se realiza en el marco de Servicio de Integraciones y Datos.
Lista de verificación para la decisión de Zero Copy
- ☐ Se han definido casos de uso concretos y no una "capacidad general".
- ☐ Se ha establecido el requisito de frescura para cada caso de uso.
- ☐ Se ha verificado la resolución de datos necesaria en la práctica.
- ☐ Se ha estimado la frecuencia de consulta y el volumen de escaneo.
- ☐ Existe un acuerdo de cambio de esquema con el propietario de la fuente.
- ☐ Se ha definido la identidad de la consulta y la política de exposición.
- ☐ Se ha considerado un patrón híbrido antes de una decisión binaria.
- ☐ Hay un plan de respaldo (fallback) para fallas de la fuente.
- ☐ Se ha realizado un piloto medido antes de la expansión.
- ☐ Hay un responsable de la monitorización de costos y la revisión periódica.
Recursos profesionales
- Salesforce Data 360 — https://www.salesforce.com/data/
- Salesforce Data 360 Architecture — https://architect.salesforce.com/docs/architect/fundamentals/guide/data-360-architecture.html
- HPI Pro – Integraciones y Datos — https://hpi.pro/integrations-data
