Qué significa la capa de datos
La capa de datos es una estructura de JavaScript que el propio sitio web crea y rellena. En la práctica es un array llamado window.dataLayer, y cada elemento que se añade es un objeto con pares de clave y valor: el tipo de página, el identificador de un producto, el importe de un pedido o el nombre de la acción que acaba de ocurrir. Nada más. No hay red, no hay servidor, no hay informe.
Conviene separarla de Google Tag Manager. El gestor de etiquetas lee la capa de datos, pero no es su dueño. El array existe en cuanto una línea de código lo declara, aunque no haya ningún contenedor instalado, y sigue siendo legible por cualquier otra herramienta que quiera suscribirse a él. Esa independencia es justo lo que hace útil el patrón: el equipo de desarrollo publica los datos una sola vez y quién los consume se decide después.
Tampoco es Google Analytics 4. Muchos artículos tratan los dos conceptos como si fueran el mismo paso, y de ahí salen implementaciones confusas. GA4 recibe eventos con sus parámetros y los guarda en una propiedad de medición. La capa de datos ocurre antes de eso, en el navegador, y no envía nada por sí misma. Un valor puede estar perfectamente disponible en window.dataLayer y no aparecer jamás en los informes de GA4 porque falta la etiqueta que lo recoja.