Почему количество пользователей в BigQuery и GA могут отличаться?
Дело в том, что в интерфейсе GA данные подтягиваются из предварительно сегрегированных таблиц, используя функции приблизительного подсчета уникальных значений (алгоритм HyperLogLog ++). Это позволяет значительно увеличить скорость отображения результатов, но немного уменьшает их точность. Обращаясь к данным в BigQuery можно намеренно использовать приблизительные функции, когда скорость отображения важнее точности результатов.
Дело в том, что в интерфейсе GA данные подтягиваются из предварительно сегрегированных таблиц, используя функции приблизительного подсчета уникальных значений (алгоритм HyperLogLog ++). Это позволяет значительно увеличить скорость отображения результатов, но немного уменьшает их точность. Обращаясь к данным в BigQuery можно намеренно использовать приблизительные функции, когда скорость отображения важнее точности результатов.