Z tego przewodnika dowiesz się ważnych informacji o danych wyświetlanych w raportach generowanych za pomocą interfejsu Google Analytics Data API. Użytkownicy często zauważają rozbieżności między danymi zwracanymi przez interfejs API (zwłaszcza przez metodę runReport) a danymi wyświetlanymi w interfejsie Google Analytics.
Próbkowanie i agregacja
Metoda runReport interfejsu Google Analytics Data API może zwracać dane próbkowane, zwłaszcza w przypadku dużych zbiorów danych lub złożonych zapytań. Interfejs Google Analytics też stosuje próbkowanie, ale konkretne progi i algorytmy mogą się różnić, co może powodować niewielkie różnice w raportowanych wartościach.
Aby sprawdzić, czy wyniki raportu są oparte na podzbiorze
dostępnych danych, sprawdź
samplingMetadatas
pole obiektu ResponseMetaData. Jeśli wyniki raportu są próbkowane, to pole opisuje odsetek zdarzeń użytych w tym raporcie.
Niektóre metody raportowania interfejsu Google Analytics Data API umożliwiają określenie żądanego poziomu próbkowania. Aby kontrolować poziom próbkowania raportu, możesz użyć pola
samplingLevel
metody properties.reportTasks.create.
Ta funkcja zapewnia usługom w Google Analytics 360 dostęp do wyższych limitów próbkowania wynoszących 1 mld zdarzeń. Limity próbkowania można też ustawić na UNSAMPLED, aby używać wyników niespróbkowanych w przypadku dużej liczby zdarzeń.
Więcej informacji znajdziesz w artykule Informacje o próbkowaniu danych.
Przybliżona liczba unikalnych użytkowników
Interfejs Google Analytics Data API używa algorytmu HyperLogLog++ (HLL++) do szacowania liczby unikalnych użytkowników w przypadku danych takich jak Aktywni użytkownicy i Sesje. To podejście jest stosowane w interfejsie API i interfejsie Google Analytics, aby zwiększyć wydajność i efektywnie zarządzać dużymi zbiorami danych. Oznacza to, że wyniki są przybliżeniami, a nie dokładnymi liczbami.
Dodatkowe informacje znajdziesz w tych materiałach: Przybliżona liczba unikalnych użytkowników w Google Analytics i Różnice w liczbie użytkowników.
Wartości progowe zbierania danych
Google Analytics może stosować wartości progowe zbierania danych w raportach, aby uniemożliwić identyfikację poszczególnych użytkowników na podstawie danych demograficznych, zainteresowań lub innych sygnałów występujących w danych.
Jeśli wiersz raportu zawiera niewielką liczbę użytkowników, może zostać wykluczony z wyników. Jest to częstsze w przypadku raportów, które zawierają wymiary o dużej mocy zbioru lub wymiary niestandardowe.
Aby sprawdzić, czy ten raport podlega wartościom progowym, sprawdź pole
subjectToThresholding
obiektu ResponseMetaData.
Więcej informacji znajdziesz w artykule Wartości progowe zbierania danych.
Wiersz „(other)”
Jeśli wymiar ma dużą moc zbioru, Google Analytics może grupować mniej popularne
wartości w wierszu oznaczonym jako (other). Jest to częstsze w przypadku raportów, które zawierają wymiary z ponad 500 unikalnymi wartościami dziennie.
Jeśli używasz filtrów z interfejsem Data API, pamiętaj, że filtry nie przeszukują wiersza
(other) i są stosowane po zagregowaniu danych i wygenerowaniu wiersza
(other).
Aby sprawdzić, czy raport zawiera dane zrolowane do wiersza (other),
sprawdź
dataLossFromOtherRow
pole obiektu ResponseMetaData.
Więcej informacji znajdziesz w artykule Wiersz „(inne)” w Google Analytics.
Tożsamość na potrzeby raportowania
Tożsamość na potrzeby raportowania określa, jak użytkownicy są deduplikowani w raportach. Różne ustawienia tożsamości (np. „Łączona” lub „Na podstawie urządzenia”) mogą powodować różne liczby użytkowników w tym samym zakresie dat.
Zarówno interfejs Google Analytics, jak i interfejs Data API używają tego samego ustawienia tożsamości na potrzeby raportowania w Twojej usłudze. Jeśli to ustawienie zostanie zmienione, wpłynie to na raporty w interfejsie i interfejsie API. Jeśli ustawienie zostanie zmienione między wygenerowaniem raportu w interfejsie a pobraniem danych raportu za pomocą interfejsu API, liczba użytkowników w obu raportach może się różnić w tym samym zakresie dat.
Szczegółowość zapytania
Aby zminimalizować rozbieżności, upewnij się, że te parametry w żądaniu do interfejsu API dokładnie odpowiadają ustawieniom w raporcie w interfejsie Google Analytics:
- Zakresy dat: sprawdź, czy daty rozpoczęcia i zakończenia są identyczne.
- Wymiary i dane: upewnij się, że wymiary i dane w żądaniu do interfejsu API są takie same jak wymiary i dane w raporcie w interfejsie Google Analytics.
- Filtry: upewnij się, że wszystkie filtry wymiarów lub danych zastosowane w żądaniu do interfejsu API są zgodne z filtrami używanymi w interfejsie.
Dodanie wymiarów do raportu może spowodować, że w obliczeniach będzie używanych mniej zdarzeń. W raporcie uwzględniane są tylko zdarzenia, które zawierają dane dla żądanych wymiarów. W rezultacie dodanie wymiarów do zapytania może zmienić zagregowane wartości danych w raporcie.
Częstotliwość aktualizacji danych
Google Analytics potrzebuje czasu na przetworzenie i zagregowanie danych zdarzeń. Jeśli pracujesz z bardzo aktualnymi danymi, możesz zauważyć niewielkie różnice między raportami, jeśli występuje opóźnienie między pobieraniem danych. Jeśli na przykład wyświetlisz raport w interfejsie, a następnie kilka minut później wyślesz zapytanie do interfejsu API o ten sam raport, dane mogą się zmienić ze względu na trwające przetwarzanie i agregację.
Więcej informacji znajdziesz w artykule Częstotliwość aktualizacji danych.
Alternatywy dla danych niespróbkowanych
Jeśli Twój przypadek użycia wymaga pełnych, niespróbkowanych danych na poziomie zdarzenia, rozważ użycie tych alternatyw:
BigQuery Export: BigQuery Export dla Google Analytics
to zalecana metoda zaawansowanej analizy nieprzetworzonych danych zdarzeń.
Analytics 360: usługi z licencją Analytics 360 mają wyższe limity próbkowania i dostęp do bardziej szczegółowych funkcji raportowania.