Oczekiwania dotyczące danych do raportu

Z tego przewodnika dowiesz się ważnych informacji o danych wyświetlanych w raportach generowanych za pomocą interfejsu Google Analytics Data API. Użytkownicy często zauważają rozbieżności między danymi zwracanymi przez interfejs API (zwłaszcza przez metodę runReport) a danymi wyświetlanymi w interfejsie Google Analytics.

Próbkowanie i agregacja

Metoda runReport interfejsu Google Analytics Data API może zwracać dane próbkowane, zwłaszcza w przypadku dużych zbiorów danych lub złożonych zapytań. Interfejs Google Analytics też stosuje próbkowanie, ale konkretne progi i algorytmy mogą się różnić, co może powodować niewielkie różnice w raportowanych wartościach.

Aby sprawdzić, czy wyniki raportu są oparte na podzbiorze dostępnych danych, sprawdź samplingMetadatas pole obiektu ResponseMetaData. Jeśli wyniki raportu są próbkowane, to pole opisuje odsetek zdarzeń użytych w tym raporcie.

Niektóre metody raportowania interfejsu Google Analytics Data API umożliwiają określenie żądanego poziomu próbkowania. Aby kontrolować poziom próbkowania raportu, możesz użyć pola samplingLevel metody properties.reportTasks.create.

Ta funkcja zapewnia usługom w Google Analytics 360 dostęp do wyższych limitów próbkowania wynoszących 1 mld zdarzeń. Limity próbkowania można też ustawić na UNSAMPLED, aby używać wyników niespróbkowanych w przypadku dużej liczby zdarzeń.

Więcej informacji znajdziesz w artykule Informacje o próbkowaniu danych.

Przybliżona liczba unikalnych użytkowników

Interfejs Google Analytics Data API używa algorytmu HyperLogLog++ (HLL++) do szacowania liczby unikalnych użytkowników w przypadku danych takich jak Aktywni użytkownicy i Sesje. To podejście jest stosowane w interfejsie API i interfejsie Google Analytics, aby zwiększyć wydajność i efektywnie zarządzać dużymi zbiorami danych. Oznacza to, że wyniki są przybliżeniami, a nie dokładnymi liczbami.

Dodatkowe informacje znajdziesz w tych materiałach: Przybliżona liczba unikalnych użytkowników w Google Analytics i Różnice w liczbie użytkowników.

Wartości progowe zbierania danych

Google Analytics może stosować wartości progowe zbierania danych w raportach, aby uniemożliwić identyfikację poszczególnych użytkowników na podstawie danych demograficznych, zainteresowań lub innych sygnałów występujących w danych.

Jeśli wiersz raportu zawiera niewielką liczbę użytkowników, może zostać wykluczony z wyników. Jest to częstsze w przypadku raportów, które zawierają wymiary o dużej mocy zbioru lub wymiary niestandardowe.

Aby sprawdzić, czy ten raport podlega wartościom progowym, sprawdź pole subjectToThresholding obiektu ResponseMetaData.

Więcej informacji znajdziesz w artykule Wartości progowe zbierania danych.

Wiersz „(other)

Jeśli wymiar ma dużą moc zbioru, Google Analytics może grupować mniej popularne wartości w wierszu oznaczonym jako (other). Jest to częstsze w przypadku raportów, które zawierają wymiary z ponad 500 unikalnymi wartościami dziennie.

Jeśli używasz filtrów z interfejsem Data API, pamiętaj, że filtry nie przeszukują wiersza (other) i są stosowane po zagregowaniu danych i wygenerowaniu wiersza (other).

Aby sprawdzić, czy raport zawiera dane zrolowane do wiersza (other), sprawdź dataLossFromOtherRow pole obiektu ResponseMetaData.

Więcej informacji znajdziesz w artykule Wiersz „(inne)” w Google Analytics.

Tożsamość na potrzeby raportowania

Tożsamość na potrzeby raportowania określa, jak użytkownicy są deduplikowani w raportach. Różne ustawienia tożsamości (np. „Łączona” lub „Na podstawie urządzenia”) mogą powodować różne liczby użytkowników w tym samym zakresie dat.

Zarówno interfejs Google Analytics, jak i interfejs Data API używają tego samego ustawienia tożsamości na potrzeby raportowania w Twojej usłudze. Jeśli to ustawienie zostanie zmienione, wpłynie to na raporty w interfejsie i interfejsie API. Jeśli ustawienie zostanie zmienione między wygenerowaniem raportu w interfejsie a pobraniem danych raportu za pomocą interfejsu API, liczba użytkowników w obu raportach może się różnić w tym samym zakresie dat.

Szczegółowość zapytania

Aby zminimalizować rozbieżności, upewnij się, że te parametry w żądaniu do interfejsu API dokładnie odpowiadają ustawieniom w raporcie w interfejsie Google Analytics:

  • Zakresy dat: sprawdź, czy daty rozpoczęcia i zakończenia są identyczne.
  • Wymiary i dane: upewnij się, że wymiary i dane w żądaniu do interfejsu API są takie same jak wymiary i dane w raporcie w interfejsie Google Analytics.
  • Filtry: upewnij się, że wszystkie filtry wymiarów lub danych zastosowane w żądaniu do interfejsu API są zgodne z filtrami używanymi w interfejsie.

Dodanie wymiarów do raportu może spowodować, że w obliczeniach będzie używanych mniej zdarzeń. W raporcie uwzględniane są tylko zdarzenia, które zawierają dane dla żądanych wymiarów. W rezultacie dodanie wymiarów do zapytania może zmienić zagregowane wartości danych w raporcie.

Częstotliwość aktualizacji danych

Google Analytics potrzebuje czasu na przetworzenie i zagregowanie danych zdarzeń. Jeśli pracujesz z bardzo aktualnymi danymi, możesz zauważyć niewielkie różnice między raportami, jeśli występuje opóźnienie między pobieraniem danych. Jeśli na przykład wyświetlisz raport w interfejsie, a następnie kilka minut później wyślesz zapytanie do interfejsu API o ten sam raport, dane mogą się zmienić ze względu na trwające przetwarzanie i agregację.

Więcej informacji znajdziesz w artykule Częstotliwość aktualizacji danych.

Alternatywy dla danych niespróbkowanych

Jeśli Twój przypadek użycia wymaga pełnych, niespróbkowanych danych na poziomie zdarzenia, rozważ użycie tych alternatyw:

  • BigQuery Export: BigQuery Export dla Google Analytics

    to zalecana metoda zaawansowanej analizy nieprzetworzonych danych zdarzeń.

  • Analytics 360: usługi z licencją Analytics 360 mają wyższe limity próbkowania i dostęp do bardziej szczegółowych funkcji raportowania.