WRInaute occasionnel
Bonjour,
Je me pose une question sur la fiabilité actuelle des outils analytics comme GA4 ou Plausible pour mesurer uniquement le trafic humain.
Avec l’évolution de la recherche et des accès automatisés au Web, la frontière entre une visite humaine et une visite générée par un navigateur automatisé devient plus difficile à lire dans les outils analytics.
Un crawler classique qui se contente de récupérer le HTML ne déclenche généralement pas un script analytics côté client. En revanche, un système automatisé utilisant un environnement de navigateur capable d’exécuter JavaScript peut techniquement déclencher GA4 ou un autre outil de mesure.
Cela ne signifie évidemment pas que les systèmes d’AI Search fonctionnent tous ainsi, ni que le trafic inexpliqué observé dans GA4 ou Plausible provient de l’IA. C’est précisément cette incertitude que je cherche à mieux mesurer.
Or certains de ces systèmes sont capables d’exécuter du JavaScript côté client et peuvent donc, au moins techniquement, déclencher les scripts analytics.
Le problème est particulièrement visible dans le trafic Direct / None : une session enregistrée par GA4 ou Plausible peut évidemment correspondre à un humain dont le referrer a disparu, mais potentiellement aussi à une automatisation suffisamment proche du comportement d’un navigateur.
Plausible filtre déjà énormément de trafic automatisé, mais cela ne permet pas nécessairement de considérer que tout ce qui reste est humain.
Ma question est donc surtout destinée aux personnes qui ont travaillé techniquement sur ce sujet :
Avez-vous réussi aujourd’hui à améliorer ou compléter GA4/Plausible afin d’isoler de manière beaucoup plus fiable le trafic réellement humain du trafic généré par des bots, navigateurs automatisés, agents IA ?
Je me pose une question sur la fiabilité actuelle des outils analytics comme GA4 ou Plausible pour mesurer uniquement le trafic humain.
Avec l’évolution de la recherche et des accès automatisés au Web, la frontière entre une visite humaine et une visite générée par un navigateur automatisé devient plus difficile à lire dans les outils analytics.
Un crawler classique qui se contente de récupérer le HTML ne déclenche généralement pas un script analytics côté client. En revanche, un système automatisé utilisant un environnement de navigateur capable d’exécuter JavaScript peut techniquement déclencher GA4 ou un autre outil de mesure.
Cela ne signifie évidemment pas que les systèmes d’AI Search fonctionnent tous ainsi, ni que le trafic inexpliqué observé dans GA4 ou Plausible provient de l’IA. C’est précisément cette incertitude que je cherche à mieux mesurer.
Or certains de ces systèmes sont capables d’exécuter du JavaScript côté client et peuvent donc, au moins techniquement, déclencher les scripts analytics.
Le problème est particulièrement visible dans le trafic Direct / None : une session enregistrée par GA4 ou Plausible peut évidemment correspondre à un humain dont le referrer a disparu, mais potentiellement aussi à une automatisation suffisamment proche du comportement d’un navigateur.
Plausible filtre déjà énormément de trafic automatisé, mais cela ne permet pas nécessairement de considérer que tout ce qui reste est humain.
Ma question est donc surtout destinée aux personnes qui ont travaillé techniquement sur ce sujet :
Avez-vous réussi aujourd’hui à améliorer ou compléter GA4/Plausible afin d’isoler de manière beaucoup plus fiable le trafic réellement humain du trafic généré par des bots, navigateurs automatisés, agents IA ?