agent-tracking

Guides

Kann ich KI-Agenten auf meiner Website kostenlos und mit Open Source messen?

Agent Tracking ist quelloffene Software unter AGPL-3.0, die du auf einem eigenen Server betreiben kannst. Der gehostete Dienst hat außerdem einen Free-Plan mit einer Website, 10.000 Agenten-Events pro Monat und 30 Tagen Dashboard-Verlauf. Quelloffene Software spart keine Server- und Wartungskosten; der gehostete Free-Plan hat Grenzen. Entscheide nach Datenbedarf und Betriebsaufwand.

Von · Stand 2026-09-24

Read this guide in English

Was Open Source hier bedeutet

Der Quellcode der Anwendung ist auf GitHub öffentlich und steht unter AGPL-3.0-only. Du kannst das Browser-Snippet, die Event-Annahme, die Bot-Klassifikation, den Log-Import und den Dashboard-Code prüfen. Eine Kopie lässt sich auf eigener Infrastruktur betreiben. Wenn du eine veränderte Version als Netzwerkdienst anbietest, entstehen Pflichten aus der Lizenz. Lies dafür den Lizenztext; für ein eigenes kommerzielles Angebot kann fachlicher Rat sinnvoll sein.

Bei einem Messprodukt ist der offene Code besonders relevant: Der Datenweg lässt sich prüfen. Du kannst nachsehen, welche Felder das Snippet sendet, wie Crawler verifiziert werden und wie lange Rohereignisse bleiben. Das ist eine bessere Grundlage als ein Datenschutzslogan allein. Es macht aber nicht jede Installation automatisch rechtskonform. Konfiguration, Hinweise, Serverzugriff und betriebliche Abläufe liegen beim jeweiligen Betreiber.

Ein öffentliches Repository erlaubt außerdem, Updates vor dem Einspielen zu testen. Dafür übernehmen Selbsthoster auch die Verantwortung für Backups, TLS, Zugriffsschutz, Überwachung und Aktualisierungen. Fehlt im Team jemand für diese Aufgaben, kann ein gehostetes Konto einfacher sein, obwohl der Quellcode selbst keine Lizenzgebühr kostet.

Was der gehostete Free-Plan enthält

Der aktuelle Free-Plan umfasst eine Website, 10.000 Agenten-Events je Kalendermonat und 30 Tage Dashboard-Verlauf. Normale menschliche Seitenaufrufe zählen nicht gegen diese Event-Grenze. Die Aufbewahrung von Rohereignissen ist vom sichtbaren Dashboard-Zeitraum zu unterscheiden; prüfe die aktuelle Dokumentation und dein Konto, bevor du langfristig planst. Pro und Agency haben höhere Grenzen. Bezeichne nicht den gesamten gehosteten Dienst als dauerhaft und unbegrenzt kostenlos.

Eine kleine Website kann mit dem Free-Plan herausfinden, ob Assistenten erkennbare Besucher schicken, welche Bots die Seiten erreichen und ob Browser-Tools aufgerufen werden. Für Crawler brauchst du zusätzlich zum Script einen Log-Import, denn viele Bots führen kein JavaScript aus. Prüfe den Aufbau mit echtem Traffic, bevor du ein Diagramm öffentlich als Beleg zeigst. Der vollständige Messleitfaden erklärt jede Quelle.

Schätze bei der Tarifwahl die Agenten-Events und nicht nur die Gesamtzahl der Besucher. Eine Dokumentationsseite, die häufig von Bots abgerufen wird, hat ein anderes Profil als eine kleine Unternehmensseite. Entscheide auch, wie viel Dashboard-Verlauf dein Team tatsächlich braucht. Wenn Berichte ein Jahr Daten in der Anwendung erfordern, vergleiche diese Anforderung vorab mit den aktuellen Plangrenzen.

Was zum Selbsthosting gehört

Das Repository enthält einen Docker-Aufbau und Anleitungen für die Next.js-Anwendung mit einer SQLite-Datei. Setze einen Reverse Proxy mit TLS davor, konfiguriere die eigene Site-Origin und den Mailversand, und speichere die Daten dauerhaft. Verwende die Beispiel-Umgebung als Ausgangspunkt. Übernimm dabei nicht versehentlich die Rechtstexte, Kontaktdaten oder Betreiberangaben des öffentlichen Dienstes. Lege dann deine Domain an, binde das Snippet ein und prüfe das erste Ereignis.

Für den produktiven Betrieb brauchst du regelmäßige Backups der SQLite-Datei, Zugriff auf Logs für den Crawler-Import, Login-E-Mails und einen wiederholbaren Update-Prozess. Teste eine Wiederherstellung, nicht nur den Backup-Job. Begrenze den Zugriff auf Anwendung und Datendatei. Das sind gewöhnliche Serveraufgaben, kosten aber Zeit und Hosting-Gebühren. Der Cloud-Dienst übernimmt einen großen Teil davon im Rahmen seiner Tarife und Bedingungen.

Wenn deine Website hinter einem CDN steht, fehlen im Origin-Log unter Umständen Anfragen, die das CDN aus dem Cache bedient oder am Netzrand blockiert hat. Der Log-Import misst dann immer noch, was deinen Server erreicht. Für eine vollständige Edge-Sicht verwende zusätzlich die CDN-Metriken. Vergleiche beide Summen nur mit einer Erklärung ihrer unterschiedlichen Abdeckung.

Welche Daten tatsächlich messbar sind

Das Seiten-Snippet erfasst erkennbare Referrals aus Assistenten, unterstützte Browser-Tool-Aufrufe und markierte Ziele. Ein Server-Log-Import ergänzt Bot-Anfragen und deren Prüfung, soweit Betreiber IP-Bereiche veröffentlichen. Diese Kategorien bleiben getrennt. Weder Anfrage noch Referral verraten den Prompt eines Menschen; ein Bot-Abruf beweist kein Zitat. Benenne die Ereignisse auch im Export genau. Plausibles Kanal AI Assistants deckt die Referral-Ebene für viele Websites bereits ab. Ein Edge-Bot-Audit kann Crawler zählen. Agent Tracking wird interessant, wenn du diese Ebenen mit Tool- und Zieldaten verbinden willst.

Das Produkt erfasst Seitenpfade statt vollständiger Query-Strings und soll keine Netzwerkadressen von Besuchern speichern. Prüfe solche Aussagen am Code und an deiner Konfiguration, bevor du sie in eigene Datenschutzhinweise übernimmst. Eine selbst gehostete Kopie verändert außerdem, wer den Server betreibt und wer Zugriff auf die Daten hat. Die Datenschutzseite beschreibt den gehosteten Dienst, nicht automatisch jeden Fork.

Wenn du ausschließlich Menschen messen willst, die von ChatGPT kommen, kann dein vorhandenes Webanalyse-Werkzeug genügen. Brauchst du nur Crawler-Zahlen, kann ein Log-Parser reichen. Eine eigene Agenten-Analytics-Installation lohnt sich besonders, wenn das Team den Weg vom Abruf über eine Aktion bis zum erreichten Ziel verstehen möchte.

Eine Entscheidung in fünf Fragen

Nutze den gehosteten Free-Plan, wenn du eine Website schnell testen willst und die Grenzen ausreichen. Hoste selbst, wenn Infrastrukturkontrolle wichtig ist und jemand den Betrieb übernimmt. Verwende für den gesamten menschlichen Traffic daneben gewöhnliche Webanalyse. Nutzt du bereits Cloudflare, prüfe AI Crawl Control für Edge-Anfragen und Regeln; es sitzt an einer anderen Stelle im Aufbau.

Kläre vor der Wahl fünf Punkte: Brauchst du verifizierte Crawler-Anfragen oder nur Assistenten-Referrals? Bietest du Browser-Tools an? Wie hoch sind Event-Volumen und gewünschter Berichtszeitraum? Wo müssen die Daten liegen? Wer wartet die Anwendung? Teste anschließend eine Woche mit einem konkreten Erfolgskriterium, etwa einem erkannten Bot-Unterschied oder einem gefundenen Tool-Fehler. Ein kleines, prüfbares Ziel ist wertvoller als ein Dashboard, auf das niemand reagiert.

Die offene Software lädt dazu ein, Produktversprechen selbst zu prüfen. Der Free-Plan ermöglicht in der Pilotphase einen Test einer echten Website ohne Karte. Beides ersetzt nicht die Frage, welche Entscheidung die Messung ermöglichen soll.

Kurz gefragt

Ist der gehostete Dienst vollständig kostenlos?

Der Free-Plan hat Grenzen für Websites, Agenten-Events und Verlauf. Bezahlte Pläne haben höhere Grenzen. Selbsthosting hat keine Software-Abogebühr, verursacht aber Infrastruktur- und Wartungskosten.

Läuft die Software auf meinem eigenen Server?

Ja. Das öffentliche Repository enthält Docker-Konfiguration und eine Beispiel-Umgebung. Der Betreiber stellt TLS, dauerhaften Speicher, Mailversand, Backups und Updates bereit.

Zählt das Browser-Snippet allein KI-Crawler?

Nein. Crawler ohne JavaScript müssen über Server- oder Edge-Logs erfasst werden. Das Snippet misst Ereignisse, die im Browser sichtbar sind.