LinkMesh

Doku, Blog und Changelog durchsuchen

Die Dokumentation ist nur auf Englisch verfügbar.

ENDE

OpenTelemetry-Flottenverwaltung

Ihre OpenTelemetry-Collector-Flotte zentral verwalten

Eine Handvoll Collectors, die Sie von Hand pflegen, ist kein Problem. Eine ganze Flotte driftet, läuft in unterschiedlichen Versionen und fällt um 2 Uhr nachts aus. LinkMesh ist ein selbst gehosteter, OpAMP-nativer Control Plane, der jeden Ihrer Collectors konfiguriert, ausrollt und überwacht — Standard-otelcol-contrib und Grafana Alloy, abgerechnet pro Collector statt pro Gigabyte.

Kostenlos starten →

25 Collectors nach kostenloser Registrierung · 5 ohne Registrierung Wie die kostenlose Stufe funktioniert

5 Collectors zu verwalten ist einfach. 50, 200 oder 1.000 nicht.

Jede Methode, die bei wenigen Collectors funktioniert — per SSH einloggen, Datei bearbeiten, neu starten —, versagt irgendwo zwischen dem zehnten und dem fünfzigsten. Das sind die Probleme, die dann auftreten.

Konfigurationsdrift

Ein Host bekommt einen Processor, der den anderen fehlt; ein Receiver-Port ändert sich auf drei von vierzig Knoten. Niemand kann mehr sagen, was „die Konfiguration“ eigentlich ist.

Versionschaos

Die halbe Flotte läuft auf dem Collector-Build vom letzten Quartal, die andere Hälfte auf dem aktuellen — und ein Fehler tritt nur auf den Hosts auf, die Sie beim Upgrade vergessen haben.

Betrieb per SSH

Jede Änderung ist eine Shell-Sitzung mal N Hosts, gefolgt von einem Neustart, von dem Sie hoffen, dass er geklappt hat. Das skaliert nicht und hinterlässt keinen Audit-Trail.

Kein Inventar

Fragen Sie, wie viele Collectors Sie betreiben, in welcher Version und in welcher Umgebung — die ehrliche Antwort ist eine Tabelle, die drei Wochen alt ist.

Kein schrittweiser Rollout

Eine neue Konfiguration geht an alle Collectors gleichzeitig. Ein fehlerhafter Receiver legt um 2 Uhr nachts überall die Datenaufnahme lahm — ohne Canary und ohne Begrenzung des Schadens.

Kein Rollback

„Wer hat die Sampling-Regel wann geändert, und können wir das rückgängig machen?“ sollte nicht das Durchsuchen der Shell-History auf vierzig Maschinen erfordern.

Wo LinkMesh sitzt

LinkMesh ist ein Control Plane, keine Data Plane. Konfiguration und Zustand laufen über OpAMP und remotecfg zwischen der Flotte und dem LinkMesh-Server; Ihre Telemetrie fließt direkt von den Collectors zu Ihren eigenen Backends und läuft nie über LinkMesh.

CONTROL PLANE · OpAMP + remotecfgLinkMesh ServerIhr selbst gehosteter Control Plane · Konfiguration, Rollout, Drift, ZustandRemoteConfigEffectiveConfig · HealthDATA PLANE · OTLP (nie über LinkMesh)QuellenHosts · KubernetesCloud · Syslog · AppsCollector-Flotteotelcol-contribüber OpAMPGrafana Alloyüber remotecfgIhre BackendsLoki · TempoPrometheus · SplunkGrafana Cloud · …TelemetrieTelemetrie
Quellen speisen die Collector-Flotte, die Telemetrie direkt an Ihre Backends sendet. LinkMesh verteilt Konfiguration und liest den Zustand zurück — außerhalb des Datenpfads.

01

Einheitliche Konfiguration

Problem

Wenn jeder Collector von Hand bearbeitet wird, laufen sie auseinander. Es gibt kein einzelnes Artefakt, auf das Sie zeigen und sagen können: „Das ist die Konfiguration der Flotte.“

LinkMesh

Definieren Sie die Konfiguration einmal — pro Gruppe, pro Umgebung — und LinkMesh erzeugt dieselbe effektive Konfiguration und verteilt sie an jeden Collector darin. otelcol-contrib erhält sie über OpAMP, Grafana Alloy ruft sie über remotecfg ab. Standard-Upstream-Builds, kein geforkter Collector und kein proprietärer Agent.

Eine einzige Quelle der Wahrheit für die Flotte. Was Sie festlegen, läuft — auf Knoten 1 und auf Knoten 400.

Wie ein Collector in LinkMesh abgebildet wird (Englisch) →
Die Collectors-Ansicht von LinkMesh — eine Flotte von OpenTelemetry Collectors mit Status, Version, letztem Kontakt, CPU und Arbeitsspeicher für jeden Knoten.
Die Flottenansicht: Status, Agent-Version und Ressourcenverbrauch für jeden verwalteten Collector.

02

Schrittweise Rollouts

Problem

Eine Konfigurationsänderung gleichzeitig an Hunderte Collectors zu verteilen, ist genau der Weg, auf dem ein einzelner fehlerhafter Receiver die Datenaufnahme in der ganzen Umgebung lahmlegt.

LinkMesh

Rollen Sie eine Änderung zuerst in einer Gruppe aus — einer Canary-Umgebung oder einer einzelnen Region —, beobachten Sie Zustand und Konvergenz der effektiven Konfiguration und übernehmen Sie sie dann für den Rest. Jeder Collector meldet seine EffectiveConfig und seinen Zustand über OpAMP zurück; Sie sehen also, dass die Änderung angekommen ist, bevor Sie sie ausweiten.

Konfiguration so ausliefern wie Code: kleiner Wirkungsbereich, beobachtet, bewusst freigegeben.

Anleitung: eine flottenweite Konfigurationsänderung stufenweise ausrollen (Englisch) →

03

Erkennung von Konfigurationsdrift

Problem

Die laufende Konfiguration eines Collectors weicht unbemerkt von dem ab, was Sie verteilt haben — ein lokaler Override, eine manuelle Änderung per SSH, eine halb angewendete Änderung. Sie merken es, wenn keine Telemetrie mehr ankommt.

LinkMesh

LinkMesh vergleicht den gemeldeten EffectiveConfig-Hash jedes Collectors mit der zugewiesenen Konfiguration und markiert Abweichungen. Die Zeitleiste des Collectors zeigt genau, wann ein Knoten einen Hash gemeldet hat, der vom letzten Server-Push abweicht, und wann er wieder konvergiert ist.

Drift wird zu einem sichtbaren Ereignis auf einer Zeitleiste statt zu einem stillen Ausfall.

Wie der Abgleich der effektiven Konfiguration funktioniert (Englisch) →
Die Detailseite des Collectors gcloud-vm-duo-1 in LinkMesh, Status Online, Laufzeit OpAMP. Das Aktivitätsprotokoll zeigt, wie der Agent die vom Server verteilte Konfiguration anwendet und später einen Konfigurations-Hash meldet, der vom letzten Server-Push abweicht.
Die Zeitleiste eines Collectors: Der Agent wendet eine vom Server verteilte Konfiguration an, später folgt ein Drift-Ereignis mit abweichendem Hash.

04

Collector-Inventar und Umgebungen

Problem

Was Sie nicht auflisten können, können Sie nicht verwalten. Größe, Versionen und Verteilung der Flotte existieren nur in den Köpfen einzelner Personen und in einer veralteten Tabelle.

LinkMesh

Jeder registrierte Collector wird automatisch inventarisiert — Status, Agent-Version, letzter Kontakt, Host sowie Gruppe und Umgebung, zu der er gehört. Organisieren Sie die Flotte in Gruppen (Produktion, Staging, pro Region, pro Mandant) und vergeben Sie Benutzerrechte pro Gruppe.

Ein Live-Inventar Ihrer Telemetrie-Edge, das nie veraltet.

Wie Collector-Gruppen und Umgebungen funktionieren (Englisch) →
Die Übersicht der Collector-Gruppe us-east-ingest in LinkMesh — Umgebung Production, zwei Collectors, ein Tag acme-logistics und gruppenbezogene Zugriffsrechte.
Eine Collector-Gruppe: Umgebung, Mitglieder, Tags und Zugriffsrechte — die Einheit, für die Sie konfigurieren und ausrollen.

05

Remote-Konfiguration — OpAMP und Alloy remotecfg

Problem

Collectors zu konfigurieren heißt: SSH, eine Konfigurationsdatei pro Host und ein Neustart, von dem Sie hoffen, dass er klappt. Das skaliert nicht und protokolliert nichts.

LinkMesh

LinkMesh ist ein OpAMP Control Plane. otelcol-contrib verbindet sich mit dem Standard-opampsupervisor über eine einzige ausgehende Verbindung auf Port 443; Grafana Alloy ruft dieselbe verwaltete Konfiguration über seinen nativen remotecfg-Endpunkt ab. RemoteConfig, Verbindungseinstellungen und Zustand laufen alle über das Protokoll — keine eingehenden Ports, kein SSH.

Eine ausgehende Verbindung pro Collector ersetzt unzählige SSH-Sitzungen.

Wie LinkMesh OpAMP spricht (Englisch) →
CONTROL PLANE · OpAMPLinkMesh ServerIhre selbst gehostete InstanzOpAMP Serverendpoint /v1/opamptransport WSS · port 443OTel Hostopampsupervisor + otelcol-contrib:4317 OTLP / gRPC:4318 OTLP / HTTP:8888 eigene MetrikenRemoteConfig · Connection SettingsEffectiveConfig · Health · StatusDATA PLANE · OTLPLogs · Metriken · TracesIhre Observability-BackendsLoki · Tempo · Prometheus · Grafana Cloud · …

06

Änderungsverlauf und Rollback

Problem

„Wer hat die Sampling-Regel wann geändert, und können wir das rückgängig machen?“ sollte eine Antwort mit einem Klick sein, keine forensische Übung.

LinkMesh

Jede Änderung an Routen, Pipelines, Processors und Zielen landet als Commit im GitOps-Konfigurations-Repository — mit vollständigem Diff, Autor und Zeitstempel. Kehren Sie zu einer beliebigen früheren Revision zurück und verteilen Sie sie erneut an die Flotte.

Änderungsverlauf in Git-Qualität und Rollback mit einem Klick für Ihre gesamte Telemetrie-Konfiguration.

Wie Konfiguration in Git versioniert wird (Englisch) →

07

Durchsetzung von Richtlinien

Problem

Ein Team liefert einen Collector aus, der Roh-Logs — inklusive personenbezogener Daten — direkt an ein Backend schickt und dabei jede vereinbarte Maskierungs- und Sampling-Regel umgeht.

LinkMesh

Hängen Sie globale Processors an eine Gruppe, damit Maskierung, Filterung und Sampling für jeden Collector darin gelten — unabhängig von der lokalen Pipeline. Neue Collectors übernehmen die Richtlinie der Gruppe, sobald sie sich registrieren.

Leitplanken, die in der ganzen Flotte gelten — keine Konventionen, die in Vergessenheit geraten.

Anleitung: Maskierung vor dem Export durchsetzen (Englisch) →
Die Processor-Bibliothek von LinkMesh mit integrierten Vorlagen für Maskierung, Filterung und Sampling, die einer Collector-Gruppe als globale Richtlinie zugewiesen werden können.
Auf Gruppenebene zugewiesene Processors werden zur Richtlinie, die jeder Collector der Gruppe übernimmt.

08

Routing an mehrere Backends

Problem

Security will Logs in Splunk, das SRE-Team Metriken in Prometheus, Finance langsame Abfragen in BigQuery — alles aus denselben Quellen.

LinkMesh

Definieren Sie Routen nach Label, Umgebung oder Mandant; derselbe Collector verteilt an mehrere Ziele, mit einer eigenen Verarbeitungskette pro Route. Die Topologie-Ansicht zeigt den Live-Durchsatz auf jeder Verbindung.

Eine Flotte, viele Backends, kein Wildwuchs an Collectors pro Team.

Anleitung: Telemetrie an mehrere Backends routen (Englisch) →
Die Topologie-Ansicht von LinkMesh — eine Collector-Gruppe routet Telemetrie an ein Ziel, mit live gemessenen Datensätzen pro Sekunde auf der Verbindung.
Die Topologie: Collectors, zu Zielen geroutet, mit Live-Durchsatz auf jeder Verbindung.

Was LinkMesh ist — und was nicht

Was es ist

Ein selbst gehosteter Control Plane, der Ihre OpenTelemetry-Collector-Flotte konfiguriert, versioniert, ausrollt und überwacht. Er verwaltet die Collectors — Standard-otelcol-contrib und Grafana Alloy — über OpAMP und remotecfg, von einer zentralen Stelle aus.

Was es nicht ist

Es ist kein Telemetrie-Backend und kein Datenspeicher. LinkMesh nimmt Ihre Logs, Metriken und Traces weder auf noch indexiert oder speichert es sie — das übernehmen die Collectors, die die Daten direkt an Ihre eigenen Backends senden. Da LinkMesh selbst gehostet ist, läuft Ihre Telemetrie nie über LinkMesh.

Wenn sich nichts ändert

Von allein wird nichts davon günstiger: Das Volumen wächst weiter, bereits versendete Daten lassen sich nicht zurückholen, und jeder zusätzliche Agent ist einer mehr, den Sie später wieder entfernen.

Wenn es läuft

  • Eine Rechnung pro Collector, die ein Volumenanstieg nicht bewegt.
  • Sensible Felder auf dem Host maskiert, bevor etwas das Netzwerk verlässt.
  • Jede Konfigurationsänderung ein Diff, das Sie prüfen und zurückrollen können.
  • Austauschbare Backends, weil nichts Proprietäres im Pfad sitzt.

Häufige Fragen

Benötigt LinkMesh einen proprietären Collector oder Agent?

Nein. LinkMesh verwaltet Standard-OpenTelemetry-Collectors — otelcol-contrib über OpAMP und Grafana Alloy über remotecfg. Es gibt keinen geforkten Build und keinen Hersteller-Agent; Sie betreiben die Upstream-Binaries, und LinkMesh konfiguriert sie.

Kann LinkMesh Grafana Alloy verwalten?

Ja. Alloy wird über seinen nativen remotecfg-Endpunkt angebunden und parallel zu otelcol-contrib-Collectors verwaltet, die sich über OpAMP verbinden. Dieselbe erzeugte Konfiguration wird jedem über sein eigenes Protokoll bereitgestellt.

Wird meine Telemetrie über eine LinkMesh-Cloud gesendet?

Nein. LinkMesh ist selbst gehostet und überträgt über den OpAMP Control Plane nur Konfiguration, Zustand und Status. Ihre Collectors senden Logs, Metriken und Traces direkt an Ihre eigenen Observability-Backends — die Telemetrie läuft nie über LinkMesh.

Wie wird LinkMesh abgerechnet?

Pro verwaltetem Collector, nie nach Datenvolumen. Die ersten 25 Collectors sind nach einer kostenlosen Registrierung ohne Kreditkarte im OpenSight Customer Portal gratis (5 ohne Registrierung); darüber kostet es pauschal USD 12.50 · CHF 12.00 · EUR 12.50 pro Collector und Monat bei jährlicher Abrechnung, und ab 200 Collectors steigen die Kosten nicht weiter.

Funktioniert LinkMesh air-gapped oder vollständig on-premises?

Ja. LinkMesh läuft vollständig in Ihrer eigenen Infrastruktur, ohne Abhängigkeit von einem LinkMesh-SaaS. Collectors verbinden sich ausgehend über eine einzige Verbindung auf Port 443 mit Ihrem LinkMesh-Server; es funktioniert daher in isolierten und air-gapped Netzen, solange die Collectors diesen Server erreichen.

Was verwaltet LinkMesh — und was nicht?

LinkMesh konfiguriert, versioniert, rollt aus und überwacht Ihre OpenTelemetry-Collector-Flotte. Es ist selbst kein Telemetrie-Backend und kein Datenspeicher: Es nimmt Ihre Logs, Metriken und Traces weder auf noch indexiert oder speichert es sie. Die Collectors erledigen die Telemetrie-Arbeit; LinkMesh verwaltet die Collectors.

Bringen Sie Ihre Collector-Flotte unter einen Control Plane

Selbst gehostet, OpAMP-nativ und pro Collector abgerechnet. Die ersten 25 Collectors sind nach einer kostenlosen Registrierung ohne Kreditkarte im OpenSight Customer Portal gratis (5 ohne Registrierung).

Control Plane auf jeder Linux-VM installieren — Ubuntu / Debian

curl -fsSL https://artifacts.saas.opensight.ch/binaries/linkmesh-server/latest/linkmesh-server_latest_amd64.deb -o linkmesh-server.deb && sudo apt install -y ./linkmesh-server.deb

RHEL / Rocky / AlmaLinux, Collector-Enrollment und die vollständige Anleitung: Installationsanleitung →

Beginnen Sie mit einem Test-Collector.

Sichern Sie die aktuelle Konfiguration, verbinden Sie einen Collector und prüfen Sie ein echtes Signal im Backend. Testen Sie eine Änderung und den Rollback, bevor Sie weitere Collectors umstellen.

Setup-Anleitungen und Evaluations-Checkliste

Download ohne E-Mail-Adresse. Enthält Fehlertests, Rollback und Prüfpunkte für Ingest-Kosten.