KI-gestützte Wissenssuche, ohne die Daten aus der Hand zu geben

Quellcode in Rust

Ausgangssituation

  • Eine Browser-Erweiterung für Wissensarbeit: Sie wertet aus, was jemand liest und recherchiert, verknüpft es und macht es später wieder auffindbar - unterstützt durch ein Sprachmodell.
  • Der übliche Weg dorthin ist, Verlauf und Seiteninhalte an einen Cloud-Dienst zu schicken und das Modell dort darauf ansetzen zu lassen. Genau das sollte hier nicht passieren.
  • Verlauf, geöffnete Seiten und deren Inhalte werden ausschließlich auf dem Rechner des Nutzers verarbeitet und gespeichert.

Herausforderung

  • Der Widerspruch im Kern des Produkts: Ein Sprachmodell braucht Kontext, um nützlich zu sein - und dieser Kontext ist genau das, was den Rechner nicht verlassen soll.
  • Ein semantisches Datenmodell, das sehr unterschiedliche Quellen - Webseiten, E-Mails, Dokumente - so beschreibt, dass sich Beziehungen zwischen ihnen abbilden und auswerten lassen
  • Eine Suche, die im Browser schnell bleibt, obwohl Index und Auswertung dort liegen und nicht auf einem Server
  • Ansätze der Vektorsuche unter den Randbedingungen einer Browser-Erweiterung: begrenzter Speicher, begrenzte Laufzeit, kein nativer Prozess im Hintergrund
  • Anbindung externer Dienste für E-Mail und Dokumente, ohne das Datenschutzversprechen aufzuweichen

slowtec Lösung

  • Austauschbare Anbindung an Sprachmodelle statt eines fest verdrahteten Cloud-Anbieters. Eingebunden werden kann ebenso gut ein offenes Modell, das auf dem eigenen Rechner oder im Firmennetz läuft. Damit bleibt auch der KI-Teil innerhalb der Grenze, die das Produkt verspricht - der Datenschutz endet nicht dort, wo die Intelligenz anfängt.
  • Semantisches Datenmodell als gemeinsame Grundlage für Verknüpfung, Auswertung und Suche
  • Lokaler Suchindex mit Ansätzen der Vektorsuche, vollständig in WebAssembly
  • Entwicklung der Erweiterung in Rust, gemeinsam mit dem Team des Kunden - ausgeführt als WebAssembly im Browser
  • Anbindung externer Dienste über OAuth, sodass die Daten zwischen dem Rechner des Nutzers und den von ihm autorisierten Konten fließen
  • Ergänzend ein Service-Backend in Rust für die Aufgaben, die außerhalb des Browsers stattfinden müssen

Warum slowtec?

  • Offene Modelle und offene Schnittstellen sind für uns dieselbe Haltung, die wir in der Automatisierung vertreten: austauschbar statt an einen Anbieter gebunden
  • Lokale Verarbeitung statt Auslagerung auf fremde Server ist unsere bevorzugte Bauweise, nicht der Sonderfall - siehe auch Klimabilanzierung von Kläranlagen und Wasserstoff-Potenzialanalyse
  • Rust und WebAssembly sind bei uns Produktionstechnik - dieselbe Sprache im Browser und im Backend, ohne Bruch dazwischen
  • Erfahrung mit Datenmodellen und Suche über gewachsene, heterogene Datenbestände

Projektstatus: slowtec-Beteiligung 2023 bis 2024, abgeschlossen. Das Produkt wird seither von anderer Seite weiterentwickelt.

Wir sind für Sie da! Kontakt

Zurück zur Übersicht