Senity Speech Flow ist eine Anwendung, die auf deinem eigenen Rechner läuft. Du hältst eine Tastenkombination, sprichst, und der gesprochene Text wird erkannt, von einem Sprachmodell überarbeitet und in das Fenster eingefügt, in dem du gerade arbeitest. Weil dabei sowohl deine Stimme als auch der Inhalt deiner Arbeit verarbeitet wird, beschreibt dieser Abschnitt genauer als die übrigen, was das Programm wann übermittelt.
Sprachaufnahme und Spracherkennung
In der Werkseinstellung wird die Spracherkennung serverseitig ausgeführt. Die Aufnahme wird dazu an unseren Transkriptionsdienst unter sdr.senity.ai übermittelt, also an unsere eigenen Server der Hetzner Online GmbH in Deutschland. Übertragen wird die vollständige Aufnahme, also deine Stimme und alles, was das Mikrofon während des Diktats sonst noch erfasst. Eine Verarbeitung allein auf deinem Gerät ist möglich, wenn du in den Einstellungen auf den lokalen Betrieb umstellst und ein lokales Erkennungsmodell installierst.
Adresse und Zugangsdaten des Endpunkts sind in der Anwendung konfigurierbar. Trägst du dort einen anderen Endpunkt ein, gelangt die Aufnahme an dessen Betreiber.
Auf dem Transkriptions-Endpunkt, den Speech Flow anspricht, wird die Aufnahme nur im Arbeitsspeicher verarbeitet und an das Erkennungsmodell weitergereicht. Sie wird dort nicht abgelegt, und das Transkript wird nicht gespeichert; nach der Antwort ist beides fort. Das Erkennungsmodell läuft auf unseren eigenen Servern, die Aufnahme geht also nicht an einen dritten Anbieter. Wir sichern zu, sie nicht zum Training oder zur Verbesserung von KI-Modellen zu verwenden.
Andere Senity-Dienste, die Sprache verarbeiten, speichern durchaus: Längere Aufträge, die im Hintergrund laufen, legen Aufnahme und Transkript für bis zu sieben Tage ab und löschen sie danach automatisch; gespeicherte Sitzungen setzen eine eigene, gesonderte Einwilligung voraus und werden bei deren Widerruf gelöscht. Das Diktieren mit Speech Flow nimmt keinen dieser beiden Wege. Wir nennen sie hier, damit die Aussage oben nicht als pauschale Zusage für alle Senity-Dienste missverstanden wird.
Automatischer Wechsel zwischen lokaler und serverseitiger Verarbeitung
Die Anwendung kennt neben dem reinen Online- und dem reinen Offline-Betrieb einen automatischen Modus. Ist er eingeschaltet, entscheidet Speech Flow für jeden einzelnen Vorgang anhand technischer Kriterien, ob lokal oder serverseitig verarbeitet wird, insbesondere anhand eines Zeitlimits für den lokalen Weg und der gemessenen Antwortzeit der letzten Vorgänge. Antwortet die lokale Verarbeitung nicht rechtzeitig, wird ihr Ergebnis verworfen und der Server-Weg genutzt. In diesem Modus kann es also auch dann zu einer Übermittlung kommen, wenn du lokale Verarbeitung bevorzugst. Ab Werk ist dieser Modus nicht aktiv; die Werkseinstellung ist reiner Online-Betrieb.
Nachbearbeitung des Transkripts durch ein Sprachmodell
Speech Flow übergibt den erkannten Text anschließend einem Sprachmodell, das ihn nach der Anweisung des gewählten Modus bearbeitet, etwa formatiert, umformuliert oder übersetzt. Übermittelt werden dabei der Text und die Anweisung, nicht die Audioaufnahme. Ab Werk ist ein Senity-Endpunkt unter sdr.senity.ai hinterlegt. Alternativ lässt sich ein auf deinem Gerät betriebenes Modell auswählen oder ein externer Ollama-Dienst, der auch als Cloud-Angebot eingebunden werden kann. Im letzten Fall wird der Text an dessen Betreiber übermittelt. Sitzt dieser außerhalb der EU beziehungsweise des EWR oder verarbeitet er dort, liegt darin eine Übermittlung in ein Drittland im Sinne der Art. 44 ff. DSGVO. Welche Endpunkte und Modelle in deiner Installation aktiv sind und auf welche Übermittlungsgrundlage wir uns dabei stützen, teilen wir dir auf Anfrage über die in Abschnitt 1 genannte Kontaktadresse mit.
Titel des Fensters, in das du diktierst
Damit das Sprachmodell weiß, wohin der Text geht, übermittelt die Anwendung ab Werk den Titel und den Programmnamen des Fensters, in dem du gerade arbeitest. Ein Fenstertitel kann aussagekräftig sein: Er enthält häufig Dateinamen, Betreffzeilen, Namen oder Aktenzeichen. Du kannst diese Übermittlung in den Einstellungen abschalten.
Zwischenablage, markierter Text und Bildschirmfotos
Ein Modus kann so eingerichtet werden, dass er dem Sprachmodell zusätzlichen Zusammenhang mitgibt: den Inhalt deiner Zwischenablage, den gerade markierten Text im fremden Fenster oder ein Bildschirmfoto beziehungsweise das Abbild des aktiven Fensters. Diese Inhalte werden dann zusammen mit dem Transkript übermittelt.
Keiner der ausgelieferten Modi tut das. Diese Erfassung findet nur statt, wenn du sie für einen Modus selbst einschaltest. Der Grund für diese Voreinstellung ist der Umfang dessen, was dabei mitginge: Ein Bildschirmfoto zeigt alles, was gerade offen ist, auch fremde Nachrichten, fremde Dokumente und Daten Dritter, die von der Software nichts wissen. Bildschirmfotos an ein Cloud-Modell zu senden ist deshalb zusätzlich durch einen eigenen Schalter gesichert, der ab Werk ausgeschaltet ist. Bevor du diese Quellen einschaltest, prüfe bitte, ob du über die dabei erfassten Daten verfügen darfst; unterliegst du einer Verschwiegenheitspflicht (etwa nach § 203 StGB), gilt das besonders.
Stammdaten aus deinem Senity-Konto
Die Anwendung ruft aus deinem Senity-Konto deine Stammdaten ab (Anrede, Vor- und Nachname, E-Mail-Adresse, Telefonnummer, Position, Anschrift) und legt sie auf deinem Gerät ab. Sie dienen dazu, Platzhalter in deinen Modus-Anweisungen zu füllen, damit du etwa eine Grußformel nicht bei jedem Diktat neu sprechen musst. Verwendest du einen solchen Platzhalter, wird der eingesetzte Wert Teil des Textes, der an das Sprachmodell geht. Rechtsgrundlage ist Art. 6 Abs. 1 lit. b DSGVO (Vertragsdurchführung).
Was auf deinem Gerät gespeichert wird
Speech Flow führt auf deinem Rechner einen Verlauf deiner Diktate. Gespeichert werden der erkannte Text im Klartext, der Zeitpunkt, die Dauer, die Sprache und das Zielprogramm, in einer Datenbankdatei im Konfigurationsverzeichnis der Anwendung. Der Verlauf ist auf die letzten 1000 Einträge begrenzt, ältere werden automatisch entfernt; du kannst ihn jederzeit in den Einstellungen löschen. Diese Daten verlassen dein Gerät nicht - sie liegen aber unverschlüsselt in deinem Benutzerprofil, sind also für jeden lesbar, der Zugriff auf dein Benutzerkonto hat. Ebenfalls lokal liegen deine Einstellungen samt Modus-Anweisungen, dein Zugangsschlüssel, die oben genannten Stammdaten und die Programmprotokolle.
Fehlerberichte und Nutzungszahlen (Einwilligung)
Beim ersten Start fragt die Anwendung dich, ob sie Fehlerberichte und Nutzungszahlen an uns senden darf. Du hast drei gleichwertige Antworten:
- Mit Kontobezug: Die Zahlen werden deinem Senity-Konto zugeordnet. Damit können wir erkennen, wenn ausgerechnet bei dir etwas nicht funktioniert, und dich ansprechen, statt zu warten, bis du dich meldest.
- Ohne Kontobezug: Dieselben Zahlen, nur mit der Kennung deiner Installation. Wir sehen dann, wie oft ein Problem auftritt, aber nicht, bei wem.
- Gar nicht: Es wird nichts übertragen.
Erfasst werden Programmstarts, die Anzahl der Diktate, fehlgeschlagene Erkennungen, Wechsel des Verarbeitungswegs sowie Ausnahmen und Fehlermeldungen des Programms, jeweils mit Programmversion, Betriebssystem und Plattform. Inhalte deiner Diktate werden in keiner der Stufen übertragen - weder Transkripte noch Texte, Audio oder deine Modus-Anweisungen. Längen und Laufzeiten gehen nur als Größenklassen mit, nicht als Einzelwerte.
Die Kennung deiner Installation bleibt über die Zeit dieselbe und wird auch bei der Geräteanmeldung mitgeschickt. Sie ist damit ein Pseudonym, kein anonymes Datum: Der Bezug zu dir ließe sich serverseitig herstellen. Wir nennen die Stufe ohne Kontobezug deshalb bewusst nicht „anonym“.
Rechtsgrundlage ist Art. 6 Abs. 1 lit. a DSGVO (Einwilligung). Du kannst deine Antwort jederzeit mit Wirkung für die Zukunft ändern oder widerrufen, in den Einstellungen der Anwendung unter „Konto und Datenschutz“. Der Widerruf berührt nicht die Rechtmäßigkeit der bis dahin erfolgten Verarbeitung (Art. 7 Abs. 3 DSGVO). Lehnst du ab, kannst du zusätzlich wählen, dass wir dich nicht erneut fragen. Die Anwendung ist ohne diese Einwilligung uneingeschränkt nutzbar; wir koppeln keine Funktion daran (Art. 7 Abs. 4 DSGVO). Empfänger sind logs.senity.ai (Fehlerberichte) und analytics.senity.ai (Nutzungszahlen), beides eigene Senity-Infrastruktur.
Lizenz, Anmeldung und Verbrauch
Für die Lizenzprüfung, die Geräteanmeldung und die Anzeige deines Guthabens spricht die Anwendung mit sdr.senity.ai. Übermittelt werden dabei dein Zugangsschlüssel, die Kennung deiner Installation und technische Angaben zu Version und Betriebssystem. Rechtsgrundlage ist Art. 6 Abs. 1 lit. b DSGVO (Vertragsdurchführung).
Besondere Kategorien personenbezogener Daten (Art. 9 DSGVO)
Sprachaufnahmen können biometrische Daten im Sinne von Art. 4 Nr. 14 DSGVO enthalten, sofern sie zur eindeutigen Identifizierung einer natürlichen Person genutzt werden. Findet die Verarbeitung allein auf deinem Endgerät statt, werden dafür keine Sprachdaten an uns übertragen oder bei uns gespeichert, und diese Einordnung greift für unsere Verarbeitungstätigkeit in der Regel nicht. Soweit Sprachdaten serverseitig verarbeitet werden, erfolgt dies ausschließlich auf Grundlage ausdrücklicher Einwilligung (Art. 9 Abs. 2 lit. a DSGVO). Kumulativ dazu dient Art. 6 Abs. 1 lit. b DSGVO (Vertragserfüllung) als Rechtsgrundlage gemäß EuGH C-667/21.
Diktierst du Inhalte, die besondere Kategorien personenbezogener Daten enthalten - etwa Gesundheitsdaten in einem Arztbrief -, oder Inhalte Dritter, so bist für diese Verarbeitung du der Verantwortliche. Wir verarbeiten sie in deinem Auftrag. Bist du Berufsgeheimnisträger, schließe mit uns bitte vor dem Einsatz einen Auftragsverarbeitungsvertrag; sprich uns dazu über die in Abschnitt 1 genannte Adresse an.