Anleitung

dicto zeigt, was du sagst oder tippst, als großen, klaren Text. Diese Anleitung beschreibt, wie die App funktioniert.

Inhaltsverzeichnis

Erste Schritte

Beim ersten Start von dicto führt eine kurze Einführung durch die Wahl einer voreingestellten Sprechsprache und eines Farbschemas. Beides lässt sich jederzeit in den Einstellungen ändern. Auf diese Voreinstellungsbildschirme folgen drei Bildschirme mit grundlegenden Hinweisen zu den Funktionen der App, die übersprungen werden können.

Wenn die Mikrofontaste zum ersten Mal gedrückt wird, bittet iOS mit den Bildschirmen Zugriffsberechtigungen um die Erlaubnis, auf die Spracherkennung und das Mikrofon deines Geräts zuzugreifen. Beides sind Apple-Dienste, und dicto benötigt sie, um deine Sprache als Text anzuzeigen. Tippe auf Erlauben; um den Zugriff später zu erteilen, öffne die iOS-Einstellungen, gehe zu Einstellungen ▸ dicto und aktiviere Mikrofon und Spracherkennung.

Der Hauptbildschirm

Der Hauptbildschirm zeigt die aktuelle Nachricht sowie die Bedienelemente zum Erstellen, Löschen und erneuten Aufrufen von Nachrichten. Das Hochformat zeigt etwas größeren Text (gut für kürzere Nachrichten), das Querformat zeigt längeren Text (gut für etwas längere oder kontextbezogene Nachrichten).

Sprechen & Diktat

Starte das Diktat, indem du auf die Mikrofontaste tippst oder auf die Nachrichtenanzeige doppeltippst. Sprich normal; die Wörter erscheinen, während du sie sagst. Wenn das Diktat nicht gut funktioniert (Sätze werden nicht richtig beendet), kann die Einstellung Sprechtempo für schnellere oder langsamere Sprechende im Menü Einstellungen helfen.

Standardmäßig beendet eine Pause von etwa einer Sekunde einen Satz, dann fügt dicto einen Punkt oder ein Fragezeichen hinzu und hört weiter zu. Eine Pause von etwa zwei Sekunden beendet den aktuellen Sprechbeitrag und zeigt den endgültigen Text an, wobei Nachrichten, die über den Hauptbildschirm hinausreichen, automatisch scrollen. Nachrichten lassen sich auch manuell scrollen, und das automatische Scrollen kann im Menü Einstellungen deaktiviert werden. Wie lange dicto bei Pausen wartet, stellst du mit Sprechtempo in den Einstellungen ein. Eine Solo-Sitzung endet automatisch nach etwa anderthalb Minuten, damit das Mikrofon in einem lauten Raum nicht offen bleibt. Auch die Satzzeiten in Solo werden über die Einstellung Sprechtempo festgelegt.

Das Diktat stammt von Apples Spracherkennung und ist nicht perfekt. Akzente, Hintergrundgeräusche, ungewöhnliche Namen, sehr kurze Sätze und Menschen, die durcheinandersprechen, können falsch verstanden werden. Am besten funktioniert es, wenn du deutlich und in natürlichem Tempo sprichst und die Einstellung Sprechtempo wählst, die zur sprechenden Person passt.

Um den Text auf dem Bildschirm zu löschen, tippe unten auf dem Bildschirm auf Löschen. Wenn du Löschen gedrückt hältst, erscheint der Dialog Neue Sitzung beginnen?. Tippe auf Neu beginnen, um dicto zurückzusetzen und den Bereich FRÜHER zu leeren.

Solo

Solo nutzt Stimmisolations-Technologie, um dicto auf eine erfasste Stimme auszurichten - darauf ausgelegt, die Worte dieser Person zu zeigen und andere Stimmen in der Nähe zu ignorieren. Solo ermöglicht den freihändigen Betrieb. Sprache anderer Stimmen wird nicht angezeigt und nie transkribiert. Solo funktioniert am besten, wenn in einem ruhigen bis mäßig lauten Raum jeweils eine Person spricht; wenn dicto nicht sicher ist, ob eine Stimme die erfasste ist, zeigt es nichts an. Schnell gesprochene Wendungen mit weniger als drei Wörtern können zu kurz sein, um erkannt zu werden (z. B. "Hallo", "Sehr schön"), und erscheinen dann möglicherweise nicht auf dem Bildschirm.

So funktioniert Solo

Während Solo aktiv ist, hört dicto im Raum zu und verwandelt jeden Sprachabschnitt in eine kleine Zahlenmenge, die den Klang der Stimme beschreibt, nicht die Worte. Diese Zahlen werden mit den bei der Erfassung aufgenommenen Zahlen verglichen. Sprache, die zur erfassten Stimme passt, wird transkribiert und angezeigt; Sprache, die nicht passt, wird verworfen, ohne je in Text umgewandelt zu werden. Der Vergleich läuft über kleine Machine-Learning-Modelle, die in der App mitgeliefert werden und vollständig auf dem Gerät laufen; kein Cloud-Dienst, kein Konto und keine Verbindung sind beteiligt. Es wird niemals Sprache aufbewahrt oder aufgezeichnet.

Eine Stimme erfassen

  1. Halte die Mikrofontaste gedrückt und sprich natürlich. Was du während des Haltens sagst, wird als normale Nachricht angezeigt.
  2. Ein Panel zeigt den Fortschritt der Erfassung. Der Balken ist rot, bis genug Stimme für eine grundlegende Zuordnung erfasst wurde.
  3. Nach etwa drei Sekunden tatsächlicher Sprache wird der Balken gelb und ein Ton erklingt: Die grundlegende Erfassung ist gelungen, und die Taste kann jederzeit losgelassen werden.
  4. Weiteres Halten der Taste verbessert die Erfassung, bis zu zehn Sekunden tatsächlicher Sprache für eine vollständige Erfassung. Der Balken wandert von Gelb Richtung Grün, je mehr Stimme erfasst wird, und erreicht Grün nach etwa zehn Sekunden. Die vollständige Erfassung wird durch das Solo Glow angezeigt, einen Leuchteffekt über den ganzen Bildschirm.
  5. Lass die Taste los. Solo beginnt, auf die erfasste Stimme zu hören. Die erfolgreiche Erfassung erkennst du daran, dass das Mikrofonsymbol zum Solo-Symbol wird: eine Person mit Sprachbalken, umgeben von einem durchgezogenen türkisen Kreis.

Wurde beim Loslassen der Taste zu wenig Stimme erfasst, hört dicto noch etwa zwei Sekunden zu und bricht die aktuelle Erfassung ab, wenn sie sich weiterhin nicht abschließen lässt.

Ergänzende Stimmerfassung und das Solo Glow

Eine einfache Erfassung genügt zum Start, und dicto erledigt den Rest unauffällig von selbst. Während einer Sitzung werden Sprachmomente, die eindeutig zur erfassten Stimme passen, der Erfassung hinzugefügt, was die Genauigkeit im Lauf des Gesprächs verbessert. Das nennt sich ergänzende Stimmerfassung; sie nutzt nur die erfasste Stimme, nie andere Sprache. Wenn die Erfassung ihren vollen Umfang erreicht - ob durch Halten der Taste bis zum grünen Balken oder durch die Ergänzung im Gespräch - erscheint das Solo Glow: ein kurzes, lautloses Leuchten über den ganzen Bildschirm, das bedeutet, dass dicto die Stimme vollständig erfasst hat. Wenn es erscheint, ist nichts weiter zu tun.

Während einer Sitzung

Die erfasste Stimme wird jeweils als eine Nachricht angezeigt, mit den Zeiten aus Sprechtempo. Andere Stimmen erzeugen nichts auf dem Bildschirm. Früher ist ausgeblendet, solange eine Solo-Sitzung läuft. Tippe auf die Mikrofontaste, um das Zuhören zu pausieren oder fortzusetzen; die Sitzung pausiert außerdem von selbst nach etwa dreißig Sekunden Stille im Raum. Eine pausierte Solo-Sitzung erkennst du daran, dass die durchgezogene türkise Linie gestrichelt wird. Zum erneuten Aktivieren der laufenden Sitzung tippe auf die Solo-Taste.

Eine Sitzung beenden

Halte die Löschen-Taste gedrückt und bestätige mit Neu beginnen, um den aktuellen Text und die erfasste Stimme zu löschen; ein kurzer Hinweis "Sitzung gelöscht" bestätigt das Löschen. Eine Sitzung endet außerdem von selbst nach etwa drei Minuten ohne die erfasste Stimme oder wenn die App in den Hintergrund wechselt. Halte während einer Sitzung die Mikrofontaste gedrückt, um anstelle der erfassten Stimme eine andere zu erfassen.

Das Stimmprofil

Der Stimmabgleich läuft über kleine Machine-Learning-Modelle, die in der App mitgeliefert werden und vollständig auf deinem Gerät laufen. Es sind kein Cloud-Dienst, kein Konto und keine Verbindung beteiligt; die Modelle vergleichen Stimmen, mehr nicht. Die Erfassung selbst ist eine kleine Zahlenmenge zur Einordnung einer Stimme, die für die Dauer der Sitzung im Arbeitsspeicher gehalten wird: nie gespeichert, nie irgendwohin gesendet und mit dem Ende der Sitzung verschwunden.

Die Modelle für den Stimmabgleich sind die Sprecher-Modelle pyannote community-1 (Familie WeSpeaker), von FluidInference nach Core ML konvertiert und unter der Lizenz Creative Commons Attribution 4.0 genutzt.

Tippen

Tippe auf die Tastaturtaste, um Text eingeben zu öffnen. Tippe oder füge eine Nachricht ein und tippe dann auf Fertig (oder auf die blaue Häkchen-Taste auf der Tastatur), um sie auf dem Hauptbildschirm anzuzeigen, oder auf Abbrechen, um zu schließen, ohne die aktuelle Nachricht zu ändern.

Flüstermodus

Der Flüstermodus schaltet die Funktion für verschwindende Nachrichten ein und aus. Aktiviere den Flüstermodus in den Einstellungen, um Wisps zu senden: Nachrichten, die auf dem Bildschirm erscheinen, einige Sekunden bleiben und dann dauerhaft verblassen. Wisps werden nie in Früher gespeichert, das ausgeblendet ist, solange der Flüstermodus aktiv ist. Automatisches Scrollen ist ebenfalls deaktiviert, solange der Flüstermodus aktiv ist.

Vorlesen

Tippe auf die Vorlesen-Taste oben rechts, um die aktuell angezeigte Nachricht laut vorlesen zu lassen. Die Taste ist nicht verfügbar, wenn keine Nachricht auf dem Bildschirm ist. Die Vorlesestimme wird unter Stimme in den Einstellungen festgelegt; weitere Stimmen lassen sich in den iOS-Einstellungen unter Bedienungshilfen ▸ Gesprochene Inhalte ▸ Stimmen hinzufügen (nicht Siri).

Einstellungen

Tippe auf die Einstellungen-Taste (das Zahnrad, oben links), um das Einstellungsmenü zu öffnen.

Datenschutz & Daten

dicto verarbeitet alles auf deinem Gerät. Nichts, was du sagst oder tippst, wird an uns gesendet, und nichts wird gespeichert, sobald du die App schließt. Alle Einzelheiten findest du in der Datenschutzerklärung.

Support

Fragen, Probleme oder Feedback? Schreib uns an support@speechdisplay.com - wir helfen gern.

Zurück zur Startseite