Anleitung
dicto zeigt, was du sagst oder tippst, als großen, klaren Text. Diese Anleitung beschreibt, wie die App funktioniert.
Inhaltsverzeichnis
Erste Schritte
Beim ersten Start von dicto führt eine kurze Einführung durch die Wahl einer voreingestellten Sprechsprache und eines Farbschemas. Beides lässt sich jederzeit in den Einstellungen ändern. Auf diese Voreinstellungsbildschirme folgen drei Bildschirme mit grundlegenden Hinweisen zu den Funktionen der App, die übersprungen werden können.
Wenn die Mikrofontaste zum ersten Mal gedrückt wird, bittet iOS mit den Bildschirmen Zugriffsberechtigungen um die Erlaubnis, auf die Spracherkennung und das Mikrofon deines Geräts zuzugreifen. Beides sind Apple-Dienste, und dicto benötigt sie, um deine Sprache als Text anzuzeigen. Tippe auf Erlauben; um den Zugriff später zu erteilen, öffne die iOS-Einstellungen, gehe zu Einstellungen ▸ dicto und aktiviere Mikrofon und Spracherkennung.
Der Hauptbildschirm
Der Hauptbildschirm zeigt die aktuelle Nachricht sowie die Bedienelemente zum Erstellen, Löschen und erneuten Aufrufen von Nachrichten. Das Hochformat zeigt etwas größeren Text (gut für kürzere Nachrichten), das Querformat zeigt längeren Text (gut für etwas längere oder kontextbezogene Nachrichten).
- Nachrichtenanzeige: Zeigt Hinweise auf dem Bildschirm und die aktuelle Nachricht, so groß wie der verfügbare Platz es zulässt, und in Echtzeit aktualisiert, während du sprichst. Doppeltippe auf den Bereich, um das Diktat zu starten oder zu stoppen. Halte gedrückt, um die aktuelle Nachricht zu bearbeiten. Lange Nachrichten scrollen automatisch; zum manuellen Scrollen wechselst du in den Einstellungen.
- Mikrofontaste: Startet oder stoppt eine gesprochene Nachricht. Siehe Sprechen & Diktat. Halte sie gedrückt, um die Erfassung in Solo zu beginnen.
- Tastaturtaste: Öffnet die Tastatur, um eine Nachricht zu tippen oder einzufügen, statt zu sprechen. Siehe Tippen.
- Löschen-Taste: Löscht die aktuelle Nachricht. Die gelöschte Nachricht wird nicht in Früher gespeichert. Ein langes Drücken der Löschen-Taste öffnet den Dialog "Neue Sitzung beginnen?", der die App zurücksetzt.
- Früher: Ein Streifen abgeschlossener Nachrichten am unteren Bildschirmrand. Eine nicht gelöschte Nachricht wird zum Bereich Früher hinzugefügt, sobald eine neue Nachricht beginnt. Tippe auf eine Nachricht, um sie erneut anzuzeigen. Früher wird beim Schließen der App geleert und ist inaktiv, solange der Flüstermodus aktiv ist oder eine Solo-Sitzung läuft.
- Vorlesen-Taste: Liest die aktuelle Nachricht mit der in den Einstellungen gewählten Stimme vor. Siehe Vorlesen.
- Einstellungen-Taste: Öffnet den Einstellungsbildschirm, in dem Vorgaben wie Sprache, Farbschema, Sprechtempo und Flüstermodus festgelegt werden. Siehe Einstellungen.
Sprechen & Diktat
Starte das Diktat, indem du auf die Mikrofontaste tippst oder auf die Nachrichtenanzeige doppeltippst. Sprich normal; die Wörter erscheinen, während du sie sagst. Wenn das Diktat nicht gut funktioniert (Sätze werden nicht richtig beendet), kann die Einstellung Sprechtempo für schnellere oder langsamere Sprechende im Menü Einstellungen helfen.
Standardmäßig beendet eine Pause von etwa einer Sekunde einen Satz, dann fügt dicto einen Punkt oder ein Fragezeichen hinzu und hört weiter zu. Eine Pause von etwa zwei Sekunden beendet den aktuellen Sprechbeitrag und zeigt den endgültigen Text an, wobei Nachrichten, die über den Hauptbildschirm hinausreichen, automatisch scrollen. Nachrichten lassen sich auch manuell scrollen, und das automatische Scrollen kann im Menü Einstellungen deaktiviert werden. Wie lange dicto bei Pausen wartet, stellst du mit Sprechtempo in den Einstellungen ein. Eine Solo-Sitzung endet automatisch nach etwa anderthalb Minuten, damit das Mikrofon in einem lauten Raum nicht offen bleibt. Auch die Satzzeiten in Solo werden über die Einstellung Sprechtempo festgelegt.
Das Diktat stammt von Apples Spracherkennung und ist nicht perfekt. Akzente, Hintergrundgeräusche, ungewöhnliche Namen, sehr kurze Sätze und Menschen, die durcheinandersprechen, können falsch verstanden werden. Am besten funktioniert es, wenn du deutlich und in natürlichem Tempo sprichst und die Einstellung Sprechtempo wählst, die zur sprechenden Person passt.
Um den Text auf dem Bildschirm zu löschen, tippe unten auf dem Bildschirm auf Löschen. Wenn du Löschen gedrückt hältst, erscheint der Dialog Neue Sitzung beginnen?. Tippe auf Neu beginnen, um dicto zurückzusetzen und den Bereich FRÜHER zu leeren.
Solo
Solo nutzt Stimmisolations-Technologie, um dicto auf eine erfasste Stimme auszurichten - darauf ausgelegt, die Worte dieser Person zu zeigen und andere Stimmen in der Nähe zu ignorieren. Solo ermöglicht den freihändigen Betrieb. Sprache anderer Stimmen wird nicht angezeigt und nie transkribiert. Solo funktioniert am besten, wenn in einem ruhigen bis mäßig lauten Raum jeweils eine Person spricht; wenn dicto nicht sicher ist, ob eine Stimme die erfasste ist, zeigt es nichts an. Schnell gesprochene Wendungen mit weniger als drei Wörtern können zu kurz sein, um erkannt zu werden (z. B. "Hallo", "Sehr schön"), und erscheinen dann möglicherweise nicht auf dem Bildschirm.
So funktioniert Solo
Während Solo aktiv ist, hört dicto im Raum zu und verwandelt jeden Sprachabschnitt in eine kleine Zahlenmenge, die den Klang der Stimme beschreibt, nicht die Worte. Diese Zahlen werden mit den bei der Erfassung aufgenommenen Zahlen verglichen. Sprache, die zur erfassten Stimme passt, wird transkribiert und angezeigt; Sprache, die nicht passt, wird verworfen, ohne je in Text umgewandelt zu werden. Der Vergleich läuft über kleine Machine-Learning-Modelle, die in der App mitgeliefert werden und vollständig auf dem Gerät laufen; kein Cloud-Dienst, kein Konto und keine Verbindung sind beteiligt. Es wird niemals Sprache aufbewahrt oder aufgezeichnet.
Eine Stimme erfassen
- Halte die Mikrofontaste gedrückt und sprich natürlich. Was du während des Haltens sagst, wird als normale Nachricht angezeigt.
- Ein Panel zeigt den Fortschritt der Erfassung. Der Balken ist rot, bis genug Stimme für eine grundlegende Zuordnung erfasst wurde.
- Nach etwa drei Sekunden tatsächlicher Sprache wird der Balken gelb und ein Ton erklingt: Die grundlegende Erfassung ist gelungen, und die Taste kann jederzeit losgelassen werden.
- Weiteres Halten der Taste verbessert die Erfassung, bis zu zehn Sekunden tatsächlicher Sprache für eine vollständige Erfassung. Der Balken wandert von Gelb Richtung Grün, je mehr Stimme erfasst wird, und erreicht Grün nach etwa zehn Sekunden. Die vollständige Erfassung wird durch das Solo Glow angezeigt, einen Leuchteffekt über den ganzen Bildschirm.
- Lass die Taste los. Solo beginnt, auf die erfasste Stimme zu hören. Die erfolgreiche Erfassung erkennst du daran, dass das Mikrofonsymbol zum Solo-Symbol wird: eine Person mit Sprachbalken, umgeben von einem durchgezogenen türkisen Kreis.
Wurde beim Loslassen der Taste zu wenig Stimme erfasst, hört dicto noch etwa zwei Sekunden zu und bricht die aktuelle Erfassung ab, wenn sie sich weiterhin nicht abschließen lässt.
Ergänzende Stimmerfassung und das Solo Glow
Eine einfache Erfassung genügt zum Start, und dicto erledigt den Rest unauffällig von selbst. Während einer Sitzung werden Sprachmomente, die eindeutig zur erfassten Stimme passen, der Erfassung hinzugefügt, was die Genauigkeit im Lauf des Gesprächs verbessert. Das nennt sich ergänzende Stimmerfassung; sie nutzt nur die erfasste Stimme, nie andere Sprache. Wenn die Erfassung ihren vollen Umfang erreicht - ob durch Halten der Taste bis zum grünen Balken oder durch die Ergänzung im Gespräch - erscheint das Solo Glow: ein kurzes, lautloses Leuchten über den ganzen Bildschirm, das bedeutet, dass dicto die Stimme vollständig erfasst hat. Wenn es erscheint, ist nichts weiter zu tun.
Während einer Sitzung
Die erfasste Stimme wird jeweils als eine Nachricht angezeigt, mit den Zeiten aus Sprechtempo. Andere Stimmen erzeugen nichts auf dem Bildschirm. Früher ist ausgeblendet, solange eine Solo-Sitzung läuft. Tippe auf die Mikrofontaste, um das Zuhören zu pausieren oder fortzusetzen; die Sitzung pausiert außerdem von selbst nach etwa dreißig Sekunden Stille im Raum. Eine pausierte Solo-Sitzung erkennst du daran, dass die durchgezogene türkise Linie gestrichelt wird. Zum erneuten Aktivieren der laufenden Sitzung tippe auf die Solo-Taste.
Eine Sitzung beenden
Halte die Löschen-Taste gedrückt und bestätige mit Neu beginnen, um den aktuellen Text und die erfasste Stimme zu löschen; ein kurzer Hinweis "Sitzung gelöscht" bestätigt das Löschen. Eine Sitzung endet außerdem von selbst nach etwa drei Minuten ohne die erfasste Stimme oder wenn die App in den Hintergrund wechselt. Halte während einer Sitzung die Mikrofontaste gedrückt, um anstelle der erfassten Stimme eine andere zu erfassen.
Das Stimmprofil
Der Stimmabgleich läuft über kleine Machine-Learning-Modelle, die in der App mitgeliefert werden und vollständig auf deinem Gerät laufen. Es sind kein Cloud-Dienst, kein Konto und keine Verbindung beteiligt; die Modelle vergleichen Stimmen, mehr nicht. Die Erfassung selbst ist eine kleine Zahlenmenge zur Einordnung einer Stimme, die für die Dauer der Sitzung im Arbeitsspeicher gehalten wird: nie gespeichert, nie irgendwohin gesendet und mit dem Ende der Sitzung verschwunden.
Die Modelle für den Stimmabgleich sind die Sprecher-Modelle pyannote community-1 (Familie WeSpeaker), von FluidInference nach Core ML konvertiert und unter der Lizenz Creative Commons Attribution 4.0 genutzt.
Tippen
Tippe auf die Tastaturtaste, um Text eingeben zu öffnen. Tippe oder füge eine Nachricht ein und tippe dann auf Fertig (oder auf die blaue Häkchen-Taste auf der Tastatur), um sie auf dem Hauptbildschirm anzuzeigen, oder auf Abbrechen, um zu schließen, ohne die aktuelle Nachricht zu ändern.
Flüstermodus
Der Flüstermodus schaltet die Funktion für verschwindende Nachrichten ein und aus. Aktiviere den Flüstermodus in den Einstellungen, um Wisps zu senden: Nachrichten, die auf dem Bildschirm erscheinen, einige Sekunden bleiben und dann dauerhaft verblassen. Wisps werden nie in Früher gespeichert, das ausgeblendet ist, solange der Flüstermodus aktiv ist. Automatisches Scrollen ist ebenfalls deaktiviert, solange der Flüstermodus aktiv ist.
Vorlesen
Tippe auf die Vorlesen-Taste oben rechts, um die aktuell angezeigte Nachricht laut vorlesen zu lassen. Die Taste ist nicht verfügbar, wenn keine Nachricht auf dem Bildschirm ist. Die Vorlesestimme wird unter Stimme in den Einstellungen festgelegt; weitere Stimmen lassen sich in den iOS-Einstellungen unter Bedienungshilfen ▸ Gesprochene Inhalte ▸ Stimmen hinzufügen (nicht Siri).
Einstellungen
Tippe auf die Einstellungen-Taste (das Zahnrad, oben links), um das Einstellungsmenü zu öffnen.
- Flüstermodus: Schaltet verschwindende Nachrichten ein und aus. Siehe Flüstermodus.
- Sprechtempo: Schnell, Mittel oder Langsam. Stellt ein, wie lange dicto bei Pausen wartet, um Sätze oder Nachrichten zu beenden. Wenn Sätze nicht getrennt werden, wähle Schnell; wenn Sätze abgeschnitten werden, wähle Langsam.
- Solo-Stimmabgleich: Streng, Ausgewogen oder Locker. Stellt ein, wie genau eine Stimme mit der erfassten übereinstimmen muss, um in Solo angezeigt zu werden. Gilt ab der nächsten Erfassung. Wähle Streng, wenn die Stimmen im Raum ähnlich klingen.
- Gesprächsabstand (nur iPad): Passt die Schriftgröße für Gespräche Nah (kleinere Schrift) und Fern (größere Schrift) an.
- Lange Nachrichten automatisch scrollen: Wenn aktiviert, scrollen lange Nachrichten in lesbarem Tempo automatisch bis zum Ende und zurück; deaktiviere die Option, um das automatische Scrollen zu stoppen. Nachrichten lassen sich immer manuell scrollen.
- Eingabe beim Öffnen: Gesprochen öffnet dicto im Zuhörmodus für die erste Nachricht, wie ein schneller Gesprächspartner; Manuell öffnet dicto mit der normalen Oberfläche und erlaubt für die erste Nachricht gesprochene oder getippte Eingabe.
- Stimme: Die Stimme, die zum Vorlesen verwendet wird.
- Farbschema: Wähle bevorzugte Anzeigefarben. Optionen System, Hell und Dunkel sowie kontrastreiche Paare: Schwarz auf Weiß, Weiß auf Schwarz, Gelb auf Blau, Grün auf Schwarz, Orange auf Schwarz, Purpurrot auf Weiß, Neonpink auf Schwarz und Weiß auf Grün. Jede Farbkombination erfüllt den Barrierefreiheitsstandard WCAG AA für Kontrast, und in den großen Größen, die dicto anzeigt, erfüllt jede Kombination AAA.
- Sprache: Die Sprache, die du zum Diktieren sprichst (nicht die Sprache der App). dicto unterstützt über 50 gesprochene Sprachen, basierend auf Apples geräteinternem Diktat. Jede Sprache kann gewählt und genutzt werden, sofern sie vom Gerät unterstützt wird, unabhängig von der Sprache der Benutzeroberfläche (z. B. lässt sich chinesisches Diktat in einer englischsprachigen App-Oberfläche nutzen). Siehe die Liste der Diktatsprachen. Die Oberfläche von dicto selbst ist in 14 Sprachen verfügbar; siehe Oberflächensprachen.
- Über dicto: App-Version, eine kurze Beschreibung und ein Link zu dieser Website.
Datenschutz & Daten
dicto verarbeitet alles auf deinem Gerät. Nichts, was du sagst oder tippst, wird an uns gesendet, und nichts wird gespeichert, sobald du die App schließt. Alle Einzelheiten findest du in der Datenschutzerklärung.
Support
Fragen, Probleme oder Feedback? Schreib uns an support@speechdisplay.com - wir helfen gern.