Sprachhilfe für macOS

Native macOS-App mit lokaler KI

Spracheingabe, Chat und Workflows in einer klaren Mac-Oberfläche.

Sprachhilfe verbindet Diktat, KI-gestützte Textverarbeitung, eigene Wissensquellen und wiederverwendbare Workflows. Entwickelt für Menschen, die lokal, kontrolliert und schnell am Mac arbeiten wollen.

macOS 14 oder neuer Apple Silicon optimiert Developer-ID signiert GPL-3.0 Open Source
SH

Übersicht

Lokale Werkzeuge & KI
36
Meine Workflowsbereit zur Nutzung
Entdeckenlokale Modelle
17 lokal 19 Cloud optional MLX bereit
AAufnahme & Transkription20
TText-to-Speech3
LLLM-Anbieter11
WWorkflows8
KEigene Wissensquellen+

Lokale Modelle entdecken

MLX-kompatible Modelle hinzufügen und direkt in Sprachhilfe nutzen.

App herunterladen

Funktionen im Überblick

Die Seite greift die Struktur deiner App auf: Menü links, Inhalte rechts, klare Listen und auffällige Aktionsbereiche.

Aufnahme

Spracheingabe und Transkription

Diktiere Texte, transkribiere Inhalte und lasse Ergebnisse direkt weiterverarbeiten.

Lokale KI

MLX-Modelle auf dem Mac

Quantisierte Modelle laufen lokal auf Apple Silicon, ohne separaten Server.

Chat

KI-Chat mit Kontrolle

Nutze Chat-Funktionen, ohne den Kontext ungeprüft aus der Hand zu geben.

Workflows für wiederkehrende Aufgaben

System-Prompts, Aktionen und Nachbearbeitung lassen sich speichern und gezielt einsetzen.

01

Prompt speichern

Lege eigene Regeln und Rollen für wiederkehrende Aufgaben an.

02

Sprache oder Text nutzen

Starte Workflows direkt aus Spracheingabe, Chat oder bestehenden Texten.

03

Ergebnis übernehmen

Korrigieren, zusammenfassen, formatieren oder für bestimmte Zielgruppen umschreiben.

Eigene Wissensquellen

Dokumente werden bewusst freigegeben. Du bestimmst, welcher Kontext für welche Aufgabe relevant ist.

Kontrolle

Kontext bewusst wählen

Wissensquellen werden nicht automatisch vermischt, sondern gezielt eingesetzt.

Privat

Lokal arbeiten

Für lokale Modelle bleiben Eingaben und Dokumente auf deinem Mac.

Übersicht

Klare Verwaltung

Die Oberfläche bleibt nah an macOS: Seitenleiste, Listen, Karten und Statusanzeigen.

Bedienungsanleitung

Sprachhilfe richtig einrichten und nutzen.

Schnelle, private Sprache-zu-Text-Erkennung für deinen Mac: transkribieren mit lokalen oder Cloud-Engines, Text mit KI-Prompts verarbeiten und direkt in jede App einfügen.

Version 1.6.12 · Juli 2026 · Tarik Zengin

Einführung

Sprachhilfe ist ein Diktier- und Transkriptions-Tool für macOS. Per Tastenkombination sprichst du Text, der automatisch erkannt und an der Cursor-Position in jede beliebige App eingefügt wird. Das funktioniert wahlweise mit lokalen On-Device-Engines, privat und ohne Internet, oder mit Cloud-Anbietern für höhere Genauigkeit.

Diese Anleitung führt durch alle Bereiche der Einstellungen. Einzelne Werte, etwa installierte Modelle, können je nach Installation abweichen.

Wichtigster Startpunkt im Alltag: der Bereich „Tastenkürzel“. Dort legst du fest, mit welcher Taste du Diktate startest und stoppst.

Start (Dashboard)

Die Startseite zeigt eine kurze Übersicht deiner Nutzung: Anzahl diktierter Wörter, durchschnittliche Wörter pro Minute, Anzahl genutzter Apps und die geschätzte gesparte Zeit gegenüber manuellem Tippen.

Darunter zeigt ein Aktivitäts-Diagramm die Nutzung der letzten Tage. Eine Liste der letzten Transkriptionen erlaubt schnellen Zugriff auf zuletzt diktierte Texte.

Screenshot: Start — Dashboard mit Nutzungsstatistik und Aktivitätsverlauf
Start-Dashboard mit Nutzungsstatistik und Aktivitätsverlauf
Start — Dashboard mit Nutzungsstatistik und Aktivitätsverlauf

Allgemein

Hier findest du die grundlegenden Einstellungen der App.

  • Gesprochene Sprache: automatische Erkennung oder Einschränkung auf bestimmte Sprachen, um die Genauigkeit zu verbessern.
  • Übersetzung: optionale lokale Übersetzung über Apple Translate.
  • App-Sprache und Autostart beim Anmelden.
  • Darstellung: Sprachhilfe bleibt standardmäßig als Menüleistensymbol aktiv, ohne Dock-Symbol.
  • Indikator: Anzeige während eines Diktats als Notch, schwebendes Overlay oder schlichtes Icon, inklusive Live-Vorschau des erkannten Texts.
Screenshot: Allgemein — Sprache, Autostart, Darstellung und Indikator-Stil
Allgemein-Einstellungen mit Sprache, Autostart, Darstellung und Indikator-Stil
Allgemein — Sprache, Autostart, Darstellung und Indikator-Stil mit Live-Vorschau

Aufnahme

Der Bereich Aufnahme ist das Herzstück der Transkription. Hier stellst du Standard-Engine und Standard-Modell für die Spracherkennung ein.

Außerdem konfigurierst du Ausgabemodus, Mikrofonauswahl mit Testfunktion, Soundfeedback bei Start, Erfolg und Fehler, Verhalten der Zwischenablage, automatische Formatierung sowie Audio Ducking.

Audio Ducking senkt die Systemlautstärke während einer Aufnahme automatisch ab. Optional kann Medienwiedergabe pausiert werden.

Screenshot: Aufnahme — Engine, Modell, Mikrofon und Ausgabe
Aufnahme-Einstellungen mit Engine, Modell, Ausgabemodus, Mikrofon und Sound-Feedback
Aufnahme — Engine, Modell, Ausgabemodus, Mikrofon, Sound-Feedback, Zwischenablage
Screenshot: Aufnahme — Audio Ducking und Medienwiedergabe
Aufnahme-Einstellungen mit Audio Ducking und Medienwiedergabe pausieren
Aufnahme — Audio Ducking, Medienwiedergabe pausieren

Wiederherstellung

Falls eine Transkription unterbrochen wird, etwa durch einen Absturz oder Verbindungsfehler, bleibt die aufgezeichnete Audiodatei erhalten.

In diesem Bereich lässt sie sich nachträglich manuell transkribieren oder verwerfen. So geht diktierter Text nicht verloren.

Screenshot: Wiederherstellung — Aufnahme erneut transkribieren
Wiederherstellung nicht abgeschlossener Aufnahme
Wiederherstellung — nicht abgeschlossene Aufnahme erneut transkribieren

Tastenkürzel

Alle Hotkeys befinden sich an einem Ort. Beim Diktat-Kurzbefehl stehen drei Modi zur Wahl.

  • Hybrid: kurz drücken zum Umschalten, halten für Push-to-Talk.
  • Push-to-Talk: halten zum Aufnehmen, loslassen zum Stoppen.
  • Umschalten: einmal drücken zum Starten, erneut drücken zum Stoppen.

Zusätzlich lassen sich Kurzbefehle für Workflow-Palette, Recorder sowie Öffnen oder Kopieren der letzten Transkription festlegen.

Screenshot: Tastenkürzel — Diktat-Modus und Shortcuts
Tastenkürzel-Einstellungen mit Diktat-Modus, Workflow-Palette, Recorder und letzter Transkription
Tastenkürzel — Diktat-Modus, Workflow-Palette, Recorder, letzte Transkription

Datei-Transkription

Bestehende Audio- oder Videodateien lassen sich per Drag & Drop oder über die Dateiauswahl transkribieren.

Unterstützt werden unter anderem WAV, MP3, M4A, FLAC, MP4 und MOV.

Screenshot: Datei-Transkription — Dateien ablegen oder auswählen
Datei-Transkription mit Ablagefläche für Audio- und Videodateien
Datei-Transkription — Audio-/Videodateien ablegen oder auswählen

Überwachter Ordner

Ein Ordner kann automatisch überwacht werden. Neue Audiodateien darin werden selbstständig transkribiert.

Das Ergebnis wird zum Beispiel als Markdown-Datei in einen Ausgabeordner geschrieben. Das ist praktisch für wiederkehrende Aufnahmen aus einem gemeinsamen Ablageordner.

Screenshot: Überwachter Ordner — automatische Transkription
Überwachter Ordner mit automatischer Transkription neuer Dateien
Überwachter Ordner — automatische Transkription neuer Dateien

Recorder

Der Recorder ist ein eigenständiger Aufnahmemodus für längere Mitschnitte, etwa Meetings.

Mikrofon und/oder Systemaudio können gleichzeitig aufgezeichnet werden, optional mit Live-Transkription während der Aufnahme. Abgeschlossene Aufnahmen erscheinen in einer Liste und können direkt transkribiert, im Finder angezeigt oder gelöscht werden.

Screenshot: Recorder — Aufnahme mit Live-Transkription
Recorder mit eigenständiger Aufnahme und Live-Transkription
Recorder — eigenständige Aufnahme mit Live-Transkription

Verlauf

Der Verlauf ist eine durchsuchbare Historie aller bisherigen Transkriptionen. Er lässt sich nach Ziel-App und Zeitraum filtern.

So findest du kürzlich diktierte Texte wieder, ohne sie erneut sprechen zu müssen.

Screenshot: Verlauf — Suche und Filter
Verlauf mit Suche und Filter
Verlauf — Suche und Filter

Wörterbuch

Eigene Fachbegriffe, Namen oder Produktbezeichnungen lassen sich hinterlegen, damit sie zuverlässiger erkannt werden.

Zusätzlich kannst du Korrekturen für Begriffe pflegen, die die Spracherkennung typischerweise falsch versteht. Eine Übersicht zeigt, welche Engines eigene Begriffe unterstützen und welche nur nachträgliche Korrekturen anwenden.

Screenshot: Wörterbuch — Begriffe und Korrekturen
Wörterbuch mit Begriffen, Korrekturen und Engine-Unterstützung
Wörterbuch — Begriffe, Korrekturen und Engine-Unterstützung

Snippets

Snippets sind kurze Auslöser-Kürzel, die automatisch zu längeren, wiederkehrenden Textbausteinen expandiert werden.

Sie eignen sich für Standardformulierungen, Signaturen oder häufig verwendete Textblöcke.

Screenshot: Snippets — leerer Zustand
Snippets mit leerem Zustand und Schaltfläche zum Hinzufügen
Snippets — leerer Zustand, Snippet hinzufügen

Workflows

Workflows verarbeiten diktierten Text automatisch mit einem KI-Modell weiter, zum Beispiel zum Umformulieren, Übersetzen oder fachlichen Analysieren.

Ein Standard-Anbieter und Standard-Modell gelten für neue Workflows, sofern sie nicht individuell überschrieben werden. Jeder Workflow lässt sich aktivieren, deaktivieren, manuell über die Workflow-Palette auslösen oder als globale Standardeinstellung festlegen.

Screenshot: Workflows — KI-gestützte Textverarbeitung
Workflows zur Verwaltung eigener KI-gestützter Textverarbeitung
Workflows — eigene KI-gestützte Textverarbeitung verwalten

Integrationen

Meine Plugins

Sprachhilfe ist modular aufgebaut. Transkriptions-Engines, Text-to-Speech, LLM-Anbieter, Nachbearbeitungs-Schritte und weitere Funktionen sind einzelne Plugins, gruppiert nach Kategorie.

Jedes Plugin zeigt, ob es lokal oder über die Cloud läuft, und lässt sich einzeln konfigurieren oder deaktivieren.

Entdecken

Im Bereich „Entdecken“ lassen sich lokale, MLX-kompatible Sprachmodelle von Hugging Face direkt durchsuchen und hinzufügen. Das funktioniert ohne API-Key und läuft auf dem eigenen Mac mit Apple Silicon.

Ein Klick auf „Hinzufügen“ registriert ein Modell. Geladen und heruntergeladen wird es anschließend in den Einstellungen des jeweiligen Plugins.

Screenshot: Integrationen — Meine Plugins
Integrationen mit Plugin-Kategorien
Integrationen — Meine Plugins, nach Kategorie gruppiert
Screenshot: Integrationen — LLM-Anbieter
Integrationen mit aufgeklappter Kategorie LLM-Anbieter
Integrationen — Kategorie „LLM-Anbieter“ aufgeklappt, inklusive Lokal-/Cloud-Kennzeichnung
Screenshot: Integrationen — Entdecken
Integrationen Entdecken mit lokalen MLX-Modellen von Hugging Face
Integrationen — Entdecken: lokale MLX-Modelle von Hugging Face durchsuchen

Chat

Der Chat ist ein Fenster für die direkte Unterhaltung mit einem gewählten KI-Anbieter, wahlweise Cloud-Dienst oder lokal laufendes Modell.

Dokumente lassen sich als Kontext hinzufügen, sodass Fragen zu eigenen Unterlagen beantwortet werden können.

Screenshot: Chat — Anbieter, Modell und Dokument-Kontext
Chat mit frei wählbarem Anbieter, Modell und Dokument-Kontext
Chat — Unterhaltung mit frei wählbarem Anbieter/Modell

Wissen

Dokumente

Die Wissens-Bibliothek speichert Dokumente wie Text, Markdown, PDF oder Word, die der Chat-Bereich als Kontext nutzen kann.

Eine Vektor-Datenbank findet passende Dokumentauszüge zu einer Frage. Optional kann ein Neo4j-Wissensgraph zusätzlich Entitäten und Beziehungen aus den Dokumenten berücksichtigen.

Der Chat nutzt dabei nur Dokumente, die im jeweiligen Chat bewusst aktiviert oder freigegeben wurden.

System-Prompts

Wiederverwendbare System-Prompt-Vorlagen lassen sich speichern und im Chat mit einem Klick auswählen, statt sie jedes Mal neu einzutippen.

Screenshot: Wissen — Dokumenten-Bibliothek
Wissens-Bibliothek mit Dokumenten für den Chat
Wissen — Dokumenten-Bibliothek für den Chat
Screenshot: Wissen — System-Prompts
Gespeicherte System-Prompt-Vorlagen in Wissen
Wissen — gespeicherte System-Prompt-Vorlagen

Erweitert

Der Bereich „Erweitert“ bündelt Einstellungen für fortgeschrittene Nutzung.

  • Support-Diagnose: erstellt einen Diagnosebericht zur Fehlersuche.
  • Einstellungen sichern: Wörterbuch, Snippets, Workflows und Profile exportieren oder importieren.
  • Memory: automatische Extraktion von Fakten und Präferenzen aus Transkriptionen als Kontext für Prompts.
  • Aufnahme-Feinheiten: automatisches Entladen lokaler Modelle, Umgang mit kurzen oder leisen Clips, Whisper-Modus, Sprachfeedback.
  • Verlauf: Speicherung ein- oder ausschalten, Audio mitspeichern, automatisches Löschen nach Zeitraum.
  • API-Server und Kommandozeilen-Tool für eigene lokale Automatisierungen und Skripte.
  • Integrationen wie die Raycast-Erweiterung für Diktat direkt aus dem Raycast-Launcher.
Screenshot: Erweitert — Diagnose, Backup und Memory
Erweiterte Einstellungen mit Support-Diagnose, Sicherung und Memory
Erweitert — Support-Diagnose, Einstellungen sichern, Memory
Screenshot: Erweitert — Verlauf und API-Server
Erweiterte Einstellungen mit Verlauf und API-Server
Erweitert — Aufnahme-Feinheiten, Verlauf-Einstellungen, API-Server
Screenshot: Erweitert — Kommandozeilen-Tool und Raycast
Erweiterte Einstellungen mit Kommandozeilen-Tool und Raycast-Integration
Erweitert — Kommandozeilen-Tool, Raycast-Integration

Über

Der Bereich „Über“ enthält Versionsinformationen, einen Link zum Entwickler, den Lizenzhinweis GNU GPL v3 sowie die Möglichkeit, den Einrichtungsassistenten jederzeit erneut zu starten, ohne bestehende Einstellungen zu verlieren.

Screenshot: Über — Version, Lizenz und Setup-Wizard
Über-Bereich mit Version, Lizenz und Setup-Wizard
Über — Version, Lizenz, Einrichtungsassistent erneut starten

Sprachhilfe herunterladen

Die offizielle DMG ist Developer-ID-signiert und von Apple notarisiert. Öffne die Datei und ziehe Sprachhilfe in den Programme-Ordner.

1DMG laden 2Öffnen 3In Programme ziehen
Download öffnen

Sprachhilfe unterstützen

Unterstützung hilft bei Weiterentwicklung, Tests und zukünftigen Versionen der nativen macOS-App.

Über PayPal unterstützen