Zum Inhalt springen

Whisper Desktop, ganz einfach: sprechen und sofort Text bekommen.

WhisPaste ist eine kostenlose, quelloffene Desktop-App, die deine Stimme in Text verwandelt — überall auf deinem Computer. Hotkey drücken, sprechen, und der Text erscheint genau dort, wo dein Cursor steht — kein Tippen, keine Cloud, kein Konto nötig.

Was ist eine „Whisper-Desktop-App“?
Eine Desktop-Anwendung, die OpenAIs Whisper-Spracherkennungsmodell direkt auf dem eigenen Rechner ausführt — nicht im Browser, nicht in der Cloud. Genau das ist WhisPaste: whisper.cpp gebündelt in einer nativen App für Windows, macOS und Linux.
Wie macht WhisPaste aus Whisper ein Desktop-Tool?
WhisPaste bündelt whisper.cpp direkt in der App — keine Python-Umgebung, kein separater Modell-Download nötig. Hotkey drücken, sprechen, und das Transkript landet direkt an der Cursor-Position.
Funktioniert die Whisper-Desktop-App offline?
Ja. Die gesamte Transkription läuft lokal — keine Cloud-Verbindung, kein Konto, kein Internet nötig, sobald App und Modell installiert sind.
Läuft es auch auf älteren oder Nicht-NVIDIA-Grafikkarten?
Ja. Unter Windows und Linux beschleunigt WhisPaste über Vulkan — ein Pfad für NVIDIA, AMD und Intel gleichermaßen, ältere Karten eingeschlossen; auf Apple Silicon über Metal. Ohne nutzbaren GPU-Treiber läuft alles auf der CPU, und stürzt eine GPU zweimal beim Laden eines Modells ab, schaltet die App dauerhaft selbst auf CPU um.
Ist WhisPaste kostenlos?
Ja. WhisPaste ist quelloffen unter der MIT-Lizenz — kein Konto, kein Abo und keine Bezahlstufe im Desktop-Download.
Ist die Nutzung sicher?
Der komplette Quellcode liegt öffentlich auf GitHub und ist für jeden prüfbar. Die Transkription läuft standardmäßig lokal, ohne Konto und ohne Telemetrie, die dein Audio oder deinen Text enthält.
Wo landet das Whisper-Transkript?
Genau dort, wo der Cursor steht. WhisPaste betreibt Whisper als systemweite Spracheingabe-Ebene: Das Transkript erscheint direkt im Editor, im Chatfenster, im Terminal oder im Formularfeld, in dem du ohnehin gerade arbeitest — kein Upload-Schritt, keine Warteschlange, kein Kopieren aus einem separaten Transkript-Fenster. Genau das macht aus Whisper statt eines Spracherkennungs-Modells eine alltägliche Desktop-Eingabemethode.

Technische Details

Setup: ein Installer, keine Python-Umgebung

WhisPaste bettet whisper.cpp (den C++-Port von OpenAI Whisper) direkt in das Desktop-Binary ein. Nach der Installation wählst du im Dropdown eine Modellgröße, die App lädt sie einmalig herunter, und ab dann läuft die Transkription vollständig offline auf deinem Rechner. Kein Virtualenv, kein pip, kein CUDA-Toolkit — die GPU-Beschleunigung steckt bereits im Download (Vulkan unter Windows und Linux, Metal auf Apple Silicon).

Performance: CPU reicht, GPU ist fünfmal schneller

whisper.cpp läuft auf jeder unterstützten Maschine auf reiner CPU (Windows 10+, macOS 10.15+, Ubuntu Linux), deshalb genügt ein 8-GB-Laptop ohne dedizierte GPU für das kompakte Modell. Auf einem Rechner mit dedizierter GPU (Vulkan unter Windows und Linux, Metal auf Apple Silicon) entsteht dasselbe Transkript ungefähr fünfmal schneller. Apple Silicon nutzt Unified Memory, weshalb 8 GB bereits für das ausgewogene Modell reichen. Gar keine GPU vorhanden? WhisPastes zweite On-Device-Engine, Parakeet, ist bewusst CPU-first gebaut und bleibt auf derselben Hardware mehrfach schneller als Whisper, auf Kosten der Sprachbreite (rund 25 statt 99 Sprachen).

Lokal vs. Cloud: dasselbe Whisper, andere Trade-offs

Lokales Whisper behält das Audio auf dem Rechner, kostet pro Minute nichts und funktioniert ohne Internet, zum Preis eines einmaligen Modell-Downloads und etwas mehr RAM. Cloud-Anbieter wie OpenAI oder Deepgram tauschen diese Ressourcen gegen rohe Geschwindigkeit und die größten Modelle. WhisPaste lässt dich pro Sitzung wählen: standardmäßig lokal bleiben, für maximale Geschwindigkeit bei langen Aufnahmen einen Cloud-Anbieter zuschalten.

  1. WhisPaste installieren und Whisper-Modell wählen

    Lade WhisPaste aus dem Microsoft Store oder von GitHub. Beim ersten Start schlägt der Einrichtungsassistent auf Basis deiner Hardware eine Modellgröße vor: kompakt für ein 8-GB-Laptop, ausgewogen für 16 GB mit GPU, Premium für mehr VRAM.

  2. Das Modell einmalig laden lassen

    WhisPaste holt das gewählte whisper.cpp-Modell im Hintergrund und prüft die Datei. Der Download setzt nach unterbrochenen Verbindungen automatisch fort, sodass ein wackeliges Netz dich nicht zwingt, neu anzufangen. Danach läuft die Transkription vollständig offline.

  3. Tastenkürzel drücken und sprechen

    Setze den Cursor an die Stelle, an der der Text hin soll, halte dein konfiguriertes Tastenkürzel und sprich. whisper.cpp transkribiert das Audio auf deinem Rechner, und das Transkript erscheint am Cursor: kein Upload, kein Browser-Tab, kein Copy-Paste-Schritt.