Darmowe i open source · Lokalny Whisper · MIT

Mówię,
więc piszę.

Naciskasz skrót. Mówisz. Tekst ląduje tam, gdzie czeka kursor — transkrybowany na Twoim sprzęcie. Bez chmury. Bez abonamentu.

Linux · GNOME na Waylandzie — natywnie. Windows 10/11 — beta. Kolejne w drodze.

0.04 style trwa transkrypcja 4 sekund mowy na RTX 3070
0 złna zawsze — Twój GPU, Twój model, licencja MIT
0 bajtówaudio kiedykolwiek opuszcza Twój komputer
96testów bez sprzętu odpala się w CI przy każdym commicie
/01

Jeden skrót. Jeden oddech. Gotowe.

Dyskretna karta pokazuje, co słyszy model — bez zabierania focusu. Puszczasz skrót: tekst jest przy kursorze.

Słucham
Super + G
claude — ~/projects/app
✻ Myślę…
● Read src/auth/session.ts
● Edit src/auth/session.ts +42 −17
● Bash(npm test) — 84 passed
✻ Sesje są walidowane po stronie serwera; testy pokrywają wygasłe tokeny.
>
Mythos 6ctx 38%main⏵ auto-accept

Trzy razy szybciej niż pisanie.

Pełen kontekst jednym oddechem —

mówisz wszystko, co masz w głowie.

LINUX — SKRÓT, PODGLĄD NA ŻYWO, WKLEJENIE TAM, GDZIE FOCUS

/02

Co podyktujesz?

Wszędzie tam, gdzie mruga kursor. Ten sam skrót, każda aplikacja.

E-mail

Trzy odpowiedzi w czasie, w którym kiedyś pisało się jedną.

„Dzień dobry, dziękuję za ofertę — umówmy się na rozmowę we wtorek…”

Wiadomości

Slack, WhatsApp, Discord — odpowiadasz z prędkością mowy.

„Spóźnię się 10 minut, zaczynajcie beze mnie.”

Kod i prompty do AI

Urodzone w terminalu: autor całymi dniami dyktuje prompty agentom kodującym.

„Zrefaktoruj moduł autoryzacji i dodaj testy wygasłych tokenów.”

Dokumenty

Raporty, prace, notatki ze spotkań — najpierw myśl, szlif potem.

„Sekcja druga: wyniki. Pomiary pokazują wyraźny trend…”

Notatki i pomysły

Pomysły ulatują szybciej, niż piszesz. Ale nie szybciej, niż mówisz.

„Pomysł: nachylić dekoder słownikiem projektu…”

W trakcie rozmowy

Na Discordzie Twój mikrofon jest wyciszany dla rozmowy, a rozmowa przyciszana — nikt nie słyszy Twoich promptów.

Rozmowa na 40% · mikrofon wyciszony · wszystko wraca w chwili końca
/03

Na telefonie tak samo.

Szybsze

Mówisz około trzy razy szybciej, niż piszesz.

Prostsze

Jeden klawisz mikrofonu zamiast klawiatury.

Rozumie Cię

Twój słownik nachyla model — nazwy trafiają bez przekręceń, intencja zostaje Twoja.

Prywatne

Nagrania i tekst nie opuszczają telefonu — Whisper działa na nim.

Wszędzie

To klawiatura systemowa — działa w każdej aplikacji.

21:3787%
Ania
Zrobisz zakupy w drodze do domu?
Jasne, wezmę standardową listę — będę koło szóstej.
iMessage
STUKNIJ, BY DYKTOWAĆ

KLAWIATURA ANDROID — STUKNIJ, POWIEDZ, WYSŁANE

Dla tych, którzy myślą na głos.

Inne narzędzia wysyłają Twój głos na serwer i wystawiają co miesiąc rachunek. voiceflow trzyma wszystko na Twoim komputerze — z architektury, nie z opcji.

Nagrania, transkrypcje i historia nie opuszczają Twojego dysku
Każdy język, którym mówi Whisper — plus Twój własny słownik
Działa offline, w samolocie, za każdym firewallem
Marmurowa muza z profilu
/04

Szybciej niż Twoja klawiatura.

Mowa~150 słów / min
Pisanie~40 słów / min
voiceflow na GPU0,04 s na 4 s mowy
Dyktowanie w chmurzepodróż przez sieć, ~1–3 s

I o to chodzi: myśl trafia na ekran, zanim wyparuje.

Ciepły w VRAMtekst ląduje, gdy kończysz mówić
Podgląd na żywokarta nie może przejąć focusu
Świadomy rozmówwycisza i przycisza, potem przywraca
Twój słowniknachyla dekoder, nigdy nie przepisuje
Historiazłe okno? voiceflow last --copy
Uczciwy schowekwklejenie działa w każdym alfabecie
/05

Płatne aplikacje są świetne.
Tylko nie są Twoje.

voiceflowtypowa płatna aplikacja
cenadarmowy, MIT~60 zł/mies.
audio opuszcza Twój komputernigdyzawsze
Linux / GNOME / Waylandnatywniebrak wsparcia
opóźnienie po końcu mówienia~0,1 s na GPUpodróż przez sieć
działa offlinetaknie
kod źródłowycały, na GitHubiezamknięty
/06

Jedna komenda. Wszystko w zestawie.

Środowisko, skrót, usługa, model — gdy instalator kończy, dyktowanie działa. Aktualizacja: ta sama komenda jeszcze raz.

Linux Ubuntu · GNOME on Wayland

Jeden krok prosi o sudo (narzędzia wejścia i reguła udev — skrypt tłumaczy dlaczego). Potem naciśnij Super + G, powiedz coś, naciśnij ponownie.

curl -fsSL https://raw.githubusercontent.com/AveJaPl/voiceflow/main/install.sh | bash

Wolisz najpierw przeczytać? Zobacz install.sh na GitHubie.

Windows 10 / 11 beta

Działa w PowerShellu i w cmd, z dowolnego katalogu. Potem naciśnij Ctrl + Shift + Spacja, powiedz coś, naciśnij ponownie.

powershell -NoProfile -ExecutionPolicy Bypass -Command "irm https://raw.githubusercontent.com/AveJaPl/voiceflow/main/windows/install.ps1 | iex"

Bez terminala? Instalator na dwuklik:

voiceflow-install.bat

macOS alfa · ze źródeł

Natywna aplikacja w pasku menu, a nie przebrany demon z Linuksa. Przytrzymaj prawy ⌥, mów, puść — tekst ląduje w oknie, które ma fokus. Whisper liczy lokalnie, nic nie wychodzi na zewnątrz.

Instalatora nie ma i nie jest to lenistwo: macOS wiąże potrzebną tu zgodę na Dostępność z podpisem kodu, a Twój podpis możesz dać tylko Ty.

brew install whisper-cpp xcodegen && git clone https://github.com/AveJaPl/voiceflow.git && cd voiceflow/macos && xcodegen generate && open VoiceFlow.xcodeproj

Potem wybierz swój zespół w Signing & Capabilities i wciśnij ⌘R. Wymaga macOS 26. Pełne kroki i dwa ustawienia, które blokują pierwszy build: macos/README.md.

Wymagania, szczegóły i uczciwe ograniczenia: README · notatki Windows · wszystkie wydania

Androidwczesna alfa · ze źródełiOSw budowie
/07

Każda platforma. Taki jest plan.

Linux — GNOME/WaylandMiejsce narodzin. Pipeline GPU, podgląd, przyciszanie, aplikacja ustawień GTK.działa
Windows 10 / 11Ten sam rdzeń, warstwa Win32: globalny skrót, schowek, przyciszanie.beta
AndroidKlawiatura głosowa (IME) z Whisperem na urządzeniu — dyktuj w każdej aplikacji.w budowie
KDE · Hyprland · SwayNajłatwiejszy port — te kompozytory mają protokoły, których brakuje GNOME.w planach
macOSNatywna aplikacja SwiftUI w pasku menu: przytrzymaj i mów, whisper.cpp lokalnie, to samo okno i format historii co na Linuksie.alfa · ze źródeł
iOSRozszerzenie klawiatury, rodzeństwo aplikacji na Androida.w budowie

Dobre dyktowanie nie powinno kosztować 60 złotych miesięcznie ani wymagać wysyłania głosu na cudzy serwer.

voiceflow pozostaje darmowy i open source na każdej platformie, do której sięgniemy. Issues powyżej mają notatki implementacyjne — weź któreś i działaj.