Przegląd systemu
- AUDIO
- TRANSCRIPTION
- PRZETWARZANIE JĘZYKA
- TRASOWANIE PYTAŃ
- LOKALNE AI
SYSTEM 07
MOWA W CZASIE RZECZYWISTYM / TŁUMACZENIE / LOKALNE AI
Desktopowy asystent AI do transkrypcji mowy w czasie rzeczywistym, tłumaczenia EN-PL i odpowiedzi wspieranych przez lokalne AI.
TOŻSAMOŚĆ SYSTEMU
ID SYSTEMUWHISPER-AI-07
STATUSDZIAŁAJĄCY PROTOTYP
TYPMOWA / TŁUMACZENIE / LOKALNE AI
Desktopowy pipeline mowy w czasie rzeczywistym łączący transkrypcję, tłumaczenie, trasowanie pytań i lokalny model językowy.
01 / PRZEGLĄD
System przechwytuje mowę z mikrofonu lub audio systemowego i zamienia ją w ustrukturyzowany kontekst tekstowy niemal w czasie rzeczywistym.
Główny lokalny przepływ wygląda następująco: AUDIO do TRANSKRYPCJI, dalej PRZETWARZANIE JĘZYKA, ROUTING PYTANIA i LOKALNE AI.
Przegląd systemu
02 / PRZYPADKI UŻYCIA
UC-01
Przechwytuj audio z mikrofonu i zamieniaj mowę na segmenty transkrypcji niemal w czasie rzeczywistym.
UC-02
Przeprowadź audio loopback desktopu przez ten sam lokalny pipeline mowy.
UC-03
Przetwarzaj mowę w procesie tłumaczenia z angielskiego na polski i z polskiego na angielski.
UC-04
Wykrywaj kompletne pytania wypowiedziane na głos przed złożeniem kontekstu dla asystenta.
UC-05
Wyślij pytanie i kontekst do lokalnego modelu Qwen z odpowiedzią generowaną na bieżąco i możliwością jej przerwania.
03 / WEJŚCIE AUDIO
Asystent może przyjmować dwa lokalne źródła i przechowywać je w krótkich segmentach z oznaczeniem czasu przed transkrypcją.
Mapa sygnału mowy
SEG-01
MIKROFON
lokalny kanał przechwytywania
SEG-02
AUDIO SYSTEMOWE / LOOPBACK
kanał audio desktopu
Łańcuch wejściowy
04 / PIPELINE MOWY
Przepływ mowy zaczyna się od segmentacji lokalnego audio, następnie każdy segment przechodzi przez Whisper i daje wynik transkrypcji.
Przetwarzanie mowy
Rozgałęzienie transkrypcji
ŚCIEŻKA TŁUMACZENIA
Tłumaczenie EN - PL może działać przez lokalny potok CTranslate2 z wykorzystaniem modeli Hugging Face.
Dostępny jest również osobny ręczny przepływ tłumaczenia.
ŚCIEŻKA PYTANIA
Transkrypcja może być także skierowana bezpośrednio do analizy pytania i przepływu asystenta.
Ta gałąź przygotowuje kontekst do komponowania odpowiedzi i przekazania go lokalnemu modelowi.
TŁUMACZENIE JEST OPCJONALNE W PIPELINE
05 / INTERFEJS
Desktopowa przestrzeń pracy na żywo łącząca angielską transkrypcję, polskie tłumaczenie i rozmowę wspieraną przez lokalne AI w jednym interfejsie.

06 / TRASOWANIE PYTAŃ
Wykrywanie pytań jest traktowane jako krok trasowania przed wywołaniem lokalnego modelu.
Łańcuch trasowania pytań
System oznacza tekst wejściowy jako intencję pytania, gdy warunek trasy zostanie spełniony.
Przeanalizowane zdanie jest weryfikowane i przygotowywane jako pełny sygnał żądania.
Treść pytania jest wyodrębniana z transkrypcji i przygotowywana do dalszego składania kontekstu.
07 / LOKALNY ASYSTENT AI
Dla transkrypcji gotowych do obsługi pytania asystent buduje żądanie z pełnego pytania, kontekstu rozmowy i kontekstu użytkownika, a następnie generuje wynik przez lokalny model językowy.
Przepływ lokalnego asystenta
08 / STACK TECHNOLOGICZNY
09 / STATUS
ID SYSTEMU WHISPER-AI-07
STANDZIAŁAJĄCY PROTOTYP
ZAKRESSYSTEM MOWY W CZASIE RZECZYWISTYM + LOKALNE AI