OGLAS

Canonical razvija projekt Myna: Lokalni sustav za prepoznavanje govora i diktiranje stiže na Ubuntu 26.10

·

Kompanija Canonical službeno je predstavila svoj novi open-source projekt pod nazivom Myna, specijalizirani sustav za prepoznavanje govora i pretvaranje glasa u tekst integriran izravno u Ubuntu radnu površinu. Naziv projekta inspiriran je pticom majna, koja je u prirodi poznata po svojoj iznimnoj sposobnosti imitiranja ljudskog govora. Glavni cilj ovog rješenja jest omogućiti korisnicima brzo i fluidno diktiranje teksta unutar operativnog sustava, uz beskompromisnu zaštitu privatnosti, budući da se obrada audio podataka odvija u potpunosti na samom računalu, bez slanja informacija na vanjske cloud poslužitelje.

Ovaj će alat službeno postati dostupan s izlaskom nadolazeće distribucije Ubuntu 26.10. Njegova je funkcionalnost u prvoj fazi strogo usmjerena na osnovni, ali visokooptimizirani scenarij korištenja u kojem korisnik aktivira diktiranje jednostavnom kombinacijom tipki te izgovara željeni tekst, nakon čega se generirani tekstualni sadržaj trenutačno ispisuje unutar aktivne aplikacije, dok sustav pruža diskretnu vizualnu povratnu informaciju o tijeku prepoznavanja.

Lokalna arhitektura i napredni sigurnosni protokoli

Tehnička arhitektura projekta Myna dizajnirana je tako da se svi modeli za prepoznavanje govora izvršavaju lokalno na korisničkom hardveru. Nakon što korisnik inicijalno preuzme potrebne jezične pakete za svoj operativni sustav, za rad alata više nije potrebna aktivna internetska veza. Sustav aktivira mikrofon isključivo na izričit zahtjev korisnika, a cjelokupni audio tok obrađuje se u radnoj memoriji (RAM) te se nigdje ne pohranjuje na tvrdi disk, čime je u potpunosti eliminiran rizik od neovlaštenog pristupa ili curenja osjetljivih zvučnih zapisa.

Integracija u GNOME okruženje i dugoročni planovi

Razvojni tim primarno je usmjerio implementaciju alata na zadano GNOME radno okruženje koje se izvodi na Wayland grafičkom poslužitelju. Ipak, inženjeri naglašavaju kako modularna struktura samog projekta ostavlja otvoren prostor za laku prilagodbu i integraciju u druga popularna grafička okruženja u budućim inačicama operativnog sustava. Kako bi se osigurala maksimalna stabilnost jezgre sustava u ranoj fazi, kompleksnije funkcije poput punokrvnog glasovnog asistenta, upravljanja radnom površinom putem naprednih glasovnih naredbi, automatskog prevođenja i detekcije jezika namjerno su izostavljene iz trenutačne razvojne faze.

Izvorni kod projekta javno je dostupan na GitHub repozitoriju pod slobodnom GPLv3 licencom, što neovisnim programerima i sigurnosnim stručnjacima omogućuje detaljnu analizu arhitekture i slanje vlastitih nadogradnji. Implementacija lokalnog prepoznavanja govora savršeno se uklapa u Canonicalovu širu dugoročnu strategiju usmjerenu na proširenje značajki pristupačnosti i podizanje razine privatnosti unutar Ubuntu ekosustava. Službeno lansiranje Ubuntua 26.10 planirano je za listopad 2026. godine, do kada razvojni tim namjerava u potpunosti dovršiti rigorozna testiranja stabilnosti i performansi za opću upotrebu.

OGLAS