Ierakstīšanas režīmi
Ierakstīšanas režīms nosaka, kas notiek, nospiežot ierakstīšanas pogu vai karsto taustiņu. Visos režīmos lietotne nosūta tikai fragmentus, kuros transkripcijai tiek noteikta runa.
Automātiski (VAD)
VAD ir vislabākais regulārām sarunām, intervijām un zvaniem, kur runu var sākt un pārtraukt, nepārvaldot katru fragmentu.
Svarīgi: jums joprojām ir jāieslēdz VAD, izmantojot ierakstīšanas pogu vai karsto taustiņu. Kad tā ir ieslēgta, lietotne klausās atlasītos audio avotus un automātiski nosaka runu. Kad kāds runā, fragments tiek ierakstīts. Pēc pauzes fragments tiek aizvērts un nosūtīts transkripcijai. Izslēdzot VAD, lietotne pārstāj analizēt audio.
Kā tas darbojas:
- Jūs ieslēdzat VAD
- Lietotne klausās atlasītos audio avotus un meklē runu
- Kad runa ir noteikta, sākas ieraksta fragments
- Pēc pauzes fragments tiek nosūtīts transkripcijai
- Ja runa turpinās ilgu laiku, ierakstu var sadalīt gabalos
Manuāli (pārslēgt)
Pārslēgšana ir paredzēta gadījumiem, kad vēlaties pats izvēlēties fragmenta sākumu un beigas. Pirmo reizi nospiežot ierakstīšanas pogu vai Ctrl+R, tiek sākta ierakstīšana, un otrā nospiešana to pārtrauc un nosūta audio transkripcijai.
Pirms ierakstīšanas sākuma lietotne saglabā īsu fona buferi. Ja pēc frāzes sākuma nedaudz nospiežat karsto taustiņu, pirmās sekundes joprojām var iekļaut. Ja pēdējais fragments nesatur runu, tas tiek automātiski atmests.
Viens šāviens (Oneshot)
Viens kadrs ir paredzēts jautājumiem, kurus vēlaties dzirdēt pilnībā pirms atbildes pieprasīšanas. Nesāciet ierakstīšanu pirms laika: pagaidiet, līdz otrs pabeidz, pēc tam nospiediet ierakstīšanas pogu vai Ctrl+R. Lietotne paņem jaunāko audio no bufera, pārraksta to un izmanto to atbildei.
Šis režīms ir noderīgs, ja iepriekš nezināt, kurš brīdis būs svarīgs. Tas neieraksta garu segmentu no sākuma līdz beigām; tiek uzņemts viens īss jaunākā audio momentuzņēmums.
Ierakstīšanas režīma izvēle
Atveriet iestatījumus (zobrata ikona sānu izvēlnē), sadaļu "Audio ierakstīšana". Šeit jūs varat izvēlēties ierakstīšanas režīmu un konfigurēt citus parametrus.
Visi ierakstīšanas iestatījumi
Uzņemšanas iestatījumi ir pieejami lietotnes iestatījumos sadaļā “Audio ierakstīšana”. Daži vienumi tiek rādīti tikai noteiktam ierakstīšanas režīmam, audio avotam, platformai vai lietotnes versijai.
Pamatiestatījumi
Audio avots vienmēr ir redzams. Tā izvēlas, ko ierakstīt: sistēmas audio + mikrofons, tikai sistēmas audio vai tikai mikrofons.
Ierakstīšanas režīms vienmēr ir redzams. Tas nosaka ierakstīšanas pogas darbību: VAD, Toggle vai Oneshot.
Microphone appears when the selected source includes microphone audio. Šeit varat izvēlēties konkrētu ievades ierīci. If you keep "Default", the system default microphone is used.
Output Device appears on Windows when the selected source includes system audio. Tas izvēlas skaļruņus vai austiņas, kuru skaņa tiks ierakstīta.
Audio avots
Sistēmas audio + mikrofons ir paredzēts zvaniem un intervijām: tas uztver gan jūsu balsi, gan citas personas audio.
System audio only captures app or speaker audio. Jūsu mikrofons nav iekļauts.
Tikai mikrofons tver tikai jūsu balsi. Izmantojiet to, ja jums nav nepieciešama sistēmas audio vai kad sistēmas audio traucē.
VAD iestatījumi
Funkcijai Chunking ir uzlaboti VAD iestatījumi, un tā ir ieslēgta pēc noklusējuma. Tas sadala garu runu atsevišķos audio failos, lai transkripciju un atbilžu ģenerēšanu varētu sākt agrāk.
Ja ir iespējota gabala sadalīšana, papildu VAD iestatījumos tiek parādīts gabalu ilgums. Diapazons: no 5 līdz 15 sekundēm, noklusējuma 7 sekundes. Tas ierobežo viena audio fragmenta maksimālo garumu, pirms tas tiek nosūtīts transkripcijai.
Ierakstīšanas apturēšanas aktivizētājs (mikrofons) tiek parādīts papildu VAD iestatījumos, ja avots ietver mikrofona audio. Diapazons: 0,5–5 sekundes, noklusējuma 0,5 sekundes. It sets how much microphone silence is needed to finish the current speech fragment.
Ierakstīšanas apturēšanas aktivizētājs (sistēmas audio) tiek parādīts papildu VAD iestatījumos, ja avots ietver sistēmas audio. Diapazons: 0,5–5 sekundes, noklusējuma 1 sekunde. It sets how much system-audio silence is needed to finish the current speech fragment.
Pārslēgt iestatījumus
Bufera ilgums parādās pārslēgt. Diapazons: no 0 līdz 15 sekundēm, pēc noklusējuma 4 sekundes. Tas pievieno dažas sekundes no pirms nospiešanas līdz ieraksta sākumam, kas palīdz, ja nedaudz nospiežat karsto taustiņu pēc frāzes sākuma.
Sūtīt ekrānuzņēmumus ar audio tiek parādīts sadaļā Pārslēgt un pēc noklusējuma ir ieslēgts. Tas automātiski pievieno ekrānuzņēmumus no tērzēšanas audio fragmentam.
Pārbaudīt audio runu ir papildu pārslēgšanas iestatījumos un ir ieslēgts pēc noklusējuma. Ieraksts tiek nodots caur Silero VAD, un fragmenti bez runas tiek izmesti. Atspējojiet to tikai tad, ja jums ir jānosūta jebkāds audio, tostarp klusums un troksnis.
Oneshot iestatījumi
Uzņemšanas ilgums tiek parādīts programmā Oneshot. Diapazons: no 5 līdz 60 sekundēm, pēc noklusējuma 20 sekundes. Tas iestata, cik pēdējo sekunžu skaits ir jāpaņem no bufera, kad nospiežat karsto taustiņu.
Notīrīt buferi pēc tveršanas parādās Oneshot un pēc noklusējuma ir izslēgts. Kad tas ir iespējots, tas notīra buferi pēc katra momentuzņēmuma, lai nākamajā nospiešanas reizē netiktu atkārtoti nosūtīts jau pārrakstītais audio.
Sūtīt ekrānuzņēmumus ar audio tiek parādīts programmā Oneshot un pēc noklusējuma ir ieslēgts. Tas automātiski pievieno ekrānuzņēmumus no tērzēšanas audio fragmentam.
Pārbaudīt audio runu ir Oneshot papildu iestatījumos un ir ieslēgts pēc noklusējuma. Ieraksts tiek nodots caur Silero VAD, un fragmenti bez runas tiek izmesti. Atspējojiet to tikai tad, ja jums ir jānosūta jebkāds audio, tostarp klusums un troksnis.
Bieži uzdotie jautājumi
Ierakstīšanas izraisītāji no trokšņa
Neironu tīkls labi filtrē skaņas, kas nav runas, taču augsts fona trokšņu līmenis var izraisīt viltus trigerus. Mēģiniet sistēmas iestatījumos samazināt mikrofona jutību vai izmantojiet austiņas.
Nogriež frāžu sākumu
Manuālajā režīmā — palieliniet bufera garumu.
Ieraksti tiek izmesti kā tukši
Neironu tīkls pārbauda katru ierakstu, lai noteiktu runas klātbūtni. Ja modelis nekonstatē balsi (piemēram, tika ierakstīts tikai fona troksnis vai mūzika), ieraksts tiek automātiski atmests. Pārliecinieties, vai jūsu mikrofons ir pareizi konfigurēts un jūsu runa ir pietiekami skaidra.