ჩაწერის რეჟიმები
ჩაწერის რეჟიმი განსაზღვრავს რა მოხდება ჩაწერის ღილაკზე ან ცხელი კლავიშის დაჭერისას. ყველა რეჟიმში, აპი აგზავნის მხოლოდ ფრაგმენტებს, სადაც მეტყველება აღმოჩენილია ტრანსკრიფციისთვის.
ავტომატური (VAD)
VAD საუკეთესოა რეგულარული საუბრებისთვის, ინტერვიუებისთვის და ზარებისთვის, სადაც მეტყველება შეიძლება დაიწყოს და შეწყდეს ყოველი ფრაგმენტის მართვის გარეშე.
მნიშვნელოვანია: თქვენ მაინც უნდა ჩართოთ VAD ჩაწერის ღილაკით ან ცხელი კლავიშით. ჩართვის შემდეგ, აპლიკაცია უსმენს არჩეულ აუდიო წყაროებს და ავტომატურად ამოიცნობს მეტყველებას. როდესაც ვინმე საუბრობს, ფრაგმენტი ჩაიწერება. პაუზის შემდეგ, ფრაგმენტი იხურება და იგზავნება ტრანსკრიფციისთვის. როდესაც თქვენ გამორთავთ VAD-ს, აპლიკაცია წყვეტს აუდიოს ანალიზს.
როგორ მუშაობს:
- თქვენ ჩართავთ VAD-ს
- აპლიკაცია უსმენს არჩეულ აუდიო წყაროებს და ეძებს მეტყველებას
- როდესაც მეტყველება აღმოჩენილია, იწყება ჩაწერის ფრაგმენტი
- პაუზის შემდეგ, ფრაგმენტი იგზავნება ტრანსკრიფციისთვის
- თუ მეტყველება დიდხანს გაგრძელდება, ჩანაწერი შეიძლება დაიყოს ნაწილებად
სახელმძღვანელო (გადართვა)
გადართვა არის იმ შემთხვევებისთვის, როდესაც გსურთ თავად აირჩიოთ ფრაგმენტის დასაწყისი და დასასრული. ჩაწერის ღილაკის პირველი დაჭერით ან Ctrl+R იწყებს ჩაწერას და მეორე პრესა აჩერებს მას და აგზავნის აუდიოს ტრანსკრიფციისთვის.
ჩაწერის დაწყებამდე აპლიკაცია ინახავს მოკლე ფონის ბუფერს. თუ ფრაზის დაწყების შემდეგ ოდნავ დააჭერთ ცხელი კლავიშს, პირველი წამები მაინც შეიძლება იყოს ჩართული. თუ საბოლოო ფრაგმენტი არ შეიცავს მეტყველებას, ის ავტომატურად იშლება.
ერთი გასროლა (Oneshot)
ერთი დარტყმა განკუთვნილია კითხვებისთვის, რომელთა მოსმენაც გსურთ, სანამ პასუხს ითხოვთ. ნუ დაიწყებთ ჩაწერას წინასწარ: დაელოდეთ სანამ სხვა ადამიანი დაასრულებს, შემდეგ დააჭირეთ ჩაწერის ღილაკს ან Ctrl+R. აპი იღებს უახლეს აუდიოს ბუფერიდან, ახდენს მის ტრანსკრიფციას და იყენებს მას პასუხისთვის.
ეს რეჟიმი სასარგებლოა, როცა წინასწარ არ იცი, რომელ მომენტს აქვს მნიშვნელობა. ის არ იწერს ხანგრძლივ დასაწყისიდან გაჩერებამდე სეგმენტს; იღებს ბოლო აუდიოს ერთ მოკლე კადრს.
ჩაწერის რეჟიმის არჩევა
გახსენით პარამეტრები (გადაცემათა კოლოფის ხატულა გვერდით მენიუში), განყოფილება "აუდიო ჩანაწერი". აქ შეგიძლიათ აირჩიოთ ჩაწერის რეჟიმი და დააკონფიგურიროთ სხვა პარამეტრები.
ჩაწერის ყველა პარამეტრი
გადაღების პარამეტრები არის აპის პარამეტრებში "აუდიო ჩანაწერის" განყოფილებაში. ზოგიერთი ელემენტი ჩნდება მხოლოდ ჩაწერის კონკრეტული რეჟიმისთვის, აუდიო წყაროსთვის, პლატფორმისთვის ან აპის ვერსიისთვის.
ძირითადი პარამეტრები
აუდიო წყარო ყოველთვის ჩანს. ის ირჩევს რა ჩაიწეროს: სისტემის აუდიო + მიკროფონი, მხოლოდ სისტემის აუდიო ან მხოლოდ მიკროფონი.
ჩაწერის რეჟიმი ყოველთვის ჩანს. ის განსაზღვრავს ჩაწერის ღილაკის ქცევას: VAD, Toggle ან Oneshot.
მიკროფონი გამოჩნდება, როდესაც არჩეული წყარო შეიცავს მიკროფონის აუდიოს. აქ შეგიძლიათ აირჩიოთ კონკრეტული შეყვანის მოწყობილობა. თუ შეინარჩუნებთ "ნაგულისხმევს", გამოიყენება სისტემის ნაგულისხმევი მიკროფონი.
გამომავალი მოწყობილობა გამოჩნდება Windows-ზე, როდესაც არჩეული წყარო შეიცავს სისტემის აუდიოს. ის ირჩევს დინამიკებს ან ყურსასმენებს, რომელთა აუდიო ჩაიწერება.
აუდიო წყარო
სისტემის აუდიო + მიკროფონი არის ზარებისა და ინტერვიუებისთვის: ის იჭერს როგორც თქვენს ხმას, ასევე სხვისი აუდიოს.
მხოლოდ სისტემის აუდიო იღებს აპის ან დინამიკის აუდიოს. თქვენი მიკროფონი არ შედის.
მხოლოდ მიკროფონი იჭერს მხოლოდ თქვენს ხმას. გამოიყენეთ ის, როდესაც არ გჭირდებათ სისტემის აუდიო ან როდესაც სისტემის აუდიო ხელს უშლის.
VAD პარამეტრები
ჩანგრევა არის გაფართოებული VAD პარამეტრები და ჩართულია ნაგულისხმევად. ის ყოფს გრძელ მეტყველებას ცალკეულ აუდიო ფაილებად, რათა ტრანსკრიფცია და პასუხების გენერაცია უფრო ადრე დაიწყოს.
ბლოკის ხანგრძლივობა გამოჩნდება VAD-ის გაფართოებულ პარამეტრებში, როდესაც ჩართვის ჩართულია. დიაპაზონი: 5-დან 15 წამამდე, ნაგულისხმევი 7 წამი. ის ზღუდავს ერთი აუდიო ფრაგმენტის მაქსიმალურ სიგრძეს ტრანსკრიფციისთვის გაგზავნამდე.
ჩაწერის შეჩერების ტრიგერი (მიკროფონი) გამოჩნდება VAD-ის გაფართოებულ პარამეტრებში, როდესაც წყარო შეიცავს მიკროფონის აუდიოს. დიაპაზონი: 0,5-დან 5 წამამდე, ნაგულისხმევი 0,5 წამი. ის ადგენს, რამდენი მიკროფონის სიჩუმეა საჭირო მიმდინარე მეტყველების ფრაგმენტის დასასრულებლად.
ჩაწერის შეჩერების ტრიგერი (სისტემის აუდიო) გამოჩნდება გაფართოებულ VAD პარამეტრებში, როდესაც წყარო შეიცავს სისტემის აუდიოს. დიაპაზონი: 0,5-დან 5 წამამდე, ნაგულისხმევი 1 წამი. ის ადგენს, რამდენი სისტემური აუდიო სიჩუმეა საჭირო მიმდინარე მეტყველების ფრაგმენტის დასასრულებლად.
პარამეტრების გადართვა
ბუფერის ხანგრძლივობა გამოჩნდება Toggle-ში. დიაპაზონი: 0-დან 15 წამამდე, ნაგულისხმევი 4 წამი. ის ამატებს რამდენიმე წამს დაჭერამდე ჩაწერის დასაწყისამდე, რაც გეხმარებათ, როდესაც ფრაზის დაწყების შემდეგ ოდნავ დააჭერთ ცხელი კლავიშს.
გააგზავნეთ ეკრანის ანაბეჭდები აუდიო საშუალებით გამოჩნდება Toggle-ში და ჩართულია ნაგულისხმევად. ის ავტომატურად ანიჭებს ეკრანის სურათებს ჩეთიდან აუდიო ფრაგმენტზე.
შეამოწმეთ აუდიო მეტყველებისთვის არის გადართვის გაფართოებულ პარამეტრებში და ჩართულია ნაგულისხმევად. ჩანაწერი გადადის Silero VAD-ში და ფრაგმენტები სიტყვის გარეშე იშლება. გამორთეთ ის მხოლოდ იმ შემთხვევაში, თუ გჭირდებათ აუდიოს გაგზავნა, მათ შორის სიჩუმე და ხმაური.
Oneshot პარამეტრები
გადაღების ხანგრძლივობა ჩანს Oneshot-ში. დიაპაზონი: 5-დან 60 წამამდე, ნაგულისხმევი 20 წამი. ის ადგენს ბოლო წამის გატარებას ბუფერიდან ცხელი კლავიშის დაჭერისას.
ბუფერის გასუფთავება გადაღების შემდეგ გამოჩნდება Oneshot-ში და ნაგულისხმევად გამორთულია. როდესაც ჩართულია, ის ასუფთავებს ბუფერს ყოველი სნეპშოტის შემდეგ, რათა შემდეგი დაჭერით არ გაიგზავნოს უკვე ტრანსკრიბირებული აუდიო.
გააგზავნეთ ეკრანის ანაბეჭდები აუდიო საშუალებით გამოჩნდება Oneshot-ში და ჩართულია ნაგულისხმევად. ის ავტომატურად ანიჭებს ეკრანის სურათებს ჩეთიდან აუდიო ფრაგმენტზე.
შეამოწმეთ აუდიო მეტყველებისთვის არის Oneshot-ის გაფართოებულ პარამეტრებში და ჩართულია ნაგულისხმევად. ჩანაწერი გადადის Silero VAD-ში და ფრაგმენტები სიტყვის გარეშე იშლება. გამორთეთ ის მხოლოდ იმ შემთხვევაში, თუ გჭირდებათ აუდიოს გაგზავნა, მათ შორის სიჩუმე და ხმაური.
ხშირად დასმული კითხვები
ტრიგერების ჩაწერა ხმაურისგან
ნერვული ქსელი კარგად ფილტრავს არასამეტყველო ხმებს, მაგრამ ფონური ხმაურის მაღალმა დონემ შეიძლება გამოიწვიოს ცრუ ტრიგერები. სცადეთ მიკროფონის მგრძნობელობის შემცირება სისტემის პარამეტრებში ან გამოიყენეთ ყურსასმენი.
წყვეტს ფრაზების საწყისს
ხელით რეჟიმში — გაზარდეთ ბუფერის სიგრძე.
ჩანაწერები გაუქმებულია, როგორც ცარიელი
ნერვული ქსელი ამოწმებს თითოეულ ჩანაწერს მეტყველების არსებობისთვის. თუ მოდელი ვერ ამოიცნობს ხმას (მაგალითად, ჩაწერილი იყო მხოლოდ ფონური ხმაური ან მუსიკა), ჩანაწერი ავტომატურად გაუქმებულია. დარწმუნდით, რომ თქვენი მიკროფონი სწორად არის კონფიგურირებული და თქვენი მეტყველება საკმარისად ნათელია.