Ի՞նչ են պատահականությունից տարբերվող մոդելները։
sobes.tech AI
Պատասխան AI-ից
Տարբերության մոդելները պատահականությունից՝ Divergence from Randomness, դասի մոդելներ են, որոնք գնահատում են փաստաթղթերի համապատասխանությունը՝ հիմնվելով տերմինների բաշխման տատանումների վրա՝ տեքստում՝ պատահական բաշխումից։ Իդեան այն է, որ կարևոր տերմինները հանդիպում են փաստաթղթում ավելի հաճախ, քան սպասվում էր պատահական բաշխման դեպքում, և այս տատանումը (տատանումը) օգտագործվում է դասակարգման համար։
Օրինակ, Divergence From Randomness (DFR) մոդելները օգտագործում են վիճական չափումներ, ինչպիսիք են տերմինի հայտնվելու հավանականությունը փաստաթղթում պատահական բաշխման դեպքում, և համեմատում դրանք իրական հաճախականության հետ։ Որքան մեծ է տատանումը, այնքան կարևոր է տերմինը փաստաթղթի համար։
Այսպիսով, դա թույլ է տալիս ավելի ճշգրիտ գնահատել համապատասխանությունը՝ հաշվի առնելով բառերի բաշխման վիճականությունը, և ոչ միայն պարզ հաճախականությունը կամ TF-IDF-ը։