Անցնել հիմնական բովանդակությանը

Ինչպե՞ս վերլուծել քանակական տվյալները

19 սեպտեմբերի, 20268 րոպեի ընթերցում
Ինչպե՞ս վերլուծել քանակական տվյալները

Քանակական տվյալների վերլուծությունը թվերը գործնական պատմության վերածելու գործիք է։ Այն օգնում է պատասխանել չորս հիմնական հարցի՝ ի՞նչ է պատահել (նկարագրական), ինչո՞ւ է պատահել (ախտորոշիչ), ի՞նչ է պատահելու (կանխատեսող) և ի՞նչ պետք է անել (նախանշող)։

  • Մաքրումը պարտադիր է։ Վերլուծությունից առաջ տվյալները պետք է մաքրել սխալներից, բացթողումներից ու կրկնօրինակներից, քանի որ հում տվյալները գրեթե միշտ «աղբ» են պարունակում։
  • Գործիքները հզոր են։ Պարզ վերլուծության համար բավարար է Excel-ը, իսկ ավելի բարդ խնդիրների համար կան մասնագիտացված լուծումներ, ինչպիսին է R վիճակագրական լեզուն՝ ավելի քան 1100 մասնագիտացված փաթեթներով։
  • Օրենքը պաշտպանում է։ Հայաստանում անձնական տվյալների հետ աշխատելիս կարևոր է հիշել, որ քաղաքացին իրավունք ունի 5-օրյա ժամկետում անվճար տեղեկություն ստանալ իր տվյալների մշակման մասին։

Ի՞նչ են քանակական տվյալները և ինչո՞ւ են դրանք կարևոր

Քանակական տվյալները չափելի, թվային արժեքներ են, որոնք օգնում են ստուգել վարկածներ և հանգել փաստերի վրա հիմնված եզրակացությունների։ Այս օբյեկտիվ թվերը կարելի է հաշվել ու վիճակագրորեն վերլուծել՝ պատասխանելով «որքա՞ն» և «ի՞նչ հաճախականությամբ» հարցերին, ի տարբերություն որակական տվյալների, որոնք բացատրում են «ինչո՞ւ»-ն։

Այս տվյալները հավաքվում են տարբեր աղբյուրներից՝ հարցումներ, գիտափորձեր, դիտարկումներ, գործարքների պատմություն կամ նույնիսկ սենսորային սարքեր։ Դրանց վերլուծությունը պարզապես միջին թվաբանական հաշվելը չէ։ Դա տվյալների համակարգված ուսումնասիրություն է՝ օրինաչափություններ, միտումներ և փոխկապակցվածություններ գտնելու համար։ Հենց այս գործընթացն է թույլ տալիս հում թվերը վերածել իմաստալից, գործնական պատկերացումների, որոնք հիմք են դառնում կարևոր որոշումների համար։ Առանց քանակական վերլուծության՝ մենք մնում ենք ենթադրությունների և կանխազգացումների դաշտում։ Իսկ թվերը, երբ ճիշտ ենք կարդում, չեն ստում։

Քանակական տվյալները տալիս են իրադարձության «ի՞նչ»-ը (օրինակ՝ օգտատերերի 70 %-ը լքում է կայքը գնումների զամբյուղի էջում), իսկ որակական տվյալները՝ «ինչո՞ւ»-ն (օրինակ՝ հարցազրույցները ցույց են տալիս, որ առաքման պայմանները շփոթեցնող են)։

Ինչպե՞ս նախապատրաստել քանակական տվյալները վերլուծության համար

Հավաքագրված տվյալները հազվադեպ են պատրաստ լինում անմիջապես վերլուծության։ Իրական կյանքի տվյալները հաճախ խառն են՝ պարունակում են բաց թողնված արժեքներ, մուտքագրման սխալներ, անհամապատասխանություններ և ուղղակի անոմալիաներ։ Այս փուլը՝ տվյալների մաքրումը, ամենակարևորներից է, թեև հաճախ մնում է կադրից դուրս։

Տվյալների նախապատրաստումը մի քանի հիմնական քայլ է ներառում։

  1. Կրկնօրինակների հեռացում։ Եթե միևնույն օգտատերը մի քանի անգամ է լրացրել հարցումը, կրկնօրինակները կարող են խեղաթյուրել արդյունքները։
  2. Բաց թողնված տվյալների մշակում։ Ի՞նչ անել, երբ հարցման մասնակիցը չի պատասխանել տարիքի հարցին։ Կարելի է բաց թողնել ամբողջ տողը, այն փոխարինել միջին արժեքով կամ կիրառել ավելի բարդ մեթոդներ։ Ընտրությունը կախված է համատեքստից։
  3. Անոմալիաների (outliers) հայտնաբերում։ Եթե ուսանողների տարիքի վերաբերյալ տվյալներում հանդիպում է 120 թիվը, դա, ամենայն հավանականությամբ, սխալ է։ Նման արտառոց արժեքները պետք է գտնել և ուղղել կամ հեռացնել։
  4. Փոփոխականների ձևափոխում։ Երբեմն պետք է միավորել կատեգորիաները (օրինակ՝ «շատ լավ» և «լավ» պատասխանները դարձնել «դրական») կամ ստեղծել նոր փոփոխականներ եղածներից (օրինակ՝ ծննդյան ամսաթվից ստանալ տարիքը)։

Այս քայլերն ապահովում են, որ ձեր վերլուծությունը հիմնված լինի որակյալ, հուսալի տվյալների, այլ ոչ թե «աղբի» վրա։

Տվյալների մաքրման փուլը բաց թողնելը նման է փտած հիմքի վրա տուն կառուցելուն։ Որքան էլ բարդ լինեն ձեր վերլուծական մոդելները, դրանք սխալ արդյունքներ կտան, եթե հիմնված են սխալ տվյալների վրա։

Վերլուծության ի՞նչ մեթոդներ են կիրառվում քանակական տվյալներն ուսումնասիրելու համար

Երբ տվյալները մաքուր են և պատրաստ, սկսվում է ամենահետաքրքիրը՝ վերլուծությունը։ Գոյություն ունի վերլուծության չորս հիմնական տեսակ, որոնք բարդության աճող մակարդակներ ունեն։ Սկսնակները հաճախ սահմանափակվում են առաջինով, բայց իրական արժեքը թաքնված է հաջորդ փուլերում։

Նկարագրական վիճակագրությունը պատասխանում է «Ի՞նչ է պատահել» հարցին։ Սա վերլուծության հիմքն է, որն ամփոփում է տվյալների հիմնական բնութագրերը։ Այստեղ են մտնում կենտրոնական միտման չափումները (միջին, միջնարժեք, մոդա) և ցրվածության չափումները (միջակայք, դիսպերսիա, ստանդարտ շեղում)։ Այն ցույց է տալիս ընդհանուր պատկերը, բայց չի բացատրում պատճառները։

Ախտորոշիչ վերլուծությունը փորփրում է ավելի խորը՝ պարզելու, թե «Ինչո՞ւ դա պատահեց»։ Այն փորձում է գտնել պատճառահետևանքային կապեր։ Եթե նկարագրական վերլուծությունը ցույց է տալիս, որ վաճառքները նվազել են, ապա ախտորոշիչը կարող է պարզել, որ դա տեղի է ունեցել այն բանից հետո, երբ մրցակիցը գործարկել է գովազդային արշավ։

Կանխատեսող վերլուծությունը օգտագործում է պատմական տվյալները՝ կանխատեսելու, թե «Ի՞նչ կարող է պատահել» ապագայում։ Սա արդեն մեքենայական ուսուցման և վիճակագրական մոդելավորման տիրույթն է։ Օրինակ՝ ռեգրեսիոն վերլուծությունը կարող է կանխատեսել տան գինը՝ հիմնվելով դրա մակերեսի, սենյակների քանակի և գտնվելու վայրի վրա։

Նախանշող վերլուծությունը ամենաբարդ մակարդակն է։ Ապագան կանխատեսելուց բացի, այն նաև առաջարկում է գործողություններ՝ «Ի՞նչ պետք է անել»՝ ցանկալի արդյունքի հասնելու համար։ Այն պատասխանում է այնպիսի հարցերի, ինչպիսին է՝ «Ո՞ր գովազդային ուղերձը պետք է ցույց տանք այս հաճախորդին, որպեսզի նա գնում կատարի»։

Վերլուծության տեսակՀիմնական հարցՕրինակ
ՆկարագրականԻ՞նչ է պատահել։Անցյալ ամիս մեր կայքն ունեցել է 10 000 այցելու։
ԱխտորոշիչԻնչո՞ւ է դա պատահել։Այցելուների թիվն աճել է, քանի որ գործարկել ենք նոր գովազդային արշավ։
ԿանխատեսողԻ՞նչ է պատահելու։Եթե շարունակենք այս արշավը, հաջորդ ամիս կունենանք 12 000 այցելու։
ՆախանշողԻ՞նչ պետք է անել։Բյուջեն 10 %-ով ավելացնելով՝ կարող ենք հասնել 15 000 այցելուի։

Ենթադրենք՝ օնլայն խանութը նկատում է, որ շատ օգտատերեր ավելացնում են ապրանքը զամբյուղի մեջ, բայց չեն ավարտում գնումը։ Ախտորոշիչ վերլուծությունը կարող է ցույց տալ, որ բջջային սարքերից օգտվողները երկու անգամ ավելի հաճախ են լքում զամբյուղը։ Սա ուղղորդում է խնդիրը փնտրել կայքի բջջային տարբերակի հարմարավետության մեջ։

Ինչպե՞ս բարելավել տվյալների ընկալումը վիզուալիզացիայի միջոցով

Թվերի սյունակները դժվարընթեռնելի են։ Մարդու ուղեղը շատ ավելի լավ է ընկալում տեսողական տեղեկատվությունը։ Այստեղ օգնության է հասնում տվյալների վիզուալիզացիան՝ թվային տեղեկատվությունը գրաֆիկների և դիագրամների վերածելու գործընթացը։ Լավ կառուցված գրաֆիկը կարող է մի հայացքով փոխանցել այն, ինչի համար կպահանջվեին տեքստի էջեր։

Վիզուալիզացիայի հիմնական նպատակը օրինաչափությունները, միտումները և անոմալիաները հեշտությամբ տեսանելի դարձնելն է։ Օրինակ՝

  • Գծային գրաֆիկները (Line charts) իդեալական են ժամանակի ընթացքում տեղի ունեցող փոփոխությունները ցույց տալու համար (օրինակ՝ ամսական վաճառքի ծավալները)։
  • Սյունակային դիագրամները (Bar charts) հարմար են կատեգորիաները համեմատելու համար (օրինակ՝ տարբեր ապրանքների վաճառքը)։
  • Ցրման դիագրամները (Scatter plots) օգնում են տեսնել երկու փոփոխականի միջև կապը (օրինակ՝ գովազդի ծախսերի և եկամտի միջև)։
  • Կլոր դիագրամները (Pie charts) ցույց են տալիս ամբողջի մասերը, բայց պետք է զգույշ լինել դրանց հետ, քանի որ դրանք կարող են խեղաթյուրող լինել, եթե շատ կտորներ կան։

Սակայն պետք է հիշել, որ վիզուալիզացիան ինքնանպատակ չէ։ Դրա խնդիրը ոչ թե ուղղակի «գեղեցիկ նկարներ» ստանալն է, այլ տվյալների պատմությունը հստակ և համոզիչ կերպով ներկայացնելը։ Վատ ընտրված գրաֆիկը կարող է ավելի շատ շփոթեցնել, քան պարզաբանել։ Ուստի, միշտ պետք է մտածել, թե ինչ եք ուզում ասել ձեր գրաֆիկով և ընտրել դրան համապատասխան տեսակը։

Ի՞նչ իրավական և էթիկական հարցեր պետք է հաշվի առնել տվյալների վերլուծության ժամանակ

Տվյալների հետ աշխատանքը, հատկապես երբ դրանք վերաբերում են մարդկանց, մեծ պատասխանատվություն է։ Ցանկացած վերլուծություն պետք է իրականացվի իրավական և էթիկական նորմերի շրջանակում։ Հայաստանում այս ոլորտը կարգավորվում է «Անձնական տվյալների պաշտպանության մասին» ՀՀ օրենքով։

Օրենքի համաձայն՝ անձնական տվյալ է համարվում ֆիզիկական անձին վերաբերող ցանկացած տեղեկություն, որը թույլ է տալիս ուղղակիորեն կամ անուղղակիորեն նույնականացնել այդ անձին։ Սա կարող է լինել անունը, հասցեն, հեռախոսահամարը կամ նույնիսկ առցանց նույնացուցիչը։

Որպես տվյալների սուբյեկտ՝ յուրաքանչյուր ոք ունի կարևոր իրավունքներ։ Օրինակ՝ դուք կարող եք կազմակերպությունից պահանջել տեղեկություն այն մասին, թե արդյոք ձեր տվյալները մշակվում են, ինչ նպատակով և ում են փոխանցվել։ Ըստ օրենքի, այդ տեղեկությունը պետք է տրամադրվի հարցումը ստանալուց հետո 5-օրյա ժամկետում, անվճար և ամբողջական։

Էթիկական կողմը նույնպես կարևոր է։ Օրինակ՝ աշխատավայրում տեսահսկումը։ Գործատուն կարող է տեղադրել տեսախցիկներ, բայց միայն բացառիկ դեպքերում, երբ դա անհրաժեշտ է մարդկանց անվտանգության կամ գույքի պաշտպանության համար։ Ընդ որում, աշխատակիցները պետք է նախապես գրավոր տեղեկացվեն, իսկ տարածքում պետք է լինեն նախազգուշացնող նշաններ։ Տվյալները պարզապես թվեր չեն, դրանց հետևում իրական մարդիկ են, և դա երբեք չի կարելի մոռանալ։

Եթե ձեր հետազոտությունը ներառում է մարդկանց վերաբերյալ տվյալներ, միշտ ձգտեք դրանք անանունացնել կամ կեղծանունացնել վերլուծությունից առաջ։ Սա նվազագույնի կհասցնի գաղտնիության հետ կապված ռիսկերը։

Հաճախ տրվող հարցեր

Ի՞նչ է քանակական տվյալը և ինչո՞վ է տարբերվում որակականից։

Քանակական տվյալները թվային, չափելի արժեքներ են (օրինակ՝ հասակ, ջերմաստիճան, եկամուտ), որոնք պատասխանում են «որքա՞ն» կամ «քանի՞» հարցերին։ Ի տարբերություն սրա՝ որակական տվյալները նկարագրական են, ոչ թվային (օրինակ՝ հարցազրույցի տեքստ, կարծիքներ) և պատասխանում են «ինչո՞ւ» կամ «ինչպե՞ս» հարցերին։

Ինչո՞ւ է տվյալների մաքրումն այդքան կարևոր քանակական վերլուծությունից առաջ։

Տվյալների մաքրումը հեռացնում է հում տվյալներում առկա սխալները, կրկնօրինակները և անհամապատասխանությունները։ Առանց այս փուլի վերլուծության արդյունքները կարող են լինել խիստ խեղաթյուրված և անարժեք, ինչը կհանգեցնի սխալ եզրակացությունների ու որոշումների։ Սա ապահովում է վերլուծության հուսալիությունը։

Ի՞նչ է նկարագրական վիճակագրությունը և ինչպիսի՞ չափումներ է ներառում։

Նկարագրական վիճակագրությունն ամփոփում և նկարագրում է տվյալների հիմնական հատկանիշները՝ առանց պատճառները բացատրելու։ Այն ներառում է կենտրոնական միտման չափումներ (միջին թվաբանական, միջնարժեք, մոդա) և ցրվածության չափումներ (միջակայք, դիսպերսիա, ստանդարտ շեղում)։

Որո՞նք են քանակական վերլուծության չորս հիմնական տեսակները։

Քանակական վերլուծության չորս հիմնական տեսակներն են՝ նկարագրական (ի՞նչ է պատահել), ախտորոշիչ (ինչո՞ւ է պատահել), կանխատեսող (ի՞նչ է պատահելու) և նախանշող (ի՞նչ պետք է անել)։ Յուրաքանչյուր հաջորդ տեսակը հիմնվում է նախորդի վրա՝ տալով ավելի խորը պատկերացումներ։

Ի՞նչ ծրագրեր կամ գործիքներ կարող եմ օգտագործել քանակական տվյալների վերլուծության համար։

Գոյություն ունեն բազմաթիվ գործիքներ՝ սկսած հանրահայտ Microsoft Excel-ից՝ պարզ վերլուծությունների համար, մինչև մասնագիտացված ծրագրեր։ Դրանցից են SPSS-ը և R վիճակագրական լեզուն, որն առաջարկում է հազարավոր անվճար փաթեթներ՝ ցանկացած բարդության խնդիր լուծելու համար։

Ի՞նչ իրավունքներ ունեմ՝ որպես տվյալների սուբյեկտ, իմ անձնական տվյալների մշակման հետ կապված։

ՀՀ օրենսդրությամբ դուք իրավունք ունեք իմանալու, թե ով, ինչ նպատակով և ինչպես է մշակում ձեր տվյալները։ Դուք կարող եք պահանջել ուղղել կամ ոչնչացնել ձեր տվյալները, ինչպես նաև 5-օրյա ժամկետում անվճար ստանալ մշակման վերաբերյալ մանրամասն տեղեկատվություն։

Ե՞րբ է նպատակահարմար օգտագործել վիզուալիզացիա՝ քանակական տվյալները ներկայացնելու համար։

Վիզուալիզացիան նպատակահարմար է գրեթե միշտ, երբ ցանկանում եք հեշտությամբ հաղորդել բարդ տվյալներ, ցույց տալ միտումներ, համեմատել խմբեր կամ ընդգծել օրինաչափություններ։ Լավ գրաֆիկն օգնում է լսարանին արագ ըմբռնել հիմնական ուղերձը՝ առանց թվերի սյունակների մեջ խորանալու։

Փորձեք referati.ai-ն՝ ակադեմիական գրելու համար ստեղծված արհեստական բանականություն։

Պատրա՞ստ ես գրել քո աշխատանքը

Referati AI-ը կօգնի քեզ րոպեների ընթացքում գտնել աղբյուրներ, կառուցել և ձևավորել ակադեմիական աշխատանք՝ իրական հղումներով։

Կարդա նաև