Theory
કોઈ આખી college ને પૂછતું નથી
આચાર્યને college ના 3000 students નો સરેરાશ રોજિંદો screen time જાણવો છે. વિકલ્પ એક: ત્રણેય હજારની મુલાકાત લો. બે અઠવાડિયાં, ચાર કર્મચારી, પરીક્ષાની મોસમ બરબાદ.
વિકલ્પ બે, જે આંકડાશાસ્ત્રીઓ ખરેખર કરે છે: ધ્યાનથી 60 students પસંદ કરો, એક બપોરમાં એમનું survey કરો, અને એમના જવાબોથી ત્રણેય હજાર વિશે બોલો.
એ ચાલ, આખું સમજવા ભાગ માપવો, એ આંકડાશાસ્ત્રનું પાયાનું કૃત્ય છે, અને આ વિષયનું પહેલું કામ એના ટુકડાઓને ચોકસાઈથી નામ આપવાનું છે.
Theory
એક ચમચી આખા તપેલાનો ચુકાદો આપે છે
રસોઇયો મીઠું તપાસવા આખું દાળનું તપેલું પી જતો નથી. એક હલાવેલી ચમચી આખા તપેલા માટે નક્કી કરે છે.
તપેલું એ વસ્તી છે: તમે જેના વિશે જાણવા માંગો છો એ બધું. ચમચી એ નમૂનો છે: તમે ખરેખર જે ભાગ ચાખો છો. અને હલાવવું એ પ્રામાણિકતાની શરત છે: ઉપરથી લીધેલી હલાવ્યા વગરની ચમચી ફક્ત વઘાર ચાખે છે, અને તપેલા વિશે જૂઠું બોલે છે.
Theory
પરીક્ષાના ચાર શબ્દ
- વસ્તી: અભ્યાસ હેઠળનું આખું જૂથ (બધા 3000 students).
- નમૂનો: ખરેખર મપાયેલો ઉપસમૂહ (survey કરાયેલા 60).
- પ્રાચલ: વસ્તીનું વર્ણન કરતી સંખ્યા (બધા 3000 નો સાચો સરેરાશ screen time: સામાન્ય રીતે અજ્ઞાત).
- આંકડો: એ જ પ્રકારની સંખ્યા જે નમૂનામાંથી ગણાય (60 students ની સરેરાશ: જે આપણે ખરેખર ગણી શકીએ).
એક શાખા તરીકે આંકડાશાસ્ત્ર એ આંકડા (નમૂનાની સંખ્યાઓ) વાપરીને પ્રાચલ (વસ્તીનાં સત્યો) નું અનુમાન કરવાની કળા છે. બધાનું પૂરું માપન એ વસ્તીગણતરી છે: ખર્ચાળ, ધીમી, ક્યારેક અશક્ય (દરેક બલ્બ ચકાસવાથી માલ નાશ પામે).
Theory
Variables: survey શું નોંધે છે
Survey કરાયેલો દરેક student ચાર પ્રશ્નોના જવાબ આપે છે. દરેક જવાબ એક variable છે, અને દરેક variable બે કુટુંબમાંથી એકનું છે:
શ્રેણીગત (ગુણવાચક): લેબલ.
- નામવાચક: કોઈ કુદરતી ક્રમ નહીં: શહેર, રક્તજૂથ.
- ક્રમવાચક: ક્રમવાળાં લેબલ: grade (A > B > C), સંતોષ (ઊંચો/મધ્યમ/નીચો).
આંકડાકીય (સંખ્યાવાચક): સંખ્યાઓ જેના પર ગણિત થઈ શકે.
- અલગ: ગણી શકાય એવા કૂદકા: નાપાસ વિષયો (0, 1, 2...).
- સળંગ: કોઈ પણ ચોકસાઈએ: ઊંચાઈ (167.5 cm), screen time (143.7 મિનિટ).
At a glance
CampusPulse નું survey, વર્ગીકૃત
| Variable | કુટુંબ | ઉપપ્રકાર |
|---|---|---|
| શહેર | શ્રેણીગત | નામવાચક (કોઈ ક્રમ નહીં) |
| Grade (A/B/C) | શ્રેણીગત | ક્રમવાચક (ક્રમવાળું) |
| નાપાસ વિષયો | આંકડાકીય | અલગ (ગણી શકાય) |
| ઊંચાઈ (cm) | આંકડાકીય | સળંગ (માપી શકાય) |
| Screen time (મિનિટ) | આંકડાકીય | સળંગ |
Quiz
Survey કરાયેલા 60 students સરેરાશ 4.2 કલાકનો screen time જણાવે છે. ચોકસાઈવાળી પરીક્ષાની ભાષામાં, એ 4.2 **શું** છે?
- એક આંકડો: નમૂનામાંથી ગણાયેલો, વસ્તીના પ્રાચલનું અનુમાન કરવા વપરાતો
- એક પ્રાચલ: ગણેલી કોઈ પણ સરેરાશ પ્રાચલ છે
- વસ્તીનું મૂલ્ય: 60 students એને ચોક્કસ બનાવવા પૂરતા છે
- વસ્તીગણતરીનું પરિણામ
Show the answer
એક આંકડો: નમૂનામાંથી ગણાયેલો, વસ્તીના પ્રાચલનું અનુમાન કરવા વપરાતો
નમૂના માંથી આવતી સંખ્યાઓ આંકડા છે; બધા 3000 નું અજ્ઞાત સાચું મૂલ્ય એ પ્રાચલ છે જેનું આંકડો અનુમાન કરે છે. જોડી (નમૂનો→આંકડો, વસ્તી→પ્રાચલ) એ સ્મૃતિની યુક્તિ છે જેની પરીક્ષકો અપેક્ષા રાખે છે. નમૂનાની સરેરાશ ક્યારેય ચોક્કસ સત્ય બનતી નથી (વિકલ્પ C), અને વસ્તીગણતરીનો અર્થ થાય કે બધા 3000 મપાયા (વિકલ્પ D).
Think first
આ ચારનું વર્ગીકરણ કરો
છાત્રાલયના survey માંથી: (1) મેસનું રેટિંગ: ખરાબ/ઠીક/સારું; (2) રાત્રિભોજનમાં ખવાયેલી રોટલીની સંખ્યા; (3) માતૃભાષા; (4) મુસાફરીનો સમય મિનિટમાં. Tap કરતાં પહેલાં દરેકને એનું કુટુંબ અને ઉપપ્રકાર આપો.
Show the answer
(1) શ્રેણીગત ક્રમવાચક: લેબલોમાં ક્રમ છે.
(2) આંકડાકીય અલગ: તમે રોટલી ગણો છો, કોઈ 2.7 ખાતું નથી.
(3) શ્રેણીગત નામવાચક: ભાષાઓમાં કોઈ ક્રમ નથી.
(4) આંકડાકીય સળંગ: 23.5 મિનિટ અર્થપૂર્ણ છે.
બે પ્રશ્નની કસોટી: એ લેબલ છે કે સંખ્યા? પછી: ક્રમવાળું કે નહીં / ગણેલું કે માપેલું? આ વિષયનો દરેક વર્ગીકરણનો પ્રશ્ન ક્રમમાં પુછાયેલા આ બે પ્રશ્નોથી ઉકેલાય છે.
Watch out
અર્થહીન ગણિતનો ફાંદો
શહેરોને 1 = સુરત, 2 = નવસારી, 3 = બારડોલી તરીકે code કરો અને spreadsheet ખુશીથી "સરેરાશ શહેર = 1.8" જણાવશે. અર્થહીન: સંખ્યાનો પોશાક પહેરેલાં નામવાચક લેબલ હજી લેબલ જ છે. Roll numbers અને pin codes માટે પણ એ જ.
Variable નો પ્રકાર એનું કાયદેસર ગણિત નક્કી કરે છે: સરેરાશ અને SD આંકડાકીય variables નાં છે; શ્રેણીગત variables ને ગણતરી અને ટકાવારી મળે છે. પરીક્ષાઓ આને "કયું માપ યોગ્ય છે?" ના પ્રશ્નોથી ચકાસે છે.
Theory
આ શબ્દભંડોળ આખો વિષય કેમ ચલાવે છે
પછીનો દરેક વિષય આજના શબ્દો પર ઊભો છે: કેન્દ્રીય પ્રવૃત્તિ અને વિકિરણ આંકડાકીય variables નો સારાંશ આપે છે; આવૃત્તિનાં કોષ્ટકો શ્રેણીગત ને ગણે છે; નમૂના લેવાની રીતો 60 ને પ્રામાણિકપણે પસંદ કરવા વિશે છે; bell curve નમૂનાના આંકડા કેવી રીતે વર્તે છે એ વર્ણવે છે. અને એકમ 3 માં, R તમારી પાસે આ પ્રકારો જાહેર કરાવશે (numeric, factor): તમે જેનું વર્ગીકરણ કર્યું નથી એ computer ધારવાની ના પાડે છે.
Summary
Key takeaways
- વસ્તી = રસ હોય એવા બધા; નમૂનો = ખરેખર મપાયેલો ભાગ.
- પ્રાચલ વસ્તીનું વર્ણન કરે છે (અજ્ઞાત); આંકડો નમૂનામાંથી ગણાય છે (એનું અનુમાન કરે છે).
- વસ્તીગણતરી = બધાને માપવા: ખર્ચાળ, ધીમી, ક્યારેક અશક્ય.
- શ્રેણીગત variables એ લેબલ છે: નામવાચક (ક્રમ વગરના) કે ક્રમવાચક (ક્રમવાળા).
- આંકડાકીય variables એ સંખ્યાઓ છે: અલગ (ગણેલી) કે સળંગ (માપેલી).
- પ્રકાર કાયદેસર ગણિત નક્કી કરે છે: શહેરના codes કે roll numbers ની સરેરાશ નહીં.
- Memory hook: એક હલાવેલી ચમચી આખા તપેલાનો ચુકાદો આપે છે.