เก่งดี
← สารบัญคณิตศาสตร์ ม.6
ม.6 · บทที่ 1📊 สถิติและความน่าจะเป็นอ่าน ~58 นาที

ความหมายของสถิติศาสตร์และข้อมูล

ก่อนจะคำนวณค่าสถิติใดๆ ต้องรู้ก่อนว่ากำลังตอบคำถามอะไร ข้อมูลมาจากไหน เก็บเมื่อไร และเป็นข้อมูลชนิดใด — เพราะชนิดของข้อมูลเป็นตัวกำหนดว่าเครื่องมือใดใช้ได้และเครื่องมือใดใช้ไม่ได้

อ้างอิงโครงสร้างหลักสูตร: สถิติและความน่าจะเป็น · ความหมายของสถิติศาสตร์ คำสำคัญ (ประชากร ตัวอย่าง ตัวแปร ข้อมูล พารามิเตอร์ ค่าสถิติ) และประเภทของข้อมูล (พื้นฐาน)

🎯 จบบทนี้แล้วคุณจะทำสิ่งเหล่านี้ได้

  • ✓บอกความหมายของสถิติศาสตร์ และแยกสถิติศาสตร์เชิงพรรณนาออกจากเชิงอนุมานได้
  • ✓เรียงลำดับขั้นตอนของกระบวนการทางสถิติ และแยกคำถามทางสถิติออกจากคำถามทั่วไปได้
  • ✓ระบุประชากร ตัวอย่าง ตัวแปร ข้อมูล พารามิเตอร์ และค่าสถิติ จากสถานการณ์ที่กำหนดได้
  • ✓จำแนกข้อมูลตามลักษณะ (เชิงปริมาณ · เชิงคุณภาพ) ตามแหล่งที่มา (ปฐมภูมิ · ทุติยภูมิ) และตามระยะเวลาที่เก็บ (อนุกรมเวลา · ตัดขวาง) ได้
  • ✓บอกได้ว่าชนิดของข้อมูลจำกัดเครื่องมือทางสถิติที่ใช้ได้อย่างไร

📘 คำศัพท์สำคัญประจำบท

สถิติศาสตร์statistics

ศาสตร์ว่าด้วยการเก็บ จัดระเบียบ นำเสนอ วิเคราะห์ และแปลความหมายข้อมูล เพื่อใช้ตัดสินใจ

สถิติศาสตร์เชิงพรรณนาdescriptive statistics

สรุปข้อมูลชุดที่มีอยู่ตรงหน้า ไม่สรุปเกินกว่านั้น

สถิติศาสตร์เชิงอนุมานinferential statistics

ใช้ข้อมูลจากตัวอย่างสรุปไปถึงประชากรทั้งหมด — จึงมีความไม่แน่นอนติดมาด้วยเสมอ

ประชากรpopulation

ทุกหน่วยที่เราสนใจจะสรุปถึง — ไม่จำเป็นต้องเป็นคน

ตัวอย่างsample

ส่วนย่อยของประชากรที่เลือกมาเก็บข้อมูลจริง

ตัวแปรvariable

ลักษณะของหน่วยที่เราสนใจวัดหรือบันทึก เช่น ส่วนสูง อาชีพ — ค่าที่ได้เปลี่ยนไปตามแต่ละหน่วย

ข้อมูลdata

ค่าของตัวแปรที่เก็บมาได้จริง อาจเป็นตัวเลขหรือไม่ใช่ตัวเลขก็ได้

พารามิเตอร์parameter

ค่าที่บอกลักษณะของ ประชากร ทั้งหมด เช่น ค่าเฉลี่ยของทุกหน่วย — มักไม่รู้ค่าจริง

ค่าสถิติstatistic

ค่าที่คำนวณจาก ตัวอย่าง ใช้บอกลักษณะของตัวอย่าง หรือใช้ประมาณค่าพารามิเตอร์

ข้อมูลเชิงปริมาณquantitative data

ข้อมูลที่เป็นตัวเลขซึ่งนำมาคำนวณได้อย่างมีความหมาย เช่น ส่วนสูง รายได้

ข้อมูลเชิงคุณภาพqualitative data

ข้อมูลที่บอกลักษณะหรือกลุ่ม เช่น เพศ อาชีพ ยี่ห้อ — แม้ใส่รหัสเป็นเลขก็คำนวณค่าเฉลี่ยไม่ได้

ข้อมูลปฐมภูมิprimary data

ข้อมูลที่ผู้ใช้เก็บเองโดยตรงจากแหล่งต้นทาง

ข้อมูลทุติยภูมิsecondary data

ข้อมูลที่คนอื่นหรือหน่วยงานอื่นเก็บไว้แล้ว เรานำมาใช้ต่อ

ข้อมูลอนุกรมเวลาtime series data

ข้อมูลเรื่องเดียวกันที่เก็บซ้ำต่อเนื่องไปตามลำดับเวลา เช่น จำนวนผู้โดยสารรถไฟฟ้ารายวัน

ข้อมูลตัดขวางcross-sectional data

ข้อมูลของหลายหน่วยที่เก็บ ณ จุดเวลาเดียว เช่น ความดันโลหิตของผู้ป่วยทุกคนที่มาตรวจวันนี้

1.1 สถิติศาสตร์คืออะไร

🔑สาระสำคัญ

คนทั่วไปใช้คำว่า “สถิติ” กับ ตัวเลข ที่เห็นในข่าว · แต่ สถิติศาสตร์ คือ วิชา ที่ว่าด้วยวิธีได้ตัวเลขนั้นมาและวิธีอ่านมันให้ถูก · ความต่างนี้สำคัญ เพราะตัวเลขเดียวกันอ่านผิดวิธีก็ให้ข้อสรุปตรงข้ามได้

สายทำอะไรข้อสรุปแบบนี้ เช่น
เชิงพรรณนาสรุปเฉพาะข้อมูลที่มีอยู่“นักเรียนห้องนี้ทั้ง คน ใช้โทรศัพท์เฉลี่ยวันละ ชั่วโมง”
เชิงอนุมานสรุปจากตัวอย่างไปถึงประชากร“จากการสุ่มถาม คน คาดว่านักเรียน ม.ปลายทั่วประเทศใช้โทรศัพท์เฉลี่ยราววันละ ชั่วโมง”

สถิติศาสตร์สองสาย — ต่างกันที่ “สรุปถึงใคร”

⚠️ข้อผิดพลาดที่แพงที่สุดในการอ่านข่าว

เอาข้อสรุปเชิงพรรณนาไปใช้เหมือนเป็นเชิงอนุมาน · เช่น สำรวจคนที่เดินในห้างแห่งหนึ่ง คนแล้วพบว่า มีสมาร์ตโฟนรุ่นใหม่ ไม่ได้แปลว่าคนไทย มี เพราะคนที่เดินห้างนั้นไม่ใช่ตัวแทนของคนไทยทั้งประเทศ · บทนี้ทั้งบทมีไว้เพื่อให้แยกสองอย่างนี้ออกจากกันได้

✏️ตัวอย่าง

ข้อสรุปต่อไปนี้ใช้สถิติศาสตร์สายใด (ก) “ร้านนี้ขายกาแฟเมื่อวานได้ แก้ว เป็นลาเต้ ” (ข) “จากการสุ่มตรวจปลากระป๋อง กระป๋อง คาดว่าทั้งล็อตมีกระป๋องบุบราว ”

  1. ขั้นที่ 1(ก) พูดถึงกาแฟทุกแก้วที่ขายเมื่อวานเท่านั้น ไม่ได้สรุปเกินข้อมูลที่มี
  2. ขั้นที่ 2(ข) ตรวจแค่ กระป๋อง แต่สรุปไปถึง ทั้งล็อต ซึ่งใหญ่กว่ากลุ่มที่ตรวจจริง

ตอบ  (ก) เชิงพรรณนา · (ข) เชิงอนุมาน

💡 ถามตัวเองว่า “ข้อสรุปพูดถึงกลุ่มที่ใหญ่กว่ากลุ่มที่เก็บข้อมูลจริงหรือไม่” — ถ้าใช่คือเชิงอนุมาน

📝 เนื้อหาเต็มของบทนี้กำลังตรวจทาน

ตอนนี้เปิดให้อ่านแล้ว 1 หัวข้อจากทั้งหมด 4 หัวข้อ — อีก 3 หัวข้อ พร้อมตัวอย่างแก้ทีละขั้น สรุปสูตรท้ายบท ข้อผิดพลาดที่พบบ่อย และแบบเช็กตัวเอง จะเปิดให้อ่านเมื่อตรวจทานเสร็จ

เราตรวจทุกสูตรและทุกตัวอย่างก่อนเผยแพร่ เพราะเนื้อหาผิดหนึ่งบรรทัด อาจทำให้คุณจำผิดไปทั้งบท

อ่านจบแล้ว — ลองของจริงเลย

โจทย์สร้างใหม่ทุกครั้ง ไม่ซ้ำ พร้อมเฉลยที่สอนวิธีคิด

ฝึกโจทย์ ประเภทของข้อมูล · ประชากร ตัวอย่าง พารามิเตอร์ ค่าสถิติ · เชิงพรรณนา-เชิงอนุมาน →

เนื้อหา ตาราง และตัวอย่างทั้งหมดเรียบเรียงขึ้นใหม่โดยเก่งดี อ้างอิงเพียงโครงสร้างหลักสูตรแกนกลาง (ข้อมูลสาธารณะ)— ไม่คัดลอกจากหนังสือเรียน หนังสือติว หรือเว็บติวของผู้ใด