Foundations

LLM ทำงานยังไง: เบื้องหลังที่อธิบายความแปลก ๆ ของ AI

8 มิถุนายน 2026 อ่าน 6 นาที ◈ Human-led, AI-assisted

โมเดลภาษาขนาดใหญ่ไม่ได้ 'รู้' อย่างที่เราคิด มันแค่ทายคำถัดไปเก่งมาก แต่ความเข้าใจกลไกนี้จะเปลี่ยนวิธีที่คุณใช้มันไปตลอดกาล

สรุปบทความนี้ด้วย AI

ทุกคนพูดถึง ChatGPT, Claude, Gemini แต่น้อยคนรู้ว่าจริง ๆ แล้วมันทำงานยังไง และยิ่งน้อยกว่านั้นที่รู้ว่าการเข้าใจเบื้องหลังช่วยให้ใช้งานได้ดีขึ้นอย่างมีนัยสำคัญ บทความนี้จะอธิบายโดยไม่ต้องมีพื้นฐาน math เลย

หัวใจของ LLM คือการทาย ไม่ใช่การรู้

ลองนึกถึงเวลาที่โทรศัพท์แนะนำคำถัดไปตอนพิมพ์ข้อความ โมเดลภาษาขนาดใหญ่ (LLM) ทำงานคล้ายกัน แค่เก่งกว่ามหาศาล

เมื่อคุณพิมพ์ “ฉันต้องการ…” AI ไม่ได้ค้นหาคำตอบจากฐานข้อมูล มันคำนวณว่า “จากทุก token ที่เป็นไปได้ อันไหนมีโอกาสสูงสุดที่จะตามมาหลังประโยคนี้?” แล้วทายทีละ token จนได้คำตอบทั้งย่อหน้า

LLM ไม่ได้ค้นข้อมูล แต่สร้างคำตอบขึ้นมาใหม่จากรูปแบบที่เคยเรียนรู้

นี่คือเหตุผลที่ AI ตอบได้ลื่นไหล แต่ก็เป็นเหตุผลเดียวกับที่มันบางครั้งมั่นใจทั้งที่ผิด

กระบวนการฝึก มาจากไหน

LLM ไม่ได้ถูก “โปรแกรม” แต่ถูก “ฝึก” ผ่านสองขั้นตอนหลัก

ขั้นที่ 1 Pre-training

โมเดลอ่านข้อความจำนวนมหาศาล - หลายล้านล้านคำจากอินเทอร์เน็ต หนังสือ บทความ code - แล้วฝึกทายว่าคำถัดไปคืออะไร ทำซ้ำนับล้านล้านครั้งจนโมเดลเรียนรู้รูปแบบของภาษา

หลังขั้นนี้ โมเดลพอที่จะสร้างข้อความที่ถูกไวยากรณ์และสมเหตุสมผล แต่ยังไม่ได้ “เป็นประโยชน์” ในแบบที่เราต้องการ

ขั้นที่ 2 Fine-tuning ด้วย RLHF

RLHF (Reinforcement Learning from Human Feedback) คือขั้นตอนที่ทำให้ AI “เป็นมิตร” และ “ตอบคำถามได้ดี” มากขึ้น

นักวิจัยให้ผู้เชี่ยวชาญมนุษย์เปรียบเทียบคำตอบสองแบบแล้วเลือกว่าอันไหนดีกว่า ข้อมูลนี้ถูกใช้ฝึกโมเดลอีกรอบให้ตอบแบบที่มนุษย์ชอบมากขึ้น

ผลลัพธ์คือโมเดลที่

  • ตอบคำถามแทนที่จะแค่ต่อประโยค
  • ปฏิเสธ request ที่เป็นอันตราย
  • มีน้ำเสียงสุภาพและเป็นประโยชน์

Token คือหน่วยความคิดของ AI

AI ไม่ได้มองข้อความเป็นคำ แต่เป็นชิ้นเล็ก ๆ ที่เรียกว่า “โทเคน” คำหนึ่งอาจเป็นหนึ่งหรือหลายโทเคนก็ได้

  • ข้อความยาว = โทเคนเยอะ = ประมวลผลนานและแพงขึ้น
  • ภาษาไทยมักใช้โทเคนมากกว่าภาษาอังกฤษในข้อความความหมายเดียวกัน

Temperature ทำไม AI บางครั้งตอบต่างกันในคำถามเดียวกัน

เวลาคุณถาม AI คำถามเดิมสองครั้ง บางครั้งได้คำตอบต่างกัน นั่นไม่ใช่บั๊ก แต่เป็น feature ที่เรียกว่า temperature

Temperature เป็นตัวเลข 0–2 ที่กำหนดว่า AI จะ “สุ่ม” มากแค่ไหนในการเลือก token ถัดไป:

Temperatureลักษณะเหมาะกับ
0.0Deterministic - ตอบเหมือนกันทุกครั้งการวิเคราะห์ข้อมูล, code, fact extraction
0.7Balancedงานเขียนทั่วไป, อธิบาย
1.0+Creative - หลากหลาย ไม่คาดเดางานสร้างสรรค์, brainstorm

เครื่องมืออย่าง ChatGPT มี default อยู่ที่ประมาณ 0.7-1.0 ทำให้คำตอบที่ได้ไม่เหมือนกันทุกครั้ง สำหรับงานที่ต้องการความแน่นอน เช่น การดึงข้อมูลจากเอกสาร ให้ระบุใน prompt ว่า “ตอบแบบตรงประเด็น อย่าเพิ่มสิ่งที่ไม่มีในเอกสาร”

ทำไม AI ถึง Hallucinate

อาการ “hallucination” คือเมื่อ AI บอกข้อมูลที่ผิดอย่างมั่นใจ เช่น ชื่อหนังสือที่ไม่มีอยู่จริง ตัวเลขที่แต่งขึ้น หรือลิงก์ที่ไม่มี

สาเหตุทางเทคนิค

AI ทายคำที่ “น่าจะตามมา” โดยอิงจากรูปแบบในข้อมูลฝึก ถ้าในข้อมูลฝึกมีรูปแบบว่า “ชื่อนักเขียน + ปี + ชื่อหนังสือ” โมเดลจะสร้างรูปแบบนี้ขึ้นมาแม้ไม่มีข้อมูลจริง

มันไม่มีกลไก “รู้ว่าตัวเองไม่รู้” แบบที่มนุษย์มี ดังนั้นเมื่อไม่มีข้อมูล แทนที่จะบอกว่าไม่รู้ มันจะสร้างคำตอบที่ดูน่าเชื่อถือขึ้นมาแทน

เมื่อไหร่ที่ hallucination เกิดบ่อยกว่า

  • ถามเรื่องข้อมูลเฉพาะเจาะจงมาก (วันที่ ตัวเลข ชื่อคน)
  • ถามเรื่องเหตุการณ์หลัง training cutoff
  • ถามเรื่องภาษาหรือวัฒนธรรมที่มีข้อมูลน้อยใน training data
  • ถามแบบ leading question ที่มีคำตอบที่ดูเหมือนถูกอยู่ในคำถาม

วิธีลด hallucination

ตอบจากเอกสารที่แนบมาเท่านั้น
ถ้าไม่มีข้อมูลในเอกสาร ให้บอกว่าไม่มีข้อมูล
อย่าเพิ่มข้อมูลจากแหล่งอื่น

Instruction แบบนี้ช่วยได้มาก แต่ก็ไม่ 100% ดังนั้น fact-check เสมอสำหรับข้อมูลที่สำคัญ

Context Window และปัญหา “Lost in the Middle”

ทุกโมเดลมี context window - ขนาดสูงสุดของข้อมูลที่รับได้ในครั้งเดียว งานวิจัยพบปัญหาที่เรียกว่า “lost in the middle” - เมื่อให้ข้อมูลยาวมาก ๆ โมเดลมักจำข้อมูลตอนต้นและตอนท้ายได้ดีกว่าตรงกลาง

ผลในทางปฏิบัติ

ถ้าคุณส่งเอกสาร 50 หน้าและถามเรื่องที่อยู่หน้า 25 โมเดลอาจตอบผิดหรือ miss ข้อมูลที่สำคัญ

วิธีรับมือ

  • ถ้าถามเรื่องเฉพาะส่วน ส่งเฉพาะส่วนนั้น ไม่ต้องส่งทั้งเอกสาร
  • ขอให้ AI อ้างอิง quote จากเอกสารเมื่อตอบ เพื่อตรวจสอบว่ามันอ่านส่วนที่ถูกต้อง
  • สำหรับเอกสารยาวมาก พิจารณาแบ่งเป็นหลาย query แทนหนึ่ง query ใหญ่

ความแตกต่างระหว่างโมเดล

ทำไม Claude, GPT, และ Gemini ถึงตอบต่างกันในคำถามเดียวกัน? เพราะ:

  1. ข้อมูลฝึกต่างกัน - แต่ละบริษัทเลือก dataset ต่างกัน
  2. ขนาดโมเดลต่างกัน - พารามิเตอร์มากกว่า ≠ ดีกว่าเสมอ แต่มักแม่นยำกว่าในงานซับซ้อน
  3. Fine-tuning ต่างกัน - บุคลิก น้ำเสียง และค่านิยมที่ฝังไว้ต่างกัน
  4. System prompt ที่ซ่อนอยู่ - ทุกบริการมี instruction ที่ผู้ใช้ไม่เห็น ที่กำหนดพฤติกรรมพื้นฐาน

แล้วเราควรใช้มันยังไง

เข้าใจเบื้องหลังนี้แล้ว ใช้งาน AI ได้ฉลาดขึ้น

ใช้ AI เก่งที่ สรุป, ร่าง, อธิบาย, เปรียบเทียบ, แปล, ระดมไอเดีย, debug code, อธิบาย concept

ระวังเมื่อ AI อ้างตัวเลข, อ้างแหล่งที่มา, บอกเหตุการณ์ปัจจุบัน, ให้คำแนะนำทางการแพทย์หรือกฎหมาย

กฎง่าย ๆ ยิ่ง stake สูง ยิ่งต้องตรวจสอบเพิ่ม ใช้ AI ร่าง ให้มนุษย์ตัดสินใจ - นี่คือหัวใจของการอยู่กับ AI โดยที่เรายังคงอยู่ในลูปต่อไป

รับจดหมายข่าวStay human. Stay in the loop.

ก้าวข้าม algorithm — รับบทความและ AI Updates ใหม่ตรงถึงอีเมลคุณทุกสัปดาห์ก่อนใครอื่น