AI Overview เปลี่ยนคำตอบบ่อยแค่ไหน: งานวิจัยต่างประเทศชี้ 80-99% แต่ Rechargeland เจอแค่ 60%
31 สิงหาคม 2569 · AI Research · อ่าน 11 นาที
ก่อนหน้านี้เราอธิบายไว้ว่าทำไม AI Overview (AIO) ถึงตอบไม่เหมือนเดิมทุกครั้ง (อ่านต้นฉบับที่ ทำไม AI Overview ตอบไม่เหมือนเดิมทุกครั้ง) คำถามที่ตามมาคือ “แล้วมันเปลี่ยนบ่อยแค่ไหนกันแน่ มีตัวเลขวัดได้ไหม” บทความนี้จะรวบรวมงานวิจัยจากต่างประเทศที่วัดตัวเลขนี้ไว้จริง แล้วเทียบกับผลทดสอบของทีมเราเอง (บทความติด Citation 4 ใน 10 ครั้ง) พร้อมข้อสันนิษฐานว่าทำไมตัวเลขของเราถึง “เสถียรกว่า” ค่าเฉลี่ยที่งานวิจัยต่างประเทศเจอมาก
งานวิจัยที่วัดความผันผวนของ AI Overview/AI Mode
มีอย่างน้อย 4 การศึกษาที่วัดเรื่องนี้อย่างเป็นระบบในช่วงปีที่ผ่านมา:
| แหล่งข้อมูล | วิธีทดสอบ | ผลลัพธ์ |
|---|---|---|
| SparkToro (ม.ค. 2569) | รัน prompt เดิมซ้ำ เช็คลิสต์แบรนด์ที่แนะนำ | ลิสต์เดิมลำดับเดิม <0.1% (เปลี่ยน >99%) |
| SE Ranking — AI Mode | 10,000 คำค้น รันซ้ำ 3 ครั้ง/วัน | URL ตรงกันทั้ง 3 รอบแค่ 9.2% |
| Ahrefs — AIO Change Tracking | ติดตาม entity ใน AIO ตามเวลา | Entity overlap เฉลี่ย 54%/การอัปเดต |
| SE Ranking — Local Volatility | AI Mode คำค้น local ซ้ำในโลเคชันเดียว | URL overlap 18-20% (volatility 80-82%) |
| Rechargeland (คำค้นไทย) | Incognito ซ้ำ 10 ครั้ง คำค้นเดียว | ติด Citation 4/10 ครั้ง (volatility 60%) |
เห็นได้ชัดว่างานวิจัยต่างประเทศส่วนใหญ่ชี้ไปทางเดียวกัน: ความผันผวนอยู่ที่ระดับ 80-99%+ แทบทุกครั้งที่รันซ้ำได้ผลลัพธ์ไม่ซ้ำเดิม ในขณะที่ตัวเลขของ Rechargeland จากคำค้นภาษาไทยอยู่ที่ราว 60% เท่านั้น — ต่างกันเกือบ 2 เท่า คำถามคือทำไม
ข้อสันนิษฐาน: จำนวนคู่แข่งในตลาดคือตัวแปรสำคัญ
งานวิจัยทั้ง 4 ชิ้นข้างต้นทำในตลาดภาษาอังกฤษ ซึ่งเป็นตลาด GEO/SEO ที่ใหญ่และแข่งขันสูงที่สุดในโลก มีเว็บไซต์คุณภาพใกล้เคียงกันแข่งกันเพื่อพื้นที่ Citation เดียวกันเป็นจำนวนมาก เมื่อมีตัวเลือกคุณภาพสูสีกันเยอะ ระบบของ AI ก็มีโอกาส “สลับ” ตัวเลือกไปมาระหว่างรอบการตอบได้มากขึ้นตามธรรมชาติ เพราะไม่มีตัวเลือกไหนที่โดดเด่นเหนือคู่แข่งจนต้องเลือกซ้ำทุกครั้ง
ตรงกันข้าม ตลาด GEO ภาษาไทยยังอยู่ในช่วงเริ่มต้น จำนวนเว็บไซต์ที่ทำคอนเทนต์แบบมีโครงสร้าง E-E-A-T ชัดเจน พร้อมสำหรับการถูกดึงไปอ้างอิงในหัวข้อเฉพาะทางยังมีน้อยกว่ามาก เมื่อคู่แข่งคุณภาพใกล้เคียงกันมีน้อย ตัวเลือกที่ AI จะสลับไปมาก็มีจำกัดตามไปด้วย ทำให้ผลลัพธ์ “นิ่ง” กว่า ไม่ใช่เพราะ AI ทำงานกับภาษาไทยได้เสถียรกว่า แต่เพราะสนามแข่งขันมีผู้เล่นน้อยกว่าต่างหาก
แต่ก็ยังมีตัวแปรอื่นที่ต้องพิจารณาร่วมด้วย
- ขนาดตัวอย่างต่างกันมาก — งานวิจัยต่างประเทศทดสอบเป็นหลักหมื่นคำค้น ส่วนของ Rechargeland คือ 1 คำค้น รันซ้ำ 10 ครั้ง เปรียบเทียบกันตรงๆ ไม่ได้แบบสถิติเต็มรูปแบบ เป็นการเทียบเชิง “ทิศทาง” มากกว่า “ตัวเลขที่แม่นยำเท่ากัน”
- ประเภทคำค้นต่างกัน — งานวิจัย SE Ranking เรื่อง Local Volatility ทดสอบคำค้นที่มีตัวแปรโลเคชันเข้ามาเกี่ยวข้องเพิ่มเติม ซึ่งเพิ่มความผันผวนได้เองอยู่แล้วโดยไม่เกี่ยวกับจำนวนคู่แข่ง
- ช่วงเวลาที่ทดสอบต่างกัน — คำค้นของ Rechargeland ทดสอบในช่วงสั้นๆ หลังบทความเพิ่งติด Citation ใหม่ๆ ซึ่งอาจเป็นช่วงที่ระบบยังไม่ “นิ่ง” เต็มที่ ต่างจากงานวิจัยต่างประเทศที่ทดสอบคำค้นที่มีการแข่งขันมานานแล้ว
นัยสำหรับธุรกิจไทยที่ทำ GEO
ถ้าสมมติฐานนี้ถูกต้องแม้เพียงบางส่วน ก็เป็นข่าวดีสำหรับธุรกิจไทยที่เริ่มทำ GEO ตอนนี้ — ตลาดที่มีคู่แข่งน้อยกว่าหมายความว่าเว็บที่ทำคอนเทนต์ถูกหลัก E-E-A-T มีโอกาสได้ตำแหน่ง Citation ที่ “นิ่ง” กว่า ไม่ต้องแย่งพื้นที่กับคู่แข่งคุณภาพสูสีจำนวนมากเหมือนตลาดอังกฤษ แต่ในขณะเดียวกันก็หมายความว่าหน้าต่างแห่งโอกาสนี้จะแคบลงเรื่อยๆ เมื่อมีคนทำ GEO ภาษาไทยมากขึ้น — ยิ่งเริ่มเร็ว ยิ่งได้เปรียบในช่วงที่คู่แข่งยังน้อย
คำถามที่พบบ่อย
AI Overview เปลี่ยนคำตอบบ่อยแค่ไหนตามงานวิจัย?
งานวิจัยต่างประเทศพบความผันผวนสูงมาก ตั้งแต่ 54% (Ahrefs entity overlap ต่อการอัปเดต) ไปจนถึงมากกว่า 99% (SparkToro เรื่องลิสต์แบรนด์ที่แนะนำ) ขึ้นอยู่กับวิธีวัดและประเภทคำค้น
ทำไมผลทดสอบของ Rechargeland ถึงเสถียรกว่างานวิจัยต่างประเทศ?
ข้อสันนิษฐานหลักคือจำนวนคู่แข่งคุณภาพใกล้เคียงกันในตลาด GEO ภาษาไทยยังมีน้อยกว่าตลาดภาษาอังกฤษมาก ทำให้ AI มีตัวเลือกให้สลับน้อยกว่า ผลลัพธ์จึงนิ่งกว่า แต่ยังเป็นสมมติฐานที่ต้องทดสอบเพิ่มเติม
เปรียบเทียบตัวเลขข้ามงานวิจัยแบบนี้แม่นยำแค่ไหน?
ควรมองเป็น “ทิศทาง” มากกว่า “ตัวเลขที่เทียบกันได้ตรงๆ” เพราะแต่ละงานวิจัยใช้วิธีวัด ขนาดตัวอย่าง และประเภทคำค้นต่างกัน การเทียบ 4/10 ของ Rechargeland กับตัวเลขงานวิจัยขนาดหมื่นคำค้นจึงเป็นการเทียบเชิงบริบท ไม่ใช่สถิติที่เท่าเทียมกันทุกมิติ
อ้างอิง
- Search Engine Journal — AI Recommendations Change With Nearly Every Query (SparkToro)
- SE Ranking — AI Mode Research: Sources, Volatility & Differences
- Ahrefs — AI Overviews Change Every 2 Days (But Never Change Their Mind)
- SE Ranking — How Volatile Are AI Mode Results? Local Search Test
อ่านเคสอื่นๆ ในซีรีส์ AI Research: ทำไม AI Overview ตอบไม่เหมือนเดิมทุกครั้ง · ChatGPT vs Google 9 ชั่วโมง (4/10) · Canva Template ติด AIO ใน 12 ชั่วโมง
Thanacharn J.
20+ ปีในสาย SEO / PPC / Social Marketing โฟกัสงานวิจัยด้าน GEO และ Zero-Click Threat


