Technical SEO

Crawl กับ Index ต่างกันยังไง ทำไมหน้าที่ Google เคยเข้าถึงถึงยังไม่ติดอันดับ

แยกความต่างระหว่าง crawl กับ index ให้ชัด อธิบายว่าทำไมหน้าที่ถูก crawl แล้วอาจยังไม่ถูก index วิธีอ่านสถานะใน Search Console และวิธีแก้ทีละขั้นตอน

ทีม NOAH · เผยแพร่ 2 กันยายน 2569 · อัปเดต 2 กันยายน 2569 · อ่าน 14 นาที

ห้องเซิร์ฟเวอร์และอุปกรณ์เครือข่าย

สรุปสั้น

  • Crawl คือขั้นตอนที่ Googlebot เข้ามาเยี่ยมชมและดึงเนื้อหาของหน้าเว็บ ส่วน index คือขั้นตอนที่ Google จัดเก็บและวิเคราะห์เนื้อหานั้นเพื่อนำไปแสดงในผลการค้นหา
  • หน้าที่ถูก crawl แล้วไม่ได้แปลว่าจะถูก index เสมอไป Google อาจตัดสินใจไม่เก็บเข้าดัชนีด้วยหลายเหตุผล
  • Google Search Console มีสถานะ “Crawled - currently not indexed” และ “Discovered - currently not indexed” ที่บอกความแตกต่างระหว่างสองขั้นตอนนี้ได้ชัดเจน
  • การส่ง sitemap หรือขอ index ผ่าน URL Inspection ช่วยให้ Google รู้จัก URL เร็วขึ้น แต่ไม่ได้รับประกันว่าจะถูก index
  • หน้าที่ถูกบล็อกด้วย robots.txt จะไม่ถูก crawl เลย จึงไม่มีทางที่ Google จะเห็นเนื้อหาหรือ meta tag ใด ๆ บนหน้านั้น

คำถามที่พบบ่อยในรายงาน Google Search Console คือทำไมหน้าที่เพิ่งเผยแพร่ถึงมีสถานะ “ถูกค้นพบแล้วแต่ยังไม่ได้จัดทำดัชนี” ทั้งที่เปิดดูในเบราว์เซอร์ได้ปกติ คำตอบอยู่ที่ความต่างระหว่างสองขั้นตอนที่คนมักเข้าใจว่าเป็นเรื่องเดียวกัน คือ crawl และ index

บทความนี้อธิบายทั้งสองขั้นตอนแยกกันให้ชัด พร้อมวิธีอ่านสถานะแต่ละแบบใน Search Console และขั้นตอนแก้ปัญหาเมื่อหน้าเว็บติดอยู่ระหว่างทางไม่ยอมถูก index สักที

Crawl กับ Index ต่างกันยังไง

Crawl กับ Index ต่างกันยังไง

Crawl คือขั้นตอนที่ Googlebot เข้ามาเยี่ยมชมหน้าเว็บและดึงเนื้อหารวมถึงลิงก์บนหน้านั้นไปเก็บไว้ ส่วน index คือขั้นตอนถัดไปที่ Google วิเคราะห์เนื้อหาที่เก็บมาแล้วตัดสินใจว่าจะบันทึกลงฐานข้อมูลเพื่อนำไปแสดงในผลการค้นหาหรือไม่ พูดง่าย ๆ คือ crawl คือการมาเยี่ยม ส่วน index คือการตัดสินใจเก็บเข้าคลัง หน้าหนึ่งอาจถูก crawl แล้วแต่ยังไม่ถูก index ก็ได้

ลองเปรียบเทียบกับร้านหนังสือ: crawl เหมือนพนักงานเดินสำรวจร้านแล้วหยิบหนังสือเล่มใหม่มาดู ส่วน index เหมือนการตัดสินใจว่าจะเอาหนังสือเล่มนั้นขึ้นชั้นวางให้ลูกค้าเห็นหรือไม่ ถ้าหนังสือเนื้อหาซ้ำกับเล่มที่มีอยู่แล้ว หรือคุณภาพไม่ผ่านมาตรฐาน พนักงานอาจตัดสินใจไม่เอาขึ้นชั้นก็ได้ แม้จะหยิบมาดูแล้วก็ตาม

ห้องเซิร์ฟเวอร์และอุปกรณ์เครือข่าย

Crawl ทำงานอย่างไร

Googlebot ค้นพบ URL ใหม่ ๆ ได้จากหลายทาง เช่น การไล่ตามลิงก์จากหน้าที่รู้จักอยู่แล้ว การอ่าน sitemap ที่ส่งไว้ใน Search Console หรือจากการที่มีเว็บอื่นลิงก์มา เมื่อรู้จัก URL แล้ว Googlebot จะเข้ามาดึงเนื้อหาของหน้านั้น ซึ่งเป็นขั้นตอนที่เรียกว่า crawl ตามเอกสารของ Google Search Central

ปัจจัยที่ทำให้หน้าหนึ่งถูก crawl ยากขึ้น ได้แก่การไม่มีลิงก์ภายในชี้เข้ามาเลย (ดู Orphan Page คืออะไร) หรือการถูกบล็อกไว้ใน robots.txt ซึ่งจะทำให้ Googlebot ไม่เข้ามาอ่านเนื้อหาของหน้านั้นเลย

Google ไม่ได้ crawl ทุกหน้าทันทีที่เผยแพร่

หน้าที่เพิ่งสร้างใหม่ไม่ได้ถูก crawl ในทันทีเสมอไป Google จัดสรร "งบประมาณการ crawl" ให้แต่ละเว็บตามความสำคัญและความน่าเชื่อถือที่สะสมมา เว็บใหม่ที่ยังไม่มีลิงก์ภายในหรือภายนอกมากนักอาจต้องรอนานกว่าจะถูก crawl เมื่อเทียบกับเว็บที่มีความน่าเชื่อถือสูงอยู่แล้ว การส่ง sitemap และเชื่อมลิงก์ภายในให้ทั่วถึงจึงช่วยให้ Google ค้นพบหน้าใหม่ได้เร็วขึ้น

Index ทำงานอย่างไร

หลังจาก crawl แล้ว Google จะวิเคราะห์เนื้อหาของหน้านั้น เช่น ข้อความ รูปภาพ และ structured data แล้วตัดสินใจว่าจะเก็บเข้าดัชนีหรือไม่ เหตุผลที่หน้าถูก crawl แล้วแต่ไม่ถูก index มีได้หลายอย่าง เช่น เนื้อหาซ้ำกับหน้าอื่นที่มีอยู่แล้ว มี meta tag noindex เนื้อหาบางเกินไป หรือ canonical tag ชี้ไปหน้าอื่น

สถานะความหมาย
Discovered - currently not indexedGoogle รู้จัก URL นี้แล้วแต่ยังไม่ได้เข้ามา crawl
Crawled - currently not indexedGoogle เข้ามา crawl แล้ว แต่ยังไม่ตัดสินใจเก็บเข้าดัชนี
Indexedหน้านี้ถูกเก็บเข้าดัชนีแล้วและมีสิทธิ์ปรากฏในผลการค้นหา
Excluded by noindex tagหน้านี้ถูก crawl แล้วแต่มีคำสั่ง noindex กำกับไว้ Google จึงไม่เก็บเข้าดัชนี
Duplicate without user-selected canonicalGoogle เห็นว่าเนื้อหาซ้ำกับหน้าอื่นและเลือก canonical เองโดยไม่ใช้หน้านี้
สถานะที่พบใน Google Search Console และความหมาย

ทำไมหน้าที่ถูก Crawl แล้วถึงยังไม่ถูก Index

จุดนี้คือความเข้าใจผิดที่พบบ่อยที่สุด หลายคนคิดว่าเมื่อเห็นสถานะ “Crawled” แล้วแปลว่าหน้านั้นควรติดอันดับได้แล้ว แต่ความจริงคือ crawl เป็นแค่ขั้นตอนแรก การถูก index ขึ้นอยู่กับการประเมินคุณภาพและความซ้ำซ้อนของเนื้อหาด้วย หน้าที่เนื้อหาบางหรือซ้ำกับหน้าอื่นในเว็บมีโอกาสสูงที่จะถูก crawl แล้วไม่ถูก index

หน้าที่ถูกบล็อกใน robots.txt จะไม่ถูก crawl เลย

ถ้าหน้าหนึ่งถูกบล็อกด้วย robots.txt Googlebot จะไม่เข้ามาอ่านเนื้อหาของหน้านั้นเลย ซึ่งหมายความว่า Google จะไม่มีทางเห็น meta tag noindex ที่อยู่บนหน้านั้นด้วย ถ้าต้องการเอาหน้าออกจากดัชนีจริง ๆ ต้องปล่อยให้ Google crawl หน้านั้นได้แล้วใช้ noindex แทนการบล็อกใน robots.txt อ่านรายละเอียดเพิ่มเติมได้ที่ robots.txt คืออะไร

ห้องเซิร์ฟเวอร์และอุปกรณ์เครือข่าย

วิธีตรวจและแก้ปัญหาทีละขั้นตอน

แก้ปัญหาหน้าที่ยังไม่ถูก index

  1. 1

    ตรวจสถานะด้วย URL Inspection

    เปิด Google Search Console แล้วใช้เครื่องมือ URL Inspection พิมพ์ URL ที่สงสัยลงไป เพื่อดูสถานะปัจจุบันว่าอยู่ขั้นไหน

  2. 2

    ตรวจว่าเนื้อหาบางเกินไปหรือไม่

    ถ้าสถานะเป็น Crawled - currently not indexed ให้กลับไปดูว่าเนื้อหาของหน้านั้นตอบคำถามได้ครบพอหรือไม่ เทียบกับหน้าที่ติดอันดับอยู่แล้วสำหรับคำค้นหาเดียวกัน

  3. 3

    ตรวจสอบ canonical และ noindex

    เปิดโค้ดหน้าเว็บดูว่ามี meta tag noindex หรือ canonical ที่ชี้ไปหน้าอื่นโดยไม่ตั้งใจหรือไม่

  4. 4

    เพิ่มลิงก์ภายในชี้มาที่หน้านั้น

    หน้าที่ไม่มีลิงก์ภายในชี้เข้ามาเลยมีโอกาสถูกมองว่าไม่สำคัญ ลองเพิ่มลิงก์จากหน้าอื่นที่เกี่ยวข้องมาชี้ที่หน้านี้

  5. 5

    ขอ index ซ้ำและรอผล

    หลังแก้ไขแล้ว ใช้ปุ่ม Request Indexing ใน URL Inspection แล้วรอตรวจสอบสถานะอีกครั้งในอีกไม่กี่วันถัดมา

ตัวอย่างสมมติ: บล็อกบริษัทที่หน้าใหม่ไม่ยอมถูก index

ลองนึกภาพบริษัทหนึ่งเผยแพร่บทความใหม่ 10 บทความในเดือนเดียว แต่หลังผ่านไปสองสัปดาห์ เข้าไปเช็กใน Search Console พบว่ามีเพียง 3 บทความที่ถูก index ส่วนอีก 7 บทความค้างอยู่ในสถานะ Crawled - currently not indexed (ตัวอย่างสมมติเพื่อให้เห็นภาพ) เมื่อตรวจดูพบว่าทั้ง 7 บทความมีความยาวสั้นกว่าบทความอื่นมาก และเนื้อหาคล้ายกันจนอาจถูกมองว่าซ้ำซ้อนกับหน้าหมวดหมู่ที่มีอยู่แล้ว หลังจากขยายเนื้อหาให้ครบถ้วนขึ้นและเพิ่มลิงก์ภายในจากหน้าอื่นมาชี้ ก็เริ่มเห็นบทความเหล่านั้นถูก index ทีละหน้าในสัปดาห์ถัดมา

วิธีตรวจสอบว่าเว็บโดยรวมมีปัญหา Crawl หรือ Index หรือไม่

  • เปิดรายงาน Pages ใน Search Console ดูสัดส่วนหน้าที่ถูก index เทียบกับหน้าที่ยังไม่ถูก index
  • สังเกตว่ามีหน้าจำนวนมากค้างอยู่ในสถานะ Discovered - currently not indexed หรือไม่ ถ้ามีมากอาจแปลว่า Google ยังไม่เห็นความสำคัญของเว็บมากพอ
  • ตรวจว่า sitemap.xml ถูกส่งและอ่านได้ถูกต้องในเมนู Sitemaps
  • สุ่มตรวจหน้าสำคัญ 5-10 หน้าด้วย URL Inspection เป็นระยะเพื่อดูว่ายังคงสถานะ Indexed อยู่หรือหลุดไปแล้ว

ข้อผิดพลาดที่เจอบ่อยเรื่อง Crawl และ Index

  • เข้าใจว่าส่ง sitemap แล้วหน้าจะถูก index ทันที ทั้งที่ sitemap แค่ช่วยให้ Google รู้จัก URL เร็วขึ้นเท่านั้น
  • บล็อกหน้าด้วย robots.txt พร้อมกับใส่ noindex ไว้บนหน้านั้นด้วย ซึ่งขัดแย้งกันเอง เพราะ Google เข้าไม่ถึงหน้านั้นเลย
  • เห็นสถานะ Crawled แล้วสรุปว่าหน้านั้นมีปัญหาเรื่องอันดับ ทั้งที่จริงยังไม่ถูก index เลยด้วยซ้ำ
  • ไม่ตรวจสถานะ index ซ้ำหลังแก้ปัญหาแล้ว ทำให้ไม่รู้ว่าที่แก้ไปได้ผลหรือไม่
  • สร้างหน้าเนื้อหาบางจำนวนมากพร้อมกันในเวลาสั้น ๆ ทำให้ Google มองว่าเนื้อหาซ้ำซ้อนกันเองและไม่ยอม index หลายหน้า

เช็กลิสต์สรุปก่อนสงสัยว่าเว็บมีปัญหา

เช็กลิสต์ 4 ข้อ

1) ตรวจสถานะแต่ละหน้าด้วย URL Inspection ก่อนสรุปว่ามีปัญหา 2) แยกให้ออกว่าหน้ายังไม่ถูก crawl หรือ crawl แล้วแต่ไม่ index 3) ตรวจ robots.txt และ noindex ว่าไม่ขัดแย้งกันเอง 4) เพิ่มความยาวและคุณภาพเนื้อหาก่อนขอ index ซ้ำ

คำถามที่พบบ่อย

ทำไมหน้าที่ index แล้วยังไม่ติดอันดับที่ต้องการ+

การถูก index หมายความแค่ว่าหน้านั้นมีสิทธิ์ปรากฏในผลการค้นหา ไม่ได้รับประกันอันดับ อันดับขึ้นอยู่กับปัจจัยอื่นอีกมาก เช่น ความเกี่ยวข้องกับคำค้นหาและคุณภาพของเนื้อหาเทียบกับหน้าอื่นที่แข่งกันอยู่

ส่ง sitemap แล้วทำไมยังไม่ถูก crawl+

sitemap ช่วยให้ Google รู้จัก URL แต่ไม่ได้รับประกันว่าจะเข้ามา crawl ทันที การ crawl ขึ้นอยู่กับหลายปัจจัย เช่น ความสำคัญของหน้านั้นในสายตา Google และจำนวนลิงก์ภายในที่ชี้เข้ามา

ใช้ URL Inspection ขอ index ได้ผลจริงไหม+

เครื่องมือ URL Inspection ใน Search Console ใช้ส่งคำขอให้ Google เข้ามา crawl หน้านั้นเร็วขึ้นได้ แต่ยังคงเป็นแค่คำขอ ไม่ได้รับประกันว่าจะถูก index เสมอไป

ตรวจสถานะ crawl และ index ได้จากที่ไหน+

ตรวจได้จาก Google Search Console ทั้งรายงาน Pages ที่แสดงภาพรวม และเครื่องมือ URL Inspection ที่ตรวจได้ทีละ URL อ่านวิธีตั้งค่าและอ่านรายงานเพิ่มเติมได้ที่ คู่มือ Google Search Console

NOAH ตรวจสถานะ crawl และ index ให้ได้ไหม+

ได้ NOAH มีการตรวจสถานะ index และ crawl ของเว็บที่เชื่อมต่อไว้ในระบบ ช่วยให้เห็นภาพว่าหน้าไหนถูกเก็บแล้วบ้างโดยไม่ต้องเข้าไปไล่ดูทีละหน้าใน Search Console เอง

ต้องรอนานแค่ไหนหลังขอ index ซ้ำถึงจะเห็นผล+

ไม่มีระยะเวลาตายตัว บางหน้าอาจถูก index ภายในไม่กี่วัน บางหน้าอาจใช้เวลานานกว่านั้น ขึ้นอยู่กับความน่าเชื่อถือของเว็บโดยรวมและคุณภาพของเนื้อหาในหน้านั้น

สรุป

crawl และ index เป็นคนละขั้นตอนกัน หน้าหนึ่งต้องถูก crawl ก่อนถึงจะมีโอกาสถูก index และการถูก index ก็ไม่ได้รับประกันอันดับ เข้าใจลำดับนี้ให้ชัดจะช่วยให้อ่านรายงานใน Search Console และวินิจฉัยปัญหาได้ตรงจุดมากขึ้น แทนที่จะเดาสาเหตุแบบไม่มีข้อมูลรองรับ

เนื้อหาที่เกี่ยวข้องกันโดยตรง: หน้ารวมTechnical SEO และบทความ INP คืออะไร ทำไมกดปุ่มแล้วหน้าเว็บตอบสนองช้า และ International SEO คืออะไร ทำเว็บหลายภาษาหลายประเทศให้ Google เข้าใจถูกต้อง

ตรวจสถานะ index และ crawl ของเว็บได้ง่ายขึ้น

ดูภาพรวมเครื่องมือ SEO ที่ช่วยตรวจสุขภาพด้าน technical ของเว็บไซต์ทั้งหมดในที่เดียว

ดูเครื่องมือ SEO ทั้งหมด

อ่านต่อ