Sitemap คืออะไร? วิธีส่ง Google ต่างจาก robots.txt
Sitemap คือไฟล์บอก Google ว่าเว็บมีหน้าไหนบ้าง อธิบาย XML sitemap มีไว้ทำไม ใครต้องมี ส่งผ่าน Search Console ยังไง และต่างจาก robots.txt
Sitemap คือไฟล์ที่บอก Google ว่าเว็บของคุณมีหน้าไหนบ้าง ส่วนใหญ่ทำเป็นไฟล์ XML รวม URL ของหน้าที่อยากให้ถูกค้นพบไว้ในที่เดียว ช่วยให้ Google เจอหน้าใหม่หรือหน้าที่ลิงก์ภายในไม่ถึงได้เร็วขึ้น แต่ ไม่ได้รับประกันว่าทุก URL ในไฟล์จะถูก index และไม่ได้มีหน้าที่บล็อกหน้าใดหน้าหนึ่งแบบ robots.txt
บทความนี้อธิบายตั้งแต่นิยาม Sitemap คืออะไร หน้าตา XML sitemap เป็นอย่างไร ใครต้องมีและใครไม่จำเป็น วิธีส่งให้ Google ผ่าน Search Console และความต่างระหว่าง sitemap กับ robots.txt ที่คนสับสนบ่อยที่สุด ทุกข้อเท็จจริงอ้างอิงจากเอกสาร Google Search Central ที่เปิดตรวจในรอบนี้
อัปเดตข้อมูล: 8 ตุลาคม 2569 (ค.ศ. 2026)
Sitemap คืออะไรตามนิยามของ Google?
ตามเอกสาร Learn about sitemaps ของ Google Search Central sitemap คือไฟล์ที่คุณใช้ให้ข้อมูลเกี่ยวกับหน้า วิดีโอ และไฟล์อื่น ๆ บนเว็บ รวมถึงความสัมพันธ์ระหว่างสิ่งเหล่านั้น เครื่องมือค้นหาอย่าง Google อ่านไฟล์นี้เพื่อ crawl เว็บได้มีประสิทธิภาพขึ้น
พูดให้เห็นภาพ ถ้าเว็บคือห้างสรรพสินค้า ลิงก์ภายในก็คือทางเดินระหว่างร้าน ส่วน sitemap คือป้ายผังห้างที่บอกว่ามีร้านอะไรอยู่ชั้นไหนบ้าง บอตของ Google ยังเดินตามทางเดิน (ลิงก์) เป็นหลัก แต่ผังช่วยให้ไม่พลาดร้านที่อยู่ในมุมลึก
สิ่งที่ sitemap บอก Google ได้ เช่น
- URL ของหน้าที่คุณถือว่าสำคัญและอยากให้ถูกค้นพบ
- วันที่หน้านั้นถูกแก้ไขครั้งล่าสุด (แท็ก
lastmod) - ข้อมูลเพิ่มเติมของรูปภาพ วิดีโอ หรือข่าว ผ่านส่วนขยายของ sitemap
- เวอร์ชันภาษาอื่นของหน้าเดียวกัน (สำหรับเว็บหลายภาษา)
ข้อควรจำคือ Google เขียนไว้ชัดว่า sitemap ช่วยให้ค้นพบ URL แต่ ไม่ได้รับประกันว่าทุกรายการใน sitemap จะถูก crawl และ index การที่หน้าจะติดผลค้นหายังขึ้นกับคุณภาพเนื้อหาและปัจจัยอื่นของ SEO ตามปกติ
XML Sitemap หน้าตาเป็นอย่างไร มีแท็กอะไรบ้าง?
XML sitemap คือไฟล์ข้อความรูปแบบ XML ที่มีรายการ <url> เรียงกันไป แต่ละรายการมี <loc> เป็น URL เต็มของหน้า และอาจมี <lastmod> บอกวันที่แก้ไขล่าสุด ตัวอย่างโครงสร้างขั้นต่ำมีหน้าตาประมาณนี้
<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
<url>
<loc>https://www.example.com/services/</loc>
<lastmod>2026-10-01</lastmod>
</url>
</urlset>
แท็กไหนที่ Google ใช้จริง แท็กไหนถูกเมิน
หลายเว็บยังตั้งค่า priority และ changefreq อย่างตั้งใจ แต่เอกสาร Build and submit a sitemap ระบุตรง ๆ ว่า Google ไม่สนใจค่า <priority> และ <changefreq>
| แท็ก | ใช้ทำอะไร | Google ใช้ไหม |
|---|---|---|
<loc> | URL เต็มของหน้า | ใช้ (จำเป็น) |
<lastmod> | วันเวลาที่หน้ามีการแก้ไขสำคัญครั้งล่าสุด | ใช้ ถ้าแม่นยำสม่ำเสมอและตรวจสอบได้ |
<changefreq> | ความถี่ที่คาดว่าหน้าจะเปลี่ยน | ไม่ใช้ |
<priority> | ความสำคัญเทียบกับหน้าอื่นในเว็บ | ไม่ใช้ |
เรื่อง lastmod มีรายละเอียดที่ต้องระวัง Google ระบุว่าค่านี้ควรสะท้อนวันที่มีการอัปเดตสำคัญครั้งล่าสุดของหน้า เช่น แก้เนื้อหาหลัก ข้อมูลโครงสร้าง หรือลิงก์ ไม่ใช่แค่เปลี่ยนวันที่ลิขสิทธิ์ท้ายเว็บ ถ้าระบบตั้ง lastmod เป็นวันนี้ให้ทุกหน้าทุกครั้งที่ build เว็บ ค่านี้จะไม่ตรงกับความจริงและ Google ก็ไม่มีเหตุผลจะเชื่อ
รูปแบบไฟล์อื่นนอกจาก XML
Google รองรับ sitemap 3 รูปแบบหลัก
- XML sitemap ยืดหยุ่นที่สุด ใส่ข้อมูลรูปภาพ วิดีโอ ข่าว และเวอร์ชันภาษาได้
- RSS 2.0 หรือ Atom 1.0 feed เหมาะกับบล็อกที่ระบบสร้าง feed ให้อยู่แล้ว
- Text sitemap (.txt) คือไฟล์ข้อความที่มี URL บรรทัดละ 1 รายการ ง่ายแต่ใส่ข้อมูลเสริมไม่ได้
ข้อกำหนดทางเทคนิคของ sitemap มีอะไรบ้าง?
สรุปสั้น ๆ คือไฟล์ต้องใช้ URL เต็มแบบ absolute เข้ารหัส UTF-8 และไฟล์เดียวต้องไม่เกิน 50,000 URL หรือ 50MB แบบไม่บีบอัด ตัวเลขทั้งหมดในตารางนี้มาจากเอกสาร Google Search Central
| ข้อกำหนด | ค่าตามเอกสาร Google |
|---|---|
| จำนวน URL ต่อ 1 ไฟล์ sitemap | ไม่เกิน 50,000 URL |
| ขนาดต่อ 1 ไฟล์ sitemap | ไม่เกิน 50MB (ไม่บีบอัด) |
จำนวน <loc> ใน sitemap index 1 ไฟล์ | ไม่เกิน 50,000 รายการ |
| จำนวน sitemap index ต่อ 1 property ใน Search Console | ส่งได้สูงสุด 500 ไฟล์ |
| รูปแบบ URL | ต้องเป็น URL เต็ม (fully-qualified, absolute) |
| การเข้ารหัส | UTF-8 |
ตัวอย่างสมมติ: ร้านค้าออนไลน์มีหน้าสินค้า 120,000 หน้า ไฟล์เดียวรับได้ 50,000 URL จึงต้องแตกเป็นอย่างน้อย 3 ไฟล์ (50,000 + 50,000 + 20,000 = 120,000) แล้วรวมทั้ง 3 ไฟล์ไว้ใน sitemap index หนึ่งไฟล์ จากนั้นส่งแค่ไฟล์ index ให้ Google ไฟล์เดียว
อีกเรื่องที่มักพลาดคือตำแหน่งไฟล์ Google ระบุว่า sitemap ที่วางไว้ที่ root ของเว็บครอบคลุมทุกไฟล์ในเว็บ แต่ sitemap ที่วางในโฟลเดอร์ย่อยจะครอบคลุมเฉพาะ URL ใต้โฟลเดอร์นั้น เว้นแต่จะส่งผ่าน Search Console
เว็บแบบไหนต้องมี sitemap และแบบไหนไม่จำเป็น?
คำตอบตามเอกสาร Google คือเว็บใหญ่ เว็บใหม่ที่มีลิงก์จากภายนอกน้อย และเว็บที่มีรูป วิดีโอ หรือข่าวเยอะ ได้ประโยชน์จาก sitemap ชัดเจน ส่วนเว็บเล็กประมาณ 500 หน้าหรือน้อยกว่าที่ลิงก์ภายในครบ อาจไม่จำเป็น
| สถานการณ์ของเว็บ | ควรมี sitemap ไหม | เหตุผลตามเอกสาร Google |
|---|---|---|
| เว็บใหญ่ หน้าเยอะ | ควรมี | ยากที่จะทำให้ทุกหน้ามีลิงก์จากหน้าอื่นอย่างน้อย 1 ลิงก์ |
| เว็บใหม่ ลิงก์จากเว็บอื่นน้อย | ควรมี | บอตอาจหาหน้าไม่เจอถ้าไม่มีใครลิงก์มา |
| มีวิดีโอ รูปภาพ หรืออยู่ใน Google News | ควรมี | sitemap ใส่ข้อมูลสื่อเพิ่มเติมได้ |
| เว็บเล็ก ~500 หน้าหรือน้อยกว่า ลิงก์ภายในครบ | อาจไม่จำเป็น | บอตเดินตามลิงก์ได้ทั่วถึงอยู่แล้ว |
ในทางปฏิบัติ เว็บที่ใช้ CMS หรือ framework สมัยใหม่ส่วนใหญ่สร้าง sitemap ให้อัตโนมัติอยู่แล้ว ต้นทุนการมีไฟล์จึงต่ำมาก และยังได้ประโยชน์ทางอ้อมคือดูสถานะการอ่านไฟล์ในรายงาน Sitemaps ของ Search Console ได้ จึงแนะนำให้มีไว้แม้เป็นเว็บเล็ก ขอแค่ให้รายการในไฟล์สะอาดและตรงกับหน้าที่อยากให้ติดผลค้นหาจริง
ส่ง sitemap ให้ Google ทำอย่างไร?
วิธีหลักมี 2 ทาง คือส่งผ่านรายงาน Sitemaps ใน Google Search Console หรือเพิ่มบรรทัด Sitemap: ในไฟล์ robots.txt ทำทั้งสองทางพร้อมกันได้และไม่ขัดกัน
วิธีที่ 1: ส่งผ่าน Google Search Console
ตามคู่มือรายงาน Sitemaps ของ Google ขั้นตอนคือ
- ยืนยันว่าบัญชีของคุณมีสิทธิ์ owner ของ property นั้นใน Search Console
- วางไฟล์ sitemap ขึ้นเว็บในรูปแบบที่ Google รองรับ
- ทดสอบ URL ของไฟล์ด้วยเครื่องมือตรวจสอบ URL แบบ live ให้ผลการดึงหน้าขึ้นว่าสำเร็จ
- เปิดรายงาน Sitemaps วาง URL ที่ทดสอบแล้วลงช่อง Add a new sitemap แล้วกด Submit
- รอให้ Google ดึงไฟล์และ crawl URL ในไฟล์ ซึ่งต้องใช้เวลา
หลังส่งแล้ว รายงานจะแสดงสถานะ 3 แบบ
| สถานะ | ความหมาย | ต้องทำอะไรต่อ |
|---|---|---|
| Success | ดึงและอ่านไฟล์ได้โดยไม่มีข้อผิดพลาด | ไม่ต้องทำอะไร ปล่อยให้ Google crawl ตามรอบปกติ |
| Couldn’t fetch | Google ดึงไฟล์ไม่ได้ | เช็กว่า URL ถูก เปิดได้จริง และไม่ถูกบล็อก |
| Has errors | ดึงไฟล์ได้แต่มีข้อผิดพลาดอย่างน้อย 1 จุด | แก้ตามที่รายงานระบุ แล้วส่งใหม่ |
Google ระบุด้วยว่าถ้าดึงไฟล์ไม่ได้ ระบบจะลองใหม่อีกหลายวันแล้วหยุดถ้ายังเข้าไม่ได้ เมื่อแก้แล้วจึงควรส่งไฟล์ใหม่อีกครั้ง
วิธีที่ 2: ใส่ตำแหน่ง sitemap ในไฟล์ robots.txt
เพิ่มบรรทัดนี้ไว้ตรงไหนก็ได้ในไฟล์ robots.txt โดยใช้ URL เต็มของไฟล์
Sitemap: https://www.example.com/sitemap.xml
เอกสาร Google ระบุว่าใส่บรรทัด Sitemap: ได้หลายบรรทัดและไม่จำกัดจำนวน วิธีนี้ไม่ต้องล็อกอินอะไร และเครื่องมือค้นหาอื่นที่อ่าน robots.txt ก็รู้ตำแหน่งไฟล์ได้ด้วย แต่ข้อเสียคือไม่มีรายงานสถานะให้ดูแบบใน Search Console
Sitemap ต่างจาก robots.txt อย่างไร?
Sitemap คือรายการหน้าที่อยากให้ Google รู้จัก ส่วน robots.txt คือกฎบอกบอตว่า URL ไหนเข้าไป crawl ได้หรือไม่ได้ ไฟล์หนึ่งชี้ทาง อีกไฟล์หนึ่งตั้งด่าน และทั้งคู่ไม่ใช่วิธีซ่อนหน้าออกจากผลค้นหา
| มิติ | Sitemap | robots.txt |
|---|---|---|
| หน้าที่หลัก | บอกว่ามี URL อะไรบ้างที่อยากให้ค้นพบ | บอกว่าบอตเข้า URL ไหนได้หรือไม่ได้ |
| รูปแบบไฟล์ | XML, RSS/Atom หรือ .txt | ไฟล์ข้อความชื่อ robots.txt ที่ root ของเว็บ |
| ใช้ซ่อนหน้าจากผลค้นหาได้ไหม | ไม่ได้ | ไม่ได้ (Google ระบุชัด) |
| ผลถ้าตั้งผิด | หน้าสำคัญอาจถูกค้นพบช้า | อาจบล็อกหน้าสำคัญไม่ให้ crawl ทั้งส่วน |
| เชื่อมกันอย่างไร | — | ใส่บรรทัด Sitemap: บอกตำแหน่งไฟล์ sitemap ได้ |
ประเด็นที่คนเข้าใจผิดมากที่สุดคือคิดว่า Disallow ใน robots.txt ทำให้หน้าหายจาก Google เอกสาร Introduction to robots.txt ระบุว่า robots.txt ไม่ใช่กลไกสำหรับกันหน้าเว็บออกจาก Google หน้าที่ถูก disallow ยังอาจถูก index ได้ถ้ามีเว็บอื่นลิงก์มา โดยจะแสดงแบบไม่มีคำอธิบาย ถ้าไม่อยากให้หน้าใดติดผลค้นหาให้ใช้ noindex หรือตั้งรหัสผ่านแทน
ความผิดพลาดที่เจอบ่อยเมื่อใช้สองไฟล์นี้คู่กัน
- ใส่ URL ไว้ใน sitemap แต่ URL เดียวกันถูก Disallow ใน robots.txt ทำให้สัญญาณขัดกันเอง
- ใส่หน้าที่ติด
noindexไว้ใน sitemap ทั้งที่ไม่อยากให้หน้านั้นติดผลค้นหา - ใส่ URL ที่ redirect หรือหน้า 404 ค้างไว้ใน sitemap หลังย้ายโครงสร้างเว็บ
- บล็อกไฟล์ sitemap เองใน robots.txt จน Google ดึงไฟล์ไม่ได้
เช็กว่า sitemap ของเว็บเราถูกต้องหรือยังทำได้อย่างไร?
วิธีเร็วที่สุดคือเปิดรายงาน Sitemaps ใน Search Console ดูว่าสถานะเป็น Success หรือไม่ แล้วเทียบรายการ URL ในไฟล์กับหน้าที่อยากให้ติดผลค้นหาจริง เช็กลิสต์ที่ใช้ได้ทันทีคือ
- เปิด URL ของไฟล์ sitemap ในเบราว์เซอร์ ต้องเปิดได้และเป็น XML ที่อ่านออก
- ตรวจว่าทุก URL เป็น URL เต็มที่ใช้โดเมนและโปรโตคอลเดียวกับเว็บจริง
- ตัด URL ที่ redirect, 404, ติด
noindexหรือเป็น URL ซ้ำที่มี canonical ชี้ไปที่อื่นออก - เช็กว่า
lastmodเปลี่ยนเฉพาะเมื่อเนื้อหาหน้านั้นเปลี่ยนจริง - ตรวจ robots.txt ว่าไม่ได้บล็อกไฟล์ sitemap และมีบรรทัด
Sitemap:ชี้ถูกไฟล์ - ส่งไฟล์ใน Search Console แล้วกลับมาดูสถานะหลัง Google ดึงไฟล์
ถ้าอยากเช็กพื้นฐาน SEO ของหน้าใดหน้าหนึ่งก่อน ลองใช้ เครื่องมือตรวจ SEO ฟรี ของเรา และถ้าต้องการไล่ทั้งเว็บแบบเป็นระบบ ดูเช็กลิสต์ SEO Audit 15 ข้อ ที่รวม sitemap, robots.txt และจุดเทคนิคอื่นไว้ครบ
Sitemap ช่วยให้ติดอันดับเร็วขึ้นไหม?
Sitemap ช่วยให้ Google ค้นพบ หน้าได้ครบและเร็วขึ้น แต่ไม่ได้เพิ่มอันดับโดยตรง อันดับยังขึ้นกับคุณภาพเนื้อหา ความตรงกับคำค้น และความน่าเชื่อถือของเว็บ
ถ้าเว็บมี sitemap ครบแล้วแต่หน้ายังไม่ขึ้น ปัญหามักอยู่ที่ส่วนอื่น เช่น เนื้อหาบางเกินไป หน้าซ้ำกันเอง หรือความเร็วเว็บ ลองไล่ดูสาเหตุที่เว็บไม่ติดอันดับ 12 ข้อ ประกอบ และถ้าอยากให้ทีมช่วยตรวจทั้ง sitemap, robots.txt, การ index และโครงสร้างเทคนิคของเว็บทั้งหมด ดูรายละเอียดบริการ SEO Audit หรือติดต่อเราได้โดยตรง
สรุป: Sitemap คืออะไรในหนึ่งย่อหน้า
Sitemap คือไฟล์รายการ URL ที่บอก Google ว่าเว็บมีหน้าไหนบ้าง นิยมทำเป็น XML ไฟล์เดียวรับได้ไม่เกิน 50,000 URL หรือ 50MB ส่งได้ผ่าน Search Console หรือบรรทัด Sitemap: ใน robots.txt Google ใช้ loc และ lastmod ที่แม่นยำ แต่ไม่สนใจ priority และ changefreq Sitemap ช่วยให้ค้นพบหน้า ไม่ใช่ตัวการันตีการ index และไม่ใช่เครื่องมือซ่อนหน้า หน้าที่ซ่อนหน้าคือ noindex ไม่ใช่ทั้ง sitemap และ robots.txt
แหล่งอ้างอิง: Google Search Central — Learn about sitemaps, Build and submit a sitemap, Manage your sitemaps with sitemap index files, Introduction to robots.txt และ Search Console Help — Manage your sitemaps using the Sitemaps report