Skip to main content
All pages in this guide
แหล่งความรู้

Last updated

ChatGPT, Perplexity, Gemini, Claude และ Copilot: แต่ละเอนจินเอาคำตอบมาจากไหน

Answer engine ดูคล้ายกันจากภายนอก คือใส่คำถามเข้าไป ได้คำตอบพร้อมการอ้างอิงออกมา แต่ข้างในต่างกันสามอย่าง คือดัชนีที่แต่ละเอนจินดึงข้อมูลจากมัน crawler ที่ป้อนดัชนีนั้น และวิธีที่การอ้างอิงไปถึงผู้อ่าน ความต่างในทางปฏิบัติส่วนใหญ่ตามมาจากดัชนี เพราะเอนจินอ้างอิงได้เฉพาะสิ่งที่ระบบดึงข้อมูลของมันเข้าถึงได้

มีข้อควรระวังหนึ่งข้อก่อน ไม่ใช่ทุกระบบเบื้องหลังจะเปิดเผยต่อสาธารณะ บางบริษัทอธิบายไปป์ไลน์การดึงข้อมูลของตนอย่างละเอียด บางรายอธิบายแค่ crawler ของตน ตรงไหนที่ไม่มีเอกสาร หน้านี้จะบอกตามนั้น กลไกร่วมของ retrieval-augmented generation อธิบายไว้ในวิธีที่ answer engine เลือกแหล่งข้อมูล ส่วนหน้านี้เป็นข้อมูลอ้างอิงรายเอนจิน

ChatGPT

OpenAI อธิบายตัวดึงข้อมูลสามตัว GPTBot เก็บเนื้อหาเพื่อเทรนโมเดลพื้นฐาน OAI-SearchBot นำเว็บไซต์ขึ้นมาแสดงในฟีเจอร์ค้นหาของ ChatGPT และ ChatGPT-User ดึงหน้าเว็บเมื่อการกระทำของผู้ใช้ต้องการ คันโยกที่มีเอกสารรองรับคือ OAI-SearchBot OpenAI ระบุว่าเว็บไซต์ที่เลือกปฏิเสธมันจะไม่ถูกแสดงในคำตอบการค้นหาของ ChatGPT รายละเอียดของโทเคนและข้อแลกเปลี่ยนของการบล็อกอธิบายไว้ในAI crawler

สิ่งที่ OpenAI ไม่ได้อธิบายคือองค์ประกอบของดัชนีเบื้องหลังการค้นหาของ ChatGPT หรือวิธีจัดอันดับแหล่งข้อมูลภายในนั้น ข้ออ้างว่ามันทำงานบนดัชนีของบุคคลที่สามรายใดรายหนึ่งไม่ได้รับการยืนยันจาก OpenAI และควรถือว่ายังไม่ได้รับการพิสูจน์ OpenAI ยังไม่มีเอกสารเรื่องรายงานการอ้างอิงสำหรับผู้เผยแพร่ด้วย

Perplexity

Perplexity อธิบายเอเจนต์สองตัว PerplexityBot นำเว็บไซต์ขึ้นมาแสดงและลิงก์ในผลการค้นหาของ Perplexity และตามเอกสารระบุว่าไม่ได้ใช้ไต่เก็บเนื้อหาสำหรับโมเดลพื้นฐานของ AI ส่วน Perplexity-User ดึงหน้าเว็บสำหรับคำถามของผู้ใช้และโดยทั่วไปไม่สนใจ robots.txt เพราะมีคนร้องขอให้ดึง การบล็อก PerplexityBot จึงไม่ได้ปกป้องอะไรในฝั่งการเทรน มันแค่ตัดคุณออกจากผลลัพธ์ของ Perplexity

นอกเหนือจากคำอธิบาย crawler เหล่านั้น Perplexity ไม่ได้เปิดเผยต่อสาธารณะว่าดัชนีสำหรับดึงข้อมูลของตนถูกประกอบขึ้นอย่างไรหรือจัดอันดับแหล่งข้อมูลอย่างไร และไม่มีเอกสารเรื่องรายงานการอ้างอิงสำหรับผู้เผยแพร่

Gemini และฟีเจอร์ AI ของ Google

Google เป็นเอนจินที่มีเอกสารครบถ้วนที่สุด คู่มือฟีเจอร์ AIของ Google ระบุว่า AI Overviews และ AI Mode ใช้ retrieval-augmented generation ที่ยึดโยงกับระบบจัดอันดับหลักของ Search โดยดึงหน้าเว็บจากดัชนีของ Search เงื่อนไขแรกเข้าเป็นแบบคลาสสิก คือไต่เก็บได้ ถูกจัดทำดัชนี มีสิทธิ์แสดงข้อความตัวอย่าง คำตอบแสดงลิงก์ที่เห็นชัดและคลิกได้ไปยังหน้าที่ใช้อ้างอิง และ Search Console มีรายงานประสิทธิภาพ Generative AI ซึ่งเป็นวิธีจากเจ้าของระบบเองในการดูทราฟฟิกนี้

ในฝั่ง crawler นั้น Googlebot ป้อน Search และทุกอย่างที่สร้างบนมัน ขณะที่ Google-Extended เป็นโทเคนควบคุมใน robots.txt ที่กำกับการเทรนโมเดล Gemini และการใช้ยึดโยงบางกรณี ไม่ใช่การถูกรวมใน Search ความต่างนี้ถูกอ่านผิดกันบ่อย

Claude

Anthropic อธิบายเอเจนต์สามตัว ClaudeBot เก็บเนื้อหาเว็บที่อาจนำไปใช้ในการเทรนโมเดล Claude-SearchBot วิเคราะห์เนื้อหาเพื่อปรับปรุงความเกี่ยวข้องและความแม่นยำของคำตอบการค้นหา และ Claude-User ดึงหน้าเว็บเมื่อมีคนถามคำถามกับ Claude เอกสารสำหรับนักพัฒนาของ Anthropic ระบุว่าคำตอบที่ผลิตด้วยการค้นหาเว็บจะมีการอ้างอิงแหล่งข้อมูลที่ดึงมาจากผลลัพธ์นั้น

ดัชนีเบื้องหลังการค้นหานั้นไม่ได้ถูกเปิดเผยต่อสาธารณะ บทความเรื่อง crawler อธิบายว่าเอเจนต์แต่ละตัวทำอะไร ไม่ได้อธิบายว่าผลการค้นหามาจากไหน และเอกสารสำหรับนักพัฒนาก็ไม่ได้ระบุชื่อผู้ให้บริการค้นหาหรือดัชนีใด ข้ออ้างใดก็ตามว่าดัชนีไหนอยู่เบื้องหลังการค้นหาเว็บของ Claude ยังไม่ได้รับการพิสูจน์ Anthropic ไม่มีเอกสารเรื่องรายงานการอ้างอิงสำหรับผู้เผยแพร่

Microsoft Copilot

Copilot เป็นกรณีที่ชัดที่สุดของเอนจินที่สร้างบนดัชนีค้นหาที่มีอยู่แล้ว Microsoft อธิบายเส้นทางการดึงข้อมูลของ Microsoft 365 Copilot และ Copilot Chat ว่าเมื่อเปิดการค้นหาเว็บ Copilot จะสร้างคำค้นจากพรอมป์ของผู้ใช้ ส่งไปยังบริการค้นหา Bing แล้วใช้ผลลัพธ์เพื่อยึดโยงคำตอบกับข้อมูลบนเว็บ การมองเห็นในคำตอบเหล่านั้นจึงผ่านดัชนีของ Bing และ crawler ของมันคือ Bingbot ส่วนวิธีที่ Copilot ชั่งน้ำหนักหรือคัดเลือกจากผลลัพธ์ Bing ที่ได้รับนั้นไม่มีเอกสารระบุ

ในเดือนกุมภาพันธ์ 2026 Bing Webmaster Tools เพิ่มรายงาน AI Performanceในสถานะพรีวิวสาธารณะ ครอบคลุมการอ้างอิงใน Microsoft Copilot บทสรุปที่สร้างด้วย AI ใน Bing และการเชื่อมต่อกับพาร์ทเนอร์บางราย มันแสดงว่า URL ไหนถูกอ้างอิง คำค้นที่ใช้ยึดโยงซึ่งดึง URL เหล่านั้นมา และกิจกรรมการอ้างอิงเปลี่ยนไปอย่างไรตามเวลา นั่นทำให้ Google และ Microsoft เป็นสองบริษัทเดียวที่มีรายงานการอ้างอิงจากเจ้าของระบบเอง ส่วน OpenAI, Anthropic และ Perplexity ไม่มีเอกสารเรื่องสิ่งที่เทียบเท่ากัน

สิ่งนี้หมายความว่าอย่างไรกับ robots.txt ของคุณ

โทเคนข้างต้นแบ่งเป็น crawler สำหรับเทรน crawler สำหรับค้นหา และตัวดึงที่ผู้ใช้กระตุ้น และการบล็อกแต่ละกลุ่มมีผลต่างกัน การบล็อกบอทสำหรับเทรนอย่าง GPTBot หรือ ClaudeBot เป็นทางเลือกเชิงนโยบายที่ไม่มีต้นทุนที่ระบุไว้ในคำตอบของเอนจินใด ส่วนการบล็อกบอทสำหรับค้นหาอย่าง OAI-SearchBot หรือ PerplexityBot ตัดคุณออกจากพื้นผิวการอ้างอิงของเอนจินนั้น ข้อแลกเปลี่ยนโทเคนต่อโทเคนอยู่ในAI crawler

งานเป็นชุดเดียวกัน แต่พื้นผิวต่างกัน

ทั้งหมดข้างต้นไม่ได้รวมกันเป็นห้าศาสตร์แยกกัน ทุกเอนจินต้องการอินพุตชุดเดียวกัน คือหน้าเว็บที่ crawler ของมันเข้าถึงได้ ย่อหน้าที่บอกคำตอบชัดพอจะยกไปอ้างได้ และเนื้อหาที่ถูกรักษาให้เป็นปัจจุบัน เอนจินต่างกันตรงที่มันพึ่งความสดใหม่หนักแค่ไหน ในการศึกษา 7,683 หน้าและการอ้างอิง 47,097 ครั้ง Gemini อ้างอิงเนื้อหาที่อัปเดตภายในหนึ่งปีที่ผ่านมา 78 เปอร์เซ็นต์ของกรณี ChatGPT 73 เปอร์เซ็นต์ และ Perplexity 65 เปอร์เซ็นต์ ส่วนควรอัปเดตอะไรและบ่อยแค่ไหนอธิบายไว้ในความสดใหม่

สิ่งที่ต่างกันจริงคือสถานะของคุณในแต่ละเอนจิน เพราะดัชนีต่างกัน วิธีเดียวที่จะรู้ว่าคุณอยู่ตรงไหนคือวัดผลแยกตามเอนจิน ด้วยการสุ่มตัวอย่างซ้ำ ๆ แทนการเช็กครั้งเดียว และสุ่มข้ามภาษาด้วย ในการวัดคำตอบของ LLM เกี่ยวกับแบรนด์ ภาษาของคำถามอธิบายความแปรปรวนของคำตอบได้ 26.5 ถึง 32.0 เปอร์เซ็นต์ ขณะที่อัตลักษณ์ของแบรนด์อธิบายได้ 1.5 เปอร์เซ็นต์ สิ่งนี้หมายความว่าอย่างไรกับตลาดต่าง ๆ อธิบายไว้ในGEO หลายภาษา

เอนจินCrawler ที่มีเอกสารระบบดึงข้อมูลเบื้องหลังที่มีเอกสารรายงานการอ้างอิงจากเจ้าของระบบ
ChatGPTGPTBot, OAI-SearchBot, ChatGPT-Userมี crawler สำหรับค้นหาป้อนการค้นหาของ ChatGPT องค์ประกอบของดัชนีไม่มีเอกสารไม่มีเอกสารระบุ
PerplexityPerplexityBot, Perplexity-Userมี crawler สำหรับค้นหาโดยเฉพาะ รายละเอียดดัชนีไม่มีเอกสารไม่มีเอกสารระบุ
Gemini และฟีเจอร์ AI ของ GoogleGooglebot โดยมี Google-Extended เป็นโทเคนควบคุมระบบจัดอันดับหลักของ Search และดัชนีของ Searchรายงานประสิทธิภาพ Generative AI ใน Search Console
ClaudeClaudeBot, Claude-SearchBot, Claude-Userไม่มีเอกสารระบุไม่มีเอกสารระบุ
CopilotBingbot ผ่านดัชนีของ Bingคำค้นที่ถูกสร้างขึ้นแล้วส่งไปยังบริการค้นหา Bingรายงาน AI Performance ใน Bing Webmaster Tools (พรีวิว)

ให้ทำงานแบบออโตไพลอต

Vupie ทำทุกอย่างในคู่มือนี้ให้คุณ แปดบทความพรีเมียมต่อเดือน

เข้าร่วมเบต้า