Crawler ที่มี Guard
Concurrent Go crawler พร้อม robots.txt, sitemap discovery, URL normalization, deduplication, redirect validation, TLS และ per-host politeness

OPEN-SOURCE SEO CRAWLER + MCP สำหรับ AI AGENT
ตรวจ Technical SEO, JavaScript SEO, Canonical, Hreflang, Sitemap, Structured Data และ Internal Link ด้วย Crawler ที่เก็บหลักฐานในเครื่อง พร้อม MCP 23 เครื่องมือให้ AI Agent วิเคราะห์และติดตามการแก้ SEO อย่างเป็นระบบ
ฟรีภายใต้ MIT License · ข้อมูลอยู่ในเครื่อง · รุ่นปัจจุบันเป็น Release Candidate · ไม่เกี่ยวข้องหรือได้รับการรับรองจาก Screaming Frog Ltd.
crawl_status → completedissue_explain → evidencecrawl_compare → fixedSEO Screaming Toad หรือ DJAI Toad คือโปรแกรม SEO crawler และ website audit tool แบบโอเพนซอร์สสำหรับ Crawl เว็บไซต์ที่คุณเป็นเจ้าของหรือได้รับอนุญาต โปรแกรมค้นหาหน้าเว็บและทรัพยากรตามลิงก์ ตรวจสัญญาณ Technical SEO แล้วเก็บ URL, Page Evidence, Link Graph และ Finding ลง SQLite เพื่อให้ตรวจย้อนกลับ เปรียบเทียบ และส่งออกรายงานได้
จุดต่างสำคัญคือ MCP Server ที่ออกแบบมาโดยเฉพาะสำหรับ AI Agent แทนการให้ AI ใช้ Shell หรือ HTTP อย่างไม่จำกัด Agent สามารถสร้างโปรไฟล์ Preview Scope เริ่มหรือควบคุม Crawl อ่านปัญหา เปิดหลักฐานของหน้า เปรียบเทียบรอบ และสร้างรายงานผ่านเครื่องมือที่มีขอบเขตและตรวจสอบได้
ความสามารถหลัก
ไม่ใช่เพียงรายการคำเตือน แต่เป็น Workflow ที่เชื่อมการค้นพบ URL, การดึงข้อมูลอย่างปลอดภัย, การแยกหลักฐาน, กฎที่มีเวอร์ชัน และการตรวจซ้ำหลังแก้ไข
Concurrent Go crawler พร้อม robots.txt, sitemap discovery, URL normalization, deduplication, redirect validation, TLS และ per-host politeness
เก็บ Raw HTML แยกจากหลักฐานหลัง Playwright render เพื่อเห็นสิ่งที่ Server ส่งและสิ่งที่ JavaScript เปลี่ยน
ทุก Finding มี Rule ID, เวอร์ชัน, Severity, Subject, Evidence, Remediation และ Limitation
ตรวจ Canonical ที่หาย ขัดแย้ง ไม่ถูกต้อง เป็น Chain ชี้หน้าเสียหรือ Noindex รวมถึง Meta Robots และ X-Robots-Tag
ตรวจ Hreflang code, Target และ Reciprocity เพื่อค้นหาคลัสเตอร์ภาษาที่ไม่สมบูรณ์
ตรวจ Title, Meta Description, H1, Exact Duplicate, Near-duplicate Signal และความยาวตามเกณฑ์ที่ตั้งไว้
ดู Inlink, Outlink, Crawl Depth, Broken Internal Target, Nofollow และหน้า Orphan-like จากข้อมูลที่พบ
ตรวจ JSON-LD syntax และโครงสร้างพื้นฐาน โดยแยกข้อจำกัดจาก Schema.org vocabulary และ Google rich-result eligibility
Pause, Resume, Cancel, Timeline, Durable Frontier, Checkpoint และ Recovery สำหรับงาน Crawl ที่ใช้เวลานาน
ส่งออก CSV, NDJSON หรือ XLSX และเปรียบเทียบหน้าที่เพิ่ม ลบ เปลี่ยน รวมถึงปัญหาใหม่หรือแก้แล้ว
Fork ของ DJAI มี README, Dashboard, CLI guidance, audit explanation และ MCP description ภาษาไทย
Source code, crawler, dashboard, CLI, Local API และ MCP ใช้งานภายใต้ MIT License
Audit Engine ปัจจุบันมี 13 หมวดกฎที่มีเวอร์ชัน ผลตรวจคือข้อสังเกตทางเทคนิค ไม่ใช่การรับประกันอันดับหรือการ Index
| หมวด | สิ่งที่ตรวจ | สิ่งที่ต้องพิจารณา |
|---|---|---|
| Response | หน้าเสีย Redirect และ Internal Target ที่โหลดไม่สำเร็จ | Failure อาจเกิดชั่วคราว |
| Metadata | Title และ Description ที่หาย สั้น ยาว หรือซ้ำ | เกณฑ์ความยาวเป็นแนวทาง ไม่ใช่ Ranking Factor |
| Canonical | Canonical หาย ขัดแย้ง Invalid, Chain, Failed หรือ Noindex Target | Canonical เป็น Hint |
| Indexability | Non-200, Noindex, Robots และ Sitemap Coverage | Search Engine มีนโยบายเพิ่มเติม |
| International | Hreflang code, Target และ Reciprocity | เจตนาภาษา/ภูมิภาคต้องตรวจโดยมนุษย์ |
| Architecture | Depth, Inlink, Outlink, Nofollow และ Orphan-like Page | Utility Page อาจตั้งใจแยก |
| Media | รูปไม่มี Alt และ Image Target ที่เสีย | Crawler ไม่เข้าใจเจตนาของภาพ |
| Structured data | JSON-LD syntax และ structural consistency | ไม่รับประกัน Google Rich Result |
ตั้ง Seed URL, Allowed Host, Path Exclusion, URL Ceiling, Depth, Rate และ Raw/Rendered Mode
Normalize Candidate URL และตรวจว่ารวมอยู่ใน Profile หรือไม่
บังคับ Robots, DNS/IP Guard, TLS, Redirect, Size Limit และ Per-host Delay
แยก Metadata, Link, Image, Hreflang, Structured Data และสร้าง Finding ที่มีหลักฐาน
เปรียบเทียบ Added, Removed, Changed, New Issue และ Fixed Issue ระหว่างรอบ
รุ่นปัจจุบันเป็น Release Candidate และยังไม่มี Signed Stable Release วิธีที่โปร่งใสที่สุดคือ Clone Repository ตรวจ Source และ Build บนเครื่องของคุณ
ต้องมี Go ตาม .go-version; Node.js และ pnpm ใช้เมื่อต้อง Build Dashboard หรือ JavaScript Renderer
git clone https://github.com/DJAI-Academy/-Screaming-Frog-Screaming-Toad-SEO-100M-URL.git
cd -- -Screaming-Frog-Screaming-Toad-SEO-100M-URL
make bootstrap
go run ./cmd/seo-auditorเปิด Repository ภาษาไทยMCP สำหรับ AI SEO
MCP Server สื่อสารผ่าน stdio และเรียก Authenticated Loopback API ของ SEO Screaming Toad จึงให้ Agent ทำงาน SEO ได้จริง แต่ไม่เปิด Generic Shell, Arbitrary SQL, Filesystem, Browser หรือ HTTP Fetch ที่ไม่จำกัด
{
"mcpServers": {
"seo-screaming-toad": {
"command": "/absolute/path/to/seo-auditor-mcp",
"env": {
"SEO_AUDITOR_BIND_HOST": "127.0.0.1",
"SEO_AUDITOR_BIND_PORT": "7331"
}
}
}
}project_createproject_listprofile_createprofile_listcrawl_preview_scopecrawl_startcrawl_statuscrawl_pausecrawl_resumecrawl_cancelcrawl_listcrawl_timelineaudit_summaryissue_listissue_explainpage_listpage_getlink_listcrawl_comparereport_exportdiagnostic_createartifact_getAI Search Optimization คือการทำให้เนื้อหาและ Entity ของเว็บไซต์ Crawl ได้ เข้าใจง่าย ตรวจสอบแหล่งที่มาได้ และตอบคำถามผู้ใช้ได้ชัดเจน ชุมชนอาจใช้คำว่า AEO หรือ GEO ด้วย ส่วนคำว่า ASO โดยทั่วไปหมายถึง App Store Optimization แต่บางคนใช้ ASO ในความหมาย AI Search Optimization เช่นกัน
SEO Screaming Toad ไม่สามารถรับประกันว่า AI Search จะอ้างอิงเว็บไซต์ของคุณ แต่ช่วยตรวจฐานทางเทคนิคที่ทั้ง Search Crawler และระบบ Retrieval ต้องพึ่งพา เช่น Status, Canonical, Indexability, Hreflang, Internal Link, Structured Data, Raw/Rendered Content และความซ้ำของหน้า
หน้าและลิงก์สำคัญค้นพบได้โดยไม่พึ่ง Interaction ที่ซ่อนอยู่
Title, H1, Canonical, Language และ Structured Data สอดคล้องกับเนื้อหาที่เห็น
คำตอบ นิยาม ขั้นตอน ข้อจำกัด และหลักฐานอยู่ใน HTML ที่อ่านได้
Thai/English URL มี Self-canonical และ Reciprocal Hreflang
ผู้เขียน องค์กร Repository License และข้อจำกัดระบุชัด
ตรวจว่าข้อมูลสำคัญไม่หายหรือเปลี่ยนผิดหลัง JavaScript ทำงาน
SEO Screaming Toad เป็นโปรเจกต์อิสระและใช้คำว่า Screaming Frog เพื่อการเปรียบเทียบเชิงอธิบายเท่านั้น ไม่อ้าง Feature Parity และไม่เกี่ยวข้องกับ Screaming Frog Ltd. จุดเด่นคือ Open Source, Local-first, Evidence Model และ MCP ที่ออกแบบสำหรับ AI Agent หาก Workflow ของคุณพึ่ง Integration หรือฟีเจอร์เฉพาะของ Commercial Crawler ให้ทดสอบทั้งสองเครื่องมือบนเว็บไซต์ตัวอย่างที่ได้รับอนุญาตแล้วเปรียบเทียบ Coverage, False Positive, Rendered Output, Export และต้นทุนการปฏิบัติงาน
| หัวข้อ | SEO Screaming Toad | สิ่งที่ควรประเมิน |
|---|---|---|
| License | MIT Open Source | ทีมสามารถตรวจ Source และปรับแต่งได้ |
| Data | Local SQLite/WAL | กำหนด Retention และ Backup เอง |
| AI automation | MCP 23 เครื่องมือ | ต้องเปิด Local Supervisor ก่อน |
| JavaScript | Optional isolated renderer | ตรวจ Raw และ Rendered แยกกัน |
| Maturity | Release Candidate | ทดสอบบน Environment และ Workflow จริงก่อนย้ายงาน |
EVIDENCE BEFORE CLAIMS
โปรเจกต์ผ่าน Synthetic Production-path Campaign 1 ล้านและ 5 ล้าน URL โดยรอบ 5 ล้านเก็บ Page 5,000,000, Link 4,999,999 และ Finding 15,884,167 รายการใน SQLite ประมาณ 11.1 GB แต่การทดสอบนี้ไม่ใช้ Live Network จึงไม่พิสูจน์ DNS, TLS, Robots, Redirect, Bandwidth, Host Scheduling หรือ JavaScript Rendering ที่ขนาดดังกล่าว สถาปัตยกรรม 100M+ เป็นทิศทางวิจัยแบบ Segmented Campaign เท่านั้น
ฟรีและโอเพนซอร์สภายใต้ MIT License คุณสามารถตรวจ Source, Build และใช้งานในเครื่องได้
ยังไม่ควรอ้างเช่นนั้น รุ่นปัจจุบันเป็น Release Candidate และไม่อ้าง Feature Parity ควรทดสอบกับ Workflow และเว็บไซต์ตัวอย่างของคุณ
MCP ให้ AI Agent เริ่มและติดตาม Crawl อ่าน Finding เปิด Page Evidence เปรียบเทียบรอบ และสร้างรายงานผ่านเครื่องมือที่มีขอบเขต
ช่วยตรวจ Crawlability, Canonical, Language, Structured Data, Internal Link และ Raw/Rendered Content ซึ่งเป็นฐานสำหรับ Search และ Retrieval แต่ไม่รับประกันการถูกอ้างอิง
Crawler และ SQLite ทำงานในเครื่องโดยค่าเริ่มต้น แต่ผู้ใช้ต้องตรวจ Environment, Renderer และ Workflow การ Export ของตนเอง
ยัง 100M+ เป็นเป้าหมายเชิงสถาปัตยกรรมที่ไม่ผ่าน Live-network Benchmark หลักฐานปัจจุบันคือ Synthetic Campaign สูงสุด 5 ล้าน URL หนึ่งรอบ
ไม่ Raw Mode เร็วกว่าและควรเป็น Baseline ใช้ Rendered Mode เมื่อเว็บไซต์พึ่ง JavaScript และต้องการเปรียบเทียบสิ่งที่เปลี่ยนหลัง Render
ยืนยันสิทธิ์ ตั้ง Scope และ Budget แบบอนุรักษ์นิยม Preview URL ก่อนเริ่ม แล้วตรวจ Terminal Reason และ Evidence ก่อนแก้เว็บไซต์
SEO SCREAMING TOAD
เปิด Repository ภาษาไทย อ่านข้อจำกัด ตรวจ Source และเริ่มจาก Crawl ขนาดเล็กบนเว็บไซต์ที่คุณได้รับอนุญาต จากนั้นใช้ Evidence และ Crawl Comparison เพื่อแก้ Technical SEO อย่างตรวจสอบได้
รวมเครื่องมือทั้งหมด
รวมเครื่องมือที่ใช้งานได้จริงสำหรับตรวจ SEO, QR Code, รูปภาพ, PDF, เสียง, วิดีโอ, เอกสาร, AI context และข้อมูลตาราง
ตรวจ Technical SEO, JavaScript SEO และหลักฐานการ Crawl พร้อม MCP สำหรับ AI Agent
สร้าง QR Code สำหรับลิงก์ Wi-Fi ผู้ติดต่อ ข้อความ และงานสื่อสาร
แปลง บีบอัด resize ลบพื้นหลัง และเตรียมรูปสำหรับแบบฟอร์ม
รวม แยก แปลง จัดหน้า ป้องกัน และทำความสะอาดไฟล์ PDF
แปลงเสียง วิดีโอ ดึงเสียง และลดขนาดวิดีโอใน browser
แปลง DOCX ดึงข้อความจาก PDF และทำ OCR เอกสาร
นับ token ทำความสะอาด context แบ่ง RAG chunk และจัด prompt
แปลง ทำความสะอาด รวม และแบ่ง CSV JSON และ XLSX