คู่มือการใช้งาน Thai Word Search

เครื่องมือค้นหารูปแบบคำภาษาไทยขั้นสูง (Pattern-Matching Engine) ออกแบบมาสำหรับการแก้ปริศนาอักษรไขว้, คำซ่อน, Anagram, สมการคำ และงานวิเคราะห์โครงสร้างภาษาไทย

Trie Engine

สำหรับรูปแบบคำพื้นฐาน (พยัญชนะและจุด) ระบบใช้โครงสร้างข้อมูล Prefix Trie ทำให้สามารถค้นหาคำตรงกันได้ในเวลาระดับกิโลเฮิรตซ์ (Microseconds)

Thai Grapheme Split

รองรับอักขระภาษาไทยโดยรวบรวมพยัญชนะ สระบน-ล่าง และวรรณยุกต์เข้าเป็นหน่วยอักขระ (Grapheme Cluster) เพื่อให้นับจำนวนตัวอักษรได้ตรงตามหลักภาษาจริง

Popularity Index

จัดลำดับคำตามดรรชนีความถี่การใช้งานในคลังข้อมูลภาษาไทย แบ่งออกเป็น 4 ระดับ (ใช้บ่อยมาก, ใช้บ่อย, ปานกลาง, พบน้อย) ช่วยแยกคำศัพท์ทั่วไปออกจากคำโบราณ

ไวยากรณ์การค้นหา (Search Syntax Reference)

สัญลักษณ์ ชื่อและความหมาย ตัวอย่าง ผลลัพธ์ที่ได้
.
ตัวอักษรใดก็ได้ 1 ตัว (Wildcard)
แทนตำแหน่งตัวอักษร 1 ตำแหน่ง
ส..น สงวน, สถาน, สุทัศน์
*
ตัวอักษรใดก็ได้ กี่ตัวก็ได้ (Filler)
แทนข้อความความยาวเท่าใดก็ได้ (0 ตัวขึ้นไป)
สับ* สับไก, สับราง, สับปะรด
[...]
เลือกตัวอักษรบางตัว (Character Class)
กำหนดกลุ่มตัวอักษรที่ยอมรับในตำแหน่งนั้น
[ใไโ]ก. โกก, ไกร, ใกล้
{...}
ค้นหาเฉพาะตัวอักษรที่กำหนด (Subset)
คำนั้นต้องสร้างจากกลุ่มตัวอักษรในวงเล็บปีกกาเท่านั้น
{บนมา} มัน, นมนาน, บนบาน
{...}+N
Subset + ตัวอักษรอืนได้ N ตัว
อนุญาตให้มีอักษรนอกกลุ่มได้ไม่เกิน N ตัว
{บนมา}+1 รามา, สนามบิน, ขนานนาม
/
การสลับอักษร (Anagram)
ค้นหาคำที่เกิดจากการสลับตัวอักษรชุดนี้
/กลม กมล, มกุล, มีลูก
A-Z
ตัวแปรอ้างอิงข้อความเดียวกัน (Variables)
ใช้ตัวอักษรภาษาอังกฤษใหญ่เป็นตัวแปรแทนลำดับอักษรเดียวกัน
AA นานา, กก
~A-Z
ตัวแปรกลับทิศทาง (Reversed Variable)
แทนตัวแปรเดิมแต่ย้อนกลับทิศทาง (เช่น พาลินโดรม)
A~A การราก
;
สมการชุดคำ (System of Equations)
เชื่อมความสัมพันธ์ระหว่างหลายรูปแบบคำด้วยตัวแปร
AB; BA กมลา; มลาก, กู้เงิน; เงินกู้
& / | / ! / ^
ตัวดำเนินการตรรกศาสตร์ (Logic Operators)
& (และ), | (หรือ), ! (ยกเว้นรูปแบบ), ^ (ยกเว้นตัวอักษร)
/*ฮ & !ฮ* เก๊กฮวย, นกฮูก

ตัวเลือกเสริม (Search Options)

1. นับอักษรบนล่าง (Strict Vowel & Tone Matching)

เมื่อเปิดใช้งาน สระและวรรณยุกต์จะถือเป็นตัวอักษรแยกต่างหากตรงตามตำแหน่ง แต่หากปิดใช้งาน ระบบจะผ่อนปรนให้ค้นหาคำที่พยัญชนะตรงกันโดยไม่สนสระบนล่างในบางสัญลักษณ์

2. รวมหัวข้อใน Wikipedia (Wikipedia Dictionary)

ขยายฐานข้อมูลจากพจนานุกรมหลัก ให้ครอบคลุมชื่อเฉพาะ คำทับศัพท์ ชื่อสถานที่ และบุคคลสำคัญ โดยใช้อ้างอิงดรรชนีหัวข้อบทความจากคลังข้อมูล Thai Wikipedia (Wikipedia Database Dump ภาษาไทย)

3. เรียงตามความนิยม (Popularity Sorting & PyThaiNLP)

เรียงลำดับคำตามความถี่การใช้งานจริงในภาษาไทย (อ้างอิงจากคลังข้อมูลความถี่คำ PyThaiNLP TNC Corpus) โดยแบ่งช่วงคำนวณด้วยค่าสถิติควอร์ไทล์ (Quartiles: Q1, Q2, Q3) ดังนี้:

  • 🔥🔥🔥 ใช้บ่อยมาก: ความถี่ ≥ 206 (Q3 Cutoff / Top 25%)
  • 🔥🔥 ใช้บ่อย: ความถี่ 48 ถึง 206 (Q2 – Q3 / ช่วง 50% - 75%)
  • 🔥 ปานกลาง: ความถี่ 18 ถึง 48 (Q1 – Q2 / ช่วง 25% - 50%)
  • พบน้อย: ความถี่ < 18 (ต่ำกว่า Q1 / Bottom 25%)