คู่มือการใช้งาน Thai Word Search
เครื่องมือค้นหารูปแบบคำภาษาไทยขั้นสูง (Pattern-Matching Engine) ออกแบบมาสำหรับการแก้ปริศนาอักษรไขว้, คำซ่อน, Anagram, สมการคำ และงานวิเคราะห์โครงสร้างภาษาไทย
Trie Engine
สำหรับรูปแบบคำพื้นฐาน (พยัญชนะและจุด) ระบบใช้โครงสร้างข้อมูล Prefix Trie ทำให้สามารถค้นหาคำตรงกันได้ในเวลาระดับกิโลเฮิรตซ์ (Microseconds)
Thai Grapheme Split
รองรับอักขระภาษาไทยโดยรวบรวมพยัญชนะ สระบน-ล่าง และวรรณยุกต์เข้าเป็นหน่วยอักขระ (Grapheme Cluster) เพื่อให้นับจำนวนตัวอักษรได้ตรงตามหลักภาษาจริง
Popularity Index
จัดลำดับคำตามดรรชนีความถี่การใช้งานในคลังข้อมูลภาษาไทย แบ่งออกเป็น 4 ระดับ (ใช้บ่อยมาก, ใช้บ่อย, ปานกลาง, พบน้อย) ช่วยแยกคำศัพท์ทั่วไปออกจากคำโบราณ
ไวยากรณ์การค้นหา (Search Syntax Reference)
| สัญลักษณ์ | ชื่อและความหมาย | ตัวอย่าง | ผลลัพธ์ที่ได้ |
|---|---|---|---|
| . | ตัวอักษรใดก็ได้ 1 ตัว (Wildcard)
แทนตำแหน่งตัวอักษร 1 ตำแหน่ง |
ส..น |
สงวน, สถาน, สุทัศน์ |
| * | ตัวอักษรใดก็ได้ กี่ตัวก็ได้ (Filler)
แทนข้อความความยาวเท่าใดก็ได้ (0 ตัวขึ้นไป) |
สับ* |
สับไก, สับราง, สับปะรด |
| [...] | เลือกตัวอักษรบางตัว (Character Class)
กำหนดกลุ่มตัวอักษรที่ยอมรับในตำแหน่งนั้น |
[ใไโ]ก. |
โกก, ไกร, ใกล้ |
| {...} | ค้นหาเฉพาะตัวอักษรที่กำหนด (Subset)
คำนั้นต้องสร้างจากกลุ่มตัวอักษรในวงเล็บปีกกาเท่านั้น |
{บนมา} |
มัน, นมนาน, บนบาน |
| {...}+N | Subset + ตัวอักษรอืนได้ N ตัว
อนุญาตให้มีอักษรนอกกลุ่มได้ไม่เกิน N ตัว |
{บนมา}+1 |
รามา, สนามบิน, ขนานนาม |
| / | การสลับอักษร (Anagram)
ค้นหาคำที่เกิดจากการสลับตัวอักษรชุดนี้ |
/กลม |
กมล, มกุล, มีลูก |
| A-Z | ตัวแปรอ้างอิงข้อความเดียวกัน (Variables)
ใช้ตัวอักษรภาษาอังกฤษใหญ่เป็นตัวแปรแทนลำดับอักษรเดียวกัน |
AA |
นานา, กก |
| ~A-Z | ตัวแปรกลับทิศทาง (Reversed Variable)
แทนตัวแปรเดิมแต่ย้อนกลับทิศทาง (เช่น พาลินโดรม) |
A~A |
การราก |
| ; | สมการชุดคำ (System of Equations)
เชื่อมความสัมพันธ์ระหว่างหลายรูปแบบคำด้วยตัวแปร |
AB; BA |
กมลา; มลาก, กู้เงิน; เงินกู้ |
| & / | / ! / ^ | ตัวดำเนินการตรรกศาสตร์ (Logic Operators)
& (และ), | (หรือ), ! (ยกเว้นรูปแบบ), ^ (ยกเว้นตัวอักษร) |
/*ฮ & !ฮ* |
เก๊กฮวย, นกฮูก |
ตัวเลือกเสริม (Search Options)
1. นับอักษรบนล่าง (Strict Vowel & Tone Matching)
เมื่อเปิดใช้งาน สระและวรรณยุกต์จะถือเป็นตัวอักษรแยกต่างหากตรงตามตำแหน่ง แต่หากปิดใช้งาน ระบบจะผ่อนปรนให้ค้นหาคำที่พยัญชนะตรงกันโดยไม่สนสระบนล่างในบางสัญลักษณ์
2. รวมหัวข้อใน Wikipedia (Wikipedia Dictionary)
ขยายฐานข้อมูลจากพจนานุกรมหลัก ให้ครอบคลุมชื่อเฉพาะ คำทับศัพท์ ชื่อสถานที่ และบุคคลสำคัญ โดยใช้อ้างอิงดรรชนีหัวข้อบทความจากคลังข้อมูล Thai Wikipedia (Wikipedia Database Dump ภาษาไทย)
3. เรียงตามความนิยม (Popularity Sorting & PyThaiNLP)
เรียงลำดับคำตามความถี่การใช้งานจริงในภาษาไทย (อ้างอิงจากคลังข้อมูลความถี่คำ PyThaiNLP TNC Corpus) โดยแบ่งช่วงคำนวณด้วยค่าสถิติควอร์ไทล์ (Quartiles: Q1, Q2, Q3) ดังนี้:
- 🔥🔥🔥 ใช้บ่อยมาก: ความถี่ ≥ 206 (Q3 Cutoff / Top 25%)
- 🔥🔥 ใช้บ่อย: ความถี่ 48 ถึง 206 (Q2 – Q3 / ช่วง 50% - 75%)
- 🔥 ปานกลาง: ความถี่ 18 ถึง 48 (Q1 – Q2 / ช่วง 25% - 50%)
- พบน้อย: ความถี่ < 18 (ต่ำกว่า Q1 / Bottom 25%)