คู่มือเลือกโมเดล · สำหรับพนักงาน
ในเมนูเลือกโมเดลของ ClickNext Agent มีหลายตัว หน้านี้บอกว่าแต่ละตัวเก่งอะไร อ่อนอะไร และควรใช้ตัวไหนกับงานแบบไหน — ทุกตัวเลขมาจาก ClickNext Bench ที่ทดสอบผ่านแอปจริง ตรวจด้วยเฉลย ไม่ได้ใช้ AI ให้คะแนนกันเอง
ผลทดสอบรอบ 15–28 กันยายน 2026ถ้าจำได้แค่ 3 ข้อ จำ 3 ข้อนี้
งานเกือบทุกอย่าง
gpt-5.6-luna
ได้คะแนนเต็มทุกหมวด ทำชุดข้อสอบยากได้ครบ และแก้ไฟล์จริงผ่านครบ 4 งาน แต่ค่าใช้จ่ายถูกที่สุดในกลุ่มที่ได้คะแนนเต็ม
ไม่แน่ใจว่าจะใช้ตัวไหน
Auto Router
ค่าเริ่มต้นของแอป ระบบเลือกโมเดลให้เองทีละคำถาม คุณภาพใกล้ตัวท็อปในราคาเท่า luna ไม่ต้องคิดเอง
ข้อมูลลับ ห้ามออกนอกบริษัท
Qwen3.8 Flash
รันบนเครื่องในบริษัท ข้อมูลไม่ถูกส่งออกไปข้างนอก ไม่มีค่าใช้จ่าย เก่งภาษาไทยและดึงข้อมูลจากเอกสาร แต่อ่อนเรื่องตรรกะ ควรตรวจผลก่อนใช้
หางานที่ตรงกับสิ่งที่คุณจะทำ แล้วเลือกตามช่อง "ใช้" ถ้าตัวแรกตอบไม่ดี ค่อยลองตัวสำรอง
โมเดลที่พนักงานส่วนใหญ่เห็นในเมนู เรียงจากที่แนะนำที่สุด ถ้าไม่เห็นบางตัว แปลว่าสิทธิ์ของคุณหรือทีมยังไม่ได้เปิดตัวนั้น
| โมเดล | คำแนะนำ | 45 ข้อ | ชุดยาก | แก้ไฟล์ | วินาที/ข้อ | บาท/รอบ | เหมาะกับ |
|---|---|---|---|---|---|---|---|
| gpt-5.6-luna | แนะนำ | 100% | 39/39 | 4/4 | 1.3 | ~฿1.24 | ตัวหลักสำหรับงานเกือบทุกอย่าง |
| Auto Routerค่าเริ่มต้น | แนะนำ | 97.8% | 39/39 | — | 1.1 | ~฿1.25 | ไม่อยากเลือกเอง ระบบเลือกให้ทีละคำถาม |
| Qwen3.8 Flashรันในบริษัท | ข้อมูลลับ | 82.2% | 31/39 | 4/4 | 0.7 | ฟรี | งานที่ข้อมูลห้ามออกนอกบริษัท ดึงข้อมูลจากเอกสาร |
| gpt-6-luna | ลองได้ | — | 38/39 | — | 2.5 | ถูกกว่า luna* | งานออกแบบ (ผลทดสอบยังน้อย) |
| gpt-5.6-sol | เมื่อจำเป็น | 100% | — | 4/4 | 1.4 | ~฿11.71 | ใช้ตรวจซ้ำงานสำคัญ คะแนนเท่า luna แต่แพงกว่าราว 9 เท่า |
| gpt-5.6-terra | เมื่อจำเป็น | 100% | — | 4/4 | 1.0 | ~฿11.92 | เหมือน sol ใช้แทนกันได้ |
| gpt-4o | เลี่ยง | 88.9% | — | 4/4 | 0.9 | ~฿14.51 | รุ่นเก่า แพงกว่า luna เกือบ 12 เท่าแต่คะแนนต่ำกว่า |
| gpt-4o-mini | เลี่ยง | 84.4% | — | 3/4 | 0.7 | ~฿0.87 | ถูกกว่า luna แค่ไม่ถึง 40 สตางค์ แต่พลาดมากกว่าหลายข้อ |
| DeepSeek Chat | เลี่ยง | 77.8% | 34/39 | 4/4 | 0.6 | ~฿1.29 | เร็วที่สุด แต่ราคาพอๆ กับ luna และพลาดคณิตกับโจทย์ยาก |
| gpt-6-sol / gpt-6.1-sol | ยังไม่มีผล | — | — | — | — | — | ยังไม่ได้ทดสอบ จะเพิ่มในรอบถัดไป |
45 ข้อ = ข้อสอบหลักผ่านแอป · ชุดยาก = 39 ข้อ · — = ยังไม่ได้ทดสอบ · บาท/รอบ = ค่า API จริงของการทำข้อสอบครบ 45 ข้อผ่านแอป คิดเป็นบาทที่ 36 บาท/ดอลลาร์ · แก้ไฟล์ = งาน agent 4 งานใน sandbox ตรวจจากไฟล์ที่ได้จริง · * gpt-6-luna ทดสอบเฉพาะชุดยาก ใช้เงินราวครึ่งหนึ่งของ luna ในชุดเดียวกัน
คะแนนข้อสอบหลัก 45 ข้อ แยก 8 หมวด (ทดสอบผ่านแอป) ทุกตัวได้เต็มด้านภาษาไทยและการดึงข้อมูล สิ่งที่แยกตัวเก่งออกจากตัวทั่วไปคือ คณิต ตรรกะ และโจทย์ยาก
| โมเดล | คณิต9 ข้อ | ตรรกะ5 ข้อ | ภาษาไทย5 ข้อ | ดึงข้อมูล4 ข้อ | ทำตามคำสั่ง5 ข้อ | โค้ด5 ข้อ | เทคนิค3 ข้อ | โจทย์ยาก9 ข้อ |
|---|
โมเดลที่ได้คะแนนเท่ากัน อาจมีค่าใช้จ่ายต่างกันเกือบ 10 เท่า การเลือกตัวที่เหมาะกับงานช่วยให้โควตาของคุณใช้ได้นานขึ้น
ทุกตัวในเมนูได้คะแนนภาษาไทยเต็ม งานเขียน สรุป หรือแปล ใช้ Auto Router หรือ luna ก็พอ
ในการทดสอบวิธีทำงาน แม้แต่ luna ก็รายงานตรงกับสิ่งที่ทำจริงแค่ 13 จาก 20 ครั้ง บางครั้งบอกว่าเสร็จทั้งที่ยังไม่เสร็จ ควรเปิดดูไฟล์หรือผลลัพธ์จริงก่อนส่งงาน
บอกบริบทให้ชัดขึ้น หรือแนบไฟล์ตัวอย่าง มักได้ผลดีกว่าการเปลี่ยนไปใช้ตัวแพง ถ้ายังไม่ได้ ค่อยลอง gpt-5.6-sol
เมื่อใช้เกินโควตา ระบบจะสลับไปใช้โมเดลฟรีในบริษัทให้เอง งานจึงยังเดินต่อ แต่งานที่ต้องคิดหลายขั้นจะแม่นน้อยลง ถ้าต้องใช้งานหนัก ให้ขอเพิ่มโควตากับหัวหน้า
ตัวเหล่านี้ไม่ได้อยู่ในเมนูของทุกคน ถ้างานของคุณต้องใช้ ให้ขอสิทธิ์กับผู้ดูแลระบบ