คู่มือเลือกโมเดล · สำหรับพนักงาน

ใช้โมเดลไหนดี?
สรุปจากผลทดสอบจริง

ในเมนูเลือกโมเดลของ ClickNext Agent มีหลายตัว หน้านี้บอกว่าแต่ละตัวเก่งอะไร อ่อนอะไร และควรใช้ตัวไหนกับงานแบบไหน — ทุกตัวเลขมาจาก ClickNext Bench ที่ทดสอบผ่านแอปจริง ตรวจด้วยเฉลย ไม่ได้ใช้ AI ให้คะแนนกันเอง

ผลทดสอบรอบ 15–28 กันยายน 2026

คำตอบสั้น

ถ้าจำได้แค่ 3 ข้อ จำ 3 ข้อนี้

งานเกือบทุกอย่าง

gpt-5.6-luna

ได้คะแนนเต็มทุกหมวด ทำชุดข้อสอบยากได้ครบ และแก้ไฟล์จริงผ่านครบ 4 งาน แต่ค่าใช้จ่ายถูกที่สุดในกลุ่มที่ได้คะแนนเต็ม

100% · 45 ข้อชุดยาก 39/39~฿1.24/รอบ

ไม่แน่ใจว่าจะใช้ตัวไหน

Auto Router

ค่าเริ่มต้นของแอป ระบบเลือกโมเดลให้เองทีละคำถาม คุณภาพใกล้ตัวท็อปในราคาเท่า luna ไม่ต้องคิดเอง

97.8% · 45 ข้อชุดยาก 39/39~฿1.25/รอบ

ข้อมูลลับ ห้ามออกนอกบริษัท

Qwen3.8 Flash

รันบนเครื่องในบริษัท ข้อมูลไม่ถูกส่งออกไปข้างนอก ไม่มีค่าใช้จ่าย เก่งภาษาไทยและดึงข้อมูลจากเอกสาร แต่อ่อนเรื่องตรรกะ ควรตรวจผลก่อนใช้

82% · 45 ข้อชุดยาก 31/39ฟรี

เลือกตามงาน

หางานที่ตรงกับสิ่งที่คุณจะทำ แล้วเลือกตามช่อง "ใช้" ถ้าตัวแรกตอบไม่ดี ค่อยลองตัวสำรอง

ถามตอบ สรุป เขียนอีเมล แปลงานภาษาทั่วไป
ใช้
Auto Routerหรือ gpt-5.6-luna
ทุกตัวในเมนูได้คะแนนเต็มด้านภาษาไทยและการดึงข้อมูล งานแบบนี้ไม่ต้องเลือกตัวแพง
เขียนโค้ด ให้ agent แก้ไฟล์งาน Code / IDE / งานหลายไฟล์
ใช้
gpt-5.6-lunaสำรอง: gpt-5.6-sol
luna ทำโค้ดขั้นสูงในชุดยากได้ 10/10 และผ่านงานแก้ไฟล์จริงครบ ต่อให้ใช้ตัวแพงกว่า คะแนนก็ไม่ได้สูงขึ้น
คำนวณ วิเคราะห์ตัวเลข โจทย์หลายขั้นงานที่ผิดนิดเดียวผลก็ผิด
ใช้
gpt-5.6-lunaสำรอง: gpt-5.6-sol
เลี่ยง gpt-4o, gpt-4o-mini และ DeepSeek Chat — ทั้งสามตัวพลาดหมวดคณิตและตรรกะหลายข้อ
มีข้อมูลลูกค้า ข้อมูลภายใน ความลับไม่อยากให้ออกนอกบริษัท
ใช้
Qwen3.8 Flashรันในเครื่องของบริษัท
ถ้างานต้องคิดหลายขั้น ให้ลบข้อมูลลับออกก่อน แล้วค่อยถาม luna จะได้ผลแม่นกว่า
ออกแบบหน้าเว็บ สไลด์ กราฟิกแท็บ Design
ใช้
gpt-6-lunaสำรอง: gpt-5.6-luna
เป็นตัวเดียวที่ผ่านการทดสอบงานออกแบบแล้ว (59/72 คะแนน) งานจัดลำดับความสำคัญและเนื้อหาตรงบรีฟทำได้ดี แต่ยังอ่อนเรื่องสีและงานยังดูเป็นเทมเพลต
งานสำคัญที่ผิดไม่ได้ส่งลูกค้า ขึ้นระบบจริง
ใช้
luna ทำ + sol ตรวจตั้งใน Pipeline
ใน Pipeline ให้ใช้ luna ทำงาน แล้วตั้ง "ผู้ตรวจ/รวมงาน (Review)" เป็น gpt-5.6-sol จะได้มีอีกตัวช่วยตรวจ โดยจ่ายราคาแพงเฉพาะขั้นตอนตรวจ

เทียบทุกตัวในเมนู

โมเดลที่พนักงานส่วนใหญ่เห็นในเมนู เรียงจากที่แนะนำที่สุด ถ้าไม่เห็นบางตัว แปลว่าสิทธิ์ของคุณหรือทีมยังไม่ได้เปิดตัวนั้น

โมเดลคำแนะนำ45 ข้อชุดยากแก้ไฟล์วินาที/ข้อบาท/รอบเหมาะกับ
gpt-5.6-lunaแนะนำ100%39/394/41.3~฿1.24ตัวหลักสำหรับงานเกือบทุกอย่าง
Auto Routerค่าเริ่มต้นแนะนำ97.8%39/39—1.1~฿1.25ไม่อยากเลือกเอง ระบบเลือกให้ทีละคำถาม
Qwen3.8 Flashรันในบริษัทข้อมูลลับ82.2%31/394/40.7ฟรีงานที่ข้อมูลห้ามออกนอกบริษัท ดึงข้อมูลจากเอกสาร
gpt-6-lunaลองได้—38/39—2.5ถูกกว่า luna*งานออกแบบ (ผลทดสอบยังน้อย)
gpt-5.6-solเมื่อจำเป็น100%—4/41.4~฿11.71ใช้ตรวจซ้ำงานสำคัญ คะแนนเท่า luna แต่แพงกว่าราว 9 เท่า
gpt-5.6-terraเมื่อจำเป็น100%—4/41.0~฿11.92เหมือน sol ใช้แทนกันได้
gpt-4oเลี่ยง88.9%—4/40.9~฿14.51รุ่นเก่า แพงกว่า luna เกือบ 12 เท่าแต่คะแนนต่ำกว่า
gpt-4o-miniเลี่ยง84.4%—3/40.7~฿0.87ถูกกว่า luna แค่ไม่ถึง 40 สตางค์ แต่พลาดมากกว่าหลายข้อ
DeepSeek Chatเลี่ยง77.8%34/394/40.6~฿1.29เร็วที่สุด แต่ราคาพอๆ กับ luna และพลาดคณิตกับโจทย์ยาก
gpt-6-sol / gpt-6.1-solยังไม่มีผล—————ยังไม่ได้ทดสอบ จะเพิ่มในรอบถัดไป

45 ข้อ = ข้อสอบหลักผ่านแอป · ชุดยาก = 39 ข้อ · — = ยังไม่ได้ทดสอบ · บาท/รอบ = ค่า API จริงของการทำข้อสอบครบ 45 ข้อผ่านแอป คิดเป็นบาทที่ 36 บาท/ดอลลาร์ · แก้ไฟล์ = งาน agent 4 งานใน sandbox ตรวจจากไฟล์ที่ได้จริง · * gpt-6-luna ทดสอบเฉพาะชุดยาก ใช้เงินราวครึ่งหนึ่งของ luna ในชุดเดียวกัน

แต่ละตัวเก่งหมวดไหน

คะแนนข้อสอบหลัก 45 ข้อ แยก 8 หมวด (ทดสอบผ่านแอป) ทุกตัวได้เต็มด้านภาษาไทยและการดึงข้อมูล สิ่งที่แยกตัวเก่งออกจากตัวทั่วไปคือ คณิต ตรรกะ และโจทย์ยาก

โมเดล คณิต9 ข้อตรรกะ5 ข้อภาษาไทย5 ข้อดึงข้อมูล4 ข้อทำตามคำสั่ง5 ข้อโค้ด5 ข้อเทคนิค3 ข้อโจทย์ยาก9 ข้อ
เต็ม พลาดบ้าง (70% ขึ้นไป) พลาดเยอะ (ต่ำกว่า 70%)

ค่าใช้จ่ายต่างกันแค่ไหน

โมเดลที่ได้คะแนนเท่ากัน อาจมีค่าใช้จ่ายต่างกันเกือบ 10 เท่า การเลือกตัวที่เหมาะกับงานช่วยให้โควตาของคุณใช้ได้นานขึ้น

~9 เท่า
luna ได้ 100% เท่ากับ sol และ terra แต่ค่าใช้จ่ายราว 1 ใน 9
~12 เท่า
gpt-4o แพงกว่า luna แต่คะแนนต่ำกว่า (88.9%)
฿0
Qwen3.8 Flash รันบนเครื่องในบริษัท ไม่มีค่า API

เคล็ดลับการใช้งาน

ภาษาไทยไม่ต้องใช้ตัวแพง

ทุกตัวในเมนูได้คะแนนภาษาไทยเต็ม งานเขียน สรุป หรือแปล ใช้ Auto Router หรือ luna ก็พอ

ตรวจงานของ agent ทุกครั้ง

ในการทดสอบวิธีทำงาน แม้แต่ luna ก็รายงานตรงกับสิ่งที่ทำจริงแค่ 13 จาก 20 ครั้ง บางครั้งบอกว่าเสร็จทั้งที่ยังไม่เสร็จ ควรเปิดดูไฟล์หรือผลลัพธ์จริงก่อนส่งงาน

ตอบไม่ดี ลองถามใหม่ก่อนเปลี่ยนตัว

บอกบริบทให้ชัดขึ้น หรือแนบไฟล์ตัวอย่าง มักได้ผลดีกว่าการเปลี่ยนไปใช้ตัวแพง ถ้ายังไม่ได้ ค่อยลอง gpt-5.6-sol

ใช้เกินโควตาแล้วงานไม่หยุด

เมื่อใช้เกินโควตา ระบบจะสลับไปใช้โมเดลฟรีในบริษัทให้เอง งานจึงยังเดินต่อ แต่งานที่ต้องคิดหลายขั้นจะแม่นน้อยลง ถ้าต้องใช้งานหนัก ให้ขอเพิ่มโควตากับหัวหน้า

โมเดลอื่นที่ทดสอบแล้ว

ตัวเหล่านี้ไม่ได้อยู่ในเมนูของทุกคน ถ้างานของคุณต้องใช้ ให้ขอสิทธิ์กับผู้ดูแลระบบ

ข้อมูลมาจากไหน

ข้อจำกัด: เป็นผลจากชุดทดสอบภายใน ณ วันที่ทดสอบ ไม่ใช่การจัดอันดับโลก บางโมเดลทดสอบไม่ครบทุกชุด และผลอาจต่างไปเมื่อใช้กับงานจริงของคุณ ตัวเลขล่าสุดดูได้ที่หน้า Benchmark ซึ่งอัปเดตอัตโนมัติทุกสัปดาห์