Alibaba เปิดตัว Qwen3.7-Plus เมื่อเดือนมิถุนายน 2026 โมเดล AI ที่ออกแบบมาเพื่อทำหน้าที่เป็น agent อัตโนมัติ (agent-first) อย่างเต็มรูปแบบ โดยมีความสามารถอ่านหน้าจอ ควบคุม GUI/CLI และทำงานจริงบนคอมพิวเตอร์ได้ ทั้งหมดนี้ในราคาที่ถูกกว่าโมเดลพี่ของมันถึง 5 เท่า ทำให้เหมาะสำหรับใช้งานในระบบ production จริง
Qwen3.7-Plus คืออะไร
Qwen3.7-Plus เป็นโมเดล multimodal agent สร้างบนพื้นฐาน (backbone) ของ Qwen3.7-Max ซึ่งเป็นโมเดล flagship ของ Qwen series จุดเด่นคือการเพิ่มความสามารถด้าน vision (การมองเห็น) และ GUI grounding (การเข้าใจและโต้ตอบกับหน้าจอ) เข้าไป โมเดลนี้รองรับข้อมูลเข้าทั้ง text และ image และตอบออกมาเป็น text กล่าวคือ คุณสามารถส่งภาพหน้าจอหรือ screenshot เข้าไป แล้วโมเดลจะเข้าใจสิ่งที่อยู่บนหน้าจอ พร้อมทั้งสั่งการให้ agent ทำงานต่อได้ เช่น คลิกปุ่ม กรอกข้อมูล หรือรันคำสั่งใน terminal สิ่งที่ทำให้ Qwen3.7-Plus แตกต่างจากโมเดลทั่วไปคือการออกแบบแบบ agent-first — ไม่ใช่แค่โมเดลที่ตอบคำถามได้ แต่เป็นโมเดลที่ออกแบบมาเพื่อสร้าง closed-loop execution คือวนลูป "มอง → คิด → ทำ → ตรวจสอบ" ได้ด้วยตัวเองจนกว่างานจะเสร็จ
ความสามารถหลัก
Qwen3.7-Plus ถูกออกแบบมาเพื่อ closed-loop execution ของงานจริงในโลกความเป็นจริง ความสามารถหลักมีดังนี้ Screen reading — อ่านและเข้าใจเนื้อหาบนหน้าจอได้ ไม่ว่าจะเป็นหน้าเว็บ แอปพลิเคชัน หรือ interface ใดๆ GUI control — ควบคุม graphic user interface ได้ เช่น คลิก พิมพ์ เลื่อน เลือกจาก dropdown และอื่นๆ CLI control — รันคำสั่งใน command line interface ได้ เหมาะสำหรับงาน devops หรือ automation ที่ต้องใช้ terminal Browser automation — ทำงานอัตโนมัติบนเว็บเบราว์เซอร์ เช่น กรอกฟอร์ม ดึงข้อมูล หรือทำ workflow ซับซ้อน Hybrid GUI + CLI workflows — ทำงานที่ผสมผสานทั้ง GUI และ CLI เข้าด้วยกันได้ใน workflow เดียว ซึ่งเป็นสิ่งที่ agent ส่วนใหญ่ยังทำได้ยาก
ผล Benchmark
ผลคะแนน benchmark ของ Qwen3.7-Plus อยู่ในระดับที่น่าพอใจ: ScreenSpot Pro: 79.0 — benchmark ที่วัดความสามารถในการเข้าใจและกระทำบนหน้าจอ (GUI grounding) Terminal-Bench: 70.3 — benchmark ที่วัดความสามารถในการใช้ terminal/command line นอกจากนี้ เวอร์ชัน preview ได้อันดับ #16 บน Vision Arena (พฤษภาคม 2026) ซึ่งเป็น arena สำหรับประเมินโมเดลที่มีความสามารถด้าน vision
ราคาที่เป็นจุดเปลี่ยน
นี่คือจุดที่ทำให้ Qwen3.7-Plus น่าสนใจที่สุด ต้นทุนต่อการรัน agent หนึ่งครั้งอยู่ที่ประมาณ $0.34 เทียบกับ $1.71 ของ Qwen3.7-Max — ต่างกันถึง 5 เท่า สำหรับงานที่ต้องรัน agent หลายรอบ หลาย task หรือต่อเนื่องตลอดเวลา ผลต่างราคานี้มีผลกระทบมหาศาลต่อต้นทุนรวม ตัวอย่างเช่น ถ้าระบบ automation ต้องรัน agent 1,000 ครั้งต่อวัน ต้นทุนจะเป็น $340 ต่อวัน แทนที่จะเป็น $1,710 ประหยัดได้มากกว่า $40,000 ต่อเดือน นี่คือเหตุผลที่ Alibaba เรียก Qwen3.7-Plus ว่าเป็น "first cost-effective model with full agent-first design" จาก Qwen series — ไม่ใช่แค่ถูก แแต่ถูกพร้อมทั้งยังมีความสามารถครบถ้วนสำหรับงาน agent
ทำไมสำคัญ
Qwen3.7-Plus มีความสำคัญในหลายมิติ ลดต้นทุนการรัน AI agent ได้จริง — ปัญหาใหญ่ของการนำ AI agent ไปใช้ใน production คือต้นทุนที่สูงเกินไป โมเดลอย่าง GPT-4o หรือ Gemini อาจมีความสามารถดี แต่เมื่อต้องรันหลายรอบใน closed-loop ต้นทุนก็บานปลาย Qwen3.7-Plus เสนอทางเลือกที่ประหยัดกว่าอย่างมีนัยสำคัญ ทางเลือกใหม่ที่ไม่พึ่งพา OpenAI/Google — สำหรับองค์กรที่ต้องการลดการพึ่งพา AI providers รายใหญ่ Qwen3.7-Plus เป็นทางเลือกที่น่าสนใจ โดยเฉพาะสำหรับงาน GUI testing, RPA (Robotic Process Automation) และ computer-use agents เปิดยุค agent-first ที่เข้าถึงได้ง่ายขึ้น — การที่มีโมเดลที่ออกแบบมาเพื่อ agent โดยตรง และมีราคาที่เอื้อมถึงได้ จะช่วยเร่งให้การใช้ AI agent แพร่หลายในวงกว้างมากขึ้น
ข้อจำกัดที่ควรรู้
แม้จะมีจุดแข็งหลายอย่าง แต่ Qwen3.7-Plus ก็มีข้อจำกัดที่ควรทำความเข้าใจ โมเดลนี้รองรับเฉพาะ text + image เข้า และ text ออก ยังไม่รองรับการสร้างภาพหรือเสียง นอกจากนี้ แม้จะทำผล benchmark ได้ดี แต่ในงานจริงที่ซับซ้อน เช่น การจัดการกับ dynamic web content หรือ interface ที่เปลี่ยนแปลงบ่อย ก็อาจยังต้องการ human-in-the-loop เพื่อความแม่นยำ
สรุป
Qwen3.7-Plus จาก Alibaba เป็นโมเดล multimodal agent ที่ออกแบบมาเพื่อทำงานจริงบนคอมพิวเตอร์ — ทั้งอ่านหน้าจอ ควบคุม GUI/CLI และทำ automation แบบ closed-loop ด้วยราคาเพียง $0.34 ต่อการรัน agent หนึ่งครั้ง หรือต่ำกว่า Qwen3.7-Max ถึง 5 เท่า ทำให้เป็นโมเดลแรกของ Qwen series ที่เหมาะสำหรับนำไปใช้ใน production จริง ด้วยผล benchmark ที่แข็งแกร่งทั้งด้าน GUI grounding (ScreenSpot Pro 79.0) และ terminal (Terminal-Bench 70.3) Qwen3.7-Plus เป็นตัวเลือกที่น่าจับตาสำหรับองค์กรที่มองหา AI agent ราคาประหยัดแต่มีประสิทธิภาพ
แหล่งอ้างอิง
Qwen/Alibaba Official Blog: https://qwen.ai/blog?qwen3.7-plus Vision Arena Rankings (May 2026) ScreenSpot Pro Benchmark Terminal-Bench Benchmark