Tencent เปิดโมเดล Hy4 preview ให้โหลดไปใช้ฟรีภายใต้ Apache 2.0…
ที่เขาตั้งใจทำตัวนี้คืองานยาวๆ ที่ต้องอยู่กับมันนาน ไม่ใช่ถามตอบสั้นๆ ในภาพจะเห็นว่ามันสร้างเกมสามมิติที่เดินได้ ตีมอนได้ มีเควสต์ มีมินิแมป และอีกภาพเป็นเว็บเล่าเรื่องมีภาพประกอบเลื่อนดูเป็นบทๆ คือของที่ต้องทำหลายไฟล์แล้วยังต้องคุมให้เข้ากันทั้งชุด
ตัวเลขที่ผมว่าต้องอ่านให้ครบคือกราฟเทียบที่เขาปล่อยมาเอง เทียบกับรุ่นก่อนคือ Hy3 มันดีขึ้นแบบชัดเจน เช่น DeepSWE จาก 28.0 ขึ้นเป็น 64.3 และ Terminal Bench จาก 70.8 เป็น 85.4 แต่พอเทียบกับ Claude Opus 5 กับ GPT 5.6 ในกราฟชุดเดียวกัน Hy4 ยังตามหลังในเกือบทุกช่อง เขาไม่ได้ปิดตรงนี้ ใส่มาให้เห็นเองเลย ซึ่งผมว่าตรงไปตรงมาดี
ทีมเขาบอกว่าเอาไปให้ผู้เชี่ยวชาญภายใน 163 คนทดสอบแบบปิดชื่อกับโจทย์วิศวกรรม 203 ข้อ แล้วผลออกมานำ GLM 5.3 กับ Kimi K3 อยู่นิดหน่อย อันนี้ต้องบอกว่าเป็นการวัดของเขาเอง ไม่ใช่การวัดจากคนกลาง
และเขายอมรับเองว่ายังเป็นรุ่นทดลอง ข้อเสียที่บอกไว้ตรงๆ คือมันคิดเยอะเกินและตรวจงานตัวเองซ้ำเกินจำเป็น มีคนเข้าไปคอมเมนต์ว่าเจอกับตัว งานยาวงานหนึ่งวนสร้างโครงไฟล์เดิมซ้ำสี่รอบก่อนจะไปต่อ กินหน้าต่างข้อความไปเยอะจนงานล้มโดยไม่ทันรู้ตัว
ตอนนี้ลองได้ผ่าน OpenRouter หรือ Tencent Cloud ปล่อยออกมาวันที่ 28 สิงหา แล้วขึ้น Product Hunt ได้ที่สองของวัน 214 โหวต
สิ่งที่ผมคิดคือการที่โมเดลเปิดขนาดนี้ออกมาถี่ขึ้นเรื่อยๆ มันเปลี่ยนคำถามของคนทำระบบ จากเดิมที่ถามว่าจะจ่ายค่า API เจ้าไหน กลายเป็นถามว่างานแบบไหนที่คุ้มจะรันเองในบ้าน ซึ่งสำหรับองค์กรที่ข้อมูลออกนอกไม่ได้ นี่คือประตูที่เพิ่งเปิด
https://hy.tencent.ai
อยากใช้ AI กับงานจริงเป็นระบบ?
เรียน Claude Method — วิธีคิดและลงมือใช้ Claude/AI กับงานจริง ตั้งแต่วันแรก
📍 โพสต้นฉบับบน Facebook: AI กับ Peesamac