Atria Dawn Preview คือโมเดล agentic ตัวใหม่จาก Shanghai…
จุดที่ทำให้ผมสนใจไม่ใช่เรื่องฉลาดกว่าใคร แต่เป็นแนวคิดที่ต่างจากโมเดลแชททั่วไป Atria ถูกออกแบบมาให้ปิดลูปงานวิจัยและวิศวกรรมทั้งกระบวนการ ตั้งแต่ตั้งคำถาม ออกแบบวิธีทดลอง เรียกใช้เครื่องมือ เขียนโค้ด รันทดลองจริง จนได้ผลลัพธ์ที่ตรวจสอบได้และทำซ้ำได้ ไม่ใช่แค่ตอบคำถามให้ดูดี
ตัวมันต่อยอดจาก GLM-5.2 แบบ MoE ขนาด 744B พารามิเตอร์ context window 256K โฟกัส 4 แกนคือ Discovery ค้นหลักฐานทำแผนทดลอง Creation สร้างซอฟต์แวร์และแอปและโมเดล ML Delivery แปลงข้อมูลเป็นรายงานและสไลด์ และ Cybersecurity หาช่องโหว่แพตช์ตรวจซ้ำในสภาพแวดล้อมที่อนุญาต
เรื่องเบนช์มาร์กที่ทีมโชว์เอง Atria นำ Claude Opus 5 กับ GPT-5.6 Sol ในงานที่เน้น automation อย่าง AutomationBench และ CyberGym แต่พอมาเทียบงานเขียนโค้ดจริงจังอย่าง SWE-bench Pro หรือ Terminal-Bench Opus 5 ยังนำอยู่ชัดเจน ก็ต้องบอกไว้ตรงๆ ว่าคะแนนพวกนี้เป็นการวัดเองของทีม Atria ไม่ใช่ leaderboard อิสระ และมีคนติว่ากราฟในโพสต้นทางสเกลดูเกินจริงด้วย
ผมมองว่านี่ไม่ใช่โมเดลที่มาแย่งบัลลังก์ frontier ทั่วไปหรอกครับ แต่มันเจาะกลุ่มคนที่อยากได้ผู้ช่วยวิจัยที่ทำงานยาวๆ แล้วส่งของที่ตรวจสอบได้จริง แถมเปิด weight ให้ไปโฮสต์เองได้ด้วย ส่วนใครอยากได้ตัวช่วยเขียนโค้ดจริงจังหรือใช้งานทั่วไป Opus 5 กับ GPT-5.6 ยังน่าใช้กว่าอยู่ดี
อยากใช้ AI กับงานจริงเป็นระบบ?
เรียน Claude Method — วิธีคิดและลงมือใช้ Claude/AI กับงานจริง ตั้งแต่วันแรก
📍 โพสต้นฉบับบน Facebook: AI กับ Peesamac