xAI ปล่อย Grok Imagine Image 2.0 ออกมาแล้วครับ…
ที่เขาเน้นคือสามอย่าง หนึ่งคือทำตามคำสั่งได้ละเอียดขึ้นมาก สองคือตัวหนังสือในภาพคมและอ่านออก แม้แต่ตัวเล็กๆ ในงานที่มีข้อความแน่นๆ สามคือวางเลย์เอาต์เป็นระบบเหมือนที่นักออกแบบทำ อินโฟกราฟิกหรือโปสเตอร์ที่มีหลายส่วนเลยไม่พังง่าย ข้อนี้แหละที่เป็นจุดตายของโมเดลสร้างภาพมาตลอด
ของใหม่ที่ผมว่าน่าใช้จริงคือชุดเครื่องมือแก้ภาพ มี Magic Wand ที่ชี้ตรงไหนแก้ตรงนั้น ที่เหลือไม่ยุ่ง มี segmentation เลือกพื้นที่เจาะจง มีลบพื้นหลังให้โปร่งใสในคลิกเดียวเอาไปวางต่อได้เลย และรับภาพอ้างอิงได้ถึงห้าใบในการสร้างครั้งเดียว แปลว่าไม่ต้องมานั่งประกอบภาพเองทีหลัง
อีกอันคือ Smart resize เลือกสัดส่วนใหม่แล้วโมเดลเติมส่วนที่ขาดให้เอง ภาพเดียวได้ครบทั้ง 1:1 9:16 16:9 อันนี้ตรงกับปัญหาคนทำคอนเทนต์มาก เพราะภาพเดียวต้องลงหลายแพลตฟอร์มที่ต้องการสัดส่วนไม่เหมือนกัน
แล้วก็มีเทมเพลตสำเร็จรูปมาให้ด้วย ทั้งถ่ายสินค้า ภาพโปรไฟล์ทางการ ไอคอน อาร์ตเกม ทำมาสคอต ทำเมิร์ช เอาไว้สำหรับคนที่ไม่อยากเขียนพรอมต์ยาวๆ เอง
เรื่องอันดับ ตัวเลขจากบอร์ด Arena วันที่ 7 สิงหาคม เขาขึ้นที่สองของโลกทั้งสองกระดาน ฝั่งแก้ภาพได้ 1439 คะแนน ฝั่งสร้างภาพจากข้อความได้ 1320 คะแนน ทั้งสองกระดานยังแพ้ gpt-image-2 ของ OpenAI ที่ได้ 1463 กับ 1380 ก็คือเป็นที่สองจริง แต่ไม่ใช่ที่หนึ่ง
ฝั่งคนใช้จริงมีเสียงติมาบ้างนะครับ ส่วนใหญ่บอกว่าภาพที่ออกมาดูพลาสติกและมันวาวเกินไป เหมือน CGI ขาดผิวสัมผัสธรรมชาติแบบรุ่นก่อน บางคนบอกว่าชอบความมั่วมีเสน่ห์ของเวอร์ชันเดิมมากกว่า และมีคนบ่นว่าการเซ็นเซอร์เข้มขึ้นในบางเคส
ตอนนี้ใช้ได้แล้วที่ grok.com/imagine โดยเลือกโหมด Quality หรือในแอป Grok ทั้ง iOS และ Android ส่วน API เขาบอกว่ากำลังจะตามมา
ผมก็เห็นว่าทิศทางที่ทุกค่ายเดินไปตรงกันหมดตอนนี้ คือเลิกแข่งกันว่าใครวาดสวยกว่า แล้วหันมาแข่งว่าใครแก้ได้ตรงจุดกว่า เพราะงานจริงไม่มีใครได้ของที่ถูกใจตั้งแต่รอบแรก มันอยู่ที่รอบที่สองสามสี่ต่างหาก
x.ai/news/grok-imagine-image-2
อยากใช้ AI กับงานจริงเป็นระบบ?
เรียน Claude Method — วิธีคิดและลงมือใช้ Claude/AI กับงานจริง ตั้งแต่วันแรก
📍 โพสต้นฉบับบน Facebook: AI กับ Peesamac