News / รีวิว / รวมค่าย
รวมค่าย · รีวิว

Hark เพิ่งเปิดตัว Handoff เมื่อวาน เป็น AI ที่ใช้เว็บแทนเรา…

ภีศเดช เพชรน้อย
ภีศเดช เพชรน้อย
6 ส.ค. 2026 · อ่าน 5 นาที
สรุปสั้น — Hark เพิ่งเปิดตัว Handoff เมื่อวาน เป็น AI ที่ใช้เว็บแทนเรา สั่งอาหารบน DoorDash จองตั๋วเครื่องบินบน United ไล่หาผู้สมัครแล้วทักบน
#Opus 4.8#GPT-5.6#Research#Productivity
Hark เพิ่งเปิดตัว Handoff เมื่อวาน เป็น AI ที่ใช้เว็บแทนเรา…

วิธีทำงานคือมันไม่ได้เรียก API ของเว็บ แต่เปิดคอมพิวเตอร์เสมือนขึ้นมาหนึ่งเครื่องต่อหนึ่งงาน แล้วขยับเมาส์ คลิก พิมพ์ เลื่อนหน้าจอเหมือนคนนั่งทำเอง เหตุผลที่ต้องทำแบบนี้คือเว็บส่วนใหญ่ในโลกไม่มี API ให้ ถ้าอยากให้ AI ทำงานบนอินเทอร์เน็ตได้จริง มันต้องใช้เว็บแบบที่คนใช้

บริษัทนี้ก่อตั้งโดย Brett Adcock คนเดียวกับที่ทำ Figure หุ่นยนต์ฮิวแมนนอยด์ และ Archer Aviation ระดมทุนรอบ Series A ไป 700 ล้านดอลลาร์เมื่อพฤษภาคมที่ผ่านมา ที่มูลค่าบริษัท 6 พันล้าน นี่คือของชิ้นแรกที่เขาปล่อยออกมาให้คนดู

ตัวเลขที่เขาชูคือได้ 97.7 บน Online-Mind2Web ซึ่งเป็นการทดสอบกับเว็บจริง 300 งานจาก 136 เว็บไซต์ แล้วให้คนเป็นคนตรวจ เทียบกับ GPT 5.4 ที่ได้ 92.8 Claude Opus 4.8 ได้ 84.1 และ Gemini 2.5 Pro ได้ราว 69 ส่วนราคาถูกกว่าราวสิบเท่า

ทีนี้มาถึงส่วนที่ผมว่าน่าสนใจกว่าตัวเลข

ที่เขาบอกว่าได้คะแนนสูงสุดเท่าที่เคยมีนั้นจริงตามกระดานอันดับ แต่เจ้าที่ครองอันดับหนึ่งอยู่ก่อนหน้าคือ Navigator n1.5 ของ Yutori ซึ่งได้ 97.3 ตั้งแต่เดือนมิถุนายน ห่างกันแค่ 0.4 คะแนน แล้วชื่อนี้ไม่ได้อยู่ในกราฟที่เขาเอามาโชว์เลย ในกราฟมีแต่ค่ายใหญ่ที่เขานำห่างๆ

อีกจุดคือรุ่นที่เอามาเทียบทั้งหมดเป็นรุ่นก่อนหน้า ทั้ง GPT 5.4 GPT 5.5 Opus 4.8 และ Gemini 2.5 Pro ส่วนตัวท็อปตอนนี้อย่าง GPT 5.6 กับ Opus 5 ไม่มีอยู่ในนั้น เหตุผลที่แฟร์กับเขาคือสองตัวนั้นยังไม่มีใครส่งผลขึ้นกระดานนี้ แต่ก็แปลว่าคำว่าเก่งที่สุดในโลกยังพิสูจน์กับของที่แรงที่สุดจริงๆ ไม่ได้

แล้วมีจุดที่ผมอ่านแล้วสะดุด ในผลทดสอบเขาได้งานง่าย 100 เปอร์เซ็นต์ งานยาก 100 เปอร์เซ็นต์ แต่งานระดับกลางได้ 95 ซึ่งงานยากทำได้ดีกว่างานกลาง เป็นรูปแบบที่แปลก อาจเป็นเพราะจำนวนงานในแต่ละกลุ่มไม่เท่ากัน แต่ก็ทำให้เห็นว่าตัวเลขพวกนี้อ่านเผินๆ ไม่ได้

ที่สำคัญกว่านั้นคือตอนนี้ยังไม่มีใครนอกบริษัทได้ลองเลย มันอยู่ในสถานะ research preview เปิดให้ลงชื่อรอ แล้วจะเปิดใช้จริงช่วงปลายเดือนนี้ ของแบบนี้บททดสอบจริงไม่ใช่ benchmark แต่คือวันที่คนทั่วไปเอาบัญชีตัวเอง บัตรเครดิตตัวเอง ยื่นให้มันไปทำงานให้

ซึ่งนำมาสู่เรื่องที่ผมคิดว่าคนควรคิดก่อนตื่นเต้น การให้ AI ใช้เว็บแทนเรา แปลว่ามันต้องล็อกอินด้วยบัญชีเรา ใช้ที่อยู่เรา จ่ายด้วยบัตรเรา และส่งข้อความในนามเรา ความผิดพลาดของมันเลยไม่ใช่แค่คำตอบผิด แต่เป็นของที่สั่งผิด ตั๋วที่จองผิดวัน หรือข้อความที่ทักไปหาคนที่ไม่ควรทัก

ความเห็นผมคือทิศทางนี้ถูกแล้วนะครับ เพราะงานน่าเบื่อในชีวิตประจำวันส่วนใหญ่มันอยู่ในเบราว์เซอร์จริงๆ และการรอให้ทุกเว็บทำ API ให้ AI คงไม่มีวันเกิด แต่ผมจะรอดูตอนคนใช้จริงมากกว่าตอนดูกราฟ เพราะเว็บจริงมันมีป๊อปอัพ มีการทดสอบสลับหน้าตา มีระบบกันบอท และมีวันที่หน้าเว็บเปลี่ยนโดยไม่บอกใคร

ของแบบนี้เก่ง 97 เปอร์เซ็นต์ฟังดูดีมาก จนกว่าเราจะนึกออกว่าอีก 3 เปอร์เซ็นต์คือเงินของเราจริงๆ

อยากใช้ AI กับงานจริงเป็นระบบ?

เรียน Claude Method — วิธีคิดและลงมือใช้ Claude/AI กับงานจริง ตั้งแต่วันแรก

ดูคอร์ส →

📍 โพสต้นฉบับบน Facebook: AI กับ Peesamac