video-use คือ skill ตัดต่อวิดีโอแบบคุยกับ AI จากทีม Browser Use…
งานที่มันทำให้คือตัดคำเอ้อ อ่า พูดผิดแล้วพูดใหม่ และช่วงเงียบระหว่างเทคออก เกรดสีให้ทุกช่วง ใส่ fade เสียง 30 มิลลิวินาทีทุกรอยตัดกันเสียงป๊อป ใส่ซับฝังในคลิป และสั่งทำแอนิเมชันซ้อนด้วย HyperFrames, Remotion หรือ Manim ได้ โดยแยก sub-agent ทำพร้อมกันตัวละแอนิเมชัน
ส่วนที่ผมชอบคือวิธีคิด AI ของเขาอ่านวิดีโอแทนการดูทีละเฟรม เริ่มจากถอดเสียงด้วย ElevenLabs Scribe ได้ timestamp ระดับคำ แยกว่าใครพูด แถมจับเสียงหัวเราะ เสียงปรบมือได้ด้วย แล้วอัดทุกเทครวมเป็นไฟล์ text ราว 12KB ให้ AI อ่าน จะเปิดภาพ waveform กับ filmstrip ดูเฉพาะจุดที่ต้องตัดสินใจเท่านั้น ทีมเขาคำนวณว่าถ้าส่งเฟรมให้ AI ดูทั้งหมดจะกินราว 45 ล้าน token
อีกจุดที่ดีคือมันไม่รีบตัด จะสำรวจคลิปทั้งหมดก่อน เสนอแผนให้เราอนุมัติ พอเรนเดอร์เสร็จก็ตรวจงานตัวเองทุกรอยตัดว่ามีภาพกระตุก เสียงป๊อป หรือซับโดนบังไหม เจอก็แก้แล้วเรนเดอร์ใหม่ได้สูงสุด 3 รอบก่อนส่งให้เราดู และจดทุกอย่างไว้ในไฟล์ project.md สัปดาห์หน้ากลับมาทำต่อได้เลย
ที่ต้องเตรียมคือ ffmpeg กับ API key ของ ElevenLabs ใช้ได้ทั้ง Claude Code, Codex และ agent อื่นที่รันคำสั่งในเครื่องได้ ตัว repo เป็น open source MIT มีดาวบน GitHub เกือบ 27,000 ดวงแล้ว
ที่มา https://github.com/browser-use/video-use
อยากใช้ AI กับงานจริงเป็นระบบ?
เรียน Claude Method — วิธีคิดและลงมือใช้ Claude/AI กับงานจริง ตั้งแต่วันแรก
📍 โพสต้นฉบับบน Facebook: AI กับ Peesamac