Clef คือโมเดลตัดสินใจ (decision model) ตัวแรกที่ Cloudflare…
โมเดลแบบนี้ไม่ได้เขียนข้อความยาวเหมือน LLM แต่ตอบเป็นคำตอบที่กำหนดรูปแบบไว้ พร้อมค่าความน่าจะเป็น เช่นส่งข้อความซัพพอร์ตเข้าไป ถามว่าด่วนไหม ทีมไหนควรรับ แล้วโค้ดเราเอาผลไปจัดเส้นทางต่อได้เลย
Cloudflare ลองใช้กับทีม Threat Intelligence จัดหมวดเว็บไซต์ ได้ผลทั้งหมวดแฟชั่น อีคอมเมิร์ซ ฟิชชิ่ง ภายใน 2.2 วินาที ส่วน gpt-oss-120b ทำงานเดียวกันใช้ 4.7 วินาที และคืนมาแค่สองหมวด
จุดต่างจาก Jev ของ Typesafe AI ที่เขาเทียบเอง คือ Clef มี vision encoder จัดหมวดภาพได้ และรับ context 64k เทียบกับ 32k ของ Jev ใช้ API รูปแบบเดียวกัน สลับมาลองได้ง่าย
ตัวเลข latency ที่เขาประกาศ Clef มัธยฐาน 209 มิลลิวินาที Clef-flash 38.8 มิลลิวินาที ส่วน Jev 524 มิลลิวินาที ตัวเลขทั้งหมดมาจาก benchmark ที่ Cloudflare รันเอง
อีกเรื่องคือบริการ fine-tune ด้วย RL ช่วงแรกทีม FDE ของ Cloudflare ลงมือช่วยลูกค้าเอง แล้วค่อยทำเป็นแพลตฟอร์มให้ฝึกและ deploy เองบน Cloudflare ภายหลัง
ผมก็เห็นว่าการได้ค่าความน่าจะเป็นกลับมา ทำให้เขียนเงื่อนไขว่าเมื่อไหร่ให้ระบบตัดสินเอง เมื่อไหร่ส่งต่อให้คนได้ตรงกว่าการให้ LLM เดาเป็นข้อความ
ที่มา: Cloudflare Blog
อยากใช้ AI กับงานจริงเป็นระบบ?
เรียน Claude Method — วิธีคิดและลงมือใช้ Claude/AI กับงานจริง ตั้งแต่วันแรก
📍 โพสต้นฉบับบน Facebook: AI กับ Peesamac