เราได้ปรับปรุงการประมวลผล AI ที่สร้าง SOP จากวิดีโอใหม่โดยสิ้นเชิน และนำเสนอโมเดลขนาดใหญ่ใหม่ "VLLM" มาใช้งาน
ด้วยสิ่งนี้ AI สามารถเข้าใจ "ความหมาย" ของวิดีโอได้ และการสร้าง SOP รวมทั้งความเร็วในการวิเคราะห์และระยะเวลาของวิดีโอที่รองรับก็ปรับปรุงอย่างมากขึ้น
①นำ VLLM มาใช้ในการประมวลผล AI วิดีโอ — เพื่อให้ AI เข้าใจ "ความหมาย" ของวิดีโอ
การวิเคราะห์การทำงานในการประมวลผล AI ก่อนหน้านี้ส่วนใหญ่เป็นการ "แบ่ง" วิดีโอ แม้ว่าจะสามารถตรวจจับการสลับฉากได้ แต่ไม่สามารถประมวลผลโดยคำนึงถึงว่าวิดีโอนั้นกำลังทำอะไรอยู่
ด้วยการนำ VLLM (AI ขนาดใหญ่ที่สามารถเข้าใจทั้งวิดีโอและภาษา) มาใช้ใหม่ AI จึงสามารถเข้าใจเนื้อหาของภาพได้โดยตรง และสร้าง SOP ตามบริบทได้
●สิ่งที่ดีขึ้นโดยเฉพาะ
-
สามารถเข้าใจ "ความหมาย" ของวิดีโอได้
ในอดีต: สามารถแบ่งวิดีโอได้เท่านั้น
ปัจจุบัน: สามารถแบ่งขั้นตอนโดยคำนึงถึงว่ากำลังทำอะไร -
สามารถสร้างคำบรรยายจากการทำงานได้
ในอดีต: การพิมพ์เสียงที่พูดเท่านั้น
ปัจจุบัน: สร้างคำบรรยายโดยอัตโนมัติเพื่ออธิบายเนื้อหาการทำงานแม้เมื่อไม่มีเสียงพูด -
การพิมพ์เสียงที่ไม่มีความหมายลดลงอย่างมาก
เนื่องจากการพิมพ์เสียงโดยคำนึงถึงบริบทของวิดีโอทั้งหมด คำบรรยายที่ไม่สอดคล้องกันเนื่องจากข้อผิดพลาดในการฟังจึงลดลงอย่างมาก -
แทรกคำถาม ข้อความ และรูปทรงโดยอัตโนมัติ
เมื่อส่งออก SOP จากวิดีโอ AI จะแทรกคำถามยืนยัน และรูปทรงข้อความภายในหน้าจอ (คำอธิบายประกอบ) โดยอัตโนมัติด้วย
②ปรับปรุงความเร็วในการวิเคราะห์ และรองรับวิดีโอที่มีระยะเวลานาน
ปรับปรุงพื้นฐานการประมวลผลใหม่โดยสิ้นเชิน และได้เพิ่มความเร็วและความจุที่ใช้งานได้ง่ายในสถานที่ทำงาน
-
ความเร็วในการวิเคราะห์ปรับปรุงอย่างมาก
เวลารอการประมวลผลหลังจาก อัปโหลด ลดลงอย่างมาก -
การแบ่งไฟล์ทุก 10 นาทีถูกยกเลิก รองรับไฟล์ตัวเดียวขนาด 50 นาทีได้
ก่อนหน้านี้วิดีโอที่เกิน 10 นาทีจะถูกแบ่งไฟล์โดยระบบ แต่ตอนนี้สามารถประมวลผลวิดีโอเดี่ยวได้สูงสุด 50 นาทีโดยไม่แบ่ง วิดีโอการฝึกอบรมหลากหลายเรื่องหรือวิดีโอที่มีกระบวนการการทำงานทั้งหมดรวมอยู่ในไฟล์เดี่ยวสามารถสร้างเป็น SOP ได้โดยไม่ต้องแบ่ง
SOP วิดีโอที่สร้างแล้วไม่ได้รับผลกระทบ เมื่ออัปโหลดวิดีโอใหม่ หรือเมื่อดำเนินการ「สร้างอัตโนมัติใหม่」บนวิดีโอที่มีอยู่ AI ใหม่จึงจะถูกนำไปใช้
ขอบคุณที่ใช้ Dive ต่อไปนะครับ◎