อาลีบาบา คลาวด์ (Alibaba Cloud) เปิดตัวโมเดล AI สร้างวิดีโอ 'Wan3.0' อย่างเป็นทางการเมื่อวันที่ 24 (เวลาท้องถิ่น) โดยสร้างวิดีโอได้ยาวสุดถึง 30 วินาที พร้อมเปิดฟีเจอร์รองรับไฟล์เอกสารเป็นอินพุตและระบบคิดราคาตามวินาทีแยกตามความละเอียด ขยายขอบเขตการใช้งานในฐานะเครื่องมือผลิตคอนเทนต์ให้กว้างขึ้น
อาลีบาบา คลาวด์ระบุผ่านช่องทางทางการว่า Wan3.0 รองรับไฟล์เอกสารรูปแบบ doc, xls, ppt, pdf และ md เป็นอินพุตใหม่ ถือเป็นการขยายขอบเขตจากเดิมที่เน้นสร้างวิดีโอจากข้อความและภาพ ไปสู่การผลิตวิดีโอจากเอกสารโดยตรง
เอกสารช่วยเหลือของอาลีบาบา คลาวด์ระบุว่า Wan3.0-Video เป็นโมเดลสร้างวิดีโออ้างอิงแบบครบวงจรที่ให้บริการผ่านแพลตฟอร์ม Model Studio ของอาลีบาบา ไป่เหลียน (Bailian) โดยโมเดลนี้รับอินพุตได้ทั้งข้อความ ภาพ วิดีโอ เสียง ไฟล์ และลิงก์ แล้วประมวลผลออกมาเป็นวิดีโอ
Wan3.0 รวมสามฟังก์ชันไว้ในโมเดลเดียว ได้แก่ การสร้างวิดีโอจากข้อความ การสร้างวิดีโอจากภาพ และการสร้างวิดีโอแบบอ้างอิง ผู้ใช้สามารถใส่ภาพ วิดีโอ เสียง หรือเอกสารที่มีอยู่เดิมเข้าไปพร้อมกันเพื่อสร้างผลลัพธ์ได้
ด้านราคาก็เปิดเผยออกมาด้วย สำหรับรีเจียนปักกิ่ง ประเทศจีน ราคา API อยู่ที่ 0.3 หยวนต่อวินาทีสำหรับความละเอียด 480P, 0.6 หยวนต่อวินาทีสำหรับ 720P และ 1.2 หยวนต่อวินาทีสำหรับ 1080P
ส่วนราคาการให้บริการระหว่างประเทศผ่านรีเจียนสิงคโปร์อยู่ที่ 0.37471 หยวนต่อวินาทีสำหรับ 480P, 0.74942 หยวนต่อวินาทีสำหรับ 720P และ 1.49884 หยวนต่อวินาทีสำหรับ 1080P สะท้อนว่าแม้เป็นโมเดลเดียวกัน แต่เกณฑ์การคิดราคาต่างกันไปตามรีเจียนและรูปแบบการให้บริการ
อาลีบาบา คลาวด์ยังจัดโปรโมชันลดราคา API ชั่วคราว 30% บนแพลตฟอร์ม Bailian และ Qwen AI ตั้งแต่วันที่ 24 ถึงวันที่ 23 กันยายน โดยเงื่อนไขการลดราคาและอัตราค่าบริการจริงต้องตรวจสอบผ่านคอนโซลของแต่ละแพลตฟอร์ม
จุดที่ปรับปรุงหลักคือ 'ความเสถียรของฉากยาว' อาลีบาบา คลาวด์อธิบายว่า Wan3.0 พัฒนาขึ้นกว่ารุ่นก่อนหน้าในด้านพื้นผิวตัวละคร ความต่อเนื่องระหว่างฉาก ความแม่นยำในการสร้างซ้ำจากภาพอ้างอิง และการแสดงออกในสไตล์ที่ไม่สมจริง
ในประกาศดังกล่าวมีตัวอย่างการใช้งาน อาทิ การผลิตซีรีส์สั้นและวิดีโอ แพลตฟอร์มสำหรับครีเอเตอร์ การตลาดโฆษณา การประชาสัมพันธ์ด้านวัฒนธรรมและการท่องเที่ยว รวมถึงมิวสิกวิดีโอ ความคิดเห็นคือ หากโมเดลสร้างวิดีโอด้วย AI จะก้าวข้ามจากการเป็นเดโมทดลองไปสู่ขั้นตอนการผลิตจริง สิ่งที่จำเป็นไม่ใช่แค่คุณภาพของผลงาน แต่ยังรวมถึงการประมวลผลข้อมูลนำเข้า ความสม่ำเสมอของผลลัพธ์ และความสามารถในการคาดการณ์ต้นทุนด้วย
การประกาศครั้งนี้มีนัยสำคัญ เพราะสะท้อนว่าการแข่งขันด้านโมเดลสร้างวิดีโอของบริษัทเทคโนโลยีรายใหญ่ของจีนกำลังขยับจากการเปิดเผยตัวชี้วัดด้านประสิทธิภาพ ไปสู่การแข่งขันด้านราคา API และช่องทางการให้บริการ ก่อนหน้านี้ TokenPost เคยรายงานว่า เมตา(META) เปิดเผยโมเดลสร้างวิดีโอ 'Muse Video' ในขั้นตอนเปิดให้ทดลองใช้งานก่อนเปิดตัวอย่างเป็นทางการ
สำหรับผู้อ่านในไทย ประเด็นที่น่าจับตาคือแพลตฟอร์ม AI ของจีนเปิดเผยทั้งฟีเจอร์รองรับอินพุตจากเอกสารและโครงสร้างราคาที่ใช้งานจริงไปพร้อมกัน ผลกระทบโดยตรงต่อบริการหรือสภาพแวดล้อมการผลิตคอนเทนต์ในไทยยังไม่มีการยืนยัน แต่เกณฑ์การเลือกใช้เครื่องมือสร้างวิดีโอด้วย AI กำลังขยายจากเรื่องประสิทธิภาพของโมเดล ไปสู่ต้นทุนการใช้งานและขั้นตอนการผลิตจริงด้วย
ความคิดเห็น 0