อาลีบาบาเปิดตัวโมเดลการสร้างวิดีโอโอเพ่นซอร์สล่าสุด – Taobao Thailand

ทั้งหมด                 Alibaba Group                 อีคอมเมิร์ซ                 เทคโนโลยี                 โลจิสติกส์            ความยั่งยืน                 ไลฟ์สไตล์


อาลีบาบาเปิดตัวโมเดลการสร้างวิดีโอโอเพ่นซอร์สล่าสุด

เทคโนโลยี|เผยแพร่เมื่อ 18 เมษายน 2025

อาลีบาบาได้เปิดตัวโมเดลการสร้างวิดีโอโอเพ่นซอร์สล่าสุด Wan2.1-FLF2V-14B ได้รับการออกแบบมาเพื่ออํานวยความสะดวกในการป้อนเฟรมเริ่มต้นและสิ้นสุดเพื่อลดความซับซ้อนในการสร้างวิดีโอ สิ่งนี้ช่วยให้ผู้สร้างวิดีโอสั้นสามารถควบคุมความคิดสร้างสรรค์ได้มากขึ้นโดยช่วยพวกเขาในการพัฒนาโมเดลและแอปพลิเคชัน AI ของตนเอง ทั้งอย่างมีประสิทธิภาพและราคาไม่แพง

โมเดลนี้เป็นส่วนหนึ่งของโมเดลรากฐานของอาลีบาบา – ซีรีส์ Wan2.1 – ซึ่งได้รับการออกแบบมาโดยเฉพาะเพื่อสร้างรูปภาพและวิดีโอคุณภาพสูงจากข้อความและรูปภาพ โมเดลนี้ได้รับการโอเพ่นซอร์สบน Hugging Face และ GitHub รวมถึง ModelScope ชุมชนโอเพนซอร์สของ Alibaba Cloud

โมเดลนี้แสดงให้เห็นถึงความสามารถที่โดดเด่นในการดําเนินการตามคําแนะนําของผู้ใช้รักษาความสอดคล้องระหว่างเฟรมแรกและวิดีโอที่สร้างขึ้นและส่งมอบการเปลี่ยนที่ราบรื่นระหว่างเฟรมแรกและเฟรมสุดท้ายเพื่อสร้างภาพที่สมจริงและเป็นธรรมชาติของการเคลื่อนไหวที่ซับซ้อน ช่วยให้ผู้ใช้สามารถสร้างวิดีโอความยาวห้าวินาทีที่ความละเอียด 720p ได้ฟรีเมื่อแจ้งโมเดลบนเว็บไซต์ทางการของ Wan

เทคโนโลยีหลักที่อยู่เบื้องหลังรุ่นนี้คือแนวทางใหม่ในการสร้างวิดีโอโดยรวมกลไกการปรับการควบคุมเพิ่มเติม กลไกนี้ใช้เฟรมแรกและเฟรมสุดท้ายที่ผู้ใช้ให้มาของซีเควนซ์เป็นเงื่อนไขการควบคุม ทําให้สามารถเปลี่ยนระหว่างเฟรมเริ่มต้นและเฟรมสิ้นสุดได้อย่างราบรื่นและแม่นยํา

กลไกนี้ช่วยแทรกคุณสมบัติความหมายจากเฟรมแรกและเฟรมสุดท้ายลงในกระบวนการสร้างทําให้โมเดลสามารถรักษาความสอดคล้องในรูปแบบเนื้อหาและโครงสร้างในขณะที่เปลี่ยนเฟรมแบบไดนามิก

ในฐานะหนึ่งในบริษัทเทคโนโลยีรายใหญ่ระดับโลกรายแรกๆ ที่โอเพ่นซอร์สโมเดล AI ขนาดใหญ่ที่พัฒนาขึ้นเอง ความมุ่งมั่นของ Alibaba Cloud ทําให้ Alibaba Cloud ได้โอเพ่นซอร์ส Wan2.1 สี่โมเดลในเดือนกุมภาพันธ์ 2025 โมเดลดังกล่าวได้รับการดาวน์โหลดมากกว่า 2.2 ล้านครั้งบน Hugging Face และ ModelScope

เปิดตัวเมื่อต้นปีนี้ ซีรีส์ Wan2.1 เป็นรุ่นวิดีโอรุ่นแรกที่รองรับเอฟเฟกต์ข้อความทั้งภาษาจีนและภาษาอังกฤษ มันอยู่ในอันดับต้น ๆ ของลีดเดอร์บอร์ด VBench ซึ่งเป็นชุดเกณฑ์มาตรฐานที่ครอบคลุมสําหรับโมเดลการสร้างวิดีโอ

Alibaba Cloud เปิดตัวโมเดลภาษาขนาดใหญ่แบบเปิด (LLM) Qwen-7B ตัวแรกในเดือนสิงหาคม 2023 โมเดลแบบเปิดของ Qwen ติดอันดับกระดานผู้นํา Hugging Face Open LLM อย่างต่อเนื่อง โดยประสิทธิภาพที่ตรงกับโมเดล AI ชั้นนําระดับโลกในเกณฑ์มาตรฐานต่างๆ

ในช่วงหลายปีที่ผ่านมา Alibaba Cloud ได้สร้างโมเดล AI เชิงกําเนิดมากกว่า 200 แบบเป็นโอเพนซอร์ส ณ ตอนนี้ โมเดลอนุพันธ์มากกว่า 100,000 รายการตามตระกูลโมเดล Qwen ได้รับการพัฒนาบน Hugging Face ทําให้เป็นหนึ่งในตระกูลโมเดล AI ที่โดดเด่นที่สุดทั่วโลก

พรอมต์: สไตล์ที่สมจริง ผู้หญิงในชุดกีฬาสีชมพูวิ่งผ่านถนนในเมือง กล้องจะซูมเข้าที่ใบหน้าของเธอก่อน จากนั้นจับภาพเธอเลี้ยวเข้าโค้งและวิ่งไปข้างหน้าในระยะไกล
พรอมต์: ศาลาแบบดั้งเดิมของจีนค่อยๆ เปลี่ยนเป็นสีชมพูการ์ตูน ในขณะที่ลูกโป่งเริ่มโผล่ออกมารอบๆ โดยถ่ายในภาพนิ่งโดยที่กล้องยังคงนิ่งอยู่

เลือกชมสินค้ามากมาย และให้เราสั่งซื้อสินค้าให้คุณ

SHOPPING MALL

อาลีบาบาเปิดตัวโมเดลการสร้างวิดีโอโอเพ่นซอร์สล่าสุด

เทคโนโลยี|เผยแพร่เมื่อ 18 เมษายน 2025
เผยแพร่เมื่อ 18 เมษายน 2025

อาลีบาบาได้เปิดตัวโมเดลการสร้างวิดีโอโอเพ่นซอร์สล่าสุด Wan2.1-FLF2V-14B ได้รับการออกแบบมาเพื่ออํานวยความสะดวกในการป้อนเฟรมเริ่มต้นและสิ้นสุดเพื่อลดความซับซ้อนในการสร้างวิดีโอ สิ่งนี้ช่วยให้ผู้สร้างวิดีโอสั้นสามารถควบคุมความคิดสร้างสรรค์ได้มากขึ้นโดยช่วยพวกเขาในการพัฒนาโมเดลและแอปพลิเคชัน AI ของตนเอง ทั้งอย่างมีประสิทธิภาพและราคาไม่แพง

โมเดลนี้เป็นส่วนหนึ่งของโมเดลรากฐานของอาลีบาบา – ซีรีส์ Wan2.1 – ซึ่งได้รับการออกแบบมาโดยเฉพาะเพื่อสร้างรูปภาพและวิดีโอคุณภาพสูงจากข้อความและรูปภาพ โมเดลนี้ได้รับการโอเพ่นซอร์สบน Hugging Face และ GitHub รวมถึง ModelScope ชุมชนโอเพนซอร์สของ Alibaba Cloud

โมเดลนี้แสดงให้เห็นถึงความสามารถที่โดดเด่นในการดําเนินการตามคําแนะนําของผู้ใช้รักษาความสอดคล้องระหว่างเฟรมแรกและวิดีโอที่สร้างขึ้นและส่งมอบการเปลี่ยนที่ราบรื่นระหว่างเฟรมแรกและเฟรมสุดท้ายเพื่อสร้างภาพที่สมจริงและเป็นธรรมชาติของการเคลื่อนไหวที่ซับซ้อน ช่วยให้ผู้ใช้สามารถสร้างวิดีโอความยาวห้าวินาทีที่ความละเอียด 720p ได้ฟรีเมื่อแจ้งโมเดลบนเว็บไซต์ทางการของ Wan

เทคโนโลยีหลักที่อยู่เบื้องหลังรุ่นนี้คือแนวทางใหม่ในการสร้างวิดีโอโดยรวมกลไกการปรับการควบคุมเพิ่มเติม กลไกนี้ใช้เฟรมแรกและเฟรมสุดท้ายที่ผู้ใช้ให้มาของซีเควนซ์เป็นเงื่อนไขการควบคุม ทําให้สามารถเปลี่ยนระหว่างเฟรมเริ่มต้นและเฟรมสิ้นสุดได้อย่างราบรื่นและแม่นยํา

กลไกนี้ช่วยแทรกคุณสมบัติความหมายจากเฟรมแรกและเฟรมสุดท้ายลงในกระบวนการสร้างทําให้โมเดลสามารถรักษาความสอดคล้องในรูปแบบเนื้อหาและโครงสร้างในขณะที่เปลี่ยนเฟรมแบบไดนามิก

ในฐานะหนึ่งในบริษัทเทคโนโลยีรายใหญ่ระดับโลกรายแรกๆ ที่โอเพ่นซอร์สโมเดล AI ขนาดใหญ่ที่พัฒนาขึ้นเอง ความมุ่งมั่นของ Alibaba Cloud ทําให้ Alibaba Cloud ได้โอเพ่นซอร์ส Wan2.1 สี่โมเดลในเดือนกุมภาพันธ์ 2025 โมเดลดังกล่าวได้รับการดาวน์โหลดมากกว่า 2.2 ล้านครั้งบน Hugging Face และ ModelScope

เปิดตัวเมื่อต้นปีนี้ ซีรีส์ Wan2.1 เป็นรุ่นวิดีโอรุ่นแรกที่รองรับเอฟเฟกต์ข้อความทั้งภาษาจีนและภาษาอังกฤษ มันอยู่ในอันดับต้น ๆ ของลีดเดอร์บอร์ด VBench ซึ่งเป็นชุดเกณฑ์มาตรฐานที่ครอบคลุมสําหรับโมเดลการสร้างวิดีโอ

Alibaba Cloud เปิดตัวโมเดลภาษาขนาดใหญ่แบบเปิด (LLM) Qwen-7B ตัวแรกในเดือนสิงหาคม 2023 โมเดลแบบเปิดของ Qwen ติดอันดับกระดานผู้นํา Hugging Face Open LLM อย่างต่อเนื่อง โดยประสิทธิภาพที่ตรงกับโมเดล AI ชั้นนําระดับโลกในเกณฑ์มาตรฐานต่างๆ

ในช่วงหลายปีที่ผ่านมา Alibaba Cloud ได้สร้างโมเดล AI เชิงกําเนิดมากกว่า 200 แบบเป็นโอเพนซอร์ส ณ ตอนนี้ โมเดลอนุพันธ์มากกว่า 100,000 รายการตามตระกูลโมเดล Qwen ได้รับการพัฒนาบน Hugging Face ทําให้เป็นหนึ่งในตระกูลโมเดล AI ที่โดดเด่นที่สุดทั่วโลก

พรอมต์: สไตล์ที่สมจริง ผู้หญิงในชุดกีฬาสีชมพูวิ่งผ่านถนนในเมือง กล้องจะซูมเข้าที่ใบหน้าของเธอก่อน จากนั้นจับภาพเธอเลี้ยวเข้าโค้งและวิ่งไปข้างหน้าในระยะไกล
พรอมต์: ศาลาแบบดั้งเดิมของจีนค่อยๆ เปลี่ยนเป็นสีชมพูการ์ตูน ในขณะที่ลูกโป่งเริ่มโผล่ออกมารอบๆ โดยถ่ายในภาพนิ่งโดยที่กล้องยังคงนิ่งอยู่

เลือกชมสินค้ามากมาย และให้เราสั่งซื้อให้คุณ

SHOPPING MALL

ให้เราสั่งซื้อสินค้าให้คุณ

SHOPPING MALL

คุณอาจชอบเนื้อหานี้

Privacy Preference Center