Alibaba Ra Mắt Wan3.0 Tạo Video AI Dài 30 Giây Từ Văn Bản, Hình Ảnh Và Tài Liệu
2 phút đọc

Wan3.0 hiện có ở bản beta và cho phép tạo video dài tối đa 30 giây, gấp đôi so với người tiền nhiệm Wan2.5. Model có thể đề xuất độ dài video phù hợp dựa trên câu lệnh của người dùng và có công cụ mở rộng để kéo dài video hiện có.
Model xử lý đồng thời văn bản, hình ảnh, video và âm thanh. Một câu lệnh có thể bao gồm tối đa 10 hình ảnh, 5 video và 5 đoạn âm thanh. Trang web, PDF và file PowerPoint cũng có thể được dùng làm nguồn đầu vào để biến dữ liệu tĩnh thành video động.
Alibaba cho biết Wan3.0 hướng tới việc giữ chi tiết tham chiếu như nhân vật, đạo cụ và bố cục không gian đồng nhất hơn để giảm hiện tượng sai lệch hình ảnh và méo mó, đặc biệt ở khuôn mặt và giao diện người dùng.
Wan3.0 có thể truy cập qua trang wan.video, Alibaba Cloud Model Studio, hoặc qua API trên Qwen Cloud. Sản phẩm được cung cấp hai tầng: bản Standard đang được giảm giá 30% và bản Prime nhanh hơn.
Alibaba giới thiệu Wan3.0 trong bối cảnh tăng cường chi tiêu cho AI; công ty vừa thông báo đợt chào bán cổ phiếu lớn nhất của một công ty niêm yết ở Hồng Kông để tài trợ cho hoạt động AI, và tuần trước báo cáo lợi nhuận quý giảm 75% theo năm do chi đầu tư vào AI tăng mạnh.
Nguồn
- Alibaba's Wan3.0 generates AI videos up to 30 seconds long from text, images, and documents— The Decoder, 24 tháng 8, 2026