Làm Chủ AI
Tin AI

Alibaba Ra Qwen-Image-3.0, Tạo Lưới Infographic Nhiều Ô Và Chữ 10 Pixel Trong Một Lần Xử Lý

2 phút đọc

Alibaba ra Qwen-Image-3.0, tạo lưới infographic nhiều ô và chữ 10 pixel trong một lần xử lý

Theo Qwen, phiên bản thứ nhất tập trung vào "độ chính xác", phiên bản hai nhắm đến "độ chính xác, đa dạng, hoàn chỉnh, đẹp và tính xác thực", còn phiên bản ba tóm gọn mục tiêu bằng từ "Thực" và hướng tới công việc thực tế như bố cục báo, storyboard và đề kiểm tra.

Qwen-Image-3.0 chấp nhận câu lệnh dài tối đa 4.500 token, giúp model tạo bố cục dày đặc trong một lần thay vì ghép từ nhiều hình. Một bản demo ghép chín infographic riêng biệt thành lưới 3 x 3, mỗi ô chứa văn bản, công thức và minh họa riêng.

Nhóm phát triển cho biết model có thể hiển thị chữ đọc được nhỏ đến 10 pixel; ví dụ gồm infographic cá mập voi đầy chữ và một trang giả lập bài báo hình học đại số với các phương trình LaTeX nhiều dòng. Các demo khác gồm trang báo giả lập, chú thích viết tay màu đỏ, và sửa một bức tranh mực truyền thống bị hỏng sao cho khớp nét vẽ và độ đậm mực.

Qwen-Image-3.0 cũng nhắm tới chi tiết như ảnh và chân dung với lỗ chân lông, kết cấu da và sợi tóc, đồng thời hỗ trợ 12 ngôn ngữ bản địa, trong đó có tiếng Nhật, tiếng Hàn và tiếng Tây Ban Nha. Các ví dụ công bố còn cho thấy model tái tạo giao diện website, game và livestream, kéo dữ liệu internet trực tiếp để sinh nội dung như dự báo thời tiết cho Hàng Châu.

Nguồn

Đọc tiếp trong Tin AI