Deepseek Ra V4 Flash 0731, Hiệu Năng Gần GPT-5.6 Luna Với Chi Phí Thấp Hơn
1 phút đọc

V4 Flash “0731” là nâng cấp lớn so với V4 Flash ra mắt tháng 4 năm 2026, và đạt 50 điểm theo Artificial Analysis Intelligence Index, cao hơn 10 điểm so với bản trước.
Điểm của model chỉ kém GPT-5.6 Luna một điểm, trong khi chi phí mỗi tác vụ của V4 Flash thấp hơn khoảng 60%, kể cả sau khi OpenAI giảm giá 80% cho Luna.
Một yếu tố quan trọng giúp giảm chi phí là mức giảm cache của Deepseek là 98%, cao hơn mức 90% được nêu là chuẩn ngành. Model cũng dùng ít hơn 12% token so với phiên bản trước.
Trên các bài kiểm tra, V4 Flash cải thiện ở mọi hạng mục so với bản trước, tiến bộ rõ nhất ở tác vụ agentic. Trên bộ đánh giá GDPval dành cho công việc văn phòng phức tạp, điểm của nó tăng từ 1.189 lên 1.559 Elo.
Kiến trúc của model giữ nguyên: tổng 284 tỉ tham số, 13 tỉ tham số hoạt động, với cửa sổ ngữ cảnh một triệu token. Trọng số model được phát hành theo giấy phép MIT trên Hugging Face.
Nguồn
- New Deepseek Flash model matches OpenAI's GPT-5.6 Luna at roughly 60 percent lower cost— The Decoder, 31 tháng 7, 2026