Làm Chủ AI
Tin AI

Google Phát Triển Chip 'Frozen V2' Nhúng Kiến Trúc Gemini Vào Phần Cứng

2 phút đọc

Google phát triển chip 'Frozen v2' nhúng kiến trúc Gemini vào phần cứng

Theo The Information, Frozen v2 sẽ nhúng một phần cấu trúc model Gemini vào phần cứng thay vì chỉ chạy như các TPU hiện tại. Ý tưởng này tương tự khái niệm 'đóng băng' tham số trong model AI, nhưng Frozen v2 nhắm đóng băng kiến trúc thay vì trọng số.

Nguồn tin cho biết cách làm này giảm bước tính toán và đẩy nhanh tốc độ phản hồi, với lợi hiệu năng có thể ở khoảng 6 đến 10 lần so với các TPU hiện tại của Google. Google dự kiến bắt đầu triển khai Frozen v2 từ năm 2028 và xem đây là thử nghiệm cho các chip chuyên dụng với quy mô sản xuất nhỏ hơn dòng TPU.

The Information nói rằng thiết kế ban đầu do Jeff Dean đề xuất từng định nhúng trọng số trực tiếp vào chip, nhưng ý tưởng đó bị bỏ vì chip sẽ chỉ phù hợp với một phiên bản Gemini và nhanh lỗi thời. Frozen v2 cho phép nạp trọng số mới lên chip vì chỉ phần kiến trúc được nhúng cố định.

Bài viết cũng nêu rằng vì chip chỉ hoạt động khi Google giữ nguyên kiến trúc model, Frozen v2 có thể không trở thành sản phẩm cho khách hàng bên ngoài như TPU hiện được cho thuê hoặc cung cấp qua chương trình TPU@Premises. Google dự định dùng Frozen v2 để giảm sức ép nhu cầu năng lực tính toán nội bộ.

Nguồn

Đọc tiếp trong Tin AI