Google lên kế hoạch chip AI thế hệ v2 “Frozen” được đóng băng để tích hợp, nhằm nhúng kiến trúc Gemini; có thể giúp nâng hiệu suất suy luận lên 6–10 lần vào năm 2028

Theo Beating, Google đang phát triển chip suy luận AI Frozen v2, trong đó tích hợp một phần kiến trúc của Gemini trực tiếp vào phần cứng để giảm chi phí tính toán và việc truyền dữ liệu trong quá trình mô hình vận hành. Chip này được kỳ vọng có thể xử lý lượng token nhiều hơn từ 6 đến 10 lần mỗi watt so với TPU mới nhất của Google, với kế hoạch triển khai sớm nhất có thể vào năm 2028.

Sáng kiến này nhằm giải quyết tình trạng thiếu chip ngày càng trầm trọng của Google, vốn đã buộc Google Cloud phải từ chối các đơn đặt hàng từ khách hàng bên ngoài. Frozen v2 sẽ hoạt động song song với TPU; trong khi TPU hỗ trợ nhiều loại mô hình, Frozen v2 ưu tiên hiệu suất hơn là tính linh hoạt.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể đến từ các nguồn bên thứ ba và chỉ mang tính chất tham khảo. Thông tin này không phản ánh quan điểm hoặc ý kiến của Gate và không cấu thành bất kỳ lời khuyên tài chính, đầu tư hoặc pháp lý nào. Giao dịch tài sản ảo tiềm ẩn rủi ro cao. Vui lòng không chỉ dựa vào thông tin trên trang này khi đưa ra quyết định. Để biết thêm chi tiết, vui lòng xem Tuyên bố miễn trừ trách nhiệm.
Bình luận
0/400
Không có bình luận