Google lên kế hoạch sản xuất chip mới để vận hành các mô hình Gemini hiệu quả hơn, theo báo cáo từ The Information
Ngày 20 tháng 7 Google đang phát triển một dòng chip máy chủ mới nhằm tích hợp trực tiếp các thành phần của mô hình Gemini vào phần cứng, trong một nỗ lực để cung cấp các mô hình AI của mình tới người dùng một cách hiệu quả hơn, theo báo cáo từ trang The Information vào thứ Hai dẫn nguồn từ những người am hiểu vấn đề.

Biểu tượng ứng dụng Gemini trong hình minh họa này được chụp vào ngày 5 tháng 6 năm 2026
Công ty thuộc sở hữu của Alphabet kỳ vọng dòng chip mới, được gọi tên không chính thức là "Frozen v2", sẽ giúp giải quyết tình trạng thiếu hụt năng lực điện toán AI — vấn đề vốn đã kích hoạt những căng thẳng nội bộ và khiến Google Cloud phải từ chối các thỏa thuận với các khách hàng bên ngoài, báo cáo cho biết.
Cổ phiếu của Alphabet đã tăng 3,3% trong phiên giao dịch đầu ngày.
Dưới đây là một số chi tiết:
Google có kế hoạch triển khai dòng chip này sớm nhất là vào năm 2028, mặc dù các kỹ sư vẫn đang hoàn thiện thiết kế của nó cũng như dung lượng thông tin mô hình sẽ được tích hợp cứng vào phần cứng, theo báo cáo.
Dòng chip này có thể hiệu quả gấp 6 đến 10 lần so với các dòng chip AI tùy chỉnh mới nhất của Google tính trên số lượng token AI được phục vụ trên mỗi đơn vị điện năng tiêu thụ, theo báo cáo.
"Các đội ngũ của chúng tôi liên tục nghiên cứu và thử nghiệm những đổi mới mới... Bằng cách đồng thiết kế cả phần cứng lẫn phần mềm ngay từ đầu, chúng tôi đảm bảo các hệ thống của mình được tích hợp và tối ưu hóa ở mức cao," một phát ngôn viên của Google Cloud cho biết.
Dự án 'Frozen' hướng tới việc tạo ra một tập hợp chip tự phát triển mới tách biệt với các bộ xử lý tensor (TPU) của Google, chứ không phải để thay thế chúng, báo cáo thông tin thêm.
Bloomberg News tuần trước từng đưa tin rằng Google đã hoãn ra mắt mô hình AI Gemini mới nhất sau khi nó không đạt được các mục tiêu nội bộ, và công ty đang nỗ lực cải thiện các năng lực của mô hình này, đặc biệt là trong mảng viết mã (coding).
