Google ra mắt liền lúc hai loại TPU, lần đầu tiên tách riêng chip huấn luyện và suy luận, doanh nghiệp triển khai rộng rãi AI Agent
Google Cloud, thuộc Alphabet, đã tung ra hàng loạt sản phẩm tại hội nghị thường niên dành cho nhà phát triển, giới thiệu đồng thời thế hệ chip tự phát triển mới và bộ công cụ AI tác vụ dành cho doanh nghiệp, đồng thời tấn công cả ở mặt trận phần cứng lẫn phần mềm nhằm thách thức Nvidia, OpenAI và Anthropic.
Vào thứ Tư theo giờ địa phương, tại hội nghị Google Cloud Next 2026 diễn ra ở Las Vegas, Google Cloud đã ra mắt hai sản phẩm mới thuộc thế hệ vi xử lý tensor (TPU) thứ tám: TPU 8T dành riêng cho huấn luyện mô hình AI, và TPU 8i tối ưu cho giai đoạn suy luận (inference), dự kiến ra mắt vào cuối năm nay. Đây là lần đầu tiên Google tách biệt nhiệm vụ huấn luyện và suy luận trên các chip độc lập, đánh dấu một bước ngoặt lớn trong chiến lược phần cứng AI của hãng.

Cùng lúc đó, Google còn cho ra mắt loạt công cụ phát triển AI tác vụ như nền tảng Gemini Enterprise Agent, trực tiếp nhắm vào thị trường tự động hóa doanh nghiệp.
Việc ra mắt chip mới diễn ra trong bối cảnh nhu cầu suy luận AI gia tăng mạnh mẽ. Phó Chủ tịch mảng Điện toán đám mây và hạ tầng AI của Google Cloud, Mark Lohmeyer, chia sẻ: "Điều cốt lõi là làm sao có thể đạt được độ trễ phản hồi tối thiểu với chi phí trên mỗi giao dịch thấp nhất. Lượng giao dịch đang tăng vọt, và chi phí cho mỗi lần phải giảm mạnh để mở rộng quy mô." Hai mẫu chip mới sẽ chính thức ra mắt vào cuối năm nay.
Tách rời huấn luyện và suy luận, hiệu năng chip tăng vọt
Việc Google tách thế hệ TPU thứ tám thành hai sản phẩm độc lập lần này là phản ứng trực tiếp với xu hướng phân mảnh ngày càng tăng của khối lượng công việc AI.
Phó Chủ tịch cao cấp kiêm Giám đốc công nghệ AI và hạ tầng của Google, Amin Vahdat, viết trên blog: "Với sự phát triển của AI tác vụ, chúng tôi nhận thấy ngành công nghiệp sẽ hưởng lợi lớn từ việc tối ưu hóa chip riêng biệt cho nhu cầu huấn luyện và suy luận."
TPU 8t được tối ưu hóa chuyên biệt cho quá trình huấn luyện mô hình AI, được quảng bá có thể 'rút ngắn chu kỳ phát triển mô hình tiên tiến từ vài tháng còn vài tuần'.
Về hiệu năng, mỗi watt của TPU 8t tăng 124% so với thế hệ trước, trong khi TPU 8i tăng 117%. So với Ironwood TPU thế hệ thứ bảy ra mắt tháng 11 năm ngoái, TPU 8t tăng hiệu năng 2,8 lần với cùng mức giá, còn TPU 8i tăng 80%.
Chip huấn luyện TPU 8t có thể kết hợp tối đa 9600 chip tạo thành một hệ thống. Google cho biết, khi triển khai hệ thống quy mô lớn như vậy, năng lượng điện trở thành yếu tố giới hạn then chốt tại trung tâm dữ liệu, vì thế hiệu quả năng lượng cao là vô cùng quan trọng.
TPU 8i chủ yếu phục vụ cho các tình huống suy luận, thích hợp để chạy mô hình AI và xử lý tác vụ AI agent. Thiết kế kiến trúc tập trung vào bộ nhớ tích hợp dung lượng lớn. Mỗi chip có 384MB SRAM, gấp ba lần so với Ironwood thế hệ trước.
Cả hai mẫu chip đều dự kiến mở bán vào cuối năm 2026.
Giám đốc điều hành Alphabet, Sundar Pichai, cho biết trên blog rằng kiến trúc này nhằm mục tiêu "cung cấp hiệu suất truyền tải lớn và độ trễ thấp cho hàng triệu AI agent chạy đồng thời với chi phí hợp lý". Việc tăng cường bộ nhớ tích hợp có nghĩa chip không cần phải liên tục truy xuất dữ liệu bên ngoài, đặc biệt quan trọng đối với các tác vụ AI yêu cầu suy luận nhiều bước.
Nền tảng AI agent mở rộng toàn diện, đối đầu trực diện OpenAI và Anthropic
Trên mặt trận phần mềm, Google lần này công bố một bộ công cụ AI agent hoàn chỉnh dành cho doanh nghiệp, trực tiếp đối đầu với chiến lược xâm lấn thị trường doanh nghiệp của OpenAI và Anthropic.
Theo Bloomberg, nhiều nhà sáng lập khởi nghiệp cho biết kỹ sư từ Silicon Valley thường chỉ chuyển đổi giữa Claude Code của Anthropic và Codex của OpenAI khi chọn công cụ lập trình AI, còn Google hiếm khi là lựa chọn - thực tế này khiến lãnh đạo Google cực kỳ lo ngại.
CEO Google Cloud, Thomas Kurian, nói trên blog: "Đây không phải là cung cấp các dịch vụ đơn lẻ có thể ghép lại với nhau, mà là cung cấp một nền tảng đổi mới toàn diện làm xương sống."
Nền tảng Gemini Enterprise Agent mới tích hợp thêm tính năng Memory Bank và Memory Profile, giúp agent ghi nhớ các tương tác lịch sử với người dùng, bù đắp khiếm khuyết về trí nhớ của các công cụ AI giai đoạn đầu; chức năng Agent Simulation cho phép nhà phát triển kiểm thử kỹ lưỡng hơn trước khi sản phẩm ra mắt.
Google cũng ra mắt nền tảng cộng tác Projects, tích hợp dữ liệu từ Workspace, Microsoft OneDrive và các công cụ trò chuyện nội bộ của doanh nghiệp, nhằm cung cấp ngữ cảnh cần thiết cho AI agent. Ngoài ra, hãng còn giới thiệu ứng dụng Gemini Enterprise dành cho nhân viên phổ thông, được định vị là "AI trước mặt cho mỗi nhân viên", cho phép người dùng tạo AI agent mà không cần viết mã.
TPU thúc đẩy thương mại hóa, song song hợp tác với Nvidia
Dù Google tiếp tục đầu tư mạnh vào chip tự nghiên cứu, hợp tác với Nvidia vẫn không bị gián đoạn.
Mark Lohmeyer cho biết Google dự định là một trong những bên đầu tiên triển khai thế hệ chip mới của Nvidia vào nửa cuối năm nay, đồng thời tiếp tục phục vụ các khách hàng muốn sử dụng hệ thống Nvidia.
Bên cạnh đó, việc thương mại hóa TPU của Google cũng đang tăng tốc.
Quỹ đầu cơ Citadel Securities đã phát triển phần mềm nghiên cứu định lượng dựa trên TPU của Google; toàn bộ 17 phòng thí nghiệm quốc gia trực thuộc Bộ Năng lượng Mỹ đều sử dụng phần mềm nhà khoa học hợp tác AI phát triển trên nền tảng TPU. Meta đã ký hợp đồng nhiều năm trị giá hàng tỷ đô với Google về việc sử dụng TPU, và AI startup Anthropic cũng cam kết tận dụng hàng gigawatt năng lực tính toán TPU của Google.
Nhà phân tích của DA Davidson năm ngoái ước tính mảng kinh doanh TPU cùng bộ phận DeepMind AI của Google có tổng giá trị khoảng 900 tỷ USD.
Lưu ý, Google không đưa ra so sánh trực tiếp hiệu năng chip mới với sản phẩm của Nvidia. Về phía Nvidia, dòng sản phẩm sắp ra mắt sẽ tích hợp công nghệ từ thương vụ mua lại Groq trị giá 20 tỷ USD, tập trung vào các tình huống suy luận siêu độ trễ thấp.
CEO Nvidia, Jensen Huang, từng cho biết hơn 20% khối lượng công việc AI có thể phù hợp nhất để vận hành trên các loại chip như vậy. Groq do một nhóm kỹ sư cũ của Google thành lập từ 2016.
Để mở rộng hơn nữa khả năng tiếp cận TPU, Google hiện cũng thử nghiệm phương án triển khai TPU tại trung tâm dữ liệu của khách hàng, cũng như nâng cao khả năng tương thích với phần mềm của bên thứ ba. Tuy nhiên, nút thắt về nguồn cung chip cùng sự bất đồng giữa tốc độ phát triển nhanh của mô hình AI và chu kỳ phát triển chip nhiều năm vẫn là những bất định lớn Google phải đối mặt trên hành trình mở rộng quy mô.
Tuyên bố miễn trừ trách nhiệm: Mọi thông tin trong bài viết đều thể hiện quan điểm của tác giả và không liên quan đến nền tảng. Bài viết này không nhằm mục đích tham khảo để đưa ra quyết định đầu tư.
Bạn cũng có thể thích
Doanh thu và lợi nhuận quý III của Adobe đều vượt kỳ vọng, AI thúc đẩy số lượng người dùng hoạt động hàng tháng vượt 1 tỷ, hướng dẫn quý IV không đủ "gây bất ngờ"|Báo cáo tài chính
Doanh thu quý III của Adobe đạt 6,76 tỷ USD, tăng 13% so với cùng kỳ năm ngoái, vượt mức dự báo trung bình của các nhà phân tích là 6,7 tỷ USD; thu nhập trên mỗi cổ phiếu không theo GAAP sau điều chỉnh là 6,13 USD, cao hơn kỳ vọng thị trường là 6,08 USD. Công ty đã nâng mức hướng dẫn EPS điều chỉnh cả năm lên khoảng từ 24,45 đến 24,50 USD, đồng thời tăng nhẹ mục tiêu doanh thu cả năm lên mức cao hơn. Tuy nhiên, dự báo doanh thu quý IV lại thấp hơn một chút so với kỳ vọng của các nhà phân tích, khiến giá cổ phiếu giảm khoảng 2% sau giờ giao dịch.
Lực lượng Houthi chiếm giữ cảng quan trọng ở Biển Đỏ, xung đột với Saudi Arabia leo thang, Iran bị tiết lộ đã nối lại sản xuất tên lửa đạn đạo, giá dầu thô tăng hơn 7% trong phiên giao dịch.
Một sĩ quan quân đội Yemen cho biết, thành phố cảng chiến lược Mukha ở tỉnh Taiz, phía tây nam Yemen, đã bị lực lượng Houthis chiếm đóng vào thứ Năm. Lực lượng Houthis Yemen cho biết Saudi Arabia đã tiến hành 64 cuộc không kích trên nhiều khu vực của Yemen trong vòng 24 giờ qua; hoạt động hàng hải ở Biển Đỏ "không bị đe dọa", các hoạt động quân sự của họ là hành động phòng vệ. Theo những người trong ngành hàng hải, việc chiếm được Mukha sẽ giúp lực lượng Houthis tiếp tục tiến về phía nam và "gần như kiểm soát hoàn toàn" eo biển Bab-el-Mandeb; việc Mukha thất thủ chắc chắn sẽ ảnh hưởng đến an ninh hàng hải của khu vực này.
SpaceX điều chỉnh toàn diện mô hình xây dựng trung tâm dữ liệu AI: mở rộng chậm lại, tăng cường độ tin cậy
Theo các báo cáo truyền thông, Elon Musk đã thực hiện những điều chỉnh lớn đối với ban quản lý trung tâm dữ liệu, giao cho một người kỳ cựu trong lĩnh vực tên lửa làm người đứng đầu. Nhóm quản lý mới yêu cầu thực hiện các bài kiểm tra toàn diện hơn trước khi trung tâm dữ liệu đi vào vận hành, lắp đặt thêm nhiều hệ thống dự phòng về điện và làm mát, hy sinh tốc độ xây dựng để đổi lấy độ tin cậy cao hơn. Tuần trước, sự cố mất điện tại trung tâm dữ liệu Memphis đã khiến một số mô hình Grok tạm ngừng hoạt động và gây tác động lan truyền đến các khách hàng thuê năng lực tính toán như Anthropic, Google.
Bộ Tài chính Mỹ thực hiện mua lại trái phiếu dài hạn trị giá hơn 5 tỷ USD, áp lực bán trái phiếu Mỹ vẫn không giảm, lợi suất trái phiếu kỳ hạn 10 năm tiến sát 5%
60 tỷ USD vẫn là một con số hạn chế đối với thị trường trái phiếu chính phủ Mỹ có quy mô khoảng 32 nghìn tỷ USD, và chưa đạt được "hiệu ứng chấn động" như kỳ vọng của một số nhà đầu tư trước đó. Các chiến lược gia của Deutsche Bank nhận định, điều này giống như Bộ Tài chính đã "tạo ra một con quái vật mà giờ phải không ngừng nuôi dưỡng."
