[비즈한국] Microsoft (MS) vừa ra mắt bộ tăng tốc trí tuệ nhân tạo (AI) tự phát triển mới nhất được tối ưu hóa cho suy luận. Trong bối cảnh các nhà cung cấp dịch vụ đám mây quy mô lớn (hyperscalers) như Google và Amazon Web Services (AWS) đang tìm cách giảm sự phụ thuộc vào Nvidia, Microsoft cũng đã gia nhập cuộc đua tự phát triển chip AI tùy chỉnh. Đây là lần ra mắt sản phẩm mới sau khoảng 2 năm kể từ khi công bố chip AI đầu tiên 'Maia 100' vào tháng 11 năm 2023.

Ngày 26 (giờ địa phương), MS thông báo đã ra mắt 'Maia 200', bộ tăng tốc thế hệ mới giúp nâng cao hiệu suất suy luận AI tạo sinh. Được sản xuất dựa trên tiến trình 3 nanomet (㎚) của TSMC, Maia 200 có đặc điểm là cải thiện tính kinh tế trong việc tạo ra các 'token', đơn vị cơ bản của suy luận AI.
MS nhấn mạnh Maia 200 là “bộ vi xử lý do hyperscaler tự phát triển có hiệu suất mạnh mẽ nhất hiện nay”. Theo giải thích, hiệu suất tính toán nhẹ (FP4) của Maia 200 phục vụ việc tạo câu trả lời AI cao gấp 3 lần so với chip 'Trainium' thế hệ thứ 3 của Amazon, đồng thời có hiệu suất tính toán cao hơn cả bộ xử lý tensor (TPU) thế hệ thứ 7 'Ironwood' của Google.
CEO Satya Nadella cho biết: “Được thiết kế để đạt hiệu suất suy luận hàng đầu ngành, sản phẩm này có hiệu suất trên mỗi đô la cao hơn 30% so với các hệ thống hiện có”.
Ngay khi ra mắt, Maia 200 được kỳ vọng sẽ đóng vai trò là 'trụ cột' chống đỡ hệ sinh thái AI khổng lồ mà Microsoft dày công xây dựng. Chip này sẽ đảm nhận hạ tầng suy luận cho các mô hình cao cấp như GPT-5.2 (mô hình thế hệ mới của OpenAI) và trợ lý AI 'Copilot' của riêng Microsoft, từ đó tối đa hóa hiệu suất tính toán cho toàn bộ hạ tầng đám mây Azure.
Tốc độ ứng dụng phần cứng thực tế cũng diễn ra rất nhanh. Microsoft đã bắt đầu triển khai và vận hành Maia 200 tại trung tâm dữ liệu ở bang Iowa, Mỹ, và có kế hoạch mở rộng phạm vi áp dụng sang các khu vực trọng điểm phía Tây như Phoenix, bang Arizona trong tương lai. Mục tiêu của chiến lược này là đảm bảo khách hàng Azure trên toàn cầu có thể sử dụng các dịch vụ hiệu năng cao dựa trên bộ tăng tốc AI độc lập một cách ổn định.
Sự đổi mới ở cấp độ hệ thống cũng rất đáng chú ý. Maia 200 áp dụng thiết kế mạng mở rộng (scale-up) 2 lớp độc lập dựa trên Ethernet tiêu chuẩn. Nó cung cấp băng thông hai chiều 2,8TB/s mỗi chip, cho phép thực hiện các tác vụ suy luận quy mô lớn một cách hiệu quả thông qua việc kết nối tới 6.144 bộ tăng tốc trong một cụm lớn.
Trước đó, Microsoft đã công bố Maia 100 vào tháng 11 năm 2023. Tuy nhiên, Maia 100 chỉ được tích hợp vào đám mây Azure để sử dụng nội bộ chứ không cung cấp cho khách hàng bên ngoài, dẫn đến tác động thị trường hạn chế. Do đó, Microsoft từng bị đánh giá là đi sau các đối thủ như Amazon và Google trong thị trường chip tự phát triển.
Với việc tung ra thị trường chip thương mại thực tế đầu tiên là Maia 200, Microsoft dự kiến sẽ tăng cường vị thế dẫn đầu trong thị trường hạ tầng AI. Dựa trên lộ trình ứng dụng bộ tăng tốc thế hệ mới này, Microsoft đặt mục tiêu nâng cao hiệu quả sử dụng điện năng và cắt giảm tổng chi phí sở hữu (TCO).
Trong ngày hôm nay, sau khi có báo cáo từ truyền thông Hàn Quốc rằng SK Hynix000660 sẽ trở thành đơn vị cung cấp độc quyền HBM (bộ nhớ băng thông cao) cho Maia 200, giá cổ phiếu của SK Hynix đã đảo chiều tăng ngay cả khi có phát biểu về 'phục hồi thuế quan tương hỗ' từ Tổng thống Mỹ Donald Trump. Việc giành được ưu thế cung ứng cho lượng HBM3E trong Maia 200 được giải thích là sự kết hợp giữa tin tốt về đơn hàng lớn và kỳ vọng về kết quả kinh doanh. Tính đến 11:30 sáng ngày 27, cổ phiếu của SK Hynix đang giao dịch ở mức 775.000 won, tăng 5,29% (39.000 won) so với phiên giao dịch trước đó.