Microsoft tăng hiệu suất ChatGPT với chip AI nội bộ, có thể cạnh tranh với Nvidia và Intel
Gia Linh
18/11/2023
Microsoft đã cho ra mắt hai loại chip mới là Maia 100 và Cobalt 100 Arm tại sự kiện Ignite, Seattle…
Trong sự kiện gần đây, Microsoft đã cho ra mắt hai loại chip AI nội bộ, nhằm mục đích tăng hiệu suất các sản phẩm AI như ChatGPT và giảm thiểu chi phí. Trong đó, chip AI Maia 100 được sử dụng để xử lý đồ họa AI, dùng trong các trung tâm dữ liệu, có thể cạnh tranh với chip do Nvidia sản xuất,. Với chip còn lại là Cobalt 100 Arm thì có những tác vụ tính toán, sử dụng trong các dịch vụ phần mềm dựa trên đám mây, nhằm cạnh tranh với bộ vi xử lý của Intel.
Việc gia công hàng loạt loại chip trên sẽ được thực hiện bởi công ty sản xuất chip Đài Loan, nhà sản xuất chip theo hợp đồng lớn nhất thế giới. Theo như chia sẻ của bà Rani Borkar, Phó Chủ tịch công ty trong một buổi phỏng vấn với CNBC, phiên bản máy ảo chạy trên chip Cobalt sẽ có sẵn trên thị trường thông qua đám mây Azure của Microsoft vào năm 2024. Tuy nhiên thời gian cụ thể phát hành chip Maia 100 vẫn chưa được thông báo.
Hiện nay, việc áp dụng bộ xử lý Cobalt đang tiến hành nhanh hơn so với việc thử nghiệm chip AI Maia 100. Gã khổng lồ công nghệ này đã cho chạy thử ứng dụng Teams và dịch vụ cơ sở dữ liệu Azure SQL trên bộ chip mới. Và cho đến nay, chúng đã hoạt động tốt hơn cỡ 40% so với chip dựa trên Arm hiện có của Azure đến từ công ty khởi nghiệp Ampere.
Microsoft đang thử nghiệm cách Maia 100 đáp ứng nhu cầu của chatbot AI của công cụ tìm kiếm Bing (hiện được gọi là Copilot thay vì Bing Chat), trợ lý mã hóa GitHub Copilot và GPT-3.5-Turbo, một mô hình ngôn ngữ lớn từ OpenAI do Microsoft hậu thuẫn. OpenAI đã cung cấp cho các mô hình ngôn ngữ của mình một lượng lớn thông tin từ internet và chúng có thể tạo email, tóm tắt tài liệu và trả lời các câu hỏi bằng một vài lời hướng dẫn của con người.
Ngoài việc thiết kế chip Maia, Microsoft còn phát minh ra phần cứng làm mát bằng chất lỏng tùy chỉnh có tên Sidekicks, đặt vừa trong các giá đỡ ngay cạnh các giá đỡ chứa máy chủ Maia.
Với GPU, việc tận dụng tối đa không gian hạn chế của trung tâm dữ liệu có thể đặt ra nhiều thách thức. Steve Tuck, đồng sáng lập và CEO của công ty khởi nghiệp máy chủ Oxide Computer, cho biết: Các công ty đôi khi đặt một vài máy chủ chứa GPU ở dưới cùng của giá đỡ để tránh tình trạng quá nóng, thay vì chất đầy giá từ trên xuống dưới.
Các công ty công nghệ giàu tiền mặt đã bắt đầu cung cấp cho khách hàng của họ nhiều lựa chọn hơn về cơ sở hạ tầng đám mây mà họ có thể sử dụng để chạy các ứng dụng. Việc sản xuất phần cứng AI nội bộ cho phép các công ty tăng hiệu quả xử lý dữ liệu và khả năng cạnh tranh của các dịch vụ như chatbot và phần mềm xử lý hình ảnh.
Nvidia có trụ sở tại Mỹ nắm giữ khoảng 80% thị trường chip AI. Nhu cầu đã tăng vọt cùng với sự bùng nổ của AI, với những con chip tiên tiến đôi khi được bán với giá từ 30.000 đến 40.000 USD. Đã có khoảng 10.000 con chip được cho là đã được sử dụng để phát triển ChatGPT, khiến chi phí của chúng trở thành gánh nặng đáng kể đối với các công ty AI.
Microsoft trước đây từng tham gia phát triển chip bán dẫn, chủ yếu dành cho máy chơi game và thực tế tăng cường. Nhưng phải đến động thái gần đây nhất mới thể hiện rõ sự thâm nhập toàn diện vào lĩnh vực này của gã khổng lồ, kết hợp các chip nội bộ vào cơ sở hạ tầng đóng vai trò là xương sống của phần mềm kinh doanh của họ.
Microsoft có liên minh kinh doanh và vốn với nhà phát triển OpenAI tại Mỹ của Chat GPT, cho phép công ty này cung cấp công nghệ AI của công ty khởi nghiệp cho các công ty và khách hàng khác thông qua đám mây và kết hợp AI vào công cụ tìm kiếm Bing của mình.
Hầu hết các dịch vụ AI đều dựa trên máy chủ của trung tâm dữ liệu. Bằng cách sử dụng các chip nội bộ chuyên dụng cho AI tổng quát trong các trung tâm dữ liệu của mình, Microsoft đặt mục tiêu vừa cải thiện hiệu suất vừa giảm chi phí mua sắm và vận hành.
Truyền thông Mỹ đưa tin, việc sử dụng chip nội bộ có thể giảm 1/3 chi phí vận hành các dịch vụ AI.
Tại sự kiện Ignite mới đây, Microsoft cũng đã công bố giới thiệu các chức năng AI cho phần mềm kinh doanh 365 của mình và sự hợp tác mới với các công ty chip lớn như Advanced Micro Devices và Nvidia.
Công ty cũng thông báo triển khai AI GPT-4 Turbo mới nhất của OpenAI, có thể xử lý các lời nhắc dài hơn.
Từ khóa:
Trong cuộc đua AI với Mỹ, Trung Quốc đang nổi lên như một trung tâm nghiên cứu và phát triển AI hàng đầu, nhưng vẫn gặp khó trong việc thu hút các nhà nghiên cứu nước ngoài, dù chính phủ đã đưa việc tuyển dụng nhân tài quốc tế trở thành một ưu tiên…
Thay vì trở thành “kẻ hủy diệt” tiền mã hóa, máy tính lượng tử có thể tạo động lực để hệ thống tài chính truyền thống chuyển sang những nền tảng blockchain đã được chuẩn bị cho kỷ nguyên hậu lượng tử…
Các ứng dụng giao hàng tức thời đang thay đổi khái niệm về sự tiện lợi tại Trung Quốc, khi người tiêu dùng có thể nhận đồ uống, nhu yếu phẩm và nhiều mặt hàng khác ngay tại nhà chỉ sau vài phút, với chi phí giao hàng chưa đến 1 USD…
Trí tuệ nhân tạo (AI) đang giúp tội phạm mạng nâng cao tốc độ và quy mô của những thủ đoạn vốn đã tồn tại, từ lừa đảo đến gian lận, khiến các cuộc tấn công trở nên khó nhận diện hơn...
Một số ngân hàng Trung Quốc đang triển khai các hướng dẫn của cơ quan quản lý và dự kiến ban hành những quy định quản trị AI…
Số tin tuyển dụng đề cập đến “agent orchestration” - kỹ năng thiết kế và điều phối nhiều AI agent cùng thực hiện một nhiệm vụ - tăng tới 1.721%. Đây là kỹ năng nóng nhất hiện nay…
Goldman Sachs Research dự báo tổng đầu tư toàn cầu cho AI sẽ vượt 1.000 tỷ USD trong năm 2026. Bain ước tính đầu tư xây dựng trung tâm dữ liệu toàn cầu có thể đạt 5.000-6.500 tỷ USD vào năm 2030...
Ngành bán dẫn đang trở thành một trong những động lực tăng trưởng mới của Singapore, khi làn sóng AI thúc đẩy nhu cầu chip, thiết bị điện tử và hạ tầng trung tâm dữ liệu…
Ấn Độ đang chuẩn bị huy động khoảng 25 tỷ USD để hỗ trợ các startup công nghệ sâu (Deep Tech), trong nỗ lực thu hẹp khoảng cách với Mỹ và Trung Quốc và giảm sự phụ thuộc vào công nghệ tiên tiến từ nước ngoài…
Samsung và SK Hynix đang cạnh tranh để trở thành những nhà cung cấp không thể thiếu cho Nvidia, OpenAI và các doanh nghiệp AI Mỹ, trong bối cảnh bộ nhớ băng thông cao (HBM) trở thành linh kiện then chốt của hạ tầng AI thế hệ mới...