Windows 11 sắp cho phép người dùng tự chia bộ nhớ cho GPU và AI
Microsoft được cho là đang thử nghiệm một tính năng mới trên Windows 11, cho phép người dùng chủ động phân bổ bộ nhớ thống nhất giữa đồ họa, AI và các tác vụ hệ thống. Đây có thể là thay đổi đáng chú ý khi những mẫu PC AI sử dụng Unified Memory với dung lượng lên tới hàng trăm GB ngày càng phổ biến.
Trên những chiếc PC không có GPU rời, CPU và GPU thường phải chia sẻ chung một vùng bộ nhớ hệ thống. Windows hiện tự động quyết định cách phân bổ tài nguyên này tùy theo nhu cầu của từng ứng dụng. Tuy nhiên, một tính năng mới xuất hiện trong bản dựng thử nghiệm Windows 11 cho thấy Microsoft có thể sắp trao quyền kiểm soát nhiều hơn cho người dùng.
Cụ thể, bản dựng Windows 11 29648.1000, phát hành ngày 17/8, chứa một thành phần có tên "IntelligentCarveout" nhưng không được Microsoft đề cập trong ghi chú phát hành. Nhà nghiên cứu Windows @phantomofearth phát hiện các chuỗi mã liên quan đến việc dành riêng bộ nhớ cho bộ tăng tốc, đồ họa và các tác vụ AI.
Nếu được triển khai chính thức, tính năng này có thể cho phép người dùng chỉ định một phần bộ nhớ thống nhất dành riêng cho GPU hoặc bộ tăng tốc AI. Phần bộ nhớ được "carve out" sẽ được giữ lại cho những tác vụ cụ thể thay vì để Windows tự động phân bổ.
Điều này đặc biệt đáng chú ý trên các hệ thống Unified Memory, nơi CPU, GPU và bộ tăng tốc AI cùng sử dụng một pool bộ nhớ duy nhất. Cách tiếp cận này đã trở nên phổ biến trên máy Mac, một số laptop, máy chơi game cầm tay và những thiết bị PC AI thế hệ mới.
Lợi thế lớn về dung lượng, nhưng không đồng nghĩa tốc độ cao hơn
Unified Memory mang lại một lợi thế rất rõ ràng: GPU có thể tiếp cận lượng bộ nhớ lớn hơn nhiều so với VRAM chuyên dụng trên một số card đồ họa truyền thống.
Nvidia là một trong những công ty đang đẩy mạnh hướng đi này với RTX Spark, dòng máy tính AI sử dụng bộ nhớ thống nhất lên tới 128GB. Nếu IntelligentCarveout được Microsoft kích hoạt rộng rãi, người dùng có thể chủ động dành một phần đáng kể dung lượng này cho đồ họa hoặc AI.
Về lý thuyết, GPU trên RTX Spark có thể được cấp quyền truy cập vào lượng bộ nhớ lớn hơn đáng kể so với 32GB VRAM GDDR7 của RTX 5090. Tuy nhiên, đây là lợi thế về dung lượng, không phải tốc độ.
Bộ nhớ LPDDR5X dùng trong hệ thống Unified Memory có băng thông và đặc tính khác biệt đáng kể so với GDDR7 chuyên dụng. Vì vậy, việc có 128GB bộ nhớ dùng chung không đồng nghĩa GPU sẽ nhanh hơn RTX 5090 trong các tác vụ đồ họa.
Điểm mạnh nằm ở những workload cần dung lượng bộ nhớ rất lớn, đặc biệt là chạy mô hình AI cục bộ, xử lý dữ liệu lớn hoặc những ứng dụng có thể tận dụng trực tiếp lượng RAM khổng lồ.
Windows có thể thay đổi cách tối ưu PC AI
Sự xuất hiện của IntelligentCarveout cũng cho thấy Microsoft đang phải thích nghi với một thế hệ PC khác hoàn toàn so với máy tính truyền thống.
Trước đây, người dùng PC gaming thường có RAM hệ thống và VRAM tách biệt. CPU sử dụng RAM, GPU sử dụng VRAM, còn việc quản lý tài nguyên tương đối rõ ràng. Nhưng với PC AI, ranh giới này đang dần biến mất.
Một hệ thống có 64GB hoặc 128GB Unified Memory có thể đồng thời chạy game, xử lý đồ họa và tải một mô hình AI lớn. Khi đó, việc Windows tự động chia sẻ bộ nhớ đôi khi có thể không phải lựa chọn tối ưu.
IntelligentCarveout, nếu trở thành tính năng chính thức, sẽ cho phép người dùng đánh đổi dung lượng giữa các workload theo nhu cầu thực tế. Game thủ có thể ưu tiên bộ nhớ cho đồ họa, trong khi người dùng AI có thể dành nhiều bộ nhớ hơn cho mô hình và bộ tăng tốc.
Tuy nhiên, Microsoft hiện chưa xác nhận thời điểm hoặc kế hoạch phát hành chính thức của IntelligentCarveout. Vì vậy, tính năng này vẫn chỉ nên được xem là một khả năng đang được thử nghiệm, thay vì một tính năng chắc chắn sẽ xuất hiện trên phiên bản Windows 11 dành cho người dùng phổ thông.
Bài cùng chuyên mục