Marek Olšák vừa gửi 19 bản vá mới nhằm tối ưu hóa driver RADV Vulkan và bộ biên dịch shader ACO, tập trung cải thiện hiệu suất shader pixel bằng cách loại bỏ các đầu ra không cần thiết như depth, stencil và sample mask, đôi khi tăng gấp đôi hiệu năng. Các bản vá cũng khắc phục vấn đề hiệu suất alpha-to-coverage trên phần cứng GFX11/RDNA3 trở lên, hỗ trợ DXVK và VKD3D, dự kiến ra mắt ổn định trong Mesa 26.3 vào Q4.
Why read it: Lập trình viên làm việc với OpenGL/Vulkan hoặc tích hợp hệ thống đồ họa cần đọc để hiểu cách tối ưu hóa sâu sắc của RADV và ACO, giúp cải thiện hiệu suất cho các ứng dụng game và ứng dụng đồ họa trên Linux, đặc biệt là khi sử dụng DXVK hoặc chuyển đổi giữa các API.
Answer 3 short questions to earn reward points for this article. Only do it if you want the points.
3 questions · under a minute · optional
Source: https://www.phoronix.com/news/RADV-ACO-19-More-Patches-Valve. 8 Sync News only summarizes and links out; content copyright belongs to the authors and original sources.
Đang tải bình luận…
AMD đã đạt mức định giá 1 tỷ USD lần đầu tiên, đồng thời Nasdaq đóng cửa ở mức kỷ lục khi các nhà đầu tư đặt cược vào việc chi tiêu cho AI vẫn đang tăng trưởng. Động lực chính đằng sau đà tăng này là nhu cầu mạnh mẽ cho bộ xử lý GPU của AMD trong thị trường AI, đặc biệt là dòng Instinct MI300. Sự thành công này cho thấy AMD đang cạnh tranh trực tiếp với NVIDIA trong lĩnh vực AI accelerator. Bài phân tích cung cấp cái nhìn sâu sắc về cách AMD tận dụng làn sóng AI để tạo ra giá trị thị trường khổng lồ, điều mà các lập trình viên quan tâm đến xu hướng công nghệ nên theo dõi.
Tin tức này giúp lập trình viên hiểu xu hướng đầu tư công nghệ AI đang định hình giá trị các công ty phần cứng hàng đầu.
Bối cảnh: Nhiều lập trình viên vẫn tin vào những quan niệm lỗi thời về CPU, dẫn đến lựa chọn không tối ưu. Nguyên nhân kỹ thuật: Các công nghệ như Intel Turbo Boost, ARM big.LITTLE và bộ đệm L3 cache đã thay đổi cách CPU hoạt động, khiến các myth về clock speed đơn thuần hay core count trở nên lỗi thời. Hệ quả: Việc dựa vào các tiêu chí lỗi thời có thể khiến bạn bỏ lỡ các giải pháp hiệu quả hơn, ví dụ như việc một chip Apple M1 với 8 core nhưng chỉ 4 performance cores có thể vượt trội hơn nhiều CPU Intel core count cao hơn. Điều đáng học: Bạn cần cập nhật kiến thức về công nghệ CPU hiện đại để đưa ra quyết định kỹ thuật chính xác, đặc biệt khi đánh giá hiệu năng tổng thể thay vì chỉ tập trung vào các con số đơn lẻ như GHz hay core count.
Bài viết này sẽ giúp bạn loại bỏ những quan niệm sai lầm về CPU đã lỗi thời để cập nhật kiến thức công nghệ hiện đại.
Bài viết hướng dẫn cách áp dụng speculative decoding trong framework vLLM khi chạy trên GPU AMD, giải thích cơ chế draft‑and‑verify và các kỹ thuật hỗ trợ như MTP, EAGLE‑3, DFlash và DSpark. Nó cho thấy việc sử dụng mô hình nháp để dự đoán trước các token rồi xác thực bằng mô hình đích giúp giảm số lần truy cập bộ nhớ và tăng tỷ lệ sử dụng lõi tính toán trên kiến trúc AMD CDNA. Kết quả thực nghiệm cho thấy throughput tăng lên đáng kể (thường gấp 1,5‑2×) và latency giảm khi cấu hình đúng kích thước batch và các tham số tuning cụ thể cho từng kernel. Điều này cho thấy lợi thế của speculative decoding không chỉ phụ thuộc vào thuật toán mà còn vào việc tối ưu hóa phần cứng cụ thể, đặc biệt là việc sử dụng DFlash để tối ưu hoá attention và DSpark để quản lý memory traffic trên GPU AMD. Bài viết nên được đọc nếu bạn muốn áp dụng hoặc cải thiện speculative decoding trên hệ thống AMD và cần tham khảo các bước cấu hình, tuning và benchmark thực tế.
Bài viết này cung cấp hướng dẫn thực tế về speculative decoding trên GPU AMD, giúp lập trình viên tối ưu hóa hiệu suất xử lý mô hình ngôn ngữ.
Intel đã cập nhật driver Mesa cho Linux, xem các đồ họa tích hợp Nova Lake S, U, H, HX thế hệ tiếp theo là ổn định và kích hoạt chúng mặc định, không cần experimental force_probe nữa. Thay đổi này theo sau Linux kernel 7.3 đã đánh dấu đồ họa Xe3P của Nova Lake là ổn định, và thay đổi này đã xuất hiện trong Mesa 26.3-devel Git với kế hoạch backport cho Mesa 26.2 stable series trước khi Nova Lake ra mắt. Lập trình viên làm việc với đồ họa Intel trên Linux có thể yên tâm sử dụng các dòng CPU mới này mà không cần bật chế độ experimental. Thay đổi này đảm bảo driver Iris Gallium3D (OpenGL) và ANV (Vulkan) hoạt động ổn định với phần cứng mới.
Bài viết này giúp lập trình viên Linux biết họ đã sẵn sàng sử dụng đồ họa Intel Nova Lake mới mà không cần thủ tục kích hoạt thử nghiệm.
Trong bối cảnh giá card đồ họa mới tăng gấp đôi so với MSRP, thị trường đồ cũ đang trở thành lựa chọn duy nhất có giá hợp lý. Nguyên nhân kỹ thuật đến từ việc các thế hệ GPU cũ như RTX 3080, RTX 3070 và AMD RX 6700 XT vẫn mạnh mẽ đủ để chạy đa tác vụ gaming và rendering. Hệ quả là những model này đang được săn đón với giá chỉ bằng 40-50% so với dòng mới, giúp tiết kiệm đáng kể cho lập trình viên. Điều đáng học là việc đánh giá hiệu năng thực tế của GPU cũ qua các benchmark thay vì chỉ chú trọng vào thông số mới nhất có thể giúp tối ưu chi phí hiệu quả.
Bài này tiết lộ 4 GPU đã qua sử dụng nay trở nên đáng giá hơn do giá card mới đã gấp đôi giá niêm yết.
Ubuntu 24.04.5 LTS is the newest point release for the Ubuntu 24.04 series, bundling accumulated stable updates for faster fresh installs and shipping a new Hardware Enablement (HWE) stack pulled from Ubuntu 26.04. That stack brings the Linux 7.0 kernel and Mesa 26.0 graphics drivers, benefiting newer hardware and improving GPU driver support for gamers and enthusiasts. All official Ubuntu flavors (Kubuntu, Xubuntu, Ubuntu MATE, Lubuntu, Ubuntu Studio, and others) received matching 24.04.5 LTS releases alongside the main edition.
Ngày nay, nhà phát triển đã bắt đầu phiên bản beta của API đồ họa Vulkan. Sự ra mắt này nhằm mục đích mang lại hiệu suất đồ họa vượt trội trên các nền tảng khác nhau. API Vulkan cho phép quản lý tài nguyên GPU trực tiếp, giảm thiểu lớp trừu tượng so với OpenGL. Việc triển khai Vulkan hứa hẹn cải thiện đáng kể tốc độ frame rate và giảm độ trễ trong các ứng dụng đồ họa. Lập trình viên nên theo dõi để cập nhật về các tính năng mới và tài liệu phát triển cụ thể của Vulkan beta.
Bài viết cung cấp thông tin quan trọng về bản beta Vulkan và các tính năng mới như NPC Auto Dormancy mà lập trình viên cần biết để cập nhật kiến thức công nghệ và tối ưu hóa hiệu suất ứng dụng.
AMD's compiler technologies team has proposed a new opt-in Clang feature, -fenable-readonly-thp, that implements instruction Transparent Huge Pages (iTHP) at compile and link time. The compiler driver arranges 2 MiB segment alignment at link time, links a small startup object, and calls madvise(MADV_COLLAPSE) at process start so the kernel can promote 4 KiB text page mappings to huge pages, reducing iTLB pressure. Testing with SPEC CPU 2026, Geekbench, CPython, and database/server workloads showed workload-dependent gains, strongest on large .text binaries like interpreters and compilers, with no broad regressions observed but some cost in larger binaries and startup overhead. The feature requires Linux 7.2 or newer since older kernels only support iTHP from TMPFS-based storage. Unlike the BOLT binary layout optimizer, this approach requires no workload profiling. A Google engineer noted they built a similar library, and AMD hopes to upstream this into LLVM and potentially GNU toolchains instead.
Read the news here, practice coding, follow structured courses and train for IELTS on our sibling products — all connected through one 8 Sync account.
The ecosystem home: product overviews, blog and full pricing.
ExploreLearn along a clear roadmap: videos, auto-graded quizzes, certificates and mentors who ship for a living.
View the roadmap1,000+ DSA problems in Vietnamese, auto-graded across 7 languages — many FREE, right in your browser.
Practice for freeAI grading for all four IELTS skills with detailed rubric feedback.
Try it freeA 22 MB AI IDE for Vietnamese devs.
Download freeOrganizational memory for AI agents.
ExploreAI that staffs your Fanpage and qualifies leads for you.
Try it