GCC has merged initial support for AI Compute Extensions (ACEv1), a new joint Intel/AMD matrix acceleration architecture intended as the successor to Intel's Advanced Matrix Extensions (AMX), targeting future generation CPUs. The support landed in GCC's Git repository for the upcoming GCC 17 release, following patches submitted since July by Intel and AMD compiler engineers. A new -macev1 compiler flag enables ACEv1 built-in functions and code generation, implying AVX10.1, AVX/AVX2, and SSE/SSE4 support. GCC 17.1 is expected around March-April with this first-generation ACE support, and parallel enablement work is underway for LLVM/Clang via an open pull request.
Nguồn: https://www.phoronix.com/news/GCC-17-Merges-ACE-v1. 8 Sync News chỉ tóm tắt và dẫn link; bản quyền nội dung thuộc tác giả và nguồn gốc.
Đang tải bình luận…
Bối cảnh: Nhiều lập trình viên vẫn tin vào những quan niệm lỗi thời về CPU, dẫn đến lựa chọn không tối ưu. Nguyên nhân kỹ thuật: Các công nghệ như Intel Turbo Boost, ARM big.LITTLE và bộ đệm L3 cache đã thay đổi cách CPU hoạt động, khiến các myth về clock speed đơn thuần hay core count trở nên lỗi thời. Hệ quả: Việc dựa vào các tiêu chí lỗi thời có thể khiến bạn bỏ lỡ các giải pháp hiệu quả hơn, ví dụ như việc một chip Apple M1 với 8 core nhưng chỉ 4 performance cores có thể vượt trội hơn nhiều CPU Intel core count cao hơn. Điều đáng học: Bạn cần cập nhật kiến thức về công nghệ CPU hiện đại để đưa ra quyết định kỹ thuật chính xác, đặc biệt khi đánh giá hiệu năng tổng thể thay vì chỉ tập trung vào các con số đơn lẻ như GHz hay core count.
Bài viết này sẽ giúp bạn loại bỏ những quan niệm sai lầm về CPU đã lỗi thời để cập nhật kiến thức công nghệ hiện đại.
ACEMAGIC gửi mẫu Kron Mini K5 Wildcat Lake mini PC để mình xem xét. Máy được cấu hình với Intel Core 3 304 hoặc Core 5 320 CPU, kèm tùy chọn RAM và storage. Kết quả là một thiết bị nhỏ gọn nhưng đủ sức chạy các công cụ phát triển nhẹ. Điều này cho thấy việc lựa chọn CPU affect performance và giá cả. Nếu bạn đang cân nhắc mua mini PC cho môi trường test nhanh, mẫu này đáng để xem chi tiết hơn.
Bài này cung cấp thông tin chi tiết về cấu hình và trải nghiệm ban đầu với ACEMAGIC Kron Mini K5 Wildcat Lake mini PC.
Bài viết hướng dẫn cách áp dụng speculative decoding trong framework vLLM khi chạy trên GPU AMD, giải thích cơ chế draft‑and‑verify và các kỹ thuật hỗ trợ như MTP, EAGLE‑3, DFlash và DSpark. Nó cho thấy việc sử dụng mô hình nháp để dự đoán trước các token rồi xác thực bằng mô hình đích giúp giảm số lần truy cập bộ nhớ và tăng tỷ lệ sử dụng lõi tính toán trên kiến trúc AMD CDNA. Kết quả thực nghiệm cho thấy throughput tăng lên đáng kể (thường gấp 1,5‑2×) và latency giảm khi cấu hình đúng kích thước batch và các tham số tuning cụ thể cho từng kernel. Điều này cho thấy lợi thế của speculative decoding không chỉ phụ thuộc vào thuật toán mà còn vào việc tối ưu hóa phần cứng cụ thể, đặc biệt là việc sử dụng DFlash để tối ưu hoá attention và DSpark để quản lý memory traffic trên GPU AMD. Bài viết nên được đọc nếu bạn muốn áp dụng hoặc cải thiện speculative decoding trên hệ thống AMD và cần tham khảo các bước cấu hình, tuning và benchmark thực tế.
Bài viết này cung cấp hướng dẫn thực tế về speculative decoding trên GPU AMD, giúp lập trình viên tối ưu hóa hiệu suất xử lý mô hình ngôn ngữ.
AMD mua lại Taalas nhằm nâng cao hiệu suất inference bằng cách khắc mô hình AI trực tiếp lên vi mạch. Các bản demo ban đầu cho thấy các mạch tích hợp chuyên dụng (model-specific integrated circuits) có thể xử lý tới 17.000 token mỗi giây.
Lập trình viên AI cần đọc để hiểu cách AMD đang tận dụng silicon custom hóa để cải thiện hiệu suất xử lý mô hình deep learning, đặc biệt là trong việc tối ưu hóa các ứng dụng inference trên thiết bị edge, giúp tiết kiệm chi phí và tăng tốc độ triển khai.
Phiên bản 11.5 của Lemonade, máy chủ AI cục bộ mã nguồn mở dựa trên AMD, vừa ra mắt với tính năng chính là Lemonade Router hoàn thiện, tự động điều hướng truy vấn LLM theo chính sách cấu hình (dựa trên quy tắc, phân loại, độ tương đồng ngữ nghĩa hoặc LLM-as-router). Ngoài ra, hệ thống bổ sung công cụ quản lý tác vụ đa bước, hỗ trợ kết nối MCP client thông qua daemon, và tương thích với NPU Ryzen AI, GPU Radeon cùng CPU trên Windows và Linux.
Lập trình viên phát triển ứng dụng AI nên đọc vì Lemonade 11.5 cung cấp Lemonade Router hoàn chỉnh, giúp tối ưu hóa lưu lượng truy vấn LLM hiệu quả hơn bằng các phương pháp tự động hóa đa dạng, từ quy tắc đến AI-as-router, giúp tiết kiệm chi phí và cải thiện hiệu suất cho các ứng dụng AI cá nhân hoặc doanh nghiệp.
Intel bắt đầu sản xuất chip sử dụng công nghệ in thạch bản cực tím (EUV) tiên tiến (High-NA EUV) trên tiến trình Panther Lake, dự kiến xuất hiện trong các laptop thế hệ tiếp theo.
Lập trình viên nên đọc bài này để hiểu cách Intel sử dụng công nghệ EUV cao độ (High-NA EUV) trong thiết kế chip Panther Lake, giúp cải thiện hiệu suất CPU/GPU và hiệu quả điện năng, ảnh hưởng trực tiếp đến các ứng dụng phần mềm, game và AI hiện đại.
Một loạt bản vá (patch series) đang trải qua gần chục phiên bản sửa đổi giới thiệu cơ chế khôi phục "cold reset" cho các driver DRM trên Linux, ban đầu nhắm đến driver đồ họa Intel Xe. Cơ chế này xử lý lỗi phần cứng cần khởi động lại toàn bộ thiết bị mà không cần khởi động lại toàn hệ thống, nhằm giải quyết lỗi Power Management Unit (PUNIT) không thể khắc phục bằng reset ấm hay tải lại driver.
Lập trình viên cần đọc để hiểu cách triển khai giải pháp cold reset cho GPU Intel trên Linux, giúp tối ưu hóa hiệu suất và tránh lỗi liên quan đến PUNIT khi hệ thống gặp sự cố cần khởi động lại thiết bị vật lý mà không cần reboot toàn bộ máy.
FSR 4.1 có thể khiến nâng cấp GPU cầm tay trở nên lỗi thời, điều mà thị trường đang cần.
Lập trình viên nên đọc bài này để khám phá cách FSR 4.1 có thể mở rộng khả năng tương thích của các thiết bị di động với GPU hiện đại, giúp phát triển game cho thiết bị cũ hơn mà vẫn hiệu suất cao, mở rộng thị trường và tiết kiệm chi phí cho các nhà phát triển.
Đọc tin ở đây, luyện code, học theo lộ trình và luyện IELTS trên các sản phẩm anh em — tất cả kết nối với nhau trong hệ sinh thái 8 Sync.
Cổng chính của hệ sinh thái: giới thiệu sản phẩm, blog và bảng giá trọn bộ.
Khám pháHọc theo lộ trình rõ từng chặng: video, quiz chấm tự động, certificate và mentor đang làm nghề.
Xem lộ trình1.000+ bài DSA, đề tiếng Việt, chấm tự động 7 ngôn ngữ — nhiều bài FREE, chạy ngay trên trình duyệt.
Luyện miễn phíChấm bốn kỹ năng IELTS bằng AI, phản hồi chi tiết theo rubric.
Dùng thử miễn phíAI IDE 22 MB cho dev Việt.
Tải miễn phíBộ nhớ tổ chức cho AI agent.
Khám pháAI trực Fanpage, tự sàng lọc lead.
Dùng thử