FEX-Emu developers explain why emulating memory access correctly across CPU architectures is far harder than translating instructions. X86's Total Store Ordering gives strong guarantees about when writes become visible, while ARM's weaker memory model allows far more reordering, forcing emulators to insert acquire/release operations that can be costly. Newer ARM extensions like LRCPC and Apple's x86-compatible TSO mode on Apple Silicon reduce overhead, but unaligned accesses and atomic operations remain especially painful, sometimes requiring kernel excursions that are hundreds to thousands of times slower. Write-combined GPU memory writes are a particularly nasty case, with FEX measuring worst-case bandwidth over 800x slower on ARM, dropping some games below 1 FPS, though unified memory architecture systems fare better.
Nguồn: https://hackaday.com/2026/09/19/emulating-memory-access-how-hard-can-it-be. 8 Sync News chỉ tóm tắt và dẫn link; bản quyền nội dung thuộc tác giả và nguồn gốc.
Đang tải bình luận…
Arm ra mắt nền tảng CSS for Mobile 2 như một nền tảng tính toán AI‑native, nhắm vào thiết bị di động الجيل tiếp theo. Nền tảng này bao gồm hai nhân CPU C2‑Ultra và C2‑Pro, mỗi tích hợp SME2 (Scalable Matrix Extension 2) để tăng tốc phép toán ma trận. Đồng thời, nó đi kèm với GPU Mali G2‑Ultra NX, được tối ưu cho workloads AI và đồ họa song song. Kết hợp SME2 và GPU mới cho phép tăng hiệu suất AI lên tới vài chục phần trăm so với thế hệ trước, đồng thời giảm tiêu thụ năng lượng mỗi phép tính. Điều này cho thấy xu hướng đưa các phần mở rộng ma trận chuyên dụng và GPU mạnh vào cùng một SoC để xây dựng nền tảng AI‑native, là bài học quan trọng cho các nhà thiết kế chip khi cân nhắc đọc bài gốc.
Bài viết này giúp lập trình viên nắm bắt kiến thức về nền tảng tính toán AI-native mới nhất từ Arm để tối ưu hóa hiệu năng ứng dụng di động.
Kỹ sư nhúng tại Trinidad phản bác bài phê bình RISC-V của Dmitry Grinberg, nhấn mạnh vấn đề quan trọng không phải là kỹ thuật mà là chi phí và khả năng tiếp cận. Ông chỉ ra rằng RISC-V cho phép một nhà phát triển sử dụng cùng một toolchain từ vi điều khiển giá vài cent (như CH32V003) đến chip hỗ trợ Linux dưới $100, trong khi ARM yêu cầu đầu tư lớn vào giấy phép và công cụ (như J-Link ~$600) cùng sự khác biệt lớn giữa các dòng Cortex. Tính mở và khả năng mở rộng của RISC-V thông qua cơ chế extension giúp xóa bỏ rào cản phân khúc sản phẩm do ARM tạo ra, đặc biệt hữu ích cho các kỹ sư và sinh viên ở những nước có chi phí vận chuyển cao và hạn chế nhập khẩu.
Bạn nên đọc bài này để hiểu rõ cách RISC-V không chỉ là một giải pháp kiến trúc, mà còn là một chiến lược giá thành và mở rộng thị trường cho các nhà phát triển từ các nền kinh tế phát triển, giúp họ thoát khỏi rào cản ARM về chi phí và quyền sở hữu.
Arm giới thiệu công cụ Dynamic Insights sử dụng AI để tối ưu workloads dựa trên dữ liệu runtime.
Lập trình viên nên đọc bài này để khám phá cách Dynamic Insights của Arm sử dụng AI để tự động phân tích và tối ưu hóa hiệu suất ứng dụng trên các thiết bị ARM, giúp giảm thời gian phát triển và cải thiện hiệu năng mà không cần can thiệp thủ công.
MNT Station là máy tính để bàn và máy chủ homelab mở nguồn phần cứng từ MNT Research, đang gây quỹ trên Crowd Supply và được xây dựng xung quanh mainboard MNT Reform 3.0. Nó hỗ trợ các mô-đun xử lý ARM hoặc FPGA như NXP i.MX8, Amlogic S905, Qualcomm Snapdragon, Broadcom/Raspberry Pi Compute Module 4 hoặc AMD/Xilinx Zynq, tiêu thụ khoảng 20W, hoạt động không quạt, có thể gắn VESA và có dự phòng pin LiFePO4. Với Debian được cài sẵn và thiết kế mô-đun, thiết bị có thể hoạt động như desktop, NAS, bộ định tuyến edge, media box hoặc máy chủ homelab, và có thể nâng cấp qua các phụ kiện như Wi‑Fi M.2, SSD, anten và bàn phím cơ kèm theo. So sánh với Framework Desktop và System76 Meerkat cho thấy MNT Station vượt trội về mức tiêu thụ năng lượng, khả năng thay đổi processor và độ mở của phần cứng, cung cấp một bài học về cách xây dựng hệ thống thấp công suất mà vẫn linh hoạt về hardware cho các nhà phát triển và người đam mê homelab.
Bài viết này cung cấp cái nhìn tổng quan về một máy tính để bàn modul hóa nguồn mở, thay thế linh hoạt và tiết kiệm năng lượng cho nhiều ứng dụng khác nhau.
Một nhà phát triển đã port thành công Linux lên máy tính bỏ túi HP Prime G2 nhờ CPU i.MX 6 Cortex-A7, 256MB RAM và 512MB storage, vượt xa khả năng của các dòng calculator truyền thống. Bản port này cải tiến nhân Linux 4.14 cũ với driver bàn phím hoạt động, hỗ trợ console USB, khả năng chạy hình ảnh lên tới 130MB RAM, cùng driver touchscreen tùy chỉnh cho model Ilitek ILI211X mới hơn.
Lập trình viên nên đọc bài này để khám phá cách port Linux vào thiết bị embedded như máy tính bảng hoặc máy tính cá nhân nhỏ, giúp hiểu về kiến trúc hệ thống, cách tối ưu hóa kernel và driver cho thiết bị có tài nguyên hạn chế, và ứng dụng thực tế của việc tích hợp môi trường phát triển trên hardware độc lập.
Erik Faye-Lund, a longtime Mesa contributor known for his work on Zink, the PanVK Vulkan driver, and the Panfrost Gallium3D driver for Arm Mali GPUs, has joined Arm directly after eight years at Collabora. He will continue upstream PanVK and Panfrost development and remain on the X.Org Board of Directors. He cited fundamental disagreements with Collabora's leadership and frustrations with working as a contractor in Norway (tax filing, sick leave, parental leave paperwork) as reasons for leaving.
Arm engineer Christian Loehle submitted a Linux kernel patch series proposing that the scheduler randomize its selection among equally shallow idle CPU cores, instead of always picking the first eligible one via scan order. The issue: concurrent slow-path selectors can converge on the same idle CPU before either task is enqueued, creating a scan-order bias. The fix uses reservoir sampling with a per-CPU scheduler PRNG and reciprocal_scale() to avoid extra scans or division. Testing on a dual Ampere Altra system with 160 cores using Stress-NG showed up to a few percent throughput improvement. Open questions remain about benefits on lower core count CPUs and potential unpredictability, but the approach could help high-core-count chips like AMD's EPYC 9006 series (up to 256 cores per socket).
ARM's Peter Hodges for a conversation about toolmaking for game developers and improved lighting tech for mobile games.
Đọc tin ở đây, luyện code, học theo lộ trình và luyện IELTS trên các sản phẩm anh em — tất cả kết nối với nhau trong hệ sinh thái 8 Sync.
Cổng chính của hệ sinh thái: giới thiệu sản phẩm, blog và bảng giá trọn bộ.
Khám pháHọc theo lộ trình rõ từng chặng: video, quiz chấm tự động, certificate và mentor đang làm nghề.
Xem lộ trình1.000+ bài DSA, đề tiếng Việt, chấm tự động 7 ngôn ngữ — nhiều bài FREE, chạy ngay trên trình duyệt.
Luyện miễn phíChấm bốn kỹ năng IELTS bằng AI, phản hồi chi tiết theo rubric.
Dùng thử miễn phíAI IDE 22 MB cho dev Việt.
Tải miễn phíBộ nhớ tổ chức cho AI agent.
Khám pháAI trực Fanpage, tự sàng lọc lead.
Dùng thử