Lambda raised about $1B of private debt for Nvidia chips Microsoft will lease, Bloomberg reports. Europe's largest neocloud is financed the same way.
Source: https://thenextweb.com/news/lambda-1bn-private-debt-microsoft-lease-nebius-european-neocloud. 8 Sync News only summarizes and links out; content copyright belongs to the authors and original sources.
MoE models bắt đầu với một số lượng chuyên gia hạn chế, ví dụ Mixtral sử dụng 8 chuyên gia mỗi lớp. Để đạt hiệu suất cao hơn, các nhà nghiên cứu đã mở rộng số chuyên gia lên gần 900 mỗi lớp trong Kimi K3, đồng thời phải giải quyết vấn đề tính sparse và độ ổn định trong quá trình huấn luyện. Các cơ chế nén như cắt bớt chuyên gia ít dùng, lượng tử hóa và phân tích hạng thấp kết hợp với các kỹ thuật ổn định như loss phụ trợ, hệ số capacity và dropout trên router cho phép mô hình vẫn khả thi để huấn luyện mà không giảm hiệu suất. Điều đáng học là khi mở rộng MoE, việc cân bằng tải giữa các chuyên gia và duy trì độ ổn định của router là then chốt để tránh hiện tượng chuyên gia chết hoặc quá tải. Điều này cho thấy, ngoài việc tăng số chuyên gia, đầu tư vào các kỹ thuật nén và ổn định là yếu tố quyết định sự thành công của các mô hình MoE hiện đại.
Đang tải bình luận…
Nvidia đang trong quá trình đàm phán mua Hugging Face với mức giá trên 13 tỷ USD, khoảng ba năm sau khi Hugging Face từng từ chối việc đầu tư của Nvidia. Lý do kỹ thuật là Nvidia muốn tích hợp sâu hơn hub mô hình mở vào hệ thống GPU và phần mềm AI của mình để tối ưu hóa việc triển khai và inference trên nền tảng của mình. Nếu thỏa thuận thành công, Nvidia sẽ kiểm soát một trong những kho lưu trữ mô hình phổ biến nhất, có thể thay đổi cách các nhà phát triển truy cập và phân phối các mô hình AI mở. Điều này có thể tăng sức cạnh tranh của Nvidia đối với các đối thủ như AMD và Google trong lĩnh vực hạ tầng AI, đồng thời gây ra lo ngại về sự tập trung trong cộng đồng mã nguồn mở. Bài học cho các lập trình viên là cần đánh giá sự phụ thuộc vào các hub mô hình của bên thứ ba và xem xét các chiến lược sao lưu hoặc tự-host khi nhà cung cấp có thể thay đổi chính sách hoặc sở hữu.
Nvidia đang đàm phán mua lại Hugging Face với giá 12.9 tỷ đô la, mở ra cơ hội lớn cho cộng đồng AI và định hình lại tương lai của ngành công nghệ trí tuệ nhân tạo.
Khi chạy mô hình học sâu trên nền tảng serverless như AWS Lambda, Azure Functions hoặc Google Cloud Run, mỗi lần gọi đầu tiên sẽ trải qua giai đoạn cold start khiến latency tăng đáng kể. Latency chủ yếu xuất phát từ thời gian tải image container, giải nén và khởi tạo runtime, đồng thời phải load mô hình từ bộ lưu trữ (S3, Blob Storage) vào RAM, và thời gian này tỷ lệ thuận với kích thước mô hình – ví dụ một mô hình 2 GB có thể cần 3‑5 giây để load. Hệ quả là các request đầu tiên gặp trễ từ vài trăm miligiây (đối với hàm nhẹ) tới vài giây (đối với mô hình lớn), làm giảm trải nghiệm người dùng và gây khó khăn trong các ứng dụng cần phản hồi real‑time như chatbot hoặc xử lý video. Các tối ưu như giảm kích thước mô hình qua quantization hoặc pruning, sử dụng lớp cache /tmp hoặc EFS, bật tính năng provisioned concurrency hoặc AWS Lambda SnapStart, và chọn runtime dựa trên hình ảnh cơ sở nhỏ (distroless, Alpine) có thể cắt giảm cold start xuống dưới 500 ms cho hầu hết các trường hợp. Kết hợp các kỹ thuật trên không chỉ giảm latency mà còn tiết kiệm chi phí do giảm thời gian thực thi và số lần khởi tạo container.
Bài viết giải thích rõ ràng về nguyên nhân gây độ trễ lúc khởi đầu và cách tối ưu hiệu suất cho serverless inference.
Framework Computer vừa bắt đầu giao các tùy chọn phần cứng mới cho Framework Laptop 16, bao gồm mô-đun GPU GeForce RTX 5070 12GB dành cho trò chơi hoặc workload CUDA/AI. Đồng thời họ ra mắt một bàn phím một mảnh sử dụng firmware mã nguồn mở QMK và một bàn chạm một mảnh bằng nhôm CNC với bề mặt haptic 124 × 77 mm, hiện đã hết hàng với giá 129 USD. Các thử nghiệm trên Fedora Workstation 44 và Ubuntu 26.04 LTS cho thấy cả GPU mới và các thiết bị nhập hoạt động tốt ngay lập tức mà không cần driver bổ sung. Điều này cho thấy khả năng tích hợp linh hoạt của kiến trúc mô-đun Framework cùng với hỗ trợ Linux tốt từ đầu. Dành cho lập trình viên cân nhắc nâng cấp hoặc mua mới, bài viết cung cấp dữ liệu cụ thể về hiệu suất và khả năng tương thích trên hai distro Linux phổ biến.
Bài này cung cấp thông tin cập nhật về các nâng phần cứng mới nhất cho Framework Laptop 16, phù hợp với cả game thủ và lập trình viên làm việc trên Linux.
PowerToys cuối cùng đã cung cấp đủ tính năng hữu ích khiến tác giả gỡ bỏ 6 ứng dụng bên ngoài sau khi chúng được tích hợp trực tiếp vào hệ điều hành.
Lập trình viên nên đọc bài này để khám phá cách tích hợp các công cụ hệ thống như PowerToys vào ứng dụng của mình, giúp tối ưu hóa hiệu suất và trải nghiệm người dùng bằng cách tự động hóa các tác vụ phức tạp.
Microsoft đã gỡ bỏ công cụ WMIC (Windows Management Instrumentation Command-line) khỏi Windows 11 phiên bản 24H2, 25H2 và các bản beta phát hành tuần này do bị tội phạm mạng lợi dụng.
Lập trình viên nên đọc bài này để hiểu cách bảo mật hệ thống Windows có thể bị xâm nhập thông qua các công cụ như WMIC, giúp bạn cập nhật kiến thức về các biện pháp phòng ngừa và cách bảo vệ ứng dụng của mình khỏi các cuộc tấn công từ bên ngoài.
Saviynt vừa ra mắt Zuma, nền tảng bảo mật danh sách doanh nghiệp dựa trên AI. Zuma tích hợp học máy để phát hiện bất thường truy cập và tự động hóa quy trình cấp quyền. Nhờ khả năng này, số lượng khách hàng mới của Saviynt tăng hơn 80% trong thời gian sau khi ra mắt. Xu hướng này cho thấy doanh nghiệp đang ưu tiên giải pháp bảo mật danh sách có trí tuệ nhân tạo để giảm rủi ro nội bộ. Điều đáng học là đầu tư vào AI cho bảo mật danh sách không chỉ nâng cao hiệu quả vận hành mà còn tạo động lực tăng trưởng khách hàng rõ ràng.
Bài viết này giúp hiểu xu hướng thị trường và tiềm năng tăng trưởng mạnh mẽ trong lĩnh vực bảo mật nhận diện doanh nghiệp bằng AI.
Ireland vẫn còn áp dụng luật từ năm 1634 cấm hình thức tài trợ bên thứ ba cho vụ kiện, nghĩa là các bên ngoài không thể đầu tư tiền để hỗ trợ các vụ kiện tập thể. Điều này khiến chi phí và rủi ro của việc khởi kiện trở thànhภาระ hoàn toàn của người kiện, làm giảm khả năng họ tham gia vào các vụ kiện chống lại các công ty Big Tech. Vì vậy, đến nay chỉ có một vụ kiện tập thể chống lại Big Tech được nộp tại Ireland, trong khi nhiều quốc gia châu Âu khác cho phép nhiều vụ kiện như vậy nhờ có tài trợ bên thứ ba. Trường hợp này cho thấy một quy định pháp luật cổ thể có thể trở thành rào cản cho quyền bồi thường tập thể trong thời đại công nghệ, và nhấn mạnh nhu cầu sửa đổi luật để cho phép tài trợ bên thứ ba trong các vụ kiện tập thể. Nếu không có sự thay đổi, người tiêu thụ châu Âu sẽ tiếp tục gặp khó khăn khi muốn kiện tập thể các conglomerate công nghệ mà không có nguồn tài trợ ngoài.
Tuổi luật kỳ lạ của Ireland đang ngăn người dân châu Âu kiện tập thể các công ty công nghệ lớn.
Read the news here, practice coding, follow structured courses and train for IELTS on our sibling products — all connected through one 8 Sync account.
The ecosystem home: product overviews, blog and full pricing.
ExploreLearn along a clear roadmap: videos, auto-graded quizzes, certificates and mentors who ship for a living.
View the roadmap1,000+ DSA problems in Vietnamese, auto-graded across 7 languages — many FREE, right in your browser.
Practice for freeAI grading for all four IELTS skills with detailed rubric feedback.
Try it freeA 22 MB AI IDE for Vietnamese devs.
Download freeOrganizational memory for AI agents.
ExploreAI that staffs your Fanpage and qualifies leads for you.
Try it