Percona has launched a Technical Preview (version 1.70.3-1) of Percona Search for MongoDB, a downstream distribution of mongot — the same search engine powering MongoDB Atlas Search. It enables full-text and vector search for self-managed MongoDB deployments without vendor lock-in. Key gaps Percona plans to address include: expanding automatic embedding support beyond Voyage AI to any OpenAI-compatible API and eventually 25,000+ open-weight models; bringing the $rerank stage (currently Atlas-only) to self-managed deployments starting with BAAI/bge-reranker-large; adding contextual chunking and multimodal pipeline support; automating search-index backups via Percona Backup for MongoDB; and shipping turnkey monitoring dashboards and alert rules via Percona Monitoring and Management. The release requires Percona Server for MongoDB 8.3 and is not yet production-ready.
Nguồn: https://www.percona.com/blog/the-open-way-of-percona-search-for-mongodb. 8 Sync News chỉ tóm tắt và dẫn link; bản quyền nội dung thuộc tác giả và nguồn gốc.
Redis, với Redis Enterprise, giúp tích hợp bộ nhớ bền vững (persistent memory) vào Snowflake Cortex Agents, tối ưu hóa tốc độ xử lý và xây dựng ứng dụng nhanh chóng.
Lập trình viên muốn tối ưu hóa hiệu năng cho các ứng dụng AI/ML trong Snowflake Cortex bằng cách kết hợp Redis với bộ nhớ dư thời gian dài, đặc biệt khi cần xử lý các nhiệm vụ phức tạp như lưu trữ và truy vấn dữ liệu nhanh chóng trong các agent AI.
Phiên bản ClickHouse 26.7 cải thiện tốc độ cho truy vấn GROUP BY ... ORDER BY ... LIMIT, bổ sung ba cải tiến cho JOIN, bốn cải tiến cho vector search, hỗ trợ tìm kiếm cụm từ theo vị trí, công cụ EXPLAIN ANALYZE, truy cập URL thống nhất cùng nhiều tính năng khác.
Lập trình viên cần đọc bài này để khám phá cách ClickHouse 26.7 tối ưu hóa hiệu suất cho các truy vấn phức tạp như GROUP BY + ORDER BY + LIMIT, cải thiện hiệu quả JOIN và tìm kiếm vector, giúp dự án của bạn chạy nhanh hơn và tiết kiệm chi phí khi xử lý dữ liệu lớn.
Cloudflare giới thiệu AI Search, công cụ tìm kiếm tích hợp sẵn giúp đơn giản hóa việc truy xuất dữ liệu từ file và website của bạn mà không cần kết hợp nhiều thành phần Cloudflare. Họ cũng công bố bản xem trước mô hình giá mới.
Là người phát triển, bạn nên tìm hiểu về Cloudflare AI Search để khám phá cách xây dựng một hệ thống tìm kiếm tự động, nhanh chóng và không cần phải xây dựng lại cơ sở hạ tầng tìm kiếm từ scratch, giúp tiết kiệm thời gian và công sức trong việc tích hợp dữ liệu của riêng bạn.
Chunking đóng vai trò quan trọng trong hiệu suất RAG, trong đó phương pháp chia token cố định không tối ưu. Bảy chiến lược chunking được so sánh gồm: chia token cố định có overlap, sentence-window retrieval, chunking cấu trúc nhận biết tài liệu, chunking dựa trên embedding ngữ nghĩa, chunking phân cấp parent-child, chunking đề xuất do LLM điều khiển, và chunking đa phương thức bảo toàn bảng. Ngoài ra, hệ thống RAG sản xuất cần quản lý vòng đời index, UUID xác định dựa trên hash nội dung, chính sách TTL, và loại bỏ trùng lặp chunk để tránh phình to cơ sở dữ liệu vector và suy giảm suy luận LLM.
Nếu bạn đang xây dựng hoặc tối ưu hóa hệ thống RAG (Retrieval-Augmented Generation) để tránh mất hiệu suất do chunking không hiệu quả và quản lý dữ liệu vector hiệu quả, bài viết này sẽ giúp bạn lựa chọn và áp dụng các chiến lược chunking phù hợp với từng trường hợp.
Bản tin EP221 giải thích cách Docker hoạt động bên trong: CLI gửi API call tới dockerd, delegated tới containerd, rồi gọi runc tạo Linux namespaces và cgroups — không dùng hypervisor. Ngoài ra, còn so sánh git merge vs rebase, đánh giá 12 vector databases (Pinecone, Weaviate, Milvus, Qdrant...), các chiến lược phân trang (offset, keyset, cursor, time-based) và cách LLM điều phối sub-agents cho tác vụ nghiên cứu sâu.
Lập trình viên nên đọc bài này để hiểu rõ cách Docker tối ưu hóa môi trường container hóa bằng cách sử dụng các hệ thống Linux như namespaces và cgroups mà không cần hypervisor, giúp tiết kiệm tài nguyên và nâng cao hiệu suất cho các ứng dụng quy mô lớn.
Nhóm kỹ thuật GitGuardian đã giảm thời gian phản hồi p95 của dashboard từ 8 giây xuống 1 giây nhờ 5 tối ưu hóa PostgreSQL trên hệ thống Django, bao gồm: deferred JOINs bằng prefetch_related, đếm bất đồng bộ, replica đọc premium, cải tiến full-text search (pg_trgm), và denormalization để hỗ trợ composite indexes. Việc nâng cấp lên PostgreSQL 18 cũng mang lại lợi ích nhỏ. Họ sử dụng OpenTelemetry và EXPLAIN ANALYZE để theo dõi tiến trình.
Nếu bạn đang làm việc với ứng dụng backend sử dụng PostgreSQL và Django, bài viết này sẽ giúp bạn tìm hiểu cách tối ưu hóa hiệu suất dashboard hiệu quả bằng những kỹ thuật cụ thể, từ đó tiết kiệm thời gian và chi phí phát triển.
Tham số gin_fuzzy_search_limit của PostgreSQL buộc các truy vấn sử dụng chỉ mục GIN trả về ngẫu nhiên một tập con kết quả thay vì toàn bộ dữ liệu, gây nguy hiểm khi GIN hỗ trợ nhiều kiểu dữ liệu (jsonb, array, hstore, trigram) mà người dùng mong đợi kết quả đầy đủ. Khuyến nghị tắt tham số này (đặt = 0) và tối ưu selectivity, lọc dữ liệu rõ ràng hoặc dùng chỉ mục RUM cho các trường hợp xếp hạng kết quả.
Lập trình viên nên đọc bài này để tránh gặp lỗi khi sử dụng GIN trong các trường hợp không mong đợi—như tìm kiếm fuzzy hay JSONB—vì gin_fuzzy_search_limit có thể khiến kết quả bị trộn lẫn, sai lệch hoặc không chính xác mà không báo hiệu, ảnh hưởng nghiêm trọng đến tính chính xác của các query quan trọng.
DumboDB là sự kết hợp giữa MongoDB và Git, được thiết kế để tránh lỗi và đảm bảo hoạt động ổn định như mong đợi.
Lập trình viên cần đọc bài này để khám phá cách DumboDB kết hợp MongoDB và Git để tự động phát hiện và khắc phục lỗi tái phát (regression) trong quá trình phát triển, giúp bảo đảm chất lượng mã và tránh những lỗi khó phát hiện trong môi trường sản xuất.
Đọc tin ở đây, luyện code, học theo lộ trình và luyện IELTS trên các sản phẩm anh em — tất cả kết nối với nhau trong hệ sinh thái 8 Sync.
Cổng chính của hệ sinh thái: giới thiệu sản phẩm, blog và bảng giá trọn bộ.
Khám pháHọc theo lộ trình rõ từng chặng: video, quiz chấm tự động, certificate và mentor đang làm nghề.
Xem lộ trình1.000+ bài DSA, đề tiếng Việt, chấm tự động 7 ngôn ngữ — nhiều bài FREE, chạy ngay trên trình duyệt.
Luyện miễn phíChấm bốn kỹ năng IELTS bằng AI, phản hồi chi tiết theo rubric.
Dùng thử miễn phíAI IDE 22 MB cho dev Việt.
Tải miễn phíBộ nhớ tổ chức cho AI agent.
Khám pháAI trực Fanpage, tự sàng lọc lead.
Dùng thử