Percona Server for MySQL 9.7.2-2 adds a DISTANCE() function (aliased as VECTOR_DISTANCE()) that computes vector similarity directly in SQL, supporting COSINE, EUCLIDEAN, EUCLIDEAN_SQUARED, MANHATTAN, and DOT metrics. Unlike MySQL's native equivalent, which is exclusive to HeatWave MySQL on OCI and limited to three metrics, this implementation runs on any platform running Percona Server. The function builds on the existing VECTOR data type and TO_VECTOR()/FROM_VECTOR() functions, letting developers rank or filter embeddings by similarity without leaving MySQL. Under the hood, the implementation auto-detects CPU SIMD capabilities at startup rather than compiling for a specific architecture, and selects kernel width based on vector dimension size. Without an approximate-nearest-neighbor (ANN) index, similarity queries still perform a full O(n) table scan; ANN indexing (HNSW, IVF) is described as the next roadmap milestone to make large-scale similarity search fast.
Source: https://www.percona.com/blog/vector-distance-vector-similarity-search-in-percona-server-for-mysql. 8 Sync News only summarizes and links out; content copyright belongs to the authors and original sources.
Đang tải bình luận…
EF Core 10 giới thiệu các toán tử LeftJoin và RightJoin cấp first-class, cùng với named …
Dalibo đã phát hành bản ổn định 1.0 của PostgreSQL Migrator, công cụ mã nguồn mở miễn phí cho phép di chuyển database từ Oracle và MySQL/MariaDB sang PostgreSQL. Được xây dựng hoàn toàn bằng Go, công cụ này cung cấp khả năng kiểm tra catalog ngoại tuyến, đánh giá độ phức tạp, giao diện web tương tác, chuyển đổi schema và dữ liệu, biên dịch SQL/PL-SQL qua công cụ transqlate, và sao chép dữ liệu tốc độ cao. PostgreSQL Migrator hỗ trợ nguồn từ Oracle 11g đến 26ai và MySQL 8.4+/MariaDB 10+, nhắm đến PostgreSQL 16-19, với bản 1.0 hiện chỉ hỗ trợ chuyển đổi roles, schemas, sequences, tables, virtual columns, constraints và indexes. Dự án đạt độ ổn định sau 1 năm beta và release candidates, với cam kết tương thích về cấu hình, CLI và dự án cho tất cả các bản 1.x.
PostgreSQL Migrator 1.0 cung cấp giải pháp toàn diện để chuyển đổi cơ sở dữ liệu từ Oracle và MySQL sang PostgreSQL với nhiều tính năng mạnh mẽ.
Trên instance GCP c4d-standard-4, tiến trình MySQL tiêu tốn 10.4 GB RAM dù innodb_buffer_pool_size chỉ được thiết lập là 7168 MB. Khoảng trống này được truy qua 4 lớp: dự kiến overhead từ InnoDB/Performance Schema/thread-buffer, khoảng ~9% mmap chunk padding trên buffer pool, sự tích tụ dirty pages của jemalloc trên DR replica không hoạt động, và nguyên nhân gốc - MALLOC_CONF không được thiết lập khiến decay của background_thread bị vô hiệu hóa. Các sửa chữa gồm giảm buffer pool thành bội số sạch (6144 MB), cắt giảm max_connections từ 3000 xuống 500, bật background_thread của jemalloc với decay 5 giây, và thêm swap để phòng OOM, giúp giảm RSS xuống còn ~7.9 GB. Bài viết cung cấp kiến thức sâu về quản lý memory của MySQL khi sử dụng jemalloc, cách tối ưu buffer pool size và thiết lập MALLOC_CONF phù hợp.
Lập trình viên cần đọc bài này để hiểu cách điều khiển và tối ưu hóa bộ nhớ InnoDB trên MySQL khi các tham số cơ bản như innodb_buffer_pool_size không đủ để giải quyết cảnh báo nhớ, khi hệ thống vẫn tiêu thụ nhiều bộ nhớ hơn dự kiến do các yếu tố như cấu hình bộ nhớ phân vùng, quá trình làm sạch nhớ của jemalloc, hoặc tình trạng replica hoạt động không hiệu quả.
Người thực hành MySQL khuyên không nên dùng các kiểu dữ liệu phức tạp như TIMESTAMP, DATE/TIME hay ENUM, thay vào đó nên dùng các kiểu số đơn giản hơn. Việc sử dụng ENUM gặp vấn đề khi xóa giá trị buộc phải rebuild toàn bộ bảng, cùng lỗi MySQL khiến MIN()/MAX() hoạt động không nhất quán trên ENUM.
Lập trình viên nên đọc bài này để tránh rủi ro về hiệu suất, tính bảo trì và tính nhất quán khi sử dụng các kiểu dữ liệu phức tạp như ENUM và TIMESTAMP trong MySQL, mà thay vào đó có thể áp dụng các giải pháp đơn giản và đáng tin cậy hơn.
Doltgres đã đạt hiệu suất tương đương MySQL nhờ những tối ưu hóa gần đây.
Lập trình viên muốn tối ưu ứng dụng database cho hiệu suất cao và khả năng mở rộng nhanh chóng nên đọc bài này để khám phá cách Doltgres vượt trội so với MySQL trong các trường hợp sử dụng thực tế.
Bài viết phân tích cách .NET từng có nhiều ngôn ngữ truy vấn riêng cho từng định dạng dữ liệu trước khi LINQ ra đời nhằm thống nhất chúng. Sau đó, mọi định dạng dữ liệu đều dần được chuyển đổi thành objects và truy vấn bằng LINQ.
LINQ không chỉ là công cụ tìm kiếm dữ liệu mà còn là khái niệm trừu tượng hóa và tiêu chuẩn hóa cách xử lý dữ liệu trong các ngôn ngữ .NET, giúp lập trình viên tránh rắc rối của các ngôn ngữ riêng biệt và tối ưu hóa hiệu suất cho các ứng dụng lớn.
Để xây dựng platform semantic code search hiệu quả, nhóm đã thiết kế RAG pipeline xử lý code qua 3 giai đoạn chính: parsing code, chunking logic và vectorization. Tác giả sử dụng AST (Abstract Syntax Tree) để phân tích cấu trúc code trước khi chia thành các chunk nhỏ hơn 200 dòng mỗi đoạn. Mỗi chunk được vector hóa bằng model embedding text-embedding-3-small của OpenAI với dimension 1536. Kết quả cho thấy pipeline này giúp hệ thống truy xuất đoạn code chính xác tới 95% khi tìm kiếm ngữ nghĩa, đáng học hỏi để cải thiện performance trong RAG application thực tế.
Bài viết hướng dẫn xây dựng pipeline RAG để tìm kiếm mã nguồn ngữ nghĩa, giúp lập trình viên nâng cao kỹ năng xử lý và truy vấn dữ liệu code.
Một hệ thống đánh giá tùy chỉnh kiểm tra khả năng của các LLM khi đóng vai DBA tự động, thực hiện nhiệm vụ quản trị cơ sở dữ liệu như cài đặt MySQL/Percona Server và cấu hình replication trên máy chủ từ xa. Kết quả thử nghiệm với các mô hình Qwen, Kimi, GLM, DeepSeek, Gemma và Muse Glimmer cho thấy hầu hết đều hoàn thành thành công nhiệm vụ, với các mô hình nhỏ hơn thường đạt hiệu quả tương đương các mô hình lớn hơn chỉ bằng một phần mười chi phí nhưng cần thêm bước thực hiện. Khi thử nghiệm với yêu cầu phiên bản không tồn tại, hầu hết mô hình sẽ thay thế bằng phiên bản gần nhất có sẵn trong khi một mô từ chối cài đặt, cho thấy tầm quan trọng của guardrails khi các mô hình tự ra quyết định trong tự động hóa hạ tầng.
Bài này tiết lộ cách các mô hình LLM có thể hoạt động như DBA tự động, giúp bạn tiết kiệm chi phí đáng kể khi quản trị cơ sở dữ liệu.
Read the news here, practice coding, follow structured courses and train for IELTS on our sibling products — all connected through one 8 Sync account.
The ecosystem home: product overviews, blog and full pricing.
ExploreLearn along a clear roadmap: videos, auto-graded quizzes, certificates and mentors who ship for a living.
View the roadmap1,000+ DSA problems in Vietnamese, auto-graded across 7 languages — many FREE, right in your browser.
Practice for freeAI grading for all four IELTS skills with detailed rubric feedback.
Try it freeA 22 MB AI IDE for Vietnamese devs.
Download freeOrganizational memory for AI agents.
ExploreAI that staffs your Fanpage and qualifies leads for you.
Try it