Cơ sở dữ liệu 30/10/2025 8 phút

Tìm 1 dòng trong 10 triệu chỉ tốn 3 lần đọc trang — và vì sao thêm dữ liệu gần như không làm chậm

Chỉ mục B-tree lớn hơn 5.350 lần mà thời gian tìm chỉ tăng 7%, nhờ mỗi nút chứa ~366 khoá nên cây chỉ cao 3 tầng. Đo cái giá phải trả khi ghi (bốn chỉ mục làm chèn chậm 3,5 lần) và chỗ UPDATE mất cơ chế HOT khi cột có chỉ mục.

Cơ sở dữ liệu 29/10/2025 8 phút

Quét toàn bảng nhanh hơn dùng chỉ mục khi lấy quá 45% số dòng — và bộ tối ưu chuyển sớm ở 32%

Thấy Seq Scan là thêm chỉ mục — nhưng có một ngưỡng mà quét toàn bảng thật sự nhanh hơn. Đo ngưỡng đó trên 2 triệu dòng, và hai thứ dịch chuyển nó: random_page_cost (mặc định từ thời đĩa quay) và thứ tự vật lý của dữ liệu.

Cơ sở dữ liệu 28/10/2025 8 phút

Bộ tối ưu tin có 3 dòng, thực tế có 500.001 — lệch 166.667 lần, và vì sao con số đó quyết định tất cả

Gần như mọi truy vấn chậm bất thường đều bắt đầu từ một con số: chênh lệch giữa rows dự đoán và rows thật. Đo ba nguồn làm bộ tối ưu PostgreSQL đoán lệch, nặng nhất 166.667 lần — và một điều nó vẫn làm đúng dù thống kê rỗng hoàn toàn.

Cơ sở dữ liệu 27/10/2025 8 phút

Nút ghi 0,003 ms nên bỏ qua? Nó chạy 49 lần — ba con số trong EXPLAIN ai cũng đọc sai

SQL nói bạn MUỐN gì, không nói LÀM THẾ NÀO — bộ lập lịch tự nghĩ ra cách làm, và EXPLAIN là cửa sổ nhìn vào đó. Mổ từng con số cost, rows, loops, buffers; ba chỗ hay đọc sai; và một ước lượng lệch 83 lần vì bộ tối ưu tưởng hai cột độc lập.

Cơ sở dữ liệu 26/10/2025 8 phút

Một dòng NULL làm NOT IN trả về rỗng — không lỗi, không cảnh báo, và còn chạy nhanh hơn

NULL không phải một giá trị, nó là 'chỗ chưa biết', và SQL xử lý nó bằng logic ba trạng thái. Hệ quả: một dòng NULL trong bảng con làm NOT IN xoá sạch kết quả, phong <> 'Ky thuat' bỏ sót người phòng trống, avg() chia nhầm mẫu số — tất cả im lặng.