PostgreSQL'de composite index kolon sırasını nasıl seçerim?
Soru
Milyonlarca satırlı bir `orders` tablom var ve en sık sorgum `WHERE user_id = X AND status = 'completed' ORDER BY created_at DESC`. Şu an çok yavaş çalışıyor; tabloda `user_id`, `status` ve `created_at` için ayrı ayrı tekli indeksler var, DB bunları Bitmap Index Scan ile birleştirmeye çalışınca maliyet patlıyor. En verimli composite index sırası ne olmalı? Kolonların seçicilik (cardinality) oranı bu sırayı nasıl etkiliyor?
Cevap
Kısa cevap: Bu sorgu için tek bir composite index kur — (user_id, status, created_at DESC). Eşitlik kolonları başa, ORDER BY kolonu en sona; gerisi kendiliğinden çözülür.
Kısa cevap
Yaşadığın yavaşlık index eksikliği değil, yanlış index biçimi: üç ayrı tekli indeksi DB Bitmap Index Scan ile birleştirip sonra ayrı bir Sort adımı çalıştırmak zorunda kalıyor, ikisi de pahalı. Aynı “sıcak tabloyu hangi kolona göre düzenlemeli” sorusunun kiracı bazlı hâlini multi-tenant izolasyon kaydında ele almıştım.
Neden
-
Eşitlik kolonları önde, sıralama kolonu sonda olmalı. B-tree, eşitlik filtresini uyguladıktan sonra satırları zaten sıralı verir; ayrı bir Sort adımına gerek kalmaz. Sıra bozulursa planlayıcı sıralamayı kendisi yapmak zorunda kalır.
-
Cardinality burada ikincil. Her iki kolon da eşitlik predicate’i olduğu için asıl kazanç sıralamayı index’e taşımakta; eşitlik kolonları arasında sıra, index’in ne kadarının taranacağını değiştirmez (PostgreSQL kılavuzu: baştaki kolonlardaki eşitlik koşulları taranan bölümü sınırlar);
user_idbaşa gidiyor çünkü yalnızcauser_idile filtreleyen sorgulara da hizmet ediyor. -
Fazlalık index bedava değil. Tekli
user_idindeksi artık composite’in gereksiz bir öneki, ama her yazmada hâlâ güncelleniyor.
Ne yapmalı
-
(user_id, status, created_at DESC)composite index’ini kur. Eşitlik kolonları başta, ORDER BY kolonu sonda. -
DESC’i index tanımına yazmak burada isteğe bağlı. PostgreSQL bir B-tree’yi geriye doğru tarayabilir; baştaki iki kolon eşitlikle sabitlendiğinde(user_id, status, created_at)deORDER BY created_at DESC’i karşılar. Index’in sorguyu belgelemesini istiyorsan yönü yaz; ORDER BY yönleri karışıksa (ör.x ASC, y DESC) gerçekten gerekir. -
EXPLAIN (ANALYZE, BUFFERS)ile doğrula. İstediğin plan tek bir Index Scan —Bitmap Index Scan+Sortdeğil. Planda hâlâ Sort görüyorsan kolon sırasına bak: sıralama kolonu eşitlik kolonlarından sonra gelmeli. -
Tekli
user_idindeksini sil. Composite, baştaki kolon üzerindeki her aramayı zaten karşılıyor.statusvecreated_atindeksleri composite’in öneki değil; başka sorgular kullanıyorsa tut, silmeden öncepg_stat_user_indexes’e bak. -
completedbaskınsa partial index düşün. Sorgularının çoğustatus = 'completed'iseWHERE status = 'completed'koşullu partial index kullan: index boyutunu küçültür, RAM’de daha çok tutabilir, yazma maliyetini düşürür.
Sonuç: Ben olsam (user_id, status, created_at DESC) composite index’ini kurar, EXPLAIN (ANALYZE, BUFFERS) ile Index Scan’e düştüğünü doğrular ve gereksiz kalan user_id indeksini silerdim. Trafiğin tek bir status’e yığılıyorsa partial index’le bir tur daha sık. Indeksleme ile native SQL’in dengesi üzerine daha derin bir tartışma için sade.dev’deki yazıya bak.
İlgili Yazılar
Yorumlar
Yorum yapmak için GitHub hesabınızla giriş yapmanız yeterli. Yorumlar GitHub Discussions üzerinde saklanır.