Нестабильность статистики PostgreSQL и альтернативный сборщик

Стандартный сборщик статистики PostgreSQL может приводить к нестабильности планов запросов из-за стохастической природы сбора данных. Даже увеличение параметра default_statistics_target не гарантирует стабильности, особенно для полей с большим количеством дубликатов. Это затрудняет воспроизводимость бенчмарков и сравнительный анализ результатов.
Нестабильность статистики PostgreSQL и альтернативный сборщик
Изображение носит иллюстративный характер

Флуктуации в оценках количества строк, выбираемых из таблицы, могут начинаться уже на стадии SeqScan. Оценка выражений вида x = ANY (...) основывается на суммировании вероятностей для каждого элемента. Даже небольшие изменения частотности элементов выборки могут приводить к изменениям в итоговых оценках и, как следствие, к смене плана запроса.

В качестве решения предлагается создать расширение для PostgreSQL, которое позволит реализовать более точный сбор статистики, проходя всю таблицу и подсчитывая количество различных значений (ndistinct) и MCV. Расширение может цепляться к SeqScan нодам запросов через CustomScan. При этом можно будет использовать два хука get_relation_stats_hook и get_index_stats_hook для подмены стандартной статистики.

Такое расширение позволит реализовать предикатную статистику и более эффективно управлять статистикой для партиционированных таблиц. Также, можно будет использовать индексы для упрощения вычислений и реализовывать иные алгоритмы выборки. Хранение статистики может быть организовано в отдельной таблице pg_statistic_extra.


Новое на сайте

19817В Луксоре нашли стелу с римским императором в образе фараона 19816Экипаж Artemis II о моменте, когда земля исчезла за луной 19815Почему луна выглядит по-разному в разных точках земли? 19814Adobe экстренно закрыла опасную дыру в Acrobat Reader, которую хакеры использовали с... 19813Метеорный поток, рождённый из умирающего астероида 19812Когда робот пишет за тебя прощальную смс 19811Что общего у лунной миссии, толстого попугая, загадочной плащаницы и лекарства от диабета? 19810Какие снимки Artemis II уже стали иконами лунной программы? 19809Кто на самом деле хочет сладкого — вы или ваши бактерии? 19808Как рекламные данные 500 миллионов телефонов оказались в руках спецслужб? 19807Экипаж Artemis II вернулся на землю после десяти дней в космосе 19806Зелёная и коричневая луна: почему геологи Artemis II уже не могут усидеть на месте 19805Эксперты уверены в теплозащитном щите Artemis II, несмотря на проблемы предшественника 19804Выжить внутри торнадо: каково это — когда тебя засасывает в воронку 19803Аляскинские косатки-охотники на млекопитающих замечены у берегов Сиэтла
Ссылка