Обновить
128K+

Базы данных *

Все об администрировании БД

228,71
Рейтинг
Сначала показывать
Порог рейтинга
Уровень сложности

Palantir — компания, которую никто не может объяснить

Время на прочтение10 мин
Охват и читатели1.8K

Палантиры (в переводе «те, что смотрят вдаль») - магические видящие камни во вселенной Толкина «Властелин колец».

Также была названа и компания. Из-за секретности первых контрактов с ЦРУ, ФБР и АНБ вокруг компании возник миф, что это «тайный мозг» правительства США, знающий о гражданах абсолютно всё.

Читать далее

Новости

Qwen3.8 27B обошла GPT-5.6 в SQL-бенчмарке. И всё это — локально на ноутбуке

Уровень сложностиСредний
Время на прочтение9 мин
Охват и читатели6.5K

Локальная Qwen3.8 27B обошла GPT-5.6 в SQL-бенчмарке, причём для её запуска хватило обычного MacBook. Стоимость запросов оказалась почти нулевой, но есть нюанс: на один ответ уходило несколько минут. Разбираемся, на что способен такой SQL-агент, где локальный запуск действительно выгоден и как настроить связку Qwen с DuckDB на своём ноутбуке.

Читать далее

Как мы строим хижину Postgres Pro

Уровень сложностиПростой
Время на прочтение15 мин
Охват и читатели11K

Хижину на высоте 3 930 метров в Кыргызстане пришлось сделать шире, чем в чертежах. Причина простая: матрасы оказались на несколько сантиметров больше, чем рассчитывали. К этому моменту материалы уже лежали на леднике: их привёз вертолёт, а недостающее мы дотаскивали в рюкзаках. Я работаю в Postgres Professional и около двадцати лет хожу в горы. Сейчас вместе с друзьями строю здесь новую хижину для альпинистов. Пока мы утепляем стены и собираем электрику, на ней уже ночуют люди, а по ночам заглядывают куницы. Для них мы закрыли все щели, но куницы всё равно нашли путь.

Читать далее

Обновления GigaIDE за сентябрь 2026

Время на прочтение5 мин
Охват и читатели6K

Как и в предыдущие месяцы, по итогам сентября мы решили рассказать про то, как изменилась GigaIDE за прошедший месяц. Ниже — краткий обзор обновлений Pro-функциональности GigaIDE, которую можно найти на нашем маркетплейсе.

Читать далее

SSD как кэш, HDD как постоянное хранилище: экспериментируем с кэшированием в bcachefs

Уровень сложностиПростой
Время на прочтение18 мин
Охват и читатели51K

Вы когда-нибудь задумывались над смыслом названия этой файловой системы? А между тем ключевая фича, с которой все начиналось, — это как раз кэширование.

Читать далее

Giper Baza − отечественная инфраструктура нового поколения

Уровень сложностиСредний
Время на прочтение10 мин
Охват и читатели6.1K

В цифровую эпоху приватность и надёжность хранения данных важны как никогда.

Сетевое разделение и недоверенные посредники ломают взаимодействие: санкции, ковровые блокировки, атаки на инфраструктуру, глухомань.

Владельцы серверов владеют данными: могут их свободно читать, сливать, менять, удалять.

Наблюдается кризис доверия к софту и запрос на импортозамещение.

Техно-гильдия Giper.Dev приняла этот вызов, и вот что у нас получилось...

Какой у нас план?

Настройка HAProxy для автоматического определения ролей экземпляров PostgreSQL и защиты от split brain

Уровень сложностиСложный
Время на прочтение18 мин
Охват и читатели10K

HAProxy должен выполнять проверки, чтобы определить роль экземпляров PostgreSQL: мастер или реплика, чтобы направлять соединения на подходящие сервера. В статье описываются способы настройки HAProxy для обнаружения переключения ролей экземпляров PostgreSQL через Patroni REST API, через параметр in_hot_standby, передаваемый сервером сразу после аутентификации клиента, или запросом select pg_is_in_recovery(); Два последних способа используются, если Patroni поставлен на паузу или не используется.

Читать далее

Бэкап был, восстановить было нечего: как pg_dump молча собирал битые дампы из‑за row‑level security

Уровень сложностиСредний
Время на прочтение4 мин
Охват и читатели6.2K

Если у вас PostgreSQL с включённым row-level security и ночной pg_dump по таймеру, откройте каталог с бэкапами и сравните размеры вчерашнего и позавчерашнего дампов. Если файлы подозрительно одинаковые и маленькие, возможно, у вас нет ни одного рабочего бэкапа. У нас так было не меньше двух недель.

Читать далее

Векторизованное колоночное исполнение запросов в PostgreSQL 19

Уровень сложностиСложный
Время на прочтение21 мин
Охват и читатели7.9K

На прошлой неделе я перенес форк Apache Cloudberry на PostgreSQL 19 в виде набора расширений и рассказал, где этот порт проигрывает оригинальному форку. Впрочем как и Cloudberry на ClickBench современные колоночные движки обгоняют его на порядок. И дело тут не в реализации MPP, а в исполнителе PostgreSQL - он работает с кортежами в памяти СУБД. Каждый кортеж проходит отдельно, значение проходит через fmgr, а сегменты кластера лишь добавляют число процессоров на котором крутится тот же самый цикл по строкам таблицы.

Следующий логичный шаг для ускорения - векторизованный исполнитель в PostgreSQL. В открытом коде Apache Cloudberry его нет: от закрытого движка в репозитарии остались только следы - флаг create_vectorization_plan, который планировщик всегда передает как false, а также узел WindowHashAgg без реализации и адаптер PAX под VEC_BUILD, который не компилируется. Проектировать придется самому и, конечно, снова в виде расширения постгреса. Так появился pg_vexec - набор расширений для PostgreSQL 19.

Проект не требует модификации ядра PostgreSQL даже при использовании планировщика ORCA в одноузловой конфигурации без координатора на ванильной сборке PostgreSQL. Модуль gp_orca из порта Cloudberry теперь собирается без pg_core и прочих потрохов greenplum и патчей ядра СУБД, а vexec превращает ORCA в векторный планировщик с исполнителем в “одном флаконе”: его оптимизатор оценивает стоимости теперь и векторных узлов, а транслятор генерирует эти узлы в плане. Патчи ядра не нужны, только если не нужна функциональность и колоночное хранение данных таблиц из Cloudberry. Если же загрузить расширение Cloudberry на пропатченном ядре постгреса, то vexec может более эффективно читать и писать колоночные PAX и ao_column, без лишних конвертаций из и в строки, а Motion тогда может передавать между сегментами данные сразу в колоночном формате Arrow IPC.

И к постгресу можно подключаться как по привычному pgwire протоколу, так и по более современному Flight SQL, что могут оценить те кто будет запускать ML модели на данных из PostgreSQL. Как минимум при загрузке данных в polars скажут мне спасибо!

Читать далее

Таймаут в секунду, запрос на 43 секунды: пять ловушек PgBouncer в режиме транзакций

Уровень сложностиСредний
Время на прочтение6 мин
Охват и читатели7.1K

В настройках клиента базы стоял statement_timeout в одну секунду, а запрос выполнялся больше сорока. Таймаут выглядел включённым и не действовал. У этой поломки нашлись четыре родственницы. Пулер в тексте ошибки назвала только одна. Остальные выглядели как пропавшая таблица, недоступная база и простой после выката.

Читать далее

Почему COALESCE ломает план PostgreSQL и как научить планировщик считать его селективность?

Уровень сложностиСредний
Время на прочтение6 мин
Охват и читатели88K

Один COALESCE в условии способен превратить быстрый Hash Join в мучительно долгий Nested Loop. Убрать оператор COALESCE — и оценка стоимости плана упадёт в десятки раз, а запрос отработает мнгновенно. В данных при этом не меняется ничего: та же колонка, та же статистика, та же селективность, просто без COALESCE планировщик её видит, а с ним — перестаёт. Обсудим, как один COALESCE в JOIN роняет план, почему PostgreSQL теряет на нём оценку, и посмотрим на патч, который учит планировщик считать селективность COALESCE из имеющейся статистики.

Читать далее

Поддержка YDB в Ptah 0.13.0: описание схемы в HCL и управление миграциями

Уровень сложностиСредний
Время на прочтение26 мин
Охват и читатели4.7K

В Ptah 0.13.0 появилась нативная поддержка YDB. Ptah умеет читать текущую схему базы, сравнивать её с декларативным описанием и на основе разницы строить план изменений или генерировать версионные миграции. В статье разберём этот процесс на примере HCL-схемы, посмотрим на работу с индексами и drift detection, а также на особенности YDB, которые приходится учитывать при миграциях: разные возможности версий, feature flags и нетранзакционный DDL.

Читать далее

Параллельное (конкурентное) создание индексов на секционированных таблицах

Уровень сложностиСредний
Время на прочтение7 мин
Охват и читатели5.2K

Привет, Хабр! Сейчас многие компании активно занимаются вопросом «импортозамещения» и мне выпала задача отвечать за поддержку и миграцию сервиса логирования. Хочу рассказать с какой проблемой я столкнулся при доработке сервиса логирования на PostgreSQL, а именно, создание индекса на высоконагруженной таблице.

Читать далее

Ближайшие события

Книга: «Высоконагруженные приложения. Программирование, масштабирование, поддержка. 2-е изд»

Время на прочтение4 мин
Охват и читатели6.3K

Привет, Хаброжители! Сегодня данные играют главенствующую роль в проектировании систем, и нужно обеспечить их масштабируемость, согласованность, надежность, производительность и удобство сопровождения. Необходимо учитывать огромное разнообразие систем хранения данных: реляционных баз данных, хранилищ NoSQL, складов и озер данных, а также облачных и локальных сервисов и встроенных баз данных.

С новым обновленным изданием книги вы сможете разобраться в терминологии и решить какой вариант лучше всего подойдет для вашего приложения.

Читать далее

PostgreSQL 19: Коммитфест 2026-03 Часть 5.4 (SQL, DEV1, DEV2)

Время на прочтение7 мин
Охват и читатели6K

Завершаем обзор мартовского коммитфеста 19-й версии. В четвертой и последней статье серии рассмотрим изменения, относящиеся к языку SQL и материалам курсов DEV1 и DEV2.

Напоминаю план статей о последнем коммитфесте 19-й версии:

Часть 5.1 (QPT)

Часть 5.2 (DBA1, DBA2)

Часть 5.3 (DBA3, DBS)

Часть 5.4 (SQL, DEV1, DEV2) – мы здесь 🙂

Об изменениях в предыдущих коммитфестах рассказано здесь: 2025-07, 2025-09, 2025-11, 2026-01.

Читать далее

DVT — новый open source ETL (Low-Code и не только)

Время на прочтение5 мин
Охват и читатели5.5K

Привет! На связи Сергей Скирдин, технический директор ИТ-интегратора «Белый код». Я достаточно много занимаюсь интеграциями, хранилищами данных и BI, поэтому, когда ребята из «Денвик Аналитика» предложили познакомиться с новым инструментом DVT, не стал отказываться.

Читать далее

PostgreSQL 19: Коммитфест 2026-03 Часть 5.3 (DBA3, DBS)

Уровень сложностиСредний
Время на прочтение10 мин
Охват и читатели6.9K

Продолжаем обзор мартовского коммитфеста 19-й версии. В третьей статье серии рассмотрим изменения, относящиеся к материалам курсов DBA3 и DBS.

Напоминаю план статей о последнем коммитфесте 19-й версии:

Часть 5.1 (QPT)

Часть 5.2 (DBA1, DBA2)

Часть 5.3 (DBA3, DBS) – мы здесь 🙂

Часть 5.4 (SQL, DEV1, DEV2)

Об изменениях в предыдущих коммитфестах рассказано здесь: 2025-07, 2025-09, 2025-11, 2026-01.

Читать далее

Сравнение провайдеров managed PostgreSQL

Время на прочтение8 мин
Охват и читатели6.1K

PostgreSQL является самой распространённой СУБД согласно исследованию StackOverflow. Но самостоятельный хостинг PostgreSQL сопряжён с риском потери данных и неоптимальной настройки.

В статье мы рассмотрим основных международных и российских провайдеров managed PostgreSQL. Их сильные и слабые стороны и сценарии оптимального использования.

Читать далее

Копия базы 1С оборвалась, а gzip -t и psql вернули 0

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели5.9K

Оборванная копия PostgreSQL может пройти gzip -t, заливку через psql и даже строгий режим с ON_ERROR_STOP: на стенде 1С все три вернули 0. Что такой обрыв всё-таки ловит, разобрано по опытам. Рядом фрагмент копии, прогнанный там же.

Какая проверка ловит оборванную копию

Я ускорил запрос в 75 раз. Через две недели оказалось, что дело было не в запросе

Время на прочтение5 мин
Охват и читатели7.8K

Добавил фильтр по городу в подзапрос — туда, куда учебники и велят его ставить. На тестовой базе в 750 строк незаметно, на проде запрос стал висеть: 0,71 с превратились в 53,7 с. Починил, замеры оставил в комментарии. Спустя две недели сел писать про это статью, перемерил — и тот же запрос на той же базе отработал за полсекунды. Разбираю, почему катастрофа рассосалась сама, почему дело было не в join и почему измеренная цифра в комментарии протухает быстрее, чем кажется.

Читать далее
1
23 ...