OpenAI опубликовали новый технический блог, в котором рассказали о том, как PostgreSQL поддерживает работу ChatGPT, имеющего от 800 до 900 миллионов активных пользователей еженедельно. Инженер компании Бохан Чжан поделился подробностями на конференции PGConf.Dev 2025. Оказалось, что OpenAI использует архитектуру с одним основным сервером и около 50 репликами для чтения, обходясь без шардирования. Кластер способен обрабатывать более миллиона запросов в секунду, обеспечивая время отклика менее 10 миллисекунд на 99-м перцентиле, и это достигается на стандартном PostgreSQL без кастомных модификаций.
Основная трудность заключается в операциях записи, так как они идут только через один сервер. Команда оптимизирует этот процесс, используя отложенную запись и контролируя скорость массовой загрузки. Изменения схемы также строго регламентированы. Чтение, в свою очередь, масштабируется гораздо легче благодаря распределению реплик по регионам и приоритетному разделению трафика. За последние девять месяцев был зафиксирован лишь один серьезный инцидент, связанный с PostgreSQL. Подход OpenAI к архитектуре отличается от общепринятого тренда на распределенные базы данных, что позволяет им максимально использовать возможности одного кластера.

