OpenAI опубликовала новый технический блог, в котором описала, как PostgreSQL обслуживает ChatGPT, использующийся 800-900 миллионами активных пользователей каждую неделю. Неожиданностью стало то, что для своей работы компания не применяет шардирование, а полагается на архитектуру с одним основным сервером и около 50 репликами для чтения. Инженер OpenAI Бохан Чжан поделился подробностями на конференции PGConf.Dev 2025. Он сообщил, что кластер обрабатывает более миллиона запросов в секунду, обеспечивая время отклика в низкие двузначные миллисекунды на 99-м перцентиле. Эта эффективность достигается на стандартном PostgreSQL без каких-либо кастомных модификаций, но с грамотной настройкой пулинга соединений и оптимизацией запросов. Однако, узким местом остаётся запись, так как все операции записи проходят через единственный основной сервер. Для оптимизации команда использует различные методы, включая отложенную запись и контроль за массовой загрузкой данных. Чтение же масштабируется проще благодаря репликам, распределённым по регионам, что позволяет разделить трафик по приоритетам. За последние девять месяцев архитектура PostgreSQL показала лишь один серьезный инцидент. Подход OpenAI отличается от общемировых трендов, так как шардирование, несмотря на упрощение масштабирования записи, усложняет другие аспекты работы с данными.
