Архитектор(GraDeLy)
Summary
Designs and evolves GraDeLy, a CDC platform that replicates PostgreSQL changes via pgoutput into Kafka, ensuring consistency, observability and secure operation in distributed environments.
**GraDeLy** — платформенный сервис для организации и управления репликацией данных. Изменения считываются из журнала транзакций PostgreSQL через механизм логической репликации и плагин **pgoutput**. Продукт должен обеспечивать управляемую и наблюдаемую репликацию в распределённой среде, включая первичную загрузку данных, потоковую передачу изменений, восстановление после сбоев и безопасную эксплуатацию.
**Технологический контекст:** Java, Spring Boot, PostgreSQL, pgoutput, Kafka, Docker, Kubernetes/OpenShift, CI/CD, TLS/mTLS, PKCS#12, мониторинг и журналирование.### Твои задачи:
* анализировать текущую архитектуру GraDeLy, выявлять узкие места, технический долг, риски масштабирования, отказоустойчивости и сопровождения
* проектировать концептуальную и детальную архитектуру компонентов управления и исполнения репликации, их взаимодействие и границы ответственности
* прорабатывать полный жизненный цикл CDC: первичную синхронизацию, переход к потоковой репликации, хранение и восстановление позиции чтения, обработку транзакций, повторную доставку и перезапуск после сбоев
* определять гарантии доставки и консистентности: порядок событий, идемпотентность, дедупликацию, обработку частичных ошибок, повторов и рассинхронизации состояния компонентов
* проектировать работу с PostgreSQL: publication, replication slot, LSN, snapshot/MVCC, транзакционные границы, изменения схемы, права доступа и ограничения логической репликации
* проектировать интеграцию с Kafka
* формировать требования к высокой доступности, производительности и масштабированию: кластеризация, распределение нагрузки между workers, выбор владельца процесса, защита от гонок и split-brain-сценариев
* определять архитектуру наблюдаемости: технические и бизнес-метрики репликации, lag, состояние модулей и процессов, трассировка, аудит, алертинг и диагностика инцидентов
* прорабатывать требования информационной безопасности: принцип наименьших привилегий, TLS/mTLS, управление сертификатами и секретами, ротация, разграничение доступа и безопасное журналирование
* разрабатывать архитектурные и аналитические артефакты: C4/UML-диаграммы, sequence diagrams, ADR, технические задания, API-контракты, модели состояний и нефункциональные требования
* обосновывать, согласовывать и защищать архитектурные решения со смежными командами, эксплуатацией, DevOps/SRE и подразделениями информационной безопасности
* участвовать в формировании roadmap и backlog продукта, оценивать архитектурное влияние изменений и выбирать решения с учетом стоимости.### Мы ожидаем, что у тебя есть:
* высшее техническое образование либо сопоставимый практический опыт в разработке программного обеспечения.
* опыт работы в разработке ИТ-продуктов от 3 лет; опыт выполнения архитектурных задач или роли ведущего инженера/системного аналитика — от 2 лет.
* практический опыт проектирования распределённых, интеграционных или высоконагруженных систем и сопровождения решений до промышленной эксплуатации.
* глубокое понимание PostgreSQL: WAL, logical decoding, logical replication, publications, replication slots, LSN, MVCC, транзакции, блокировки и репликационные права.
* уверенное знание Apache Kafka: топики, партиции, порядок сообщений, consumer groups, rebalance, delivery semantics, идемпотентность и управление нагрузкой.
* знание протоколов и механизмов интеграции: TCP, HTTP/REST, JDBC, TLS/mTLS; форматов JSON и YAML.
* уверенное владение инструментами архитектурного описания и документирования: C4, UML, sequence/state diagrams, ADR, PlantUML/Draw.io, Git, Confluence и Jira.
* умение декомпозировать сложные задачи, аргументировать решения, фиксировать компромиссы и договариваться с участниками разных ролей
* опыт создания AI-агентов и использования их в работе будет преимуществом.
**Будет плюсом:**
* опыт разработки или архитектурного развития репликаторов, CDC-, ETL/ELT- или стриминговых платформ
* опыт проектирования multi-tenant-решений и систем с динамическим распределением задач между workers
* практический опыт построения observability на базе Prometheus/Grafana/OpenTelemetry и сопровождения production-инцидентов.
===### Работа в СберТехе - это:
* гибридный формат работы
* годовой бонус и ежегодный пересмотр зарплаты
* статус аккредитованной ИТ-компании
* расширенный ДМС с первого дня и льготное страхование для семьи
* корпоративный университет Сбера, внутренняя образовательная платформа, участие в IT-конференциях
* 90 дней удаленной работы из любого региона РФ
* льготная ипотека в Сбере
* бесплатная подписка СберПрайм, которой можно поделиться с 3 близкими.