Skip to content

Вопросы на собеседовании: Архитектор решений

100 реальных вопросов с образцовыми ответами и пояснениями для уровня Senior.

Смотреть пример резюме: Архитектор решений

Тренировка флешкарточками

Интервальное повторение · Hunter Pass

Вопросы

designcloud-regionsauth

Я буду резервировать ключ каждого платежа в глобально согласованном хранилище, а финансовую запись оставлю одному региональному владельцу.

  • Amazon Route 53 направляет клиента в ближайший регион, где conditional write в DynamoDB Global Tables с multi-region strong consistency резервирует UUID до списания.
  • Региональный реестр PostgreSQL имеет тот же уникальный ключ, платёжный провайдер получает его при каждом повторе, а outbox публикует PaymentAuthorized только после коммита.
  • Каждый регион работает на 60% пиковой мощности, чтобы два оставшихся приняли отказавшую нагрузку; это примерно на 50% дороже active-passive, но убирает 20-минутный RTO переключения.

Зачем это спрашивают: Интервьюер оценивает, выполняет ли проект измеримые требования к задержке и корректности без предположения, что глобальная согласованность бесплатна.

designcloud-modelscloud

Я использую общие ячейки для стандартных арендаторов, а выделенные аккаунты и базы только для регулируемых банков.

  • Двадцать ячеек с PostgreSQL row-level security вмещают примерно по 1 000 стандартных арендаторов и ограничивают отказ ячейки 5% общей группы.
  • Каждый банк получает аккаунт AWS, ключ KMS и кластер Aurora, что добавляет около $1 200 в месяц, но выполняет договорную изоляцию и восстановление отдельного клиента.
  • Управляющий слой сопоставляет tenant ID с ячейками, применяет квоты и поддерживает перенос через CDC, поэтому выросший клиент меняет уровень без изменения API.

Зачем это спрашивают: Сильный ответ балансирует изоляцию, область отказа, возможность переноса и конкретный бюджет.

designcloud-regions

Я разделю регулируемые исходные записи по юрисдикциям и буду глобально реплицировать только одобренную модель чтения.

  • PII из ЕС остаются в eu-west-1, а PII из США в us-east-1; данные шифруются региональными ключами AWS KMS и доступны через привязанные к региону endpoints.
  • Топики Kafka передают события ProfileDisplayNameChanged без адресов и налоговых номеров, а региональные consumers строят модели Redis с целью свежести 60 секунд.
  • Глобальная репликация добавляет около $9 000 в месяц на брокеры, cache и transfer, но копирование полных PII нарушило бы резидентность и расширило аудит.

Зачем это спрашивают: Интервьюер проверяет, охватывает ли контроль резидентности payload, ключи, события и модели чтения при сохранении низкой задержки.

oauthapidesign

Я размещу версионируемый REST-контракт за Kong Gateway и разделю аутентификацию, квоты и бизнес-обработку.

  • Kong проверяет OAuth 2.0 токены от Okta, применяет token bucket квоты в Redis и возвращает заголовки RateLimit до передачи трафика региональным сервисам.
  • OpenAPI служит источником контракта, расширения остаются в v1, а несовместимые изменения переходят в v2 с 12 месяцами параллельной работы и consumer contract tests.
  • Управляемый gateway сократил бы эксплуатацию, но стоил бы около $90 000 в месяц при 25 000 RPS, тогда как Kong в Kubernetes стоит около $35 000 плюс два человеко-месяца в год.

Зачем это спрашивают: Интервьюер оценивает жизненный цикл API, управление трафиком и явный ценовой компромисс между управляемой и собственной эксплуатацией.

designconcurrency

Я синхронно зафиксирую заказ, а fulfillment перенесу в событийный процесс.

  • Checkout API записывает Order и outbox в одной транзакции PostgreSQL за 250 мс, затем Debezium публикует OrderPlaced в Kafka без разрыва dual-write.
  • Consumers для запасов, списания платежа и доставки используют order ID как ключ идемпотентности, а Temporal координирует компенсацию после исчерпания повторов.
  • Kafka и Temporal добавляют около $28 000 в месяц и задержку проекций, но убирают медленные складские API из checkout и поглощают десятикратный всплеск трафика.

Зачем это спрашивают: Сильный ответ отделяет критичный по задержке commit от длительной работы и учитывает атомарную публикацию и компенсацию.

backlogdesign

Я использую отдельные очереди Amazon SQS для уровней сервиса, взвешенные пулы workers и явные ограничения приёма.

  • Premium, standard и bulk очереди получают минимум 60%, 30% и 10% мощности workers, а свободная мощность может временно перераспределяться.
  • Producers ограничиваются, когда возраст bulk превышает 30 минут или очередь достигает 50 миллионов сообщений; после пяти попыток задачи переходят в именованные dead-letter queues.
  • SQS стоит примерно $21 000 в месяц при таком объёме; Kafka могла бы снизить цену сообщения, но добавляет управление партициями и слабее поддерживает задержку отдельных сообщений.

Зачем это спрашивают: Интервьюер проверяет изоляцию приоритетов, ограничение backlog, обработку ошибок и экономику технологии очередей.

system-designcloud-migrationmigrations

Я буду переносить отдельные возможности полиса за anti-corruption API, а не заменять весь mainframe одним переключением.

  • В месяцы 1-3 карта охватывает COBOL-правила, вызовы и владение данными; в месяцы 4-8 появляются адаптеры Apigee и IBM MQ, сначала переносятся read-only возможности.
  • В месяцы 9-13 CDC переносит изменения в PostgreSQL, количества и финансовые итоги сверяются ежедневно, затем запись переключается по одной продуктовой линии с четырёхчасовой границей отката; в месяц 14 адаптеры удаляются после 30 стабильных дней.
  • Пять месяцев параллельной работы стоят около $700 000, но ограничивают семантический риск и риск потери данных, которые единый cutover сосредоточил бы в одном окне.

Зачем это спрашивают: Интервьюер оценивает поэтапное сосуществование, контроль зависимостей, измеримую сверку и цену снижения риска.

databasepostgresmigrations

Я совмещу преобразование схемы, массовую загрузку и непрерывную репликацию, а затем передам право записи на отрепетированном переключении.

  • В месяцы 1-2 AWS SCT классифицирует несовместимый PL/SQL и определяет переработки; в месяцы 3-5 snapshots загружаются, а AWS DMS CDC держит lag ниже 30 секунд.
  • В месяцы 6-8 shadow traffic выполняет dual-read, сравниваются количества строк, checksums и 25 финансовых инвариантов, затем дважды репетируется 20-минутная остановка записи и смена DNS.
  • В месяц 9 запись останавливается, lag DMS доводится до нуля, право записи переключается, а Oracle остаётся изолированным, но доступным для отката в течение четырёх часов.
  • Aurora экономит ориентировочно $420 000 лицензий в год, миграция стоит около $650 000, а основные риски связаны с семантикой sequences, isolation и stored procedures.

Зачем это спрашивают: Сильный ответ включает этапы, контрольные точки, числа переключения, технологии и полную экономику миграции.

monolithmicroservicesdatabase

Я применю strangler architecture к бизнес-срезам, пока монолит остаётся первоначальным источником истины.

  • Фасад AWS API Gateway маршрутизирует по одной возможности, начиная с поиска товаров, затем promotions, а contract tests защищают действующих мобильных клиентов.
  • Новые сервисы публикуют domain events через outbox в Kafka, но запись в общие таблицы прекращается только после получения каждым срезом собственной схемы и сверки 99,999%.
  • Параллельная работа стеков добавляет около $45 000 в месяц на 12 месяцев, но ограничивает откат одной возможностью и не требует останавливать 120 разработчиков ради rewrite.

Зачем это спрашивают: Интервьюер проверяет конкретный порядок извлечения, условия владения данными, цену сосуществования и границы отката.

databasedesignlatency

Я разверну два независимых канала ExpressRoute по 10 Гбит/с и буду считать гибридные зависимости временной миграционной инфраструктурой.

  • Каналы завершаются в разных peering locations и хабах Azure Virtual WAN, а суммарные BGP-маршруты не позволяют 80 сетям публиковать отдельные prefixes.
  • Private DNS, федерация Entra ID, сертификаты и мониторинг проверяются до первой волны; приложения с задержкой выше 15 мс переносятся вместе со своими базами.
  • Резервированные каналы стоят около $32 000 в месяц против $6 000 для VPN, но VPN не выполняют требования к throughput и jitter базы.

Зачем это спрашивают: Сильный ответ выводит сеть из измеренных требований к полосе и задержке, учитывает общие зависимости и оценивает цену резервирования.

deploymentconcurrency

Я выберу Apache Kafka, потому что партиционированный порядок, replay и гибридное развёртывание являются основными требованиями.

  • Customer ID служит ключом для 384 партиций, рассчитанных менее чем на 1 000 событий в секунду каждая и с 30% запаса роста.
  • Три брокера на площадку и MirrorMaker 2 реплицируют выбранные топики, а Schema Registry проверяет обратную совместимость Avro-контрактов.
  • Managed Confluent стоит около $110 000 в месяц против $55 000 для своей эксплуатации; доплата оправдана, если нет трёх platform engineers для обновлений и восстановления.

Зачем это спрашивают: Интервьюер оценивает выбор технологии по требованиям порядка и replay вместе с реалистичным сравнением эксплуатационной цены.

concurrency

Я выберу Amazon SQS Standard, потому что нагрузке нужна долговечная эластичная очередь, а не маршрутизация брокера или строгий порядок.

  • SQS предоставляет visibility timeout, задержку сообщений, dead-letter queues и автоматическое масштабирование выше среднего в 174 задачи в секунду и пика в 2 000.
  • Workers хранят job ID в DynamoDB для идемпотентности, поскольку at-least-once допускает дубликаты.
  • Запросы SQS стоят примерно $400 в месяц, а отказоустойчивый RabbitMQ около $3 000 плюс патчи и управление ёмкостью.

Зачем это спрашивают: Сильный ответ выбирает более простую очередь по конкретной семантике и оценивает обработку дубликатов и цену.

dependencies

Я использую синхронные вызовы только для решений до завершения checkout, а события для работы вне этого ответа.

  • Налог рассчитывается через gRPC с timeout 80 мс и кэшированными таблицами юрисдикций, поскольку результат сразу меняет сумму к оплате.
  • Fraud вызывается параллельно по gRPC с бюджетом 250 мс и fail-closed для сумм выше $500, а CheckoutCompleted отправляется в Kafka для аналитики.
  • Kafka стоит около $7 000 в месяц, но не позволяет недоступности аналитики расходовать 300 мс checkout; полностью синхронная цепочка умножила бы риск доступности.

Зачем это спрашивают: Интервьюер проверяет, следует ли временная связанность бизнес-срокам, а не одному предпочтительному стилю интеграции.

distributeddesigntransactions

Я использую сагу под оркестрацией Temporal с явными сроками резервирования и компенсирующими действиями.

  • Workflow параллельно резервирует перелёт и отель, затем авторизует платёж и сохраняет идентификаторы поставщиков после каждого успешного шага.
  • Повторы activity используют exponential backoff внутри 12-минутного окна, а идемпотентные отмены продолжаются 24 часа при недоступности поставщика.
  • Temporal стоит около $8 000 в месяц и требует навыков workflow, но даёт видимую машину состояний, безопаснее скрытой Kafka choreography между тремя внешними системами.

Зачем это спрашивают: Сильный ответ учитывает сроки, долговечное состояние, идемпотентную компенсацию и цену оркестрации.

sqlqueriessystem-design

Я использую CDC по журналу транзакций и опубликую стабильные бизнес-события через Kafka.

  • Debezium для SQL Server читает журнал в сырые CDC-топики, удерживает нагрузку источника ниже 5% и сохраняет порядок по таблице.
  • Сервис трансформации создаёт события CustomerUpdated и InvoicePaid, удаляет PII и проверяет совместимость через Schema Registry.
  • Пайплайн стоит около $14 000 в месяц и добавляет до 20 секунд задержки, но убирает шесть polling-нагрузок и не превращает схему источника в публичный контракт.

Зачем это спрашивают: Интервьюер оценивает интеграцию с низкой нагрузкой на источник, владение контрактом, приватность, задержку и эксплуатационную цену.

webhooksdesign

Я объединю версионируемый REST API с долговечными webhooks и доступным клиенту endpoint для replay.

  • Apigee проверяет OAuth 2.0, применяет tenant quotas и публикует OpenAPI v1 с аддитивной эволюцией и 12-месячным сроком вывода будущей v2.
  • Domain events поступают в Kafka, webhook workers подписывают payload, повторяют доставку 24 часа с jitter, затем кладут ошибки в tenant-specific dead-letter store.
  • Apigee и webhook fleet стоят около $48 000 в месяц, но управляемые политики и аналитика сокращают кастомную работу и дают данные поддержки для 3 000 клиентов.

Зачем это спрашивают: Сильный ответ охватывает синхронные и асинхронные контракты, replay, изоляцию клиентов и цену платформы.

procurementschemadesign

Я буду принимать неизменяемые файлы в Amazon S3 и обрабатывать их AWS Glue с отдельными контрактами и quarantine paths для каждого поставщика.

  • Поставщики загружают данные через S3 Transfer Acceleration или AWS Transfer Family с manifests, checksums и ключами объектов по поставщику и бизнес-дате.
  • Glue jobs проверяют схемы через Glue Schema Registry, записывают таблицы Apache Iceberg и отправляют отклонённые строки в именованные quarantine queues SQS.
  • Около 750 G.2X worker-hours за ночь укладываются примерно в $20 000 в месяц; постоянный EMR превысит $35 000, но может выиграть при росте за шестичасовой пик.

Зачем это спрашивают: Интервьюер проверяет batch-архитектуру, контроль схем, восстановимость, sizing и цену технологии при фиксированном сроке.

design

Я использую региональные data planes в S3 с каталогом Iceberg и отдельный глобальный управляющий слой метаданных.

  • Kinesis Firehose и Kafka Connect записывают партиционированный Parquet, а теги Lake Formation разграничивают доступ без копирования payload из ЕС за пределы eu-central-1.
  • Snapshots Iceberg поддерживают почасовые инкрементальные запросы Athena и Spark, а compaction собирает файлы по 512 МБ, чтобы избежать миллионов мелких scans.
  • Первые сохранённые 2 ПБ стоят около $47 000 в месяц в S3 без compute, а цена растёт вместе с retention; межрегиональная репликация добавит минимум $40 000 transfer и нарушит резидентность.

Зачем это спрашивают: Сильный ответ объединяет масштаб, формат таблиц, управление, региональные границы и экономику хранения.

design

Я разделю высокообъёмный путь телеметрии и низколатентный путь команд устройствам.

  • AWS IoT Core аутентифицирует устройства индивидуальными сертификатами и направляет около 83 000 сообщений в секунду в Kinesis с device ID как partition key.
  • Firehose пакетирует телеметрию в S3, Timestream хранит семь горячих дней, а MQTT retained topics и device shadows доставляют команды за пять секунд.
  • IoT messaging и streaming стоят около $250 000 в месяц без долгого хранения и аналитики, но своя глобальная сеть MQTT-брокеров потребует отдельной команды и создаст риски сертификатов и масштабирования.

Зачем это спрашивают: Интервьюер оценивает соответствие протокола, расчёт throughput, горячее и холодное хранение, семантику команд и цену managed services.

designapiconcurrency

Я загружу файлы прямо в object storage и запущу transcoding через долговечные события.

  • API выдаёт multipart presigned URLs для S3, фиксирует намерение в DynamoDB и получает EventBridge Object Created после завершения.
  • EventBridge передаёт задания в SQS, AWS MediaConvert создаёт HLS renditions, CloudFront отдаёт подписанные playback URLs, а дубликаты игнорируются по upload ID.
  • Первые 30 дней хранения 6 ПБ нового raw video стоят около $140 000 в S3 без renditions и egress, поэтому исходники удаляются через месяц; свой FFmpeg может снизить transcoding cost, но добавит GPU и эксплуатацию кодеков.

Зачем это спрашивают: Сильный ответ убирает большие payload с серверов приложений и оценивает компромисс управляемой обработки видео.

Закрытые вопросы

  • 21

    Спроектируйте e-commerce платформу для запуска, где нагрузка растёт с 5 000 до 150 000 запросов в секунду за 90 секунд, а точность запасов checkout должна превышать 99,99%.

    zero-to-onedesign
  • 22

    Спроектируйте ячеистое масштабирование для 60 000 SaaS-арендаторов и 120 000 запросов в секунду, ограничив любой единичный отказ максимум 2% клиентов.

    scalingdesigncloud-models
  • 23

    Разделите на shards клиентскую базу 30 ТБ с ростом 2 ТБ в месяц, если один корпоративный клиент создаёт 18% записей, а большинство запросов ограничено tenant.

    databaseshardingqueries
  • 24

    Спроектируйте кэширование каталога на 70 000 чтений в секунду, где цены могут отставать на 30 секунд, а остатки только на две секунды.

    designcaching
  • 25

    Спроектируйте глобальный rate limiting для API с пределом 100 000 запросов в секунду, где клиент может кратко превысить региональную долю на 5%.

    designcloud-regionsapi
  • 26

    Спроектируйте disaster recovery для revenue-платформы с RTO 15 минут, RPO одна минута, состоянием 25 ТБ и максимальными дополнительными расходами $90 000 в месяц.

    designdisaster-recovery
  • 27

    Выберите Kubernetes или serverless для 60 независимых API с нагрузкой 5-500 запросов в секунду каждый, командой платформы из шести человек и бюджетом $70 000 в месяц.

    kubernetesapiserverless
  • 28

    Выберите runtime для лицензируемого risk engine с 64 ГБ RAM, локальным NVMe, запуском менее 20 секунд и только 12 production instances.

    compute
  • 29

    Выберите базу для 400 миллионов корзин, 35 000 записей в секунду, TTL 30 дней и доступа только по cart ID.

    database
  • 30

    Выберите Amazon Kinesis или Kafka для 80 000 событий в секунду, хранения 24 часа, одного региона AWS и трёх consumer-приложений.

    kafkacloud-regionsretention
  • 31

    Выберите API gateway для 200 внутренних сервисов в двух облаках с self-hosting, OIDC, mTLS и лицензией дешевле $250 000 в год.

    gatewayapi-gatewayapi
  • 32

    Решите, внедрять ли Istio для 180 Kubernetes-сервисов с требованиями mTLS, traffic shifting и tracing при команде платформы из четырёх человек.

    kubernetesmtls
  • 33

    Спроектируйте multi-cloud для регулируемого сервиса, который должен пережить потерю одного провайдера, обрабатывает 2 000 транзакций в секунду и ограничен $300 000 в месяц.

    designmulti-cloudtransactions
  • 34

    Выберите build или buy для customer identity на 8 миллионов пользователей, social login, MFA, резидентность ЕС и запуск через шесть месяцев.

    decision-making
  • 35

    Спроектируйте observability для 900 сервисов с 25 ТБ logs в день, 30 днями searchable retention и пределом $220 000 в месяц.

    retentiondesignobservability
  • 36

    Спроектируйте Zero Trust доступ для 14 000 сотрудников, 2 000 подрядчиков и 600 workloads в AWS, Azure и локальных системах.

    system-designdesignzero-trust
  • 37

    Спроектируйте сокращение PCI DSS scope для marketplace на 20 миллионов карточных транзакций в месяц без хранения PAN в продуктовых сервисах.

    transactionsdesignconcurrency
  • 38

    Спроектируйте готовую к SOC 2 AWS landing zone для 120 аккаунтов с подключением команды менее чем за час и непрерывным сбором evidence.

    designlanding-zoneonboarding
  • 39

    Спроектируйте структуру AWS accounts для 30 продуктовых команд, четырёх сред и шести регулируемых workloads без сотен лишних сетевых соединений.

    design
  • 40

    Спроектируйте сеть для 300 VPC в трёх регионах, 40 локальных площадок, пересекающихся адресных диапазонов и централизованной проверки egress.

    designcloud-regions
  • 41

    Сократите облачный счёт $180 000 в месяц, где $65 000 приходится на межрегиональный и интернет-egress, сохранив p95 ниже 100 мс для глобальных пользователей.

    cloud-regionslatency
  • 42

    Спланируйте закупку compute для платформы с постоянной базой 12 000 vCPU, ночным ростом до 20 000 и непредсказуемыми месячными пиками 35 000.

  • 43

    Перепроектируйте image API на 4 миллиарда запросов в месяц, чей serverless bill вырос до $260 000, при требовании p99 ниже 180 мс.

    serverlessapi
  • 44

    Решите, использовать ли Event Sourcing для страховых claims на 80 000 дел в день с семилетним аудитом и восстановлением состояния на любой момент.

    event-sourcingsystem-designconcurrency
  • 45

    Решите, применять ли CQRS к каталогу с 5 000 записей, 120 000 чтений в секунду и шестью разными поисковыми представлениями со свежестью до 10 секунд.

    distinctcqrs
  • 46

    Выберите search architecture для 600 миллионов документов товаров, 20 000 обновлений в секунду, многоязычных запросов и p95 ниже 120 мс.

    queriesarchitecture
  • 47

    Интегрируйте Salesforce с order platform при 10 000 обновлений в минуту, свежести две минуты и запрете прямого доступа к базам с обеих сторон.

    database
  • 48

    Спроектируйте B2B file exchange для 900 партнёров, отправляющих 30 000 файлов в день размером от 10 МБ до 20 ГБ, с обработкой за четыре часа и аудитом семь лет.

    retentiondesignconcurrency
  • 49

    Предоставьте 40 новым REST consumers доступ к legacy SOAP billing за пять месяцев, не позволяя его пределу 60 запросов в секунду каскадировать вверх.

    system-designrest
  • 50

    Спланируйте интеграцию приобретённой компании с 70 приложениями, другим identity provider и 6 ТБ клиентских данных за 12 месяцев, пока оба бизнеса продолжают работать.

  • 51

    Через четыре часа после переноса базы биллинга объёмом 6 ТБ в Aurora PostgreSQL вы обнаружили 18 000 записей, разделённых между Oracle и Aurora. Что вы сделаете до возобновления трафика?

    databasepostgres
  • 52

    Запланированное 20-минутное переключение CRM длится уже 55 минут, отставание CDC всё ещё составляет 14 минут, а бизнес допускает не более 60 минут простоя. Что вы сделаете?

  • 53

    После релиза интеграции с SAP 7 400 повторных событий InvoiceCreated создают дебиторскую задолженность на лишние $2,1 млн. Как вы локализуете и исправите проблему?

  • 54

    Во время миграции 12 ТБ из SQL Server Debezium отстаёт на шесть часов, а 3% балансов клиентов отличаются в целевой базе. Как вы решите, нужен ли откат?

    sqlmigrationsrollback
  • 55

    Поставщик CIAM повышает цену с $70 000 до $119 000 в месяц с уведомлением за 90 дней, а от него зависят восемь миллионов пользователей. Как вы организуете выход?

    procurement
  • 56

    Поставщик документов снижает квоту API с 10 000 до 2 000 запросов в минуту за две недели до налогового сезона, а пиковый спрос составляет 7 500. Что вы измените?

    procurementapi
  • 57

    SaaS для расчёта зарплат перед расторжением договора разрешает выгружать только 50 ГБ в день, но за 120 дней нужно перенести 9 ТБ и сохранить семь лет аудиторской истории. Что вы сделаете?

    cloud-modelscloud
  • 58

    Поставщик прекращает поддержку проприетарного контура управления Kubernetes через шесть месяцев, а 140 сервисов используют его закрытый API деплоя. Как выйти без заморозки релизов?

    kubernetesdeploymentapi
  • 59

    Три команды отклоняют ваше предложение по Kafka после пилота, который добавил 11 минут задержки при требовании в две минуты. Вы будете защищать или менять архитектуру?

    kafkaconcurrency
  • 60

    Security отклоняет вашу архитектуру публичного API после теста угроз, который нашёл 14 утечек между арендаторами на 100 000 запросов, из-за чего запуск сдвигается на три недели. Что вы сделаете?

    api
  • 61

    Finance возражает против вашей active-active архитектуры за $160 000 в месяц после chaos-теста, где тёплый резерв восстановился за 18 минут при RTO в 30 минут. Что вы теперь рекомендуете?

    design
  • 62

    Sales и Support отклоняют предложенное вами разделение домена Customer, потому что оно добавляет три API и угрожает запуску через 10 недель. Как вы его защитите или измените?

    api
  • 63

    Бюджет модернизации в $1,2 млн сокращают до $700 000 после подписания договоров, а первый клиентский релиз должен выйти через пять месяцев. Что вы урежете?

  • 64

    Утверждённый бюджет облачной эксплуатации падает со $180 000 до $110 000 в месяц, но платформа всё ещё обязана обеспечивать доступность 99,95% для 20 000 арендаторов. Как вы перестроите план?

  • 65

    Программа миграции с планом в $3 млн переоценена в $4,2 млн после переноса только 30 из 90 приложений. Как вы перестроите оставшиеся девять месяцев?

    migrationscloud-migration
  • 66

    Архитектуру наблюдаемости с бюджетом $220 000 в месяц ограничивают $120 000 после того, как 900 сервисов уже создают 25 ТБ логов в день. Что вы измените?

    designobservability
  • 67

    За 10 недель до запуска проверка PCI находит номера карт в логах Kafka у 14 сервисов, а срок перенести нельзя. Что вы сделаете?

    estimationkafka
  • 68

    Регулятор даёт 16 недель на хранение записей ЕС внутри региона, но 20-летний мейнфрейм каждую ночь отправляет полные клиентские файлы американскому batch-процессору. Что вы измените?

    batchcloud-regionsconcurrency
  • 69

    Аудитор SOC 2 даёт 30 дней на устранение 46 неуправляемых изменений production в 120 аккаунтах AWS. Что вы сделаете без остановки всей поставки?

  • 70

    Партнёр требует TLS 1.3 через шесть недель, но 280 legacy-клиентов поддерживают только TLS 1.2 и дают 35% выручки. Как выполнить ограничение?

    tls
  • 71

    После релиза p99 checkout растёт с 220 мс до 1,4 секунды при 8 000 запросов в секунду. Что вы сделаете в первый час и после стабилизации?

  • 72

    Отказ одной зоны доступности выводит на 47 минут сервис с обещанными 99,99%, потому что все pod работали в одной подсети. Какое конкретное исправление вы внесёте?

    networkingpromises
  • 73

    Отставание потребителей Kafka растёт с 20 секунд до 38 минут во время кампании со 120 000 событий в секунду, нарушая пятиминутный SLO выполнения заказов. Что вы измените?

    kafkaslo
  • 74

    Переключение региональной базы занимает 42 минуты при RTO в 15 минут, потому что в Terraform не заданы квоты мощности. Что вы измените до следующих учений?

    capacitycloud-regionsfailover
  • 75

    Сбой инвалидации Redis показывает отсутствующие товары доступными 11 минут и создаёт 3 200 заказов сверх остатка. Что вы сделаете?

    redis
  • 76

    Ночная загрузка 9 ТБ от поставщиков завершается за 9,5 часа вместо договорных шести после роста объёма файлов на 40%. Что вы измените?

    procurement
  • 77

    Младший архитектор предлагает Istio, Kafka и CQRS для сервиса на 40 запросов в секунду, добавляя шесть недель к 10-недельной поставке. Как вы будете его наставлять?

    cqrskafkamentoring
  • 78

    Архитектор, которого вы наставляете, назначил переключение базы 4 ТБ без репетиции отката и с окном простоя всего 30 минут. Что вы сделаете?

    mentoringdatabaserollback
  • 79

    Два архитектора вашей команды предлагают противоположные API и уже девять дней блокируют 18 инженеров. Как вы поможете им закрыть решение?

    mentoringapidesign
  • 80

    Старший архитектор более чем на 30% занизил облачные расходы в трёх предложениях подряд. Как вы будете наставлять его перед следующей заявкой на $2 млн?

    mentoring
  • 81

    Через два дня после федерации провайдера идентификации поглощённой компании 1 800 пользователей теряют доступ, а 63 бывших сотрудника получают его снова. Что вы сделаете?

  • 82

    Релиз API ломает интеграции 26 из 180 партнёров и вызывает 70-минутный простой заказов вопреки обещанию совместимости на два года. Что вы сделаете?

    promises
  • 83

    Поставщик ERP неожиданно ограничивает запись 60 запросами в секунду, а новая интеграция отправляет 240 и теряет 8% заказов. Что вы измените?

    procurement
  • 84

    После перевода fulfillment на события 4 600 заказов выполняются в неверном порядке, а 900 отправляются до списания оплаты. Как вы исправите архитектуру?

    architecture
  • 85

    Operations возражает против вашей active-active архитектуры после game day с 37 минутами split-brain записи и 12 000 конфликтов. Вы будете её защищать или измените?

    design
  • 86

    Совет директоров настаивает на active-active в двух облаках за шесть месяцев, но четырёхнедельный прототип даёт только 97,8% согласованности и стоит $410 000 в месяц при лимите $300 000. Что вы рекомендуете?

    consistencyprototypes
  • 87

    Продуктовые команды отвергают обязательный API gateway, потому что пилот добавляет 28 мс p99 при бюджете 15 мс для 200 сервисов. Что вы сделаете?

    gatewayapi-gatewayapi
  • 88

    Рекомендованная вами serverless-платформа получает 9% тайм-аутов холодного старта при 30-кратном всплеске, и команда хочет перейти на Kubernetes. Как вы ответите?

    resilienceserverlesskubernetes
  • 89

    Ошибка локальности данных увеличивает межрегиональный egress с $40 000 до $105 000 в месяц, а Finance требует исправления за 30 дней без роста p95 выше 100 мс. Что вы сделаете?

    ownershipcloud-regions
  • 90

    Банковское приложение нужно запустить за восемь недель с требованием резидентности, но Legal запрещает межрегиональные резервные копии, а договор обещает 99,99% доступности. Что вы сделаете?

    backupscloud-regionspromises
  • 91

    Истёкший сертификат вызывает 96-минутный простой 300 legacy-приложений, но 70 из них не поддерживают вашу автоматическую систему сервисной идентификации. Что вы исправите сначала?

    system-design
  • 92

    Учения DR восстанавливают только 21 ТБ платформы из 25 ТБ и превышают 15-минутный RTO на 34 минуты. Что вы скажете руководству и исправите?

    disaster-recovery
  • 93

    AWS Config находит drift 380 ресурсов под управлением Terraform в 45 аккаунтах за неделю до аудита комплаенса. Что вы сделаете?

    terraformconfigiac
  • 94

    Ransomware шифрует 600 виртуальных машин, а единственная чистая legacy-копия отстаёт на 18 часов при RPO в четыре часа. Что вы сделаете под давлением?

    backupscomputeencryption
  • 95

    Sales обещает SLA 99,99% и региональное восстановление за 30 минут для запуска через шесть недель, но последние учения заняли 74 минуты. Что вы сделаете до подписания?

    cloud-regionspromises
  • 96

    После неудачной миграции архитектор, которого вы наставляете, обвиняет Operations, хотя логи показывают отсутствие 12-минутной проверки репликации в его runbook. Как вы ответите?

    migrationsreplicationmentoring
  • 97

    Runtime-телеметрия показывает, что 17 команд обошли утверждённый слой API и создали 43 неучтённых потока данных за пять дней до релиза. Что вы сделаете?

    api
  • 98

    Поставщик проприетарной базы повышает лицензии на 80%, увеличивая годовую стоимость с $1,5 млн до $2,7 млн, а проверка выхода находит 140 хранимых процедур без аналога в PostgreSQL. Что вы сделаете?

    databasepostgresstored-procedures
  • 99

    Пользователи в APAC видят p99 620 мс при цели 200 мс после того, как требование резидентности заставило выполнять запись во Франкфурте. Какое конкретное исправление вы внесёте?

  • 100

    Программа на $30 млн заблокирована 21 день, потому что четыре архитектора постоянно открывают решение по интеграции, а первый релиз нужен через восемь недель. Что вы сделаете?