Вопросы на собеседовании: Архитектор решений
100 реальных вопросов с образцовыми ответами и пояснениями для уровня Senior.
Смотреть пример резюме: Архитектор решений →Тренировка флешкарточками
Интервальное повторение · Hunter Pass
Вопросы
Я буду резервировать ключ каждого платежа в глобально согласованном хранилище, а финансовую запись оставлю одному региональному владельцу.
- Amazon Route 53 направляет клиента в ближайший регион, где conditional write в DynamoDB Global Tables с multi-region strong consistency резервирует UUID до списания.
- Региональный реестр PostgreSQL имеет тот же уникальный ключ, платёжный провайдер получает его при каждом повторе, а outbox публикует PaymentAuthorized только после коммита.
- Каждый регион работает на 60% пиковой мощности, чтобы два оставшихся приняли отказавшую нагрузку; это примерно на 50% дороже active-passive, но убирает 20-минутный RTO переключения.
Зачем это спрашивают: Интервьюер оценивает, выполняет ли проект измеримые требования к задержке и корректности без предположения, что глобальная согласованность бесплатна.
Я использую общие ячейки для стандартных арендаторов, а выделенные аккаунты и базы только для регулируемых банков.
- Двадцать ячеек с PostgreSQL row-level security вмещают примерно по 1 000 стандартных арендаторов и ограничивают отказ ячейки 5% общей группы.
- Каждый банк получает аккаунт AWS, ключ KMS и кластер Aurora, что добавляет около $1 200 в месяц, но выполняет договорную изоляцию и восстановление отдельного клиента.
- Управляющий слой сопоставляет tenant ID с ячейками, применяет квоты и поддерживает перенос через CDC, поэтому выросший клиент меняет уровень без изменения API.
Зачем это спрашивают: Сильный ответ балансирует изоляцию, область отказа, возможность переноса и конкретный бюджет.
Я разделю регулируемые исходные записи по юрисдикциям и буду глобально реплицировать только одобренную модель чтения.
- PII из ЕС остаются в eu-west-1, а PII из США в us-east-1; данные шифруются региональными ключами AWS KMS и доступны через привязанные к региону endpoints.
- Топики Kafka передают события ProfileDisplayNameChanged без адресов и налоговых номеров, а региональные consumers строят модели Redis с целью свежести 60 секунд.
- Глобальная репликация добавляет около $9 000 в месяц на брокеры, cache и transfer, но копирование полных PII нарушило бы резидентность и расширило аудит.
Зачем это спрашивают: Интервьюер проверяет, охватывает ли контроль резидентности payload, ключи, события и модели чтения при сохранении низкой задержки.
Я размещу версионируемый REST-контракт за Kong Gateway и разделю аутентификацию, квоты и бизнес-обработку.
- Kong проверяет OAuth 2.0 токены от Okta, применяет token bucket квоты в Redis и возвращает заголовки RateLimit до передачи трафика региональным сервисам.
- OpenAPI служит источником контракта, расширения остаются в v1, а несовместимые изменения переходят в v2 с 12 месяцами параллельной работы и consumer contract tests.
- Управляемый gateway сократил бы эксплуатацию, но стоил бы около $90 000 в месяц при 25 000 RPS, тогда как Kong в Kubernetes стоит около $35 000 плюс два человеко-месяца в год.
Зачем это спрашивают: Интервьюер оценивает жизненный цикл API, управление трафиком и явный ценовой компромисс между управляемой и собственной эксплуатацией.
Я синхронно зафиксирую заказ, а fulfillment перенесу в событийный процесс.
- Checkout API записывает Order и outbox в одной транзакции PostgreSQL за 250 мс, затем Debezium публикует OrderPlaced в Kafka без разрыва dual-write.
- Consumers для запасов, списания платежа и доставки используют order ID как ключ идемпотентности, а Temporal координирует компенсацию после исчерпания повторов.
- Kafka и Temporal добавляют около $28 000 в месяц и задержку проекций, но убирают медленные складские API из checkout и поглощают десятикратный всплеск трафика.
Зачем это спрашивают: Сильный ответ отделяет критичный по задержке commit от длительной работы и учитывает атомарную публикацию и компенсацию.
Я использую отдельные очереди Amazon SQS для уровней сервиса, взвешенные пулы workers и явные ограничения приёма.
- Premium, standard и bulk очереди получают минимум 60%, 30% и 10% мощности workers, а свободная мощность может временно перераспределяться.
- Producers ограничиваются, когда возраст bulk превышает 30 минут или очередь достигает 50 миллионов сообщений; после пяти попыток задачи переходят в именованные dead-letter queues.
- SQS стоит примерно $21 000 в месяц при таком объёме; Kafka могла бы снизить цену сообщения, но добавляет управление партициями и слабее поддерживает задержку отдельных сообщений.
Зачем это спрашивают: Интервьюер проверяет изоляцию приоритетов, ограничение backlog, обработку ошибок и экономику технологии очередей.
Я буду переносить отдельные возможности полиса за anti-corruption API, а не заменять весь mainframe одним переключением.
- В месяцы 1-3 карта охватывает COBOL-правила, вызовы и владение данными; в месяцы 4-8 появляются адаптеры Apigee и IBM MQ, сначала переносятся read-only возможности.
- В месяцы 9-13 CDC переносит изменения в PostgreSQL, количества и финансовые итоги сверяются ежедневно, затем запись переключается по одной продуктовой линии с четырёхчасовой границей отката; в месяц 14 адаптеры удаляются после 30 стабильных дней.
- Пять месяцев параллельной работы стоят около $700 000, но ограничивают семантический риск и риск потери данных, которые единый cutover сосредоточил бы в одном окне.
Зачем это спрашивают: Интервьюер оценивает поэтапное сосуществование, контроль зависимостей, измеримую сверку и цену снижения риска.
Я совмещу преобразование схемы, массовую загрузку и непрерывную репликацию, а затем передам право записи на отрепетированном переключении.
- В месяцы 1-2 AWS SCT классифицирует несовместимый PL/SQL и определяет переработки; в месяцы 3-5 snapshots загружаются, а AWS DMS CDC держит lag ниже 30 секунд.
- В месяцы 6-8 shadow traffic выполняет dual-read, сравниваются количества строк, checksums и 25 финансовых инвариантов, затем дважды репетируется 20-минутная остановка записи и смена DNS.
- В месяц 9 запись останавливается, lag DMS доводится до нуля, право записи переключается, а Oracle остаётся изолированным, но доступным для отката в течение четырёх часов.
- Aurora экономит ориентировочно $420 000 лицензий в год, миграция стоит около $650 000, а основные риски связаны с семантикой sequences, isolation и stored procedures.
Зачем это спрашивают: Сильный ответ включает этапы, контрольные точки, числа переключения, технологии и полную экономику миграции.
Я применю strangler architecture к бизнес-срезам, пока монолит остаётся первоначальным источником истины.
- Фасад AWS API Gateway маршрутизирует по одной возможности, начиная с поиска товаров, затем promotions, а contract tests защищают действующих мобильных клиентов.
- Новые сервисы публикуют domain events через outbox в Kafka, но запись в общие таблицы прекращается только после получения каждым срезом собственной схемы и сверки 99,999%.
- Параллельная работа стеков добавляет около $45 000 в месяц на 12 месяцев, но ограничивает откат одной возможностью и не требует останавливать 120 разработчиков ради rewrite.
Зачем это спрашивают: Интервьюер проверяет конкретный порядок извлечения, условия владения данными, цену сосуществования и границы отката.
Я разверну два независимых канала ExpressRoute по 10 Гбит/с и буду считать гибридные зависимости временной миграционной инфраструктурой.
- Каналы завершаются в разных peering locations и хабах Azure Virtual WAN, а суммарные BGP-маршруты не позволяют 80 сетям публиковать отдельные prefixes.
- Private DNS, федерация Entra ID, сертификаты и мониторинг проверяются до первой волны; приложения с задержкой выше 15 мс переносятся вместе со своими базами.
- Резервированные каналы стоят около $32 000 в месяц против $6 000 для VPN, но VPN не выполняют требования к throughput и jitter базы.
Зачем это спрашивают: Сильный ответ выводит сеть из измеренных требований к полосе и задержке, учитывает общие зависимости и оценивает цену резервирования.
Я выберу Apache Kafka, потому что партиционированный порядок, replay и гибридное развёртывание являются основными требованиями.
- Customer ID служит ключом для 384 партиций, рассчитанных менее чем на 1 000 событий в секунду каждая и с 30% запаса роста.
- Три брокера на площадку и MirrorMaker 2 реплицируют выбранные топики, а Schema Registry проверяет обратную совместимость Avro-контрактов.
- Managed Confluent стоит около $110 000 в месяц против $55 000 для своей эксплуатации; доплата оправдана, если нет трёх platform engineers для обновлений и восстановления.
Зачем это спрашивают: Интервьюер оценивает выбор технологии по требованиям порядка и replay вместе с реалистичным сравнением эксплуатационной цены.
Я выберу Amazon SQS Standard, потому что нагрузке нужна долговечная эластичная очередь, а не маршрутизация брокера или строгий порядок.
- SQS предоставляет visibility timeout, задержку сообщений, dead-letter queues и автоматическое масштабирование выше среднего в 174 задачи в секунду и пика в 2 000.
- Workers хранят job ID в DynamoDB для идемпотентности, поскольку at-least-once допускает дубликаты.
- Запросы SQS стоят примерно $400 в месяц, а отказоустойчивый RabbitMQ около $3 000 плюс патчи и управление ёмкостью.
Зачем это спрашивают: Сильный ответ выбирает более простую очередь по конкретной семантике и оценивает обработку дубликатов и цену.
Я использую синхронные вызовы только для решений до завершения checkout, а события для работы вне этого ответа.
- Налог рассчитывается через gRPC с timeout 80 мс и кэшированными таблицами юрисдикций, поскольку результат сразу меняет сумму к оплате.
- Fraud вызывается параллельно по gRPC с бюджетом 250 мс и fail-closed для сумм выше $500, а CheckoutCompleted отправляется в Kafka для аналитики.
- Kafka стоит около $7 000 в месяц, но не позволяет недоступности аналитики расходовать 300 мс checkout; полностью синхронная цепочка умножила бы риск доступности.
Зачем это спрашивают: Интервьюер проверяет, следует ли временная связанность бизнес-срокам, а не одному предпочтительному стилю интеграции.
Я использую сагу под оркестрацией Temporal с явными сроками резервирования и компенсирующими действиями.
- Workflow параллельно резервирует перелёт и отель, затем авторизует платёж и сохраняет идентификаторы поставщиков после каждого успешного шага.
- Повторы activity используют exponential backoff внутри 12-минутного окна, а идемпотентные отмены продолжаются 24 часа при недоступности поставщика.
- Temporal стоит около $8 000 в месяц и требует навыков workflow, но даёт видимую машину состояний, безопаснее скрытой Kafka choreography между тремя внешними системами.
Зачем это спрашивают: Сильный ответ учитывает сроки, долговечное состояние, идемпотентную компенсацию и цену оркестрации.
Я использую CDC по журналу транзакций и опубликую стабильные бизнес-события через Kafka.
- Debezium для SQL Server читает журнал в сырые CDC-топики, удерживает нагрузку источника ниже 5% и сохраняет порядок по таблице.
- Сервис трансформации создаёт события CustomerUpdated и InvoicePaid, удаляет PII и проверяет совместимость через Schema Registry.
- Пайплайн стоит около $14 000 в месяц и добавляет до 20 секунд задержки, но убирает шесть polling-нагрузок и не превращает схему источника в публичный контракт.
Зачем это спрашивают: Интервьюер оценивает интеграцию с низкой нагрузкой на источник, владение контрактом, приватность, задержку и эксплуатационную цену.
Я объединю версионируемый REST API с долговечными webhooks и доступным клиенту endpoint для replay.
- Apigee проверяет OAuth 2.0, применяет tenant quotas и публикует OpenAPI v1 с аддитивной эволюцией и 12-месячным сроком вывода будущей v2.
- Domain events поступают в Kafka, webhook workers подписывают payload, повторяют доставку 24 часа с jitter, затем кладут ошибки в tenant-specific dead-letter store.
- Apigee и webhook fleet стоят около $48 000 в месяц, но управляемые политики и аналитика сокращают кастомную работу и дают данные поддержки для 3 000 клиентов.
Зачем это спрашивают: Сильный ответ охватывает синхронные и асинхронные контракты, replay, изоляцию клиентов и цену платформы.
Я буду принимать неизменяемые файлы в Amazon S3 и обрабатывать их AWS Glue с отдельными контрактами и quarantine paths для каждого поставщика.
- Поставщики загружают данные через S3 Transfer Acceleration или AWS Transfer Family с manifests, checksums и ключами объектов по поставщику и бизнес-дате.
- Glue jobs проверяют схемы через Glue Schema Registry, записывают таблицы Apache Iceberg и отправляют отклонённые строки в именованные quarantine queues SQS.
- Около 750 G.2X worker-hours за ночь укладываются примерно в $20 000 в месяц; постоянный EMR превысит $35 000, но может выиграть при росте за шестичасовой пик.
Зачем это спрашивают: Интервьюер проверяет batch-архитектуру, контроль схем, восстановимость, sizing и цену технологии при фиксированном сроке.
Я использую региональные data planes в S3 с каталогом Iceberg и отдельный глобальный управляющий слой метаданных.
- Kinesis Firehose и Kafka Connect записывают партиционированный Parquet, а теги Lake Formation разграничивают доступ без копирования payload из ЕС за пределы eu-central-1.
- Snapshots Iceberg поддерживают почасовые инкрементальные запросы Athena и Spark, а compaction собирает файлы по 512 МБ, чтобы избежать миллионов мелких scans.
- Первые сохранённые 2 ПБ стоят около $47 000 в месяц в S3 без compute, а цена растёт вместе с retention; межрегиональная репликация добавит минимум $40 000 transfer и нарушит резидентность.
Зачем это спрашивают: Сильный ответ объединяет масштаб, формат таблиц, управление, региональные границы и экономику хранения.
Я разделю высокообъёмный путь телеметрии и низколатентный путь команд устройствам.
- AWS IoT Core аутентифицирует устройства индивидуальными сертификатами и направляет около 83 000 сообщений в секунду в Kinesis с device ID как partition key.
- Firehose пакетирует телеметрию в S3, Timestream хранит семь горячих дней, а MQTT retained topics и device shadows доставляют команды за пять секунд.
- IoT messaging и streaming стоят около $250 000 в месяц без долгого хранения и аналитики, но своя глобальная сеть MQTT-брокеров потребует отдельной команды и создаст риски сертификатов и масштабирования.
Зачем это спрашивают: Интервьюер оценивает соответствие протокола, расчёт throughput, горячее и холодное хранение, семантику команд и цену managed services.
Я загружу файлы прямо в object storage и запущу transcoding через долговечные события.
- API выдаёт multipart presigned URLs для S3, фиксирует намерение в DynamoDB и получает EventBridge Object Created после завершения.
- EventBridge передаёт задания в SQS, AWS MediaConvert создаёт HLS renditions, CloudFront отдаёт подписанные playback URLs, а дубликаты игнорируются по upload ID.
- Первые 30 дней хранения 6 ПБ нового raw video стоят около $140 000 в S3 без renditions и egress, поэтому исходники удаляются через месяц; свой FFmpeg может снизить transcoding cost, но добавит GPU и эксплуатацию кодеков.
Зачем это спрашивают: Сильный ответ убирает большие payload с серверов приложений и оценивает компромисс управляемой обработки видео.
Закрытые вопросы
- 21
Спроектируйте e-commerce платформу для запуска, где нагрузка растёт с 5 000 до 150 000 запросов в секунду за 90 секунд, а точность запасов checkout должна превышать 99,99%.
zero-to-onedesign - 22
Спроектируйте ячеистое масштабирование для 60 000 SaaS-арендаторов и 120 000 запросов в секунду, ограничив любой единичный отказ максимум 2% клиентов.
scalingdesigncloud-models - 23
Разделите на shards клиентскую базу 30 ТБ с ростом 2 ТБ в месяц, если один корпоративный клиент создаёт 18% записей, а большинство запросов ограничено tenant.
databaseshardingqueries - 24
Спроектируйте кэширование каталога на 70 000 чтений в секунду, где цены могут отставать на 30 секунд, а остатки только на две секунды.
designcaching - 25
Спроектируйте глобальный rate limiting для API с пределом 100 000 запросов в секунду, где клиент может кратко превысить региональную долю на 5%.
designcloud-regionsapi - 26
Спроектируйте disaster recovery для revenue-платформы с RTO 15 минут, RPO одна минута, состоянием 25 ТБ и максимальными дополнительными расходами $90 000 в месяц.
designdisaster-recovery - 27
Выберите Kubernetes или serverless для 60 независимых API с нагрузкой 5-500 запросов в секунду каждый, командой платформы из шести человек и бюджетом $70 000 в месяц.
kubernetesapiserverless - 28
Выберите runtime для лицензируемого risk engine с 64 ГБ RAM, локальным NVMe, запуском менее 20 секунд и только 12 production instances.
compute - 29
Выберите базу для 400 миллионов корзин, 35 000 записей в секунду, TTL 30 дней и доступа только по cart ID.
database - 30
Выберите Amazon Kinesis или Kafka для 80 000 событий в секунду, хранения 24 часа, одного региона AWS и трёх consumer-приложений.
kafkacloud-regionsretention - 31
Выберите API gateway для 200 внутренних сервисов в двух облаках с self-hosting, OIDC, mTLS и лицензией дешевле $250 000 в год.
gatewayapi-gatewayapi - 32
Решите, внедрять ли Istio для 180 Kubernetes-сервисов с требованиями mTLS, traffic shifting и tracing при команде платформы из четырёх человек.
kubernetesmtls - 33
Спроектируйте multi-cloud для регулируемого сервиса, который должен пережить потерю одного провайдера, обрабатывает 2 000 транзакций в секунду и ограничен $300 000 в месяц.
designmulti-cloudtransactions - 34
Выберите build или buy для customer identity на 8 миллионов пользователей, social login, MFA, резидентность ЕС и запуск через шесть месяцев.
decision-making - 35
Спроектируйте observability для 900 сервисов с 25 ТБ logs в день, 30 днями searchable retention и пределом $220 000 в месяц.
retentiondesignobservability - 36
Спроектируйте Zero Trust доступ для 14 000 сотрудников, 2 000 подрядчиков и 600 workloads в AWS, Azure и локальных системах.
system-designdesignzero-trust - 37
Спроектируйте сокращение PCI DSS scope для marketplace на 20 миллионов карточных транзакций в месяц без хранения PAN в продуктовых сервисах.
transactionsdesignconcurrency - 38
Спроектируйте готовую к SOC 2 AWS landing zone для 120 аккаунтов с подключением команды менее чем за час и непрерывным сбором evidence.
designlanding-zoneonboarding - 39
Спроектируйте структуру AWS accounts для 30 продуктовых команд, четырёх сред и шести регулируемых workloads без сотен лишних сетевых соединений.
design - 40
Спроектируйте сеть для 300 VPC в трёх регионах, 40 локальных площадок, пересекающихся адресных диапазонов и централизованной проверки egress.
designcloud-regions - 41
Сократите облачный счёт $180 000 в месяц, где $65 000 приходится на межрегиональный и интернет-egress, сохранив p95 ниже 100 мс для глобальных пользователей.
cloud-regionslatency - 42
Спланируйте закупку compute для платформы с постоянной базой 12 000 vCPU, ночным ростом до 20 000 и непредсказуемыми месячными пиками 35 000.
- 43
Перепроектируйте image API на 4 миллиарда запросов в месяц, чей serverless bill вырос до $260 000, при требовании p99 ниже 180 мс.
serverlessapi - 44
Решите, использовать ли Event Sourcing для страховых claims на 80 000 дел в день с семилетним аудитом и восстановлением состояния на любой момент.
event-sourcingsystem-designconcurrency - 45
Решите, применять ли CQRS к каталогу с 5 000 записей, 120 000 чтений в секунду и шестью разными поисковыми представлениями со свежестью до 10 секунд.
distinctcqrs - 46
Выберите search architecture для 600 миллионов документов товаров, 20 000 обновлений в секунду, многоязычных запросов и p95 ниже 120 мс.
queriesarchitecture - 47
Интегрируйте Salesforce с order platform при 10 000 обновлений в минуту, свежести две минуты и запрете прямого доступа к базам с обеих сторон.
database - 48
Спроектируйте B2B file exchange для 900 партнёров, отправляющих 30 000 файлов в день размером от 10 МБ до 20 ГБ, с обработкой за четыре часа и аудитом семь лет.
retentiondesignconcurrency - 49
Предоставьте 40 новым REST consumers доступ к legacy SOAP billing за пять месяцев, не позволяя его пределу 60 запросов в секунду каскадировать вверх.
system-designrest - 50
Спланируйте интеграцию приобретённой компании с 70 приложениями, другим identity provider и 6 ТБ клиентских данных за 12 месяцев, пока оба бизнеса продолжают работать.
- 51
Через четыре часа после переноса базы биллинга объёмом 6 ТБ в Aurora PostgreSQL вы обнаружили 18 000 записей, разделённых между Oracle и Aurora. Что вы сделаете до возобновления трафика?
databasepostgres - 52
Запланированное 20-минутное переключение CRM длится уже 55 минут, отставание CDC всё ещё составляет 14 минут, а бизнес допускает не более 60 минут простоя. Что вы сделаете?
- 53
После релиза интеграции с SAP 7 400 повторных событий InvoiceCreated создают дебиторскую задолженность на лишние $2,1 млн. Как вы локализуете и исправите проблему?
- 54
Во время миграции 12 ТБ из SQL Server Debezium отстаёт на шесть часов, а 3% балансов клиентов отличаются в целевой базе. Как вы решите, нужен ли откат?
sqlmigrationsrollback - 55
Поставщик CIAM повышает цену с $70 000 до $119 000 в месяц с уведомлением за 90 дней, а от него зависят восемь миллионов пользователей. Как вы организуете выход?
procurement - 56
Поставщик документов снижает квоту API с 10 000 до 2 000 запросов в минуту за две недели до налогового сезона, а пиковый спрос составляет 7 500. Что вы измените?
procurementapi - 57
SaaS для расчёта зарплат перед расторжением договора разрешает выгружать только 50 ГБ в день, но за 120 дней нужно перенести 9 ТБ и сохранить семь лет аудиторской истории. Что вы сделаете?
cloud-modelscloud - 58
Поставщик прекращает поддержку проприетарного контура управления Kubernetes через шесть месяцев, а 140 сервисов используют его закрытый API деплоя. Как выйти без заморозки релизов?
kubernetesdeploymentapi - 59
Три команды отклоняют ваше предложение по Kafka после пилота, который добавил 11 минут задержки при требовании в две минуты. Вы будете защищать или менять архитектуру?
kafkaconcurrency - 60
Security отклоняет вашу архитектуру публичного API после теста угроз, который нашёл 14 утечек между арендаторами на 100 000 запросов, из-за чего запуск сдвигается на три недели. Что вы сделаете?
api - 61
Finance возражает против вашей active-active архитектуры за $160 000 в месяц после chaos-теста, где тёплый резерв восстановился за 18 минут при RTO в 30 минут. Что вы теперь рекомендуете?
design - 62
Sales и Support отклоняют предложенное вами разделение домена Customer, потому что оно добавляет три API и угрожает запуску через 10 недель. Как вы его защитите или измените?
api - 63
Бюджет модернизации в $1,2 млн сокращают до $700 000 после подписания договоров, а первый клиентский релиз должен выйти через пять месяцев. Что вы урежете?
- 64
Утверждённый бюджет облачной эксплуатации падает со $180 000 до $110 000 в месяц, но платформа всё ещё обязана обеспечивать доступность 99,95% для 20 000 арендаторов. Как вы перестроите план?
- 65
Программа миграции с планом в $3 млн переоценена в $4,2 млн после переноса только 30 из 90 приложений. Как вы перестроите оставшиеся девять месяцев?
migrationscloud-migration - 66
Архитектуру наблюдаемости с бюджетом $220 000 в месяц ограничивают $120 000 после того, как 900 сервисов уже создают 25 ТБ логов в день. Что вы измените?
designobservability - 67
За 10 недель до запуска проверка PCI находит номера карт в логах Kafka у 14 сервисов, а срок перенести нельзя. Что вы сделаете?
estimationkafka - 68
Регулятор даёт 16 недель на хранение записей ЕС внутри региона, но 20-летний мейнфрейм каждую ночь отправляет полные клиентские файлы американскому batch-процессору. Что вы измените?
batchcloud-regionsconcurrency - 69
Аудитор SOC 2 даёт 30 дней на устранение 46 неуправляемых изменений production в 120 аккаунтах AWS. Что вы сделаете без остановки всей поставки?
- 70
Партнёр требует TLS 1.3 через шесть недель, но 280 legacy-клиентов поддерживают только TLS 1.2 и дают 35% выручки. Как выполнить ограничение?
tls - 71
После релиза p99 checkout растёт с 220 мс до 1,4 секунды при 8 000 запросов в секунду. Что вы сделаете в первый час и после стабилизации?
- 72
Отказ одной зоны доступности выводит на 47 минут сервис с обещанными 99,99%, потому что все pod работали в одной подсети. Какое конкретное исправление вы внесёте?
networkingpromises - 73
Отставание потребителей Kafka растёт с 20 секунд до 38 минут во время кампании со 120 000 событий в секунду, нарушая пятиминутный SLO выполнения заказов. Что вы измените?
kafkaslo - 74
Переключение региональной базы занимает 42 минуты при RTO в 15 минут, потому что в Terraform не заданы квоты мощности. Что вы измените до следующих учений?
capacitycloud-regionsfailover - 75
Сбой инвалидации Redis показывает отсутствующие товары доступными 11 минут и создаёт 3 200 заказов сверх остатка. Что вы сделаете?
redis - 76
Ночная загрузка 9 ТБ от поставщиков завершается за 9,5 часа вместо договорных шести после роста объёма файлов на 40%. Что вы измените?
procurement - 77
Младший архитектор предлагает Istio, Kafka и CQRS для сервиса на 40 запросов в секунду, добавляя шесть недель к 10-недельной поставке. Как вы будете его наставлять?
cqrskafkamentoring - 78
Архитектор, которого вы наставляете, назначил переключение базы 4 ТБ без репетиции отката и с окном простоя всего 30 минут. Что вы сделаете?
mentoringdatabaserollback - 79
Два архитектора вашей команды предлагают противоположные API и уже девять дней блокируют 18 инженеров. Как вы поможете им закрыть решение?
mentoringapidesign - 80
Старший архитектор более чем на 30% занизил облачные расходы в трёх предложениях подряд. Как вы будете наставлять его перед следующей заявкой на $2 млн?
mentoring - 81
Через два дня после федерации провайдера идентификации поглощённой компании 1 800 пользователей теряют доступ, а 63 бывших сотрудника получают его снова. Что вы сделаете?
- 82
Релиз API ломает интеграции 26 из 180 партнёров и вызывает 70-минутный простой заказов вопреки обещанию совместимости на два года. Что вы сделаете?
promises - 83
Поставщик ERP неожиданно ограничивает запись 60 запросами в секунду, а новая интеграция отправляет 240 и теряет 8% заказов. Что вы измените?
procurement - 84
После перевода fulfillment на события 4 600 заказов выполняются в неверном порядке, а 900 отправляются до списания оплаты. Как вы исправите архитектуру?
architecture - 85
Operations возражает против вашей active-active архитектуры после game day с 37 минутами split-brain записи и 12 000 конфликтов. Вы будете её защищать или измените?
design - 86
Совет директоров настаивает на active-active в двух облаках за шесть месяцев, но четырёхнедельный прототип даёт только 97,8% согласованности и стоит $410 000 в месяц при лимите $300 000. Что вы рекомендуете?
consistencyprototypes - 87
Продуктовые команды отвергают обязательный API gateway, потому что пилот добавляет 28 мс p99 при бюджете 15 мс для 200 сервисов. Что вы сделаете?
gatewayapi-gatewayapi - 88
Рекомендованная вами serverless-платформа получает 9% тайм-аутов холодного старта при 30-кратном всплеске, и команда хочет перейти на Kubernetes. Как вы ответите?
resilienceserverlesskubernetes - 89
Ошибка локальности данных увеличивает межрегиональный egress с $40 000 до $105 000 в месяц, а Finance требует исправления за 30 дней без роста p95 выше 100 мс. Что вы сделаете?
ownershipcloud-regions - 90
Банковское приложение нужно запустить за восемь недель с требованием резидентности, но Legal запрещает межрегиональные резервные копии, а договор обещает 99,99% доступности. Что вы сделаете?
backupscloud-regionspromises - 91
Истёкший сертификат вызывает 96-минутный простой 300 legacy-приложений, но 70 из них не поддерживают вашу автоматическую систему сервисной идентификации. Что вы исправите сначала?
system-design - 92
Учения DR восстанавливают только 21 ТБ платформы из 25 ТБ и превышают 15-минутный RTO на 34 минуты. Что вы скажете руководству и исправите?
disaster-recovery - 93
AWS Config находит drift 380 ресурсов под управлением Terraform в 45 аккаунтах за неделю до аудита комплаенса. Что вы сделаете?
terraformconfigiac - 94
Ransomware шифрует 600 виртуальных машин, а единственная чистая legacy-копия отстаёт на 18 часов при RPO в четыре часа. Что вы сделаете под давлением?
backupscomputeencryption - 95
Sales обещает SLA 99,99% и региональное восстановление за 30 минут для запуска через шесть недель, но последние учения заняли 74 минуты. Что вы сделаете до подписания?
cloud-regionspromises - 96
После неудачной миграции архитектор, которого вы наставляете, обвиняет Operations, хотя логи показывают отсутствие 12-минутной проверки репликации в его runbook. Как вы ответите?
migrationsreplicationmentoring - 97
Runtime-телеметрия показывает, что 17 команд обошли утверждённый слой API и создали 43 неучтённых потока данных за пять дней до релиза. Что вы сделаете?
api - 98
Поставщик проприетарной базы повышает лицензии на 80%, увеличивая годовую стоимость с $1,5 млн до $2,7 млн, а проверка выхода находит 140 хранимых процедур без аналога в PostgreSQL. Что вы сделаете?
databasepostgresstored-procedures - 99
Пользователи в APAC видят p99 620 мс при цели 200 мс после того, как требование резидентности заставило выполнять запись во Франкфурте. Какое конкретное исправление вы внесёте?
- 100
Программа на $30 млн заблокирована 21 день, потому что четыре архитектора постоянно открывают решение по интеграции, а первый релиз нужен через восемь недель. Что вы сделаете?