Webrium
Подписаться
Материалы/Платформа

Платформа

Материалов: 16 в этом направлении.

Цепочка запроса: прокси передаёт запрос, но бэкенд не отвечаетПроксиБэкенд не ответил
Практика11 минут

502 и 504: кто именно не ответил и что чинить

Как диагностировать и устранять ошибки 502 и 504, чтобы восстановить работу серверной инфраструктуры

Фильтрация логов: из множества событий выделяется критичный сигнал для анализа сбоевВсе событияКритичный сигнал
Разбор7 минут

Уровни логирования: что писать, а что выключить

Как правильно выбирать уровни логирования и что писать в логах, чтобы быстро находить причины сбоев

Два способа связать сервисы: прямой вызов и очередьпрямой вызовчерез очередь
Цифры7 минут

Очередь между сервисами: когда она окупается

Модель расчёта в часах: когда очередь окупается, а когда никогда

Прокси как граница: часть данных пересекает её и теряетсяснаруживнутри
Разбор6 минут

Обратный прокси: что он решает и что ломает

Что он действительно снимает с приложения и что ломает молча

Кеш сборки держится до первого изменившегося шага: всё, что ниже, пересобирается зановокеш держитсяпересобирается
Практика6 минут

Образ, который собирается минуту вместо десяти

Время сборки определяется не объёмом работы, а тем, какая её часть выполняется заново. Одна перестановка строк даёт больше, чем подбор базового образа.

Вложенные слои — поколения модных инструментов; в самой глубине выделен старый механизм, то, что осталось живым.старые механизмы
Практика9 минут

Деплой без кластера: что осталось живым

Что кластер даёт на самом деле, почему однонодовый вариант — тупик и как выкатывать сервисы через релиз-каталоги, атомарный симлинк и systemd

Стык инструкции с реальностью: у golden path шаги и система совпадают, у документации текст разошёлся с жизньюшаги зашиты в кодтекст разошёлся
Разбор8 минут

Golden path вместо документации

Почему документация гниёт, почему её нельзя спасти процессами и ревью, и как golden path делает стандартные операции исполняемыми

Растущая нагрузка пробивает порог окупаемости — за ним своё железо дешевле облакапорог окупаемостипрофиль нагрузки
Цифры9 минут

Своё железо под инференс: расчёт на три сценария

Пошаговая модель расчёта, которая покажет, когда свой сервер для инференса дешевле облака, если подставить ваш профиль нагрузки и тариф на электричество

Столбцы часов нынешней эксплуатации команды; правые столбцы поднимаются выше пунктирной линии — налога на обслуживание кластерачасы против налога
Цифры7 минут

Kubernetes на команду из двенадцати человек

Как на своих числах решить, нужен ли команде Kubernetes: сравниваем часы нынешней эксплуатации с налогом на обслуживание кластера

Четыре шкалы расходов: хостинг, лицензии и зарплаты — в норме, а четвёртая, стоимость владения кодом, уходит за шкалу — инвойса на неё не существуетстоимость кода
Цифры8 минут

Стоимость владения кодом: что считать и что игнорировать

Как посчитать в часах, сколько труда съедает уже написанный код, — по горячим модулям и следам, которые система и команда оставляют сами

Цепочка релизных шагов — окружение, пайплайн, выкатка, доступы, — последний шаг выходит за границу продуктовой работы: команды тратят время на обвязку, а не на граница продуктаобвязка
Практика8 минут

Платформенная команда: когда её заводить

Как посчитать на ваших числах, когда платформенная команда окупается, почему стандарты и одиночный инфра-инженер не спасают, и что проверить перед стартом

Из шести алертов в канале лишь один требует действия дежурного, остальные проматываютсяпоток алертовтребует действия
Практика9 минут

Алерты, на которые перестали смотреть

Почему дежурные рационально перестают читать канал алертов и почему подстройка порогов меняет частоту алертов, а не их применимость

Поле, разделённое швом: элементы OpenTelemetry пересекают границу между тем, что уже стало стандартом, и тем, что остаётся удобным клеемСтало стандартомУдобный клей
Разбор9 минут

OpenTelemetry: что стало стандартом, а что ещё нет

Разберёмся, какие слои OpenTelemetry действительно стали стандартами, а какие остаются удобным клеем, и почему граница проходит именно между ними

Два пути узнать о поломке сайта: короткий дорогой — внешний робот-мониторинг сообщает сразу; длинный дешёвый — владелец узнаёт последнимробот — сразусам — последним
Просто10 минут

Как вообще узнают, что сайт сломался

Почему владелец узнаёт о поломке сайта последним, почему ручные проверки не помогают и как работает робот, который следит за сайтом вместо человека

Сетка из пятнадцати ячеек изображает ленту лога: девять заняты событиями, а рядом отдельный счётчик показывает лишь четыре причины решений — лента отвечает «гдепричины решений
Разбор9 минут

Трассировка шагов вместо логов

Как заменить ленту логов на дерево шагов, чтобы видеть не только где упало, но и почему агент решил именно так

Четыре показателя-поля трейса: ID запроса, шаг вызова и код ошибки в норме, а тело запроса уходит за шкалу — его место в архиве, а не в трейсетело запроса
Практика8 минут

Что писать в трассировку, а что нет

Как проектировать трассировку под дежурного: какие поля писать в спанах, а какие выносить в архив, чтобы трейс сразу показывал, где сломался запрос

Письмо по вторникам

Один разбор недели и короткий список того, что изменилось. Без дайджестов на сорок ссылок.

Начните вводить — материалы появятся здесь.

выбрать · Enter открыть · Esc закрыть