Webrium
Подписаться

Цифры

Расчёты и модели, в которые можно подставить свои значения.

Регулярные часы на синхронизацию решают спор раньше, чем список возможностейчасы содержания
Данные6 минут

Поиск по своим данным: когда нужен отдельный движок

Отдельный движок окупается, когда поиск — основной способ добраться до данных. Модель расчёта в часах, куда подставляются свои значения.

Два способа связать сервисы: прямой вызов и очередьпрямой вызовчерез очередь
Платформа7 минут

Очередь между сервисами: когда она окупается

Модель расчёта в часах: когда очередь окупается, а когда никогда

Ожидание пробивает порог терпения — и проверку выключаюттерпениеожидание
Backend6 минут

Инструменты переписывают на Rust: считаем, стоит ли переезжать

Считаем переезд в часах: окупается то, чего ждёт человек, а не фоновый прогон

Из потока запросов векторный поиск выигрывает не на всехзапросыпо смыслу
AI/ML6 минут

Векторная база: когда она окупается, а когда хватит обычного поиска

Модель расчёта в часах: когда векторный поиск окупается, а когда только мешает

Доли языков: малые величины растут быстрее крупныхмалые растут быстрее
Инструменты7 минут

Доля языков: кто теряет, а кто набирает

Наш замер долей: полезное в таблице — не порядок лидеров, а изменение малых величин

Из нескольких размеров корпуса только один укладывается в бюджет и окно контекста без переплатыразмеры корпусав бюджет и окно
AI/ML9 минут

Длинный контекст: когда он экономит, а когда просто дорожает

Как на самом деле считается стоимость длинного контекста, за что вы платите при каждом запросе и когда кэш префикса даёт реальную экономию

Два стыка: расчёт по модели из пяти слоёв совпадает с реальной стоимостью месяца, а прайс, умноженный на объём, с ней расходитсямодель из слоёвпрайс × объём
Данные8 минут

Стоимость хранения: три сценария на 100 ТБ

Почему нельзя просто умножить цену за терабайт на сто и как собрать модель из пяти слоёв, чтобы честно сравнить свои диски, выделенный сервер и облако

Растущая нагрузка пробивает порог окупаемости — за ним своё железо дешевле облакапорог окупаемостипрофиль нагрузки
Платформа9 минут

Своё железо под инференс: расчёт на три сценария

Пошаговая модель расчёта, которая покажет, когда свой сервер для инференса дешевле облака, если подставить ваш профиль нагрузки и тариф на электричество

Столбцы часов нынешней эксплуатации команды; правые столбцы поднимаются выше пунктирной линии — налога на обслуживание кластерачасы против налога
Платформа7 минут

Kubernetes на команду из двенадцати человек

Как на своих числах решить, нужен ли команде Kubernetes: сравниваем часы нынешней эксплуатации с налогом на обслуживание кластера

Четыре шкалы расходов: хостинг, лицензии и зарплаты — в норме, а четвёртая, стоимость владения кодом, уходит за шкалу — инвойса на неё не существуетстоимость кода
Платформа8 минут

Стоимость владения кодом: что считать и что игнорировать

Как посчитать в часах, сколько труда съедает уже написанный код, — по горячим модулям и следам, которые система и команда оставляют сами

Столбцы времени закрытия вакансии растут всё круче и взлетают над пунктирным планом: у редкого языка сроки найма растут как произведение этапов воронки, а не кавремя закрытия
Backend9 минут

Найм под редкий язык: сколько это стоит на самом деле

Почему найм на редкий язык дорожает временем, часами интервьюеров и простоем, и как посчитать это по своей воронке

Два маршрута запроса: короткий дорогой — Python несёт всё на себе в монолите, и длинный дешёвый — Python лишь дирижирует, а фильтрацию и агрегацию делают база иНести на себеДирижировать
Backend8 минут

Куда сместился Python за два года

Как за два года изменилась роль Python в архитектуре бэкенда и как измерить, какая доля времени вашего запроса уходит на сам язык

Счёт за инференс, разогнанный повторами вызовов, растёт и пробивает порог бюджета, зажигая сигнал тревогисчёт с повторамимесяц
AI/ML6 минут

Сколько стоит инференс: считаем до счёта, а не после

Модель расчёта, которую можно заполнить своими числами за час. Главный множитель — не размер модели, а доля повторов.

Два стыка: один совпадает — локальный инференс оказывается дешевле облака, другой расходится — облако выгоднее; итог зависит от нагрузки и тарифовлокально дешевлеоблако дешевле
AI/ML9 минут

Локальный инференс: когда он дешевле облака

Как построить модель расчёта, которая по вашей нагрузке, планке качества и тарифам покажет, когда локальный запуск LLM дешевле облачного API, а когда дороже

Сетка часов рабочего дня: закрашена лишь малая часть ячеек — набор кода, который ускорил ассистент; соседний счётчик показывает, что общий срок задачи не изменисрок задачи тот же
Инструменты9 минут

ИИ в редакторе: что реально ускорилось

Почему ассистент ускоряет набор кода, но не сроки задачи: как посчитать свой выигрыш по закону Амдала и когда вычитка подсказок его съедает

Полная стоимость self-hosted как вложенные друг в друга слои: инфраструктура, труд, риски, миграции. В самой глубине выделена цена сервера — лишь одна строка изСервер — лишь доля
Инструменты8 минут

Self-hosted вместо подписок: честный расчёт

Почему деление цены подписки на цену сервера ничего не доказывает и как честно посчитать полную стоимость подписки и собственной инфраструктуры

Письмо по вторникам

Один разбор недели и короткий список того, что изменилось. Без дайджестов на сорок ссылок.

Начните вводить — материалы появятся здесь.

выбрать · Enter открыть · Esc закрыть