Где стартапы теряют деньги: 7 скрытых расходов на облачную инфраструктуру

Alex61

New member
Два года назад мы втроём запускали B2B-сервис и радовались первому счёту от облачного провайдера — что-то около двухсот долларов в месяц. Через полгода тот же счёт вырос до шести тысяч, а выручка выросла лишь вдвое. Никто нас не взламывал, никто не воровал кредитки: мы просто теряли деньги в местах, о которых даже не задумывались. С тех пор я провёл аудит облачных расходов не в одном десятке стартапов и собрал семь типовых дыр, которые съедают бюджет почти у всех.

Первое и самое дорогое — простой ресурсов. Инстансы, которые подняли под нагрузочный тест и забыли погасить. Виртуалки, рассчитанные на пик распродажи, которые крутятся круглый год на четверть мощности. Мы сами держали кластер из четырёх нод под нагрузку в один запрос в секунду, потому что боялись, что упадёт прод. Честный ответ: половину облачного счёта съедает не трафик, а железо, которое ничего не делает.

Второе — исходящий трафик. Про него вспоминают только тогда, когда видят счёт. Межзональные перегоны данных между сервисами, NAT-шлюз, который тарифицируется за каждый гигабайт и каждый час, отсутствие кэша перед базой, отдача картинок напрямую из приложения. Один раз мы платили больше за трафик между зонами доступности, чем за сами серверы в этих зонах. Лечится архитектурой, а не скидками.

Третье — хранение и логи. Снапшоты двухлетней давности, версии объектов в бакете, бэкапы, которые никто ни разу не восстанавливал, логи приложения за всё время существования проекта. Хранение стоит копейки за гигабайт, поэтому на него не смотрят, пока не обнаружат, что накопились десятки терабайт. Настройте политику жизненного цикла с первого дня, а не через год.

Четвёртое — наблюдаемость. Мониторинг и APM часто стоят дороже, чем сама инфраструктура, которую они мониторят. Кастомные метрики с высокой кардинальностью, лог-менеджмент по цене за гигабайт, плата за каждый хост и каждый контейнер. У одного знакомого стартапа счёт за мониторинг превысил счёт за вычисления в два раза. Прежде чем подключать очередной агент, посчитайте, сколько он будет стоить на сотне инстансов.

Пятое — забытые окружения. Dev, staging, стенды под фича-ветки, демо-контуры для инвесторов, тестовые базы, скопированные с прода. Они живут месяцами, потому что удалять страшно, а отвечать за них некому. Туда же висят неприкреплённые диски и старые IP-адреса. Мы ввели правило: любое окружение, кроме прода, автоматически гасится в пятницу вечером и поднимается по команде. Экономия оказалась приятной неожиданностью.

Шестое — управляемые сервисы и лицензии. Managed-база удобна, но может стоить в три раза дороже той же базы на своей виртуалке. Плюс премиум-поддержка, расширенные тарифы, лицензии на Windows и enterprise-надстройки, которые подключили на этапе пилота и забыли отключить. Я не призываю всё тащить на себе, но раз в квартал стоит пересматривать тарифные планы: рынок меняется быстро, а вы всё ещё платите по прошлогоднему прайсу.

Седьмое — отсутствие финансовой дисциплины. Нет тегов на ресурсах, значит нет понимания, какая команда и какой продукт сколько тратит. Нет бюджетов и алертов, поэтому аномалия обнаруживается через месяц. Нет разговора про обязательства и спотовые инстансы, хотя они снимают тридцать, а то и сорок процентов счёта. Мой главный совет: назначьте одного человека ответственным за облачный бюджет, тегируйте всё с первого дня, поставьте алерт на резкий рост и раз в месяц проводите получасовую ревизию ресурсов. Это скучно, но именно скучные вещи спасают runway.

А какой самый неожиданный облачный расход ловили вы? Было ли что-то, что заставило вас схватиться за голову при виде счёта? Расскажите в комментариях — вместе мы соберём неплохой чек-лист для тех, кто только начинает.
 
Назад
Вверх