Файл База Terraform для DevOps-инженера 4.jpeg · 824 КБ · нажмите — покажем
💡 Короткая шпаргалка для тех, кто работает с инфраструктурой как кодом или только начинает разбираться в Terraform.
Внутри:
— зачем Terraform хранит состояние инфраструктуры;
— как модули помогают не копировать один и тот же код;
— почему реальные ресурсы могут отличаться от конфигурации;
— как безопасно применять изменения в рабочих проектах.
На просмотр уйдёт около пяти минут, а основные принципы станут заметно понятнее 🕺
📍 Навигация: Вакансии • Задачи • Собесы
🐸 Библиотека devops'a
#архитектура_на_салфетке
😳 Documentation Driven Development звучит как ещё один модный термин. Пока не попробуешь объяснить свой проект AI.
Агент работает только с тем контекстом, который ему дали. Если документация неполная или устарела, он начинает додумывать — отсюда появляется неверный код.
🔘 На курсе «ИИ для разработчиков» эту тему разбирает Арсений Харланов. Он покажет, как подготовить документацию и контекст, чтобы агент понимал архитектуру проекта, ограничения и связи между компонентами.
Также разберём, как выбирать модель под задачу: Claude, DeepSeek, Qwen и другие ✏️
Впереди 7 недель работы со своим репозиторием. Вебинары проходят вживую и остаются в записи.
Стартуем 31 августа. До конца июля можно присоединиться по ранней цене, а доступ к материалам останется бессрочным 😀
🔗 Посмотреть, что будет на курсе
🏃♀️ Proglib Academy
📍 Шпаргалка по циклам в Bash
Чтобы не держать в голове всю синтаксическую магию, собрали удобные примеры: for, while, until, диапазоны, чтение файлов и даже управление потоком с break и continue.
🈂️ Цикл for в Bash:
for i in /etc/*; do
echo $i
done
# То же самое (альтернативный синтаксис), также работает с другими видами циклов
for i in /etc/*
do
echo $i
done
🈂️ Цикл for, как в C:
for ((i = 0; i < 100; i++)); do
echo $i
done
# альтернативный синтаксис
for ((i = 0; i < 100; i++))
do
echo $i
done
🈂️ Цикл for с диапазонами:
for i in {1..10}; do
echo "Number: $i"
done
# С шагом
# ⇒ {НАЧАЛО..КОНЕЦ..ШАГ}
for i in {5..50..5}; do
echo "Number: $i"
done
🈂️ Цикл while в Bash:
# увеличение значения
i=1
while [[ $i -lt 4 ]]; do
echo "Number: $i"
((i++))
done
# уменьшение значения
i=3
while [[ $i -gt 0 ]]; do
echo "Number: $i"
((i--))
done
🈂️ Цикл while true:
# длинная форма while true
while true; do
# TODO
# TODO
done
# или короткая запись
while :; do
# TODO
# TODO
done
🈂️ Чтение файлов:
# использование пайпов
cat file.txt | while read line
do
echo $line
done
# ИЛИ использование перенаправления ввода
while read line; do
echo $line
done < "/path/to/txt/file"
🈂️ Оператор continue:
# команда seq может использоваться для генерации диапазонов
for number in $(seq 1 3); do
if [[ $number == 2 ]]; then
continue
fi
echo "$number"
done
🈂️ Оператор break:
for number in $(seq 1 3); do
if [[ $number == 2 ]]; then
# Пропустить оставшуюся часть цикла или выйти из цикла
break
fi
# Здесь выведется только 1
echo "$number"
done
🈂️ Цикл until:
# увеличение значения
count=0
until [ $count -gt 10 ]; do
echo "$count"
((count++))
done
# уменьшение значения
count=10
until [ $count -eq 0 ]; do
echo "$count"
((count--))
done
📍 Навигация: Вакансии • Задачи • Собесы
🐸 Библиотека devops'a
#root_prompt
💡 Почему облака ломаются: главные выводы отчётов за 2026 год
IncidentHub изучил более 30 тысяч сбоев у 1082 облачных и SaaS-провайдеров за первую половину 2026 года. Больше всего инцидентов пришлось на облачные платформы и инструменты разработчиков.
🔴 Один из главных выводов: плохие изменения распространяются по инфраструктуре так же быстро, как хорошие.
В распределённых системах новая конфигурация может за минуты попасть во все регионы и сервисы. Но откатить её часто сложнее: нужно понять причину, остановить распространение и вернуть систему в стабильное состояние.
Параллельно Uptime Institute отметил ещё несколько тенденций:
🔹 сети стали причиной 23% IT-сбоев и обогнали проблемы с электропитанием;
🔹 человеческий фактор участвовал в 92% значимых инцидентов;
🔹 физическая инфраструктура дата-центров становится надёжнее, но зависимости между сетями, облаками и внешними сервисами усложняются.
🔴 Отдельный риск — GPU-кластеры. Во время обучения моделей тысячи ускорителей могут одновременно резко увеличить потребление энергии. При переключении дата-центра на резервное питание такой скачок создаёт нагрузку, на которую старые схемы резервирования могли быть не рассчитаны.
📍 Навигация: Вакансии • Задачи • Собесы
🐸 Библиотека devops'a
#локализация
🌍 us-east-1 снова лёг. Значит ли это, что пора переходить на multi-region?
Несмотря на статус самого крупного региона AWS, именно us-east-1 регулярно оказывается в центре крупных инцидентов. В июле проблемы затронули Lambda, CloudFormation и Management Console. В отчёте IncidentHub за H1 2026 этот регион снова оказался лидером по суммарному времени недоступности.
Построение multi-region повышает отказоустойчивость, но за это приходится платить: сложнее архитектура, дороже инфраструктура, труднее поддержка и деплой.
❓ А как у вас:
👍 Уже работаем в нескольких регионах
🔥 Планируем переход
🤔 Пока хватает одного региона — риски оправданы
📍 Навигация: Вакансии • Задачи • Собесы
🐸 Библиотека devops'a
#холиварня
😱 Знакомо? Лимит уже закончился, а задача всё ещё не готова. Часть токенов могла уйти на повторное чтение файлов, лишний контекст и неудачные попытки.
⚡️ Этому посвящён отдельный блок курса «ИИ для разработчиков». Вы разберёте расходы на собственных проектах, сравните подходы и найдёте места, где агент выполняет лишнюю работу.
В итоге станет понятнее, сколько ресурсов выделять на запуск, когда его останавливать и в какой момент лучше изменить подход 🔍
До 31 июля курс можно купить со скидкой, а все материалы останутся в бессрочном доступе.
🔗 Узнать подробности о курсе
🏃♀️ Proglib Academy
🔐 Как не пропустить истечение сертификата
Истёкший сертификат может остановить сервис. Чтобы этого не произошло, достаточно настроить пару простых проверок.
➡️ В Kubernetes (cert-manager)
Проверить сертификаты:
kubectl get certificates -A
Если используете kube-prometheus-stack, можно добавить алерт:
- alert: CertExpiringSoon
expr: certmanager_certificate_expiration_timestamp_seconds - time() < 7 * 24 * 3600
➡️ Для внешних сервисов
blackbox_exporter умеет проверять срок действия SSL-сертификатов. Используйте метрику:
probe_ssl_earliest_cert_expiry
и настройте алерт, например за 30 дней до истечения.
📌 Хорошая практика:
🟡 Warning — за 30 дней.
🔴 Critical — за 7 дней.
Автоматическое обновление сертификатов — это хорошо. Но мониторинг нужен, чтобы вовремя узнать, если автоматизация не сработала.
📍 Навигация: Вакансии • Задачи • Собесы
🐸 Библиотека devops'a
#арсенал_инженера
Что делает ConfigMap в Kubernetes?
👾 — Управляет сетевым трафиком
👍 — Хранит большие наборы данных
🥰 — Управляет секретами приложений
⚡️ — Отделяет конфигурацию от кода приложения
Библиотека задач по DevOps
🤔 Вопрос от подписчика: как обновляете stateful-приложения без downtime?
Со stateless всё относительно просто — rolling update обычно хватает.
А вот со stateful начинаются нюансы:
— миграции БД;
— WebSocket и gRPC-соединения;
— rollback;
— совместимость старой и новой версии.
Кто-то использует Blue-Green, кто-то expand/contract для миграций, кто-то вообще предпочитает небольшое окно обслуживания вместо усложнения инфраструктуры.
📍 Навигация: Вакансии • Задачи • Собесы
🐸 Библиотека devops'a
#dev_null
🤔 У большинства разработчиков уже есть подписки на IDE, GitHub Copilot, Claude, ChatGPT или облачные сервисы.
Логично, что обучение тоже постепенно приходит к той же модели: не покупать отдельный курс под каждую новую тему, а иметь доступ ко всей библиотеке и выбирать, что актуально именно сейчас.
Такой формат недавно появился и в Proglib Academy. Вместо одного курса — доступ сразу ко всей библиотеке и новым материалам, которые появляются в подписке 😎
🔗 Подробнее
🏃♀️ Proglib Academy
0️⃣ Калькулятор для сравнения облака и собственной инфраструктуры
Когда нужно решить, где разворачивать инфраструктуру — в облаке или на своих серверах — начинается головная боль. Цифры нужны точные, но переменных слишком много: железо, электричество, зарплаты, лицензии, безопасность. Excel быстро превращается в хаос.
InfraWise — открытый инструмент, который считает полную стоимость владения (TCO) для облачной и on-premise инфраструктуры.
🔵 Он учитывает больше 80 параметров: от стоимости электроэнергии и GPU до затрат на compliance: SOC 2, HIPAA, GDPR и человеческие ресурсы.
Инструмент строит прогнозы на несколько лет вперед с учетом инфляции и роста нагрузки, показывает точку безубыточности, разделяет капитальные и операционные расходы, визуализирует данные интерактивными графиками и предлагает готовые пресеты для стартапов, средних компаний и энтерпрайза.
➡️ Посчитать затраты
📍 Навигация: Вакансии • Задачи • Собесы
🐸 Библиотека devops'a
#арсенал_инженера
☁️☁️☁️☁️☁️☁️☁️
24 сентября Yandex Cloud проведёт Yandex Scale 2026 — флагманскую технологическую конференцию, посвящённую облачным технологиям, инфраструктуре и искусственному интеллекту.
🎨🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨
В программе четыре продуктовых трека — AI, Data, Security и Hybrid Infrastructure & DevOps, — и отдельный углублённый технологический трек DeepTech, который пройдёт только онлайн.
В треке Hybrid Infrastructure & DevOps откроем программу рассказом про главные инфраструктурные анонсы и новинки 2026 года. На примере Stackland расскажем, как построить свою внутреннюю платформу по методологии Platform Engineering и ускорить time to market. Разберём, зачем бизнесу кластеры Yandex Managed Service for Kubernetes на тысячи нод — на реальном продакшн-кейсе Mindbox. Расскажем, как получить предсказуемую и безопасную ИИ‑разработку с ИИ‑командой на платформе SourceCraft и максимизировать возврат инвестиций от ИИ. Разберём возможности построения реальной гибридной инфраструктуры на базе единой технологической платформы и то, как полноценно объединить локальную и облачную среды, включая выделенные серверы BareMetal. И на примере крупного банка рассмотрим, как создать полноценный гибрид, соблюдая требования безопасности, регуляторов и бизнеса одновременно.
🎨🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨
Отдельно пройдут воркшопы по Hybrid Infrastructure & DevOps. Смоделируем аварию на физическом сервере и проверим, как гибридная архитектура на облаке и BareMetal держит отказоустойчивость. Научим разворачивать корпоративную ИИ-систему с RAG-сценарием на Yandex BareMetal и Stackland — чтобы модель работала с внутренней документацией и базами знаний. Разберём, как эффективно делить GPU-ресурсы Yandex Managed Service for Kubernetes между параллельными задачами обучения моделей. И покажем, как команда ИИ-агентов SourceCraft проходит путь от бизнес-требований до безопасного релиза — с проверкой на уязвимости на каждом шаге.
🎨🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨🎨
На конференции будут не только треки —
Планы на 3 октября — прийти на RWB Infra x Security Meetup
Мы направим прожекторы на инфраструктуру и информационную безопасность — туда, где за привычными решениями скрываются сложные инженерные задачи, компромиссы и неочевидные риски.
Будем разбирать реальные кейсы, искать узкие места, обсуждать и показывать решения, которые помогают инфраструктуре и безопасности выдерживать рост.
Когда: суббота, 3 октября, старт в 13:00
Где: Москва + онлайн
В программе 8 докладов, разделенных по двум тематическим трекам
Трек Infra:
• Тюнинг Gitlab CE как реакция на быстрый рост нагрузки
• Путь баланса и компромиссов в DCIM
• Единая инфраструктура доверия: PKI на базе Vault
• Kubernetes vs Bare Metal: что может пойти не так
Трек Security:
• DevSecOps: от сканирования в пайплайне к платформе — и обратно
• Почти эффективный VM: как мы боролись с хаосом в инфраструктуре и сократили время обработки уязвимостей
• Как защищать данные, когда единого периметра больше нет
• От заявки до доступа за 90 секунд: как шесть инженеров управляет доступом в тысяче систем
Регистрация уже открыта — не откладывайте заявку и приглашайте коллег (количество мест на площадке ограничено)!
Подробнее о программе — на сайте.
🤪 Если бы можно было задать один вопрос про AI в разработке — что бы вы спросили?
Как выбрать инструмент? Как работать с AI-агентами? Как проверять сгенерированный код? Или как вообще встроить нейросети в свой процесс?
Собираем вопросы для вебинара. Самые залайканные разберём в первую очередь 🔥
Пишите, что действительно интересно ⬇️
Видео 1096027_1676569558.mp4 · 151 КБ · нажмите — покажем
🌸 Вселенная намекает: пора уже начать этот курс
С 14 сентября цены в Proglib Academy вырастут на 20% 👀
Так что если курс давно ждёт своего часа — лучше не откладывать ещё на месяц 😏
📍 Выбрать курс
👩💻 Bash-скрипт для мониторинга сервисов
Полноценный мониторинг вроде Zabbix или Prometheus не всегда оправдан, особенно на небольших проектах или dev-серверах. Иногда достаточно простого скрипта, который проверит список сервисов и скажет, что именно не работает.
Ниже готовый скрипт с проверкой через systemctl и отправкой уведомлений в Telegram.
Базовая версия
Создаём файл:
nano check_services.sh
Содержимое:
#!/bin/bash
SERVICES=("nginx" "postgresql" "redis" "ssh")
echo "===== СТАТУС СЕРВИСОВ ====="
echo ""
for SERVICE in "${SERVICES[@]}"; do
STATUS=$(systemctl is-active "$SERVICE" 2>/dev/null)
if [ "$STATUS" = "active" ]; then
echo "[OK] $SERVICE"
else
echo "[УПАЛ] $SERVICE"
fi
done
Даём права и запускаем:
chmod +x check_services.sh
./check_services.sh
Массив SERVICES правите под свой стек. Вывод будет примерно таким:
===== СТАТУС СЕРВИСОВ =====
[OK] nginx
[OK] postgresql
[УПАЛ] redis
[OK] ssh
Версия с уведомлением в Telegram
Базовая версия показывает результат в консоли. Но если скрипт работает по cron, вы его вывод не увидите. Добавим отправку сообщения в Telegram при обнаружении упавшего сервиса.
Для этого понадобится бот и chat_id. Бота создаёте через @BotFather, chat_id получаете через @userinfobot или из API бота после отправки ему любого сообщения.
#!/bin/bash
SERVICES=("nginx" "postgresql" "redis" "ssh")
BOT_TOKEN="123456:ABC-DEF1234ghIkl-zyx57W2v1u123ew11"
CHAT_ID="987654321"
FAILED=""
for SERVICE in "${SERVICES[@]}"; do
STATUS=$(systemctl is-active "$SERVICE" 2>/dev/null)
if [ "$STATUS" != "active" ]; then
FAILED="${FAILED} ${SERVICE}\n"
fi
done
if [ -n "$FAILED" ]; then
HOSTNAME=$(hostname)
MESSAGE=" Проблема на ${HOSTNAME}\n\nУпавшие сервисы:\n${FAILED}"
curl -s -X POST "https://api.telegram.org/bot${BOT_TOKEN}/sendMessage" \
-d chat_id="$CHAT_ID" \
-d text="$(echo -e "$MESSAGE")" \
-d parse_mode="HTML" > /dev/null
fi
Скрипт о
😭 Как не потратить недельный лимит AI-кодинга за три дня?
Разберём на вебинаре, как тратить меньше на AI-агентов — без потери качества кода.
🔘 Поговорим о том:
— когда дорогая модель действительно нужна, а когда хватит дешёвой;
— сколько стоит один прогон и куда уходят токены;
— какие задачи можно отдавать субагентам;
— как настроить маршрутизацию моделей;
— что проверять в AI-коде перед merge.
✏️ Покажем всё на конкретных цифрах и вживую: сравним расходы до и после.
⬇️ 17 сентября, 19:00 МСК
⬇️ 1,5 часа · бесплатно
⬇️ Арсений Харланов и Олег Лайок
💬 Пишите в комментариях, где упираетесь в лимиты и на что уходят деньги. Самые залайканные вопросы разберём на вебинаре.
🔗 Зарегистрироваться на вебинар
🤖 ИИ-агенту теперь можно поставить задачу прямо в GitLab — и не расписывать каждый следующий шаг
В SourceCraft появились автономные агенты, которые работают как отдельные участники команды. Разработчик ставит задачу в обсуждении, агент выполняет её и передаёт результат на проверку. Если по дороге ему не хватает данных или нужно согласование, он сам возвращается к команде с запросом.
При этом можно подключать не только готовых агентов, но и собственных — в том числе созданных с помощью Yandex AI Studio. Например, под конкретные задачи разработки или проверки безопасности кода.
Получается workflow, где ИИ может самостоятельно проходить целую цепочку действий, а не просто выполнять отдельную команду по запросу разработчика.
Для тех, кто работает с Kubernetes и облачной инфраструктурой, в октябре намечается отличный повод выбраться из рабочих чатов и встретиться офлайн 👀
Обсудим:
– как пройти путь от бизнес-требования к ядру Linux
– как дать агенту управление кластером вашей инфраструктуры
– как в MWS Cloud Platform доставляют системный софт в managed K8s
– мультитенантность в Kubernetes-платформе — «Проект вместо namespace»
– как работает LLM-диагностика инцидентов в Kubernetes и OpenStack
Не обойдётся и без дискуссий: на круглых столах разберём, действительно ли Kubernetes победил и что делать, если из-за ИИ нас всех уволят.
В течение дня вас ждут доклады, общение с коллегами и активности от партнеров. Будет возможность обсудить кейсы, обменяться опытом и познакомиться с коллегами из индустрии. После конференции вас ждет афтепати, где можно будет пообщаться с единомышленниками в более неформальной обстановке.
📍 Москва, 5-й Донской проезд, 17, Connect
📅 22 октября, 10:00–21:00
👉 Программу, билеты и подробности сможете найти на сайте Kuber Conf от АОТ!
SRE-инженеры, общий сбор
21 октября Т-Банк проведет онлайн-встречу «SRE-техтолк». Приглашают SRE и DevOps-инженеров.
На техтолке расскажут:
Какие подходы к надежности работают в Т-Банке.
Как в бигтехе отслеживают бизнес-операции и автоматизируют дежурства.
Какие решения можно адаптировать под свои задачи.
Приходите слушать доклады экспертов из разных команд Т-Банка, обсуждать реальные кейсы и проверенные инструменты.
Встреча пройдет онлайн, а для инженеров из Екатеринбурга и Новосибирска Т-Банк организует трансляцию в ИТ-хабах.
Участие бесплатное. А регистрация тут!