loose_code | Unsorted

Telegram-канал loose_code - DevOps Portal | Linux

13139

Присоединяйтесь к нашему каналу и погрузитесь в мир DevOps Сотрудничество, реклама: @devmangx Менеджер: @Spiral_Yuri РКН: https://clck.ru/3P8kFH

Subscribe to a channel

DevOps Portal | Linux

Планирование GPU-ресурсов в Kubernetes сейчас становится важным навыком

Вот почему 👇

Большинство организаций либо экспериментируют, либо уже запускают ML-нагрузки в Kubernetes.

Как DevOps-инженеры, вы должны понимать, как настраивать и управлять GPU-ресурсами.

Вот простой гайд по настройке GPU-ноды с использованием NVIDIA GPU Operator.

К концу этой статьи у вас будет чёткое понимание:

- зачем нужен GPU Operator в Kubernetes
- как установить NVIDIA GPU Operator в Kubernetes-кластер
- как проверить, видит ли Kubernetes GPU
- как задеплоить реальную GPU-нагрузку, чтобы провалидировать весь стек

Если честно, всё не так сложно, как кажется, когда понимаешь базу.

Даже если у вас нет доступа к GPU, просто изучите материал, чтобы разобраться, как это работает.

Прочитать можно здесь: https://devopscube.com/setup-gpu-operator-kubernetes/

👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

Docker 101: docker save <image>

Если вы запускаете эту команду впервые, её вывод может слегка сбить с толку: вместо ожидаемых rootfs и конфигурационного файла, в tar-архиве вы увидите index-файл и набор непонятных blob-ов.

Этот формат называется OCI Image Layout — это стандартизированная структура каталогов на диске для хранения и передачи контейнерных образов. Но не пугайтесь – выглядит (и звучит) сложнее, чем есть на самом деле.

Как только вы поймёте, как это устроено, вы сможете легко в нём ориентироваться, а ваши навыки анализа образов выйдут на совершенно другой уровень.

Разберитесь, как распутать структуру OCI Image Layout, решив эту практичесую задачу:
https://labs.iximiuz.com/challenges/inspect-oci-image-layout

👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

Сетевые основы 101: Как работает маршрутизация трафика

Знаете ли вы, что компьютеры могут обмениваться данными только с соседями (участниками одной подсети)? Но как тогда мы передаём пакеты через Интернет? Именно здесь вступает в игру маршрутизация.

Узнайте больше: https://labs.iximiuz.com/challenges/networking-configure-basic-routing

👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

Эта статья объясняет, как эффективно обрабатывать миллионы событий eBPF в секунду, не прожигая CPU, используя трёхступенчатую funnel-архитектуру для фильтрации и агрегации

Читайте тут

👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

Kubernetes – это  база, если вы про enterprise
Свежее совместное исследование TAdviser и команды контейнерной платформы «Штурвал» “State of Enterprise Kubernetes 2026” показало:

- 60% крупных компаний уже используют Kubernetes в продакшене, а еще 15% — планируют внедрение
- Российские контейнерные решения по распространению почти догоняют open-source (33% против 54%), иностранные продукты используют всего 10%
- 73% компаний разворачивают контейнерные платформы поверх существующей виртуализации. Стандартом де-факто остается VMware (62%)
- Главными барьерами внедрения остаются дефицит кадров и компетенций 

Kubernetes становится новым стандартом инфраструктуры, а не опцией, и вот почему:


- Сontainer-first перестал быть трендом и становится дефолтом в разработке
- Импортозамещение подталкивает пересобирать стек
- Бизнесу проще выкатывать обновления и масштабироваться 

Kubernetes не воспринимается как способ экономии. Это в первую очередь новая культура разработки и инструмент, ускоряющий вывод продуктов на рынок. И 51% опрошенных планирует расширять использование K8s-платформ в ближайшие 2-3 года. 

👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

Когда начинаешь разбираться в архитектуре Istio,

часто всплывает такой вопрос про SPOF 👇

Является ли ztunnel единой точкой отказа (single point of failure)?

Что произойдёт, если ztunnel упадёт на ноде?

Вот ответ.

Поскольку ztunnel запускается как один pod на каждую ноду, может показаться, что это SPOF.

Если ztunnel падает, трафик к pod’ам на конкретной ноде будет затронут.

Однако pod’ы на других нодах не пострадают.

На каждой ноде есть свой здоровый экземпляр ztunnel.

Поскольку ztunnel развёрнут как DaemonSet, Kubernetes автоматически перезапустит его — так же, как и любой другой pod из daemonset.

Так является ли ztunnel SPOF? Конечно, нет.

Архитектура изначально предполагает, что ноды могут падать — это нормально для распределённых систем.

Восстановление обрабатывается автоматически самим Kubernetes.

Понимание таких архитектурных паттернов помогает проектировать более надёжные системы и уверенно отвечать на подобные вопросы во время внедрения

👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

Этот исследование показывает, как авторы использовали динамическое разбиение MIG для разделения крупных GPU, таких как NVIDIA A100/H100, на несколько изолированных слайсов, чтобы множество небольших задач могли эффективно шарить один GPU

Читать nscharan1/gpu-starvation-in-kubernetes-how-dynamic-mig-partitioning-saved-our-gpu-budget-d242d6e56581">тут

👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

На Stepik вышел курс по Kubernetes

Этот курс даёт крепкую базу по Kubernetes: от понимания архитектуры кластера и запуска первых Pod до работы с Deployment, Service, Ingress, storage и сетевым взаимодействием.

Вы научитесь:
- разворачивать Kubernetes-кластер локально
- работать с kubectl и основными ресурсами Kubernetes
- деплоить и масштабировать приложения
- настраивать сети, сервисы и хранилище
- понимать архитектуру Kubernetes и как он работает "под капотом"

Всё сразу закрепляется на практике с помощью заданий с автопроверкой.

Материал подаётся понятным языком, шаг за шагом, на реальных примерах и с наглядными схемами.

После прохождения вы получите сертификат, который можно добавить в резюме.

В ближайшие 48ч курс доступен со скидкой 20% по промокоду «DEVOPS20»: открыть курс на Stepik

Читать полностью…

DevOps Portal | Linux

Linux 101: Защити открытый порт с помощью правил фаервола

HTTP-сервис уже запущен на сервере и слушает 0.0.0.0:8080. Твоя задача – защитить этот порт, не перезапуская и не перенастраивая сервис.

Сможешь решить задачу? https://labs.iximiuz.com/challenges/linux-protect-ports

👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

Эта статья рассказывает, как в Dream11 собрали собственную observability-платформу на базе SigNoz, ClickHouse и OpenTelemetry, чтобы обрабатывать миллионы метрик и трейсов с тысяч EC2-инстансов и при этом сэкономить миллионы на коммерческих инструментах.

Читайте ShiveeGupta/building-a-production-grade-observability-platform-with-signoz-clickhouse-and-opentelemetry-d7f09a5250f5">тут

👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

60 минут, чтобы оптимизировать Redis для высоких нагрузок

Selectel приглашает на практический вебинар, где разберут целостный инженерный подход к оптимизации Redis под high-load — от памяти и клиентских запросов до мониторинга и нагрузочного тестирования.

Покажут, как настройки и паттерны использования Redis влияют на вытеснение ключей, p95/p99 задержки и стабильность системы.

📅 26 марта, 12:00
📍 Онлайн
👥 Для инженеров DevOps и DBA, бэкенд-разработчиков, системных администраторов и архитекторов

👉Смотрите полную программу и регистрируйтесь: https://slc.tl/372hz

Чтобы не пропустить вебинар и узнавать о других событиях и бесплатных курсах Selectel, подписывайтесь на @selectel_events

Реклама. АО "Селектел". erid:2W5zFHppVWy

Читать полностью…

DevOps Portal | Linux

Оптимизация СУБД в облаке: ускоряем запросы и стабилизируем прод

Нет ничего более постоянного, чем что-то временное, поэтому проекты часто обрастают костыльными решениями, которые потом сложно переписывать.

24 марта, 17:00 (мск) мы проведем вебинар, где на практике разберем, как правильно создавать запросы в разных СУБД, как работать с их встроенными инструментами и как нужно интерпретировать метрики.

Почему стоит прийти на вебинар
- Посмотрим, как и почему происходит деградация производительности после релиза
- Попрактикуемся в оптимизации запросов MySQL и PostgreSQL, а также посмотрим на универсальные решения
- Разберем типовые ошибки и антипаттерны: как избегать использования костылей при снятии блокировок
- Соберем чек‑лист качественной оптимизации СУБД

До встречи в эфире! Будет много практики и прикладных решений.

Читать полностью…

DevOps Portal | Linux

Помните времена, когда спокойно покупали игры, подписки и софт без танцев с бубном?

Сейчас оплатить многие сервисы стало непросто: GPT, игры, подписки, зарубежные сайты 💚

Я сам пользуюсь ботом, через который можно оплачивать всё прямо в Telegram.

🟢 Оплата рублями
🟢 СБП / карты РФ
🟢 Без лишней мороки

Если тоже устали искать обходные пути — вот рабочий вариант ➡️@OplataRublemBot

Читать полностью…

DevOps Portal | Linux

Этот туториал объясняет, как создавать и деплоить production-ready микрофронтенды в Kubernetes.

Также в нём рассматривается настройка ingress-роутинга для module federation и реализация CI/CD пайплайнов для изолированных команд микрофронтенда.

Читайте tamer-abdulghani/building-production-ready-micro-frontends-in-kubernetes-a-pragmatic-approach-708134467b02">тут

👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

Как работают мультиплатформенные container images

Когда вы делаете docker pull nginx:1.29 на AMD64-сервере и на ARM64-ноутбуке, Docker подтягивает совершенно разные сборки образа. Но как это возможно, если в обоих случаях используется одно и то же имя образа?

Чтобы представить несколько сборок через одну ссылку на образ (например, nginx:1.29), container registry использует специальный файл — Image Index, в котором перечислены манифесты для отдельных платформенных сборок. Поэтому при pull появляется дополнительный шаг:

- Сначала запрашивается index по адресу https://registry.example[.]com/v2/REPO/manifests/TAG

- Затем в index находится манифест образа для нужной платформы, после чего он запрашивается по digest: https://registry.example[.]com/v2/REPO/blobs/DIGEST

- И уже после этого по digest’ам из манифеста подтягиваются config образа и blobs слоёв файловой системы

Для single-platform image ссылка https://registry.example[.]com/v2/REPO/manifests/TAG указывает сразу на его manifest. То есть здесь на один уровень косвенности меньше.

Подробнее о внутреннем устройстве container images:
https://labs.iximiuz.com/tutorials/container-image-from-scratch

👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

Linux совет дня

Чтобы скопировать последние команды из терминала без номеров строк:

fc -ln


Чисто, удобно для копирования, читабельно

👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

Docker 101: как подтягивать образы из разных реестров

Формат имени образа (он же reference) у меня занял какое-то время, чтобы в нём разобраться, когда только начинал с Docker. Скорее всего потому, что в одном имени сразу зашито:

Registry
Repository
Tag и digest


Подробнее: https://labs.iximiuz.com/challenges/docker-pull-container-images

👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

9 000₽ за вечер. Без кода. Без офиса. Без опыта.

Именно столько платят за одного чат-бота для бизнеса начинающим спецам.

Сейчас висит более 3800 запросов на создание бота только в Максе. Работы валом, а спецов не хватает. Хотя работа не сложная, на 2-3 часа в день:

Берёшь шаблон → собираешь бота → сдаёшь клиенту. Первые деньги — в первую же неделю.

В первый месяц обычно выходят на 50–80 тыс ₽. Дальше — от 180 тыс ₽ и выше.

Инструкция по сборке доступна бесплатно, но только до 30 марта.
Пробуй 👉 @other_digital_bot

Читать полностью…

DevOps Portal | Linux

Если вы работали с Kubernetes, то наверняка видели pod в статусе Pending и задавались вопросом, что сломалось. Ситуация частая, но не всегда понятно, как её дебажить.

В статье разбираются основные причины: нехватка ресурсов, проблемы с node selector’ами, биндингом PVC, taints и ресурсными квотами. Есть конкретные kubectl команды и примеры из реальной практики.

Бен Ример сделал удобный гайд – подойдёт и для обучения, и как шпаргалка при troubleshooting проблем с Kubernetes scheduling.

Читайте тут ✌️

👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

Выкатили новую фичу в kubectx после 2 млн скачиваний с момента последнего релиза (это было 1,5 года назад):

Теперь можно создавать shell-сессии, привязанные к конкретному k8s-кластеру. Это защищает от случайной работы не с тем кластером, когда вы меняете дефолтный контекст глобально.

$ brew upgrade kubectx


👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

Какие инструменты ускоряют запуск продуктов и упрощают разработку ↗️

Узнайте на GoCloud 2026

9 апреля команда Cloud.ru проводит большую ИТ-конференцию про облака и ИИ.

В этот раз отдельный трек посвящен разработке и инструментам, которые снижают нагрузку на команду:

▶️автоматизация в эпоху ИИ

▶️DevOps-инструменты в облаке

▶️эффективные среды для разработки, CI/CD и обучения

▶️DevOps- и SRE-агенты

▶️защита cloud native приложений

▶️и другие доклады


Также будут отдельные треки про ИИ, облачную инфраструктуру и работу с данными. И самое крутое – практические воркшопы: берите ноутбук и решайте прикладные задачи под руководством экспертов Cloud.ru.

Где и когда:
9 апреля в Москве и онлайн

👉Не пропустите👈

Читать полностью…

DevOps Portal | Linux

Разработчики часто разворачивают приложения вроде NGINX в Kubernetes.

Но при этом им приходится писать множество YAML-манифестов, таких как:

Deployments, Services, Ingress и ConfigMaps.

Управлять всем этим бывает довольно сложно.

KRO (Kubernetes Resource Orchestrator) решает эту проблему с помощью переиспользуемых шаблонов, называемых ResourceGroups.

Разработчику достаточно указать простые параметры — например, имя приложения, количество реплик или тег образа — и KRO автоматически создаст все необходимые ресурсы Kubernetes.

Вот как это работает:

- Вы создаёте определение ResourceGroup, которое объединяет несколько Kubernetes-ресурсов в один шаблон.
- Контроллер KRO отслеживает такие инстансы и автоматически провиженит все связанные ресурсы в правильном порядке.
- Он управляет зависимостями между ресурсами, гарантируя корректную последовательность их создания.

В отличие от Helm или Kustomize, KRO работает напрямую на уровне Kubernetes API, что упрощает управление ресурсами и интеграцию с GitOps-пайплайнами.

Репозиторий GitHub: https://github.com/kubernetes-sigs/kro

👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

Docker 101: Как извлечь файловую систему образа контейнера?

Образы состоят из слоёв, и каждый слой содержит diff изменений файловой системы. Однако, когда вы запускаете контейнер из образа, он получает обычную «плоскую» rootfs (корневую файловую систему).

Разберитесь с несколькими способами её инспекции:
https://labs.iximiuz.com/challenges/extract-container-image-filesystem

👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

🚀 Выиграйте обучение до 100 000 ₽ на любом курсе

Учебный центр для инженеров разработки и эксплуатации (DevOps), разработчиков и системных администраторов Слёрм запустил розыгрыш грантов на обучение: это ваш шанс получить доступ к курсам для ИТ‑специалистов абсолютно бесплатно, улучшить свои навыки и ускорить карьерный рост.

Что можно выиграть:
1 место — 100 000 ₽ на обучение
2 место — 30 000 ₽
3 место — 10 000 ₽

❗️Важно: грант можно использовать на любой курс или комплект курсов Слёрма, но он не действует на пакеты подписки и курс «Профессия DevOps-инженер».

Чтобы участвовать:
✨ Подпишитесь на канал Слёрма, если не сделали этого ранее
✨ Нажмите «Участвовать» под этим постом

Подведём итоги и назовём счастливчиков 4 апреля. Искренне желаем удачи каждому! 🍀

Читать полностью…

DevOps Portal | Linux

База по сетевым технологиям для разрабов, девопсов и платформенных инженеров

Мини-курс с кучей наглядных схем по уровням Ethernet и IP (L2/L3) в компьютерных сетях. В комплекте — богатый набор практических лабораторных работ

Забираем здесь 🍯

👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

HTTP (HyperText Transfer Protocol)

Данные передаются в открытом виде, и любой в сети может их перехватить или прочитать – протокол небезопасен.
Пример: http://example.com

Шифрование отсутствует, поэтому соединение уязвимо для атак.

HTTPS (HTTP Secure)

Данные передаются в зашифрованном виде, и злоумышленники не могут их прочитать или изменить – соединение считается безопасным.
Пример: https://example.com

Данные защищены.

👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

Как Kubernetes вообще понимает, что в вашем кластере есть GPU?

Kubernetes сам по себе не умеет обнаруживать GPU.

Он полагается на device plugin’ы, которые запускаются как DaemonSet’ы на нодах с GPU.

Когда вы устанавливаете NVIDIA GPU Operator или соответствующий device plugin, он регистрирует GPU-ресурсы в kubelet на каждой ноде.

Плагин объявляет доступные GPU как расширенные ресурсы (например, nvidia.com/gpu: 1).

После регистрации kubelet репортит эти ресурсы в API server, и они становятся доступными для планировщика (schedulable).

После этого ваши поды могут запрашивать GPU через resource limits в своих спецификациях.

Без device plugin’а Kubernetes вообще не знает, что на нодах есть GPU, даже если железо физически присутствует.


Читайте здесь: https://newsletter.devopscube.com/p/gpu-scheduling-kubernetes

Примечание: в Kubernetes 1.32 появился Dynamic Resource Allocation (DRA) — следующий этап эволюции управления аппаратными ресурсами.

Он предоставляет более гибкое и детализированное распределение ресурсов, которое невозможно реализовать с помощью device plugin’ов.

Тем не менее, device plugin’ы по-прежнему широко используются в продакшене, и на данный момент оба подхода сосуществуют.


👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

StatefulSet в Kubernetes используется для управления stateful-приложениями, где каждому поду нужна фиксированная идентичность и собственное хранилище данных.

Ключевая идея (просто):

В отличие от Deployment (где поды считаются взаимозаменяемыми), StatefulSet даёт каждому поду:
- Стабильное имя → app-0, app-1, app-2
- Персистентное хранилище → каждый под сохраняет свои данные
- Упорядоченный запуск/остановку → поды стартуют и завершаются последовательно

Используй StatefulSet, когда приложение:
- Требует сохранения данных (например, базы данных)
- Нуждается в уникальной идентичности для каждого пода
- Требует упорядоченного масштабирования

Примеры:
- MySQL кластер
- MongoDB
- Kafka
- Redis (в режиме кластера)

👉 DevOps Portal

Читать полностью…

DevOps Portal | Linux

Наши планы на последнюю пятницу марта:

✅ Получить чек-лист по защите чувствительных данных на DBaaS
✅ Узнать различия и преимущества FoundationDB и Cassandra 5 на практике
✅ Понять, чем отличается путь масштабирования S3 в Авито

Всё потому, что мы узнали, что 27 марта будет Avito Database meetup в офисе Авито

Кстати, если будете не в Москве, то у ребят есть онлайн-трансляция.

Нашли и ссылку для регистрации, поэтому залетайте, увидимся ✌️

Читать полностью…

DevOps Portal | Linux

Как отечественная ОС стала лидером рынка и гарантом безопасности?

Рассказывам в спецпроекте «Российская ОС: код доверия». Он посвящен Astra Linux, самой популярной отечественной ОС, которая занимает 76% рынка российских операционных систем.

В проекте — пять развернутых материалов:

🔹 «17 лет эволюции Astra Linux: от первого релиза до версии 1.8» — о ключевых этапах становления продукта и его развитии.
🔹 Интерфейс Fly 2.0 — о создании графической оболочки во взаимодействии с пользователями и заказчикам.
🔹 Безопасность и встроенные СЗИ — о механизмах защиты в актуальной версии.
🔹 Опыт заказчика — Павел Лобанов, руководитель практики по продуктовому бизнес-анализу компании «Газпром нефть», рассказывает про процесс миграции и результаты внедрения.
🔹 Пошаговый гайд по переходу на версию 1.8 — рассказываем о ценности обновлений, даем рекомендации для ИТ-команд, демонстрируем переход на Astra Linux 1.8 в видео.

Отправиться в путешествие по галактике Astra Linux

Читать полностью…
Subscribe to a channel