Расписание

Время в программе указано для вашего часового пояса .

Программа пополняется

Программа пополняется

Новые доклады публикуем каждую неделю, не пропустите обновления.

  • Без темы

    32
    • Обсуждение

      Открытие конференции

      Говорим о расписании, сессиях и делимся информацией.

    • Доклад

      When the Human Becomes the Copilot

      В докладе рассматривается путь от эксплуатации с помощью ИИ к самоуправляемой инфраструктуре: уровни автономности, агентные контуры управления, динамические песочницы, операционная безопасность, верификация и меняющаяся роль человека-оператора.

    • Доклад

      Reliability Map и куда она ведет

      Пути, карты и надежность. Как уже сегодня сделать так, чтобы ваши сервисы были доступны на 100%? Практики SRE и что такое CRE: как в облаке и на земле обеспечить доступность и отказоустойчивость сервисов (а не только инфраструктуры).

    • Доклад

      Жизнь после Managed Spark: как мы сделали Spark управляемым runtime на K8s как часть ML-платформы

      Миграция с Managed Spark в Kubernetes — это не перенос кода, а проектирование отдельного управляемого compute-слоя, который стал частью ML-платформы: поддерживаемые base images, CI/CD, Airflow, Spark Operator, YuniKorn, секреты и observability.

      В докладе покажу, как сделать запуск Spark-задач удобным для DE/ML-инженеров и сохранить управляемость в эксплуатации кластера.

    • Доклад

      Как мы покрытие инфраструктуры харденингом мониторили

      Важно не только внедрить харденинг, но и постоянно проверять, что он действительно применяется на всех хостах и не «уезжает» со временем. В докладе я расскажу, как мы полностью автоматизировали этот процесс: от формирования эталона и динамического инвентаря до проверок через Ansible, метрик в Prometheus и визуализации в Grafana.

    • Доклад

      Как создать 1000 тестовых стендов и не выгореть

      Доклад показывает, как построить масштабируемую систему динамических тестовых окружений и избавиться от проблем с общими стендами. Слушатели узнают, какие технологии и архитектурные решения позволяют ускорить разработку, тестирование и проверку изменений.

    • Доклад

      Каскадный деплой в GitOps: два подхода на FluxCD

      Покажу, как построить каскадный деплой на FluxCD и не распространять ошибочное изменение сразу на все окружения. Разберу два подхода: GitOps promotion через Kargo.io и Gitless-доставку через OCI artifacts, а также Prometheus gates как механизм stop/go-решений между dev, stage и production.

    • Доклад

      Ниже Kubernetes: расследования в GPU-кластерах на Talos Linux

      За прикладным уровнем AI-систем — MLOps, моделями и инференсом — стоит платформа, которую нужно заставить работать: Kubernetes, операционная система, драйверы NVIDIA и весьма капризное серверное железо. На примере реальных расследований из эксплуатации GPU-кластеров на базе Talos Linux покажу, как искать причины сложных проблем на стыке этих слоев — и почему реальная причина часто оказывается совсем не там, где ее ждешь.

    • Доклад

      Поваренная книга DevOps, или Как приготовить практики в банке

      Опишу, как мы создавали у себя DevOps Cookbook. Что это такое в нашем понимании, как мы пришли к тому, что он нам необходим.

      Как мы перешли от «стены текста» к боту-помощнику. И наши планы на будущее.

    • Доклад

      Сломаться или стать сильнее? Зарисовки инцидентов c K8s в инфре MWS Cloud

      Как устроены наши отказоустойчивые K8s-кластера в инфраструктуре, как мы автоматизировали их управление через CAPI на масштабах сотен серверов.

    • Доклад

      Трудности деплоя: почему декларативность Kubernetes заканчивается на втором манифесте

      Сравним возможности ArgoCD и Flux, kubectl, Helm и Nelm/werf в упорядочивании развертывания, отслеживании готовности и управлении жизненным циклом ресурсов.

    • Доклад

      Железный фундамент: как автоматизация помогает строить и динамично менять инфраструктуру облака

      Доклад о построении большой «железной» инфраструктуры и о том, как мы в K2 Cloud прошли путь в этой сфере от полного хаоса до стандартизированной, но в то же время гибкой системы, которая позволяет быстро адаптироваться под динамичный темп развития облачной платформы.

    • Доклад

      Веса, GPU и первый токен: как принять LLM в эксплуатацию

      К вам пришла ML-команда: «LLM'ка отвечает в контейнере, теперь отдайте ее пользователям и поддерживайте».

      Разберем, что норовит пойти не так по дороге в заветный продакшен: веса и GPU, первый токен, ключи и доступы, обновления, метрики и аварии. И как со всем этим справиться с наименьшими потерями.

    • Доклад

      Социальный контракт DevOps-инженера

      Доклад осветит онбординг, механизмы обучения, передачи знаний, используемые технологии и условия труда. Вы сможете узнать о том, чем вы платите за привилегии и «печеньки».

    • Доклад

      DevOps без K8s: как инженерная культура спасла управление проектами

      Расскажем, с какими сложностями столкнулись, покажем, как превратили хаос в управляемую систему: что пошло не так на старте, какие инструменты реально сработали и как мы измеряли эффект.

    • Доклад

      Kyverno в масштабе: мультитенантность, observability и как не остановить работу компании

      Доклад — практический опыт масштабирования, observability политик и awareness вокруг них, — чтобы каждая команда понимала, что происходит в ее кластере, не дожидаясь инцидента.

    • Доклад

      State of Russian NGFW: что нужно знать перед внедрением

      Расскажу, как импортозамещение NGFW в банке превратилось в пересборку сетевой модели production Kubernetes: namespace-level доступы, миграция в облако и отказ от привычной модели авторизации трафика.

    • Воркшоп

      Пятница, 17:59

      Командный воркшоп, где вы тушите боевой инцидент в реальном времени — по механикам настолок.

    • Доклад

      Как превратить хаос в контекст, развивая Harness

      В крупной IT-организации данные о системах, API, командах, владельцах и интеграциях часто разрознены между порталами, репозиториями, документацией и чатами. Это замедляет поиск информации, усложняет архитектурные решения и повышает риски изменений.

      В докладе я расскажу, как Middleware Service Hub превращает разрозненные данные в связанный технологический контекст, развивается от каталога компонентов к Digital Twin организации и становится основой для Architecture as Code, API governance и AI Harness.

    • Доклад

      Корпоративный GPT. Как внедрить так, чтобы все остались довольны

      • К какой архитектуре мы пришли, построив корпоративный ChatGPT-like сервис на 10К пользователей с DAU 1000+ на этапе разработки.

      • Как в такой схеме реализовать практически любое бизнес-правило.

      • С какими трудностями мы столкнулись и как решили их силами нашей команды.

      1. Патчи — снижаем TTFT и E2E, интегрируем наши сервисы, реализуем кастомную логику.

      2. Обновления базовых версий компонентов, как наложить патчи на сотни новых коммитов.

      3. Как дать доступ всем и не положить модели нагрузкой.

      • Что мы выяснили, пока ресерчили море опенсорса. Упор на инференс, к каким бэкендам и конфигурациям мы пришли.

      • Реализация агента и как мы будим Jupyter-кернелы за 1-2 секунды, не давая им заснуть.

    • Доклад

      Штабные игры DevOps'ов по нажатию красной кнопки

      Доклад строится на двух частях: сетевая изоляция зараженной инфраструктуры и то, как ее делать инженерам. И куда бежать, если надо разворачивать новую инфраструктуру.

    • Доклад

      От Bash к Terraform — эволюция централизованного управления GitLab-проектами

      Реальный опыт эволюции подхода управления централизованной конфигурацией проектов Gitlab, Hashicorp Vault и других в 2ГИС: от простых bash-скриптов до связки Terraform и Terragrunt.

      Организация структуры конфигураций команд и групп, чтобы обрабатывать сотни проектов за минуты вместо часов.

    • Доклад

      17 лет опыта в Kubernetes: как поймать фабрикованное резюме и не разориться на нейросетях

      Каждое второе входящее резюме врет (17 лет опыта в Kubernetes при том, что ему 12), а нейросеть, которая это ловит, либо разоряет на счетах, либо врет сама, либо принимает решение по найму, которое потом нельзя объяснить юристам.

      Покажу, как это лечится каскадом из трех уровней моделей с дорогой в конце, тремя защитными слоями и реальными цифрами до и после — на живой коллекции пойманных фабрикаций.

    • Обсуждение

      Закрытие конференции

      Подводим итоги конференции, вспоминаем яркие моменты и рассказываем о дальнейших планах.