Расписание

Время в программе указано для вашего часового пояса .

Программа пополняется

Программа пополняется

Новые доклады публикуем каждую неделю, не пропустите обновления.

  1. 12 октября

    Доклад

    When the Human Becomes the Copilot

    В докладе рассматривается путь от эксплуатации с помощью ИИ к самоуправляемой инфраструктуре: уровни автономности, агентные контуры управления, динамические песочницы, операционная безопасность, верификация и меняющаяся роль человека-оператора.

    Доклад

    Reliability Map и куда она ведет

    Пути, карты и надежность. Как уже сегодня сделать так, чтобы ваши сервисы были доступны на 100%? Практики SRE и что такое CRE: как в облаке и на земле обеспечить доступность и отказоустойчивость сервисов (а не только инфраструктуры).

    Доклад

    Жизнь после Managed Spark: как мы сделали Spark управляемым runtime на K8s как часть ML-платформы

    Миграция с Managed Spark в Kubernetes — это не перенос кода, а проектирование отдельного управляемого compute-слоя, который стал частью ML-платформы: поддерживаемые base images, CI/CD, Airflow, Spark Operator, YuniKorn, секреты и observability.

    В докладе покажу, как сделать запуск Spark-задач удобным для DE/ML-инженеров и сохранить управляемость в эксплуатации кластера.

    Доклад

    Как мы покрытие инфраструктуры харденингом мониторили

    Важно не только внедрить харденинг, но и постоянно проверять, что он действительно применяется на всех хостах и не «уезжает» со временем. В докладе я расскажу, как мы полностью автоматизировали этот процесс: от формирования эталона и динамического инвентаря до проверок через Ansible, метрик в Prometheus и визуализации в Grafana.

    Доклад

    Как создать 1000 тестовых стендов и не выгореть

    Доклад показывает, как построить масштабируемую систему динамических тестовых окружений и избавиться от проблем с общими стендами. Слушатели узнают, какие технологии и архитектурные решения позволяют ускорить разработку, тестирование и проверку изменений.

    Доклад

    Каскадный деплой в GitOps: два подхода на FluxCD

    Покажу, как построить каскадный деплой на FluxCD и не распространять ошибочное изменение сразу на все окружения. Разберу два подхода: GitOps promotion через Kargo.io и Gitless-доставку через OCI artifacts, а также Prometheus gates как механизм stop/go-решений между dev, stage и production.

    Доклад

    Ниже Kubernetes: расследования в GPU-кластерах на Talos Linux

    За прикладным уровнем AI-систем — MLOps, моделями и инференсом — стоит платформа, которую нужно заставить работать: Kubernetes, операционная система, драйверы NVIDIA и весьма капризное серверное железо. На примере реальных расследований из эксплуатации GPU-кластеров на базе Talos Linux покажу, как искать причины сложных проблем на стыке этих слоев — и почему реальная причина часто оказывается совсем не там, где ее ждешь.

    Доклад

    Поваренная книга DevOps, или Как приготовить практики в банке

    Опишу, как мы создавали у себя DevOps Cookbook. Что это такое в нашем понимании, как мы пришли к тому, что он нам необходим.

    Как мы перешли от «стены текста» к боту-помощнику. И наши планы на будущее.

    Доклад

    Железный фундамент: как автоматизация помогает строить и динамично менять инфраструктуру облака

    Доклад о построении большой «железной» инфраструктуры и о том, как мы в K2 Cloud прошли путь в этой сфере от полного хаоса до стандартизированной, но в то же время гибкой системы, которая позволяет быстро адаптироваться под динамичный темп развития облачной платформы.

    Доклад

    Веса, GPU и первый токен: как принять LLM в эксплуатацию

    К вам пришла ML-команда: «LLM'ка отвечает в контейнере, теперь отдайте ее пользователям и поддерживайте».

    Разберем, что норовит пойти не так по дороге в заветный продакшен: веса и GPU, первый токен, ключи и доступы, обновления, метрики и аварии. И как со всем этим справиться с наименьшими потерями.

  2. 13 октября

    Доклад

    Социальный контракт DevOps-инженера

    Доклад осветит онбординг, механизмы обучения, передачи знаний, используемые технологии и условия труда. Вы сможете узнать о том, чем вы платите за привилегии и «печеньки».

    Доклад

    DevOps без K8s: как инженерная культура спасла управление проектами

    Расскажем, с какими сложностями столкнулись, покажем, как превратили хаос в управляемую систему: что пошло не так на старте, какие инструменты реально сработали и как мы измеряли эффект.

    Доклад

    Kyverno в масштабе: мультитенантность, observability и как не остановить работу компании

    Доклад — практический опыт масштабирования, observability политик и awareness вокруг них, — чтобы каждая команда понимала, что происходит в ее кластере, не дожидаясь инцидента.

    Воркшоп

    Пятница, 17:59

    Командный воркшоп, где вы тушите боевой инцидент в реальном времени — по механикам настолок.

    Доклад

    Как превратить хаос в контекст, развивая Harness

    В крупной IT-организации данные о системах, API, командах, владельцах и интеграциях часто разрознены между порталами, репозиториями, документацией и чатами. Это замедляет поиск информации, усложняет архитектурные решения и повышает риски изменений.

    В докладе я расскажу, как Middleware Service Hub превращает разрозненные данные в связанный технологический контекст, развивается от каталога компонентов к Digital Twin организации и становится основой для Architecture as Code, API governance и AI Harness.

    Доклад

    Корпоративный GPT. Как внедрить так, чтобы все остались довольны

    • К какой архитектуре мы пришли, построив корпоративный ChatGPT-like сервис на 10К пользователей с DAU 1000+ на этапе разработки.

    • Как в такой схеме реализовать практически любое бизнес-правило.

    • С какими трудностями мы столкнулись и как решили их силами нашей команды.

    1. Патчи — снижаем TTFT и E2E, интегрируем наши сервисы, реализуем кастомную логику.

    2. Обновления базовых версий компонентов, как наложить патчи на сотни новых коммитов.

    3. Как дать доступ всем и не положить модели нагрузкой.

    • Что мы выяснили, пока ресерчили море опенсорса. Упор на инференс, к каким бэкендам и конфигурациям мы пришли.

    • Реализация агента и как мы будим Jupyter-кернелы за 1-2 секунды, не давая им заснуть.

    Доклад

    От Bash к Terraform — эволюция централизованного управления GitLab-проектами

    Реальный опыт эволюции подхода управления централизованной конфигурацией проектов Gitlab, Hashicorp Vault и других в 2ГИС: от простых bash-скриптов до связки Terraform и Terragrunt.

    Организация структуры конфигураций команд и групп, чтобы обрабатывать сотни проектов за минуты вместо часов.

    Доклад

    17 лет опыта в Kubernetes: как поймать фабрикованное резюме и не разориться на нейросетях

    Каждое второе входящее резюме врет (17 лет опыта в Kubernetes при том, что ему 12), а нейросеть, которая это ловит, либо разоряет на счетах, либо врет сама, либо принимает решение по найму, которое потом нельзя объяснить юристам.

    Покажу, как это лечится каскадом из трех уровней моделей с дорогой в конце, тремя защитными слоями и реальными цифрами до и после — на живой коллекции пойманных фабрикаций.

    Обсуждение

    Закрытие конференции

    Подводим итоги конференции, вспоминаем яркие моменты и рассказываем о дальнейших планах.