Расписание

Время в программе указано для вашего часового пояса .

Программа пополняется

Программа пополняется

Новые доклады публикуем каждую неделю, не пропустите обновления.

Скачать расписание
  1. 12 октября

    Keynote

    When the Human Becomes the Copilot

    В докладе рассматривается путь от эксплуатации с помощью ИИ к самоуправляемой инфраструктуре: уровни автономности, агентные контуры управления, динамические песочницы, операционная безопасность, верификация и меняющаяся роль человека-оператора.

    Доклад

    Железный фундамент: как автоматизация помогает строить и динамично менять инфраструктуру облака

    Доклад о построении большой «железной» инфраструктуры и о том, как мы в K2 Cloud прошли путь в этой сфере от полного хаоса до стандартизированной, но в то же время гибкой системы, которая позволяет быстро адаптироваться под динамичный темп развития облачной платформы.

    Воркшоп

    Пятница, 17:59

    Командный воркшоп, где вы тушите боевой инцидент в реальном времени — по механикам настолок.

    Доклад

    Как превратить хаос в контекст, развивая Harness

    В крупной IT-организации данные о системах, API, командах, владельцах и интеграциях часто разрознены между порталами, репозиториями, документацией и чатами. Это замедляет поиск информации, усложняет архитектурные решения и повышает риски изменений.

    В докладе я расскажу, как Middleware Service Hub превращает разрозненные данные в связанный технологический контекст, развивается от каталога компонентов к Digital Twin организации и становится основой для Architecture as Code, API governance и AI Harness.

    Доклад

    Как создать 1000 тестовых стендов и не выгореть

    Доклад показывает, как построить масштабируемую систему динамических тестовых окружений и избавиться от проблем с общими стендами. Слушатели узнают, какие технологии и архитектурные решения позволяют ускорить разработку, тестирование и проверку изменений.

    Доклад

    Рост покемона — трейсинг в ecom.tech

    Трейсинг — важная часть сигналов observability, и много кто уже внедрил и активно использует его у себя сейчас. Мы скорее нагоняли тренд использования трейсов и собрали разных шишек, пытаясь сделать «сразу хорошо», в условиях highload.

    Проиллюстрируем, как росла наша платформа трейсинга, менялись инструменты от Tempo до VictoriaTraces, какие шишки мы собирали, какие проблемы решали и как повышали гарантии услуги.

    BOF-сессия

    Шатаем прод агентами — как пускать ИИ к красной кнопке?

    Индустрию штормит от сокращений. Команды урезают, микросервисов меньше не становится, а соблазн отдать ИИ-агенту ключи от инфраструктуры растет. В пять утра очень хочется натравить агента на алерты, чтобы он сам прочитал логи, нашел проблему и сделал спасительный kubectl fix. Но готовы ли мы пустить LLM в закрытый контур, зная про галлюцинации и непредсказуемость?

    Доклад

    Каскадный деплой в GitOps: два подхода на FluxCD

    Покажу, как построить каскадный деплой на FluxCD и не распространять ошибочное изменение сразу на все окружения. Разберу два подхода: GitOps promotion через Kargo.io и Gitless-доставку через OCI artifacts, а также Prometheus gates как механизм stop/go-решений между dev, stage и production.

    Доклад

    Проверки Helm-чартов в CI/CD: где заканчивается линтинг и начинается эксплуатационная валидация

    На примерах из практики РТЛабс покажу, как находить в CI/CD ошибки, которые не ловит линтинг Helm-чартов: некорректный JSON внутри YAML, опасные изменения Kafka-топиков и недоступность зависимостей из Kubernetes-кластера. Разберем, где достаточно готовых инструментов, а где нужны собственные проверки с учетом контекста релиза и целевой среды.

  2. 13 октября

    Доклад

    Веса, GPU и первый токен: как принять LLM в эксплуатацию

    К вам пришла ML-команда: «LLM'ка отвечает в контейнере, теперь отдайте ее пользователям и поддерживайте».

    Разберем, что норовит пойти не так по дороге в заветный продакшен: веса и GPU, первый токен, ключи и доступы, обновления, метрики и аварии. И как со всем этим справиться с наименьшими потерями.

    Доклад

    DevOps без K8s: автоматизация управления проектами

    Расскажем, с какими сложностями столкнулись, покажем, как превратили хаос в управляемую систему: что пошло не так на старте, какие инструменты реально сработали и как мы измеряли эффект.

    Доклад

    Ниже Kubernetes: расследования в GPU-кластерах на Talos Linux

    За прикладным уровнем AI-систем — MLOps, моделями и инференсом — стоит платформа, которую нужно заставить работать: Kubernetes, операционная система, драйверы NVIDIA и весьма капризное серверное железо. На примере реальных расследований из эксплуатации GPU-кластеров на базе Talos Linux покажу, как искать причины сложных проблем на стыке этих слоев — и почему реальная причина часто оказывается совсем не там, где ее ждешь.

    Доклад

    Инфраструктурные кочевники: делаем переезды скучными

    Инфраструктурная миграция проверяет не только технологии, но и то, насколько команда знает свои зависимости, умеет повторять действия и готова к неудачному сценарию. На опыте пяти переездов покажу, как превращать ошибки в конкретные изменения — автоматизацию, актуальные паспорта, проверки и репетиции, — чтобы следующий переезд требовал меньше героизма и больше следования понятному плану.

    Доклад

    Поваренная книга DevOps, или Как приготовить практики в банке

    Опишу, как мы создавали у себя DevOps Cookbook. Что это такое в нашем понимании, как мы пришли к тому, что он нам необходим.

    Как мы перешли от «стены текста» к боту-помощнику. И наши планы на будущее.

    BOF-сессия

    Бумажная «элита» и State of Cloud Native Russia

    Почему никому не нужно релизить в 70 раз чаще и нужны ли будут инженеры в 2027-м?
    Каждый год нам пишут, что жить стало лучше и веселее. И вот уже: 90% индустрии пишет код с ИИ, ИБ не тормозит пайплайны, IDP есть у каждого первого, а «элитные» команды релизят не переставая. Мы смотрим на эти графики State of Cloud Native, переводим взгляд на наш пылающий легаси-монолит и думаем: на какой планете живут все эти люди?

    Доклад

    17 лет опыта в Kubernetes: как поймать фабрикованное резюме и не разориться на нейросетях

    Каждое второе входящее резюме врет (17 лет опыта в Kubernetes при том, что ему 12), а нейросеть, которая это ловит, либо разоряет на счетах, либо врет сама, либо принимает решение по найму, которое потом нельзя объяснить юристам.

    Покажу, как это лечится каскадом из трех уровней моделей с дорогой в конце, тремя защитными слоями и реальными цифрами до и после — на живой коллекции пойманных фабрикаций.

    Доклад

    Жизнь после Managed Spark: как мы сделали Spark управляемым runtime на K8s как часть ML-платформы

    Миграция с Managed Spark в Kubernetes — это не перенос кода, а проектирование отдельного управляемого compute-слоя, который стал частью ML-платформы: поддерживаемые base images, CI/CD, Airflow, Spark Operator, YuniKorn, секреты и observability.

    В докладе покажу, как сделать запуск Spark-задач удобным для DE/ML-инженеров и сохранить управляемость в эксплуатации кластера.

    Доклад

    Ликбез по жидкостному охлаждению вычислительных GPU-кластеров

    Современные мощные серверные GPU по дефолту охлаждаются жидкостью. Расскажу, какие варианты возможны при создании вычислительного GPU-кластера или дата-центра для ИИ, а также какие выгоды получаем и чем расплачиваемся.

    Доклад

    Корпоративный GPT. Как внедрить так, чтобы все остались довольны

    Современные корпоративные AI-платформы — это уже не просто OpenWebUI + Ollama, это десятки возможных комбинаций различных решений: AI-gateway, RAG-системы, инференс-бэкенды, инфраструктура, агенты и прочая обвязка, закрывающая потребности бизнеса. Всё это добро должно работать согласованно, держать высокую нагрузку и обеспечивать пользователей качественным сервисом с адекватными задержками.

    Расскажу, к какой архитектуре пришли мы, построив корпоративный ChatGPT-like сервис на 18К пользователей с DAU 1500+ на этапе разработки.

    Доклад

    От Bash к Terraform — эволюция централизованного управления GitLab-проектами

    Реальный опыт эволюции подхода управления централизованной конфигурацией проектов Gitlab, Hashicorp Vault и других в 2ГИС: от простых bash-скриптов до связки Terraform и Terragrunt.

    Организация структуры конфигураций команд и групп, чтобы обрабатывать сотни проектов за минуты вместо часов.