Обложка мероприятия Смолл/мидтех трек на Saint HighLoad++ 2026
РазработкаML/AIБезопасность, SecOps

Смолл/мидтех трек на Saint HighLoad++ 2026

Смоллтех выходит на Saint HighLoad++! Представляем смолл/мидтех-трек для инженеров малых и средних технологических компаний.

В партнерстве сообщества Смоллтех и программного комитета Saint HighLoad++ 2026 мы собрали отдельный трек для инженеров смоллтеха и мидтеха: про AI-инфраструктуру, экономику inference, безопасность AI-агентов, FinOps, legacy и архитектурный рост — без лишнего пафоса и без предположения, что у каждой команды есть бесконечный бюджет.

Что это за трек

Это не «урезанный HighLoad» и не инструкция «делайте как бигтех». Мы собрали доклады, которые ближе к реальности небольших и средних инженерных команд: ограниченные ресурсы, быстрый рост, legacy, инфраструктурные решения, AI-инструменты и цена ошибки, которую не хочется платить дважды.

Трек пройдёт 22–23 июня в Санкт-Петербурге в рамках Saint HighLoad++ 2026. Смотрите состав трека ниже, в разделе "Расписание", или на сайте конференции.

Для инженеров смоллтеха и мидтеха доступны скидки до 30%

Мы хотим снизить порог входа для команд, которым и так хватает барьеров в профессиональной деятельности. Чтобы получить специальное условие на билет, напишите Елизавете Царёвой на elizaveta.tsareva@ontico.ru — она подскажет, какая скидка применима к вашей компании и как оформить участие.

пн, 22 июнь #

Мастер-класс «Детские болезни доменных платформ: архитектурные ошибки, которые дорого чинить» #

Зал "Розовый"

Екатерина ЛысенкоНезависимый эксперт

Доклад для всех, кто работает/работал/будет работать, и для тех, кто НИКОГДА НИ ПРИ КАКИХ УСЛОВИЯХ не пойдет работать в BigTech! А еще для всех, кто верит в фразу: "У нас такоооооооой специфический домен"!

Уровни зрелости внедрения AI в процессы разработки #

Зал "Башня" (Главный зал)

Иван ПоддубныйВебпрактик

А вы уже в AI-native разработке? Или просто выдали разработчикам Claude/Cursor и считаете, что внедрили AI? Или построили сквозной процесс с общим контекстом? Или вся агентная инфраструктура уже работает автономно, а людям оставлены HITL-вставки в критичных точках? Кто-то застрял на начальных этапах, кто-то пытается перепрыгнуть стадии и запрыгнуть в полную автоматизацию.

В докладе:

— разберу мировые и локальные модели оценки зрелости AI в разработке;

— покажу, как честно определить, на каком уровне находится ваша команда или компания;

— расскажу, что меняется в инфраструктуре, процессах и роли разработчика на каждом следующем уровне.

Слушатель унесёт инструмент самооценки и понимание, какие именно архитектурные и процессные изменения нужны для следующего шага, а не для очередной галочки «внедрили AI».

FinOps: Anomaly Management как версия управления инцидентами #

Зал "Башня" (Главный зал)

Максим БурцевКупер.тех

SRE-инженеры, тимлиды команд разработки и эксплуатации, менеджеры процесса FinOpS, и все-все-все, кто хочет прозрачно контролировать свои расходы на облака и железо.

вт, 23 июнь #

Почему вам (скорее всего) не нужен локальный LLM-инференс #

Зал "Башня" (Главный зал)

Егор АндреевAdmindivision / Впрод

Мы строим платформу инференса и обычно пропагандируем идею "локальные LLM в продакшн". Но для средних и малых компаний рекомендация часто будет противоположная: не надо начинать с покупки GPU. В докладе покажу, где именно ломается экономика локального инференса и почему "поставим vLLM на свою карту" не равно "получим дешёвый продакшн-сервис".

Разбор будет через TCO. RTX 5090 можно арендовать за 50-90 тыс. рублей в месяц или купить за 300-500 тыс., но железо — только первая строка затрат. Дальше появляются ДЦ, электричество, охлаждение, сеть, мониторинг, деплой, кусочек или полный DevOps на поддержку и несколько человеко-месяцев на запуск. Даже если модель даёт хорошие tok/s в бенчмарке, карта ночью простаивает, днём упирается в потолок, а среднемесячная загрузка редко похожа на провайдерские 50-70%.

В конце разберём исключения: ИБ или регуляторика; GPU-парк в наследство от прошлого проекта; CAPEX, который проще защитить, чем OPEX; подозрительно постоянная нагрузка/training, под которую железо можно занять почти круглосуточно. В остальных случаях сначала стоит смотреть на API/OpenRouter, отечественные сервисы с оплатой по токенам или аренду GPU на короткий тест.

Безопасность AI-агентов: векторы угроз и механизмы защиты #

Зал "Розовый"

Радда ЮрьеваPositive Technologies

AI-агенты уже принимают решения, работают с API и управляют финансами. В докладе Радда Юрьева из Positive Technologies сначала разберёт реальные атаки через prompt injection, PDF, LinkedIn CV и RAG, а также защиту AI-систем, guardrails и способы обхода Llama Guard 2.

Как колоночное хранилище может помочь legacy? #

Зал "Розовый"

Михаил ШишкинООО Газинформсервис

В старых нагруженных корпоративных проектах часто можно встретить активное использование временных таблиц в СУБД. Нередко подобные решения оказываются очень чувствительными к росту объема поступающих в систему данных.

Чтобы оживить один из таких проектов без его модернизации мы воспользовались одним из ключевых преимуществ колоночных хранилищ и применили его к этому "проблемному" паттерну.

«Давайте просто развернём свою LLM на 1Т параметров»: как выглядит self-hosted AI после первого миллиона запросов #

Зал "Розовый"

Сергей НотевскийБитрикс24

Что происходит после фразы “давайте просто развернём open-source модель у себя”? На опыте Битрикс24 разберу грабли self-hosted AI: контекст, vLLM, GPU-пулы, evals, качество, стоимость и миллионы запросов в месяц. На выходе - чек-лист решений и метрик, который поможет оценить готовность к своим моделям и не сжечь бюджет на железе.

Партнёры

Кратко о мероприятии

Для кого
инженеры, инженеры small tech, инженеры mid tech, разработчики, инфраструктурные инженеры
Основные темы
small tech, mid tech, инженерия для малых компаний, инженерия для средних компаний
Что получите
изучить практические подходы для инженерии в small/mid tech, понять AI-инфраструктуру и FinOps, получить знания о легаси и архитектуре
Формат программы
глубокие технические доклады, производственные кейсы