ITNEWS.pro
…
12 часов назад
Подписаться
Чужое ядро и свои адаптеры. Белорусская компания «Квантэк» собрала языковую модель под чувствительные данные

Белорусская компания «Квантэк» была основана около полутора лет назад, а сейчас у нее уже восемь серьезных клиентов на отечественном рынке, в том числе среди государственных структур и крупных компаний. Соучредитель и технический директор Даниил Радченко называет такой старт неплохим и объясняет его спросом на одно и то же: организациям с чувствительными данными нужен Искусственный интеллект (ИИ), который работает внутри их собственной сети, без Интернета и чужих облаков. Это цифровой суверенитет в масштабе одной организации: все работает на ее серверах и не зависит от внешних облачных сервисов.

Основа у всех продуктов компании одна: большая языковая модель (LLM), которую «Квантэк» купил у китайской Alibaba. Радченко этого не скрывает: ядро зарубежное, а «собственной» модель делают адаптеры, которые настраивают ее под каждого заказчика. Работать все может в закрытом контуре даже на нескольких видеокартах с 16 гигабайтами памяти, без дорогих серверных ускорителей Nvidia H100 или H200. Из этой связки выросли семь программных продуктов.

Со стороны такая история выглядит неожиданно, потому что отставание Беларуси в «гонке ИИ» принято считать очевидным. Лаборатории, которые обучают большие модели с нуля, находятся в США и Китае, а стоимость такой работы измеряется миллиардами долларов. Наше государство при этом относится к технологии всерьез.

Такой курс оставляет место компаниям, которые берут готовое ядро и превращают его в продукт под конкретного заказчика. «Квантэк» относится именно к таким, а Радченко рассказал, как эта работа устроена изнутри.

Три года без единого клиента

До выхода на рынок команда три-четыре года разрабатывала продукты и ничего не продавала. По выражению Радченко, она просто верила в идею. В резиденты Парка высоких технологий (компаний с особым правовым режимом для IT, их больше тысячи) «Квантэк» приняли с первого раза. Офисы у компании находятся в Минске и Орше.

Даниил начинал с сайтов. В IT он пришел в 2017 году с фриланса, вдохновленный студией Артемия Лебедева (одной из самых известных в русскоязычном Интернете), а параллельно учился на приборостроителя в Белорусском национальном техническом университете (БНТУ). Автоматизация, которую проходят на этой специальности, подсказала перспективное направление бизнеса: автоматизация процесса создания сайтов. Он хотел, чтобы малый бизнес получал индивидуальный дизайн вместо шаблона вроде Tilda (популярного конструктора сайтов) и не платил за это большие деньги. Ровно этим сейчас занимается шведская компания Lovable, которую этим летом оценили в 13,3 млрд долларов. Радченко замечает, что за 20 долларов такой сервис действительно соберет сайт, но результат почти всегда выходит типовым и легко узнается.

Команда сложилась после знакомства на европейской конференции в Чехии. Там Радченко познакомился с компаньоном Матвеем Цариковым, тоже белорусом и специалистом по машинному обучению. Обоих интересовала автоматизация, и на этом пересечении они собрали, как выражается Радченко, команду чудаков-энтузиастов. Экспертизу приходилось подтягивать со стороны, ведь проект с нуля и на одном желании получается у немногих, поэтому он много ездил на технологические выставки в Европе и странах СНГ, смотрел, где и как работают другие, и учился.

Данные остаются дома

Спрос, по объяснению Радченко, держится на требованиях к защите данных, которые государство предъявляет самим организациям. Он ссылается на приказ Оперативно-аналитического центра при Президенте (ОАЦ, государственный орган, отвечающий за информационную безопасность) № 66 и на закон № 99-З о защите персональных данных. Документ утвердил порядок технической и криптографической защиты информации в системах, где обрабатываются сведения ограниченного распространения, а его обновленные редакции действуют с 1 марта 2025 года. Закон требует беречь персональные данные граждан, которыми те делятся с компаниями. Поэтому основной упор «Квантэк» делает на кибербезопасность крупного и среднего бизнеса, который работает с людьми.

Правила правилами, но сотрудник с ChatGPT под рукой легко отправит туда служебный документ. Такие случаи известны: весной 2023 года инженеры полупроводникового подразделения Samsung загрузили в чат-бот исходный код и записи внутренних совещаний, после чего компания запретила генеративный ИИ на рабочих устройствах и сообщила, что готовит собственный инструмент. «Квантэк» предлагает обойтись без запрета. С руководителем предприятия Радченко говорит примерно так: «Искусственный интеллект у вас уже работает, просто официально его нет и он никак не регулируется. Ваши данные уходят на чужие ресурсы. Давайте не запрещать, а использовать внутри компании и под контролем».

Технически это означает поставить модель на серверы самой организации, где она работает полностью без Интернета. Для компаний без собственных видеокарт есть возможность развернуть модель в облаке в стране заказчика, а чувствительные данные можно обрабатывать локально по гибридной схеме. Тот же поворот видят и аналитики. Gartner (международная исследовательская компания в сфере IT) включила в десятку главных технологических трендов 2026 года конфиденциальные вычисления и геопатриацию, то есть перенос данных и вычислений из глобальных облаков в локальную инфраструктуру. В «Международном деловом альянсе» (белорусская ИТ-компания с собственным дата-центром) добавляют, что в государственном секторе и финансах требования к размещению и обработке данных все чаще предполагают национальную инфраструктуру и локальные дата-центры.

К внедрению данные готовят по одной схеме. У многих крупных компаний уже есть системы электронного документооборота, поэтому документы можно вынуть оттуда, перевести в Markdown (простой текстовый формат) и собрать из них базу знаний. Технических сложностей с этим нет, считает Радченко, документация давно оцифрована. Сложнее с самими данными, и здесь он не одинок. В «Международном деловом альянсе» называют главным барьером ИИ-проектов их состояние: данные разбросаны по CRM (системам работы с клиентами), ERP (системам управления ресурсами предприятия), 1С и таблицам, без общей структуры и контроля качества.

Чужое ядро и свои адаптеры

Для работы «Квантэк» приобрел большую языковую модель у Alibaba. Да, открытые китайские модели вроде Qwen, Kimi или DeepSeek доступны любому, и многие организации ставят их у себя. Трудности начинаются потом. Заказчик покупает «железо», разворачивает открытую модель, через какое-то время качество падает, а объяснить причину некому, потому что не хватает экспертизы в настройке. Порядок затрат Радченко тоже называет: чтобы поставить полноразмерную DeepSeek R1, по его оценке, нужно около 400 гигабайт видеопамяти, а в системе «Квантэк» на карту приходится 16. Главную фишку компании он видит именно здесь: минимизировать затраты на «железо», не теряя в качестве.

Само ядро весит сравнительно немного, а основная нагрузка зависит от того, сколько информации заказчик подключает к базе знаний. Чтобы уместить все на локальном сервере, компания использует собственную технику совместной работы видеокарты и оперативной памяти: часть данных и вычислений переносится в обычную память. Выгрузку части нейросети в оперативную память в отрасли применяют давно, а как именно устроена реализация «Квантэк», в компании не раскрывают, это внутренняя коммерческая разработка.

Под задачи конкретного заказчика ядро настраивают с помощью LoRA-адаптеров. LoRA (Low-Rank Adaptation, адаптация низкого ранга) придумали исследователи Microsoft, метод описан в 2021 году. Основные веса большой модели замораживают, а обучают только небольшие добавочные матрицы, которые встраивают в слои сети. На примере GPT-3 со 175 миллиардами параметров авторы показали, что обучаемых параметров становится в 10 тысяч раз меньше, а потребность в памяти видеокарт падает втрое, и качество при этом не хуже, чем при полном дообучении. Практическое следствие простое: одну модель можно обслуживать множеством маленьких адаптеров, по одному на заказчика, и менять их по необходимости.

Заказчики у «Квантэк» самые разные, от государственных структур до пищевой промышленности, торговли и сферы услуг, поэтому адаптер обучают не по шаблону. Сначала аудит и описание процессов, затем оцифрованная документация превращается в базу знаний, а дальше адаптер дообучается почти непрерывно и автоматически. Основная модель остается прежней, и когда у Alibaba выходит новая версия ядра, обновление входит в техническое сопровождение.

— То есть контур закрытый, а модель при этом дообучается?

— Она обучается на ваших данных, которые у вас внутри, именно в этом закрытом контуре, — отвечает Радченко.

Возражение напрашивается само: LoRA при желании обучит любой энтузиаст, скачав открытую модель с Hugging Face (крупной площадки с открытыми моделями). Радченко с этим не спорит и переводит разговор на продукты. Зайти в облако и написать MVP (минимально работающую версию) может любой, объясняет он, но за решением должна стоять вся экспертиза. Конкуренцию на белорусском рынке ИИ он оценивает как небольшую и добавляет, что компания уже получила признание у государственных заказчиков.

Что растет на этом ядре

Продукты «Квантэк» проще всего понять по задачам. Doc Fly ищет по корпоративному архиву: сотрудник пишет обычным языком, например «какие у нас просрочки по договорам», а система поднимает документы, проверяет сроки и выдает список, причем каждый видит только то, к чему допущен. В основе схема RAG (retrieval-augmented generation, генерация ответа с предварительным поиском): перед ответом система находит нужные фрагменты в документах компании и отвечает по ним, указывая источник. Kvantek Voice превращает в текст звонки, совещания и диктовку, разделяет реплики по говорящим и знает профессиональную лексику, медицинскую и юридическую.

Kvantek Manager работает ИИ-менеджером по продажам для B2B (для компаний, которые продают другим компаниям): отвечает клиентам в мессенджерах и по телефону, готовит коммерческие предложения, а готового к сделке клиента передает живому коллеге вместе с контекстом диалога.

УиКР (учет и контроль работы) подключается к 1С и Битрикс24, сам заполняет отчеты, табели и служебные записки и показывает руководителю, чем занят каждый сотрудник. Радченко называет его Битриксом со встроенным интеллектом. Пример из отдела продаж: система находит «спящих» клиентов, с которыми давно не было контакта, и напоминает, кому позвонить. При этом она же отслеживает эффективность работы сотрудников компании, чем занимается человек в рабочее время.

— А как же личное пространство?

— Его никто не отменял, — говорит Радченко. — Личный телефон у человека никто не забирает, он может заниматься на нем чем угодно. Но на корпоративном компьютере, в локальной сети, надо постоянно быть в работе и в обновлении.

Для инженеров есть Kvantek Draft, который переводит чертежи из PDF и сканов в редактируемые форматы DWG и DXF (форматы систем автоматизированного проектирования). Платформа DAS AUTO AI собрана из тех же деталей для автосервисов и магазинов автозапчастей.

У «Квантэк» есть отдельное решение для белорусского языка. Компания разработала LoRA-адаптер для работы на «мове» — дополнительную настройку модели с более чем 3 млрд параметров. Пользователь может задать вопрос по-белорусски: система сама распознает язык и отвечает на нем же. Сервис Kvantek Voice умеет расшифровывать белорусскую речь и готовить отчеты сразу в двух вариантах — на русском и белорусском языках. По словам Радченко, пилотный проект с профильным государственным центром получил очень хорошие отзывы от тестировщиков. Это практично: часть юридических документов в Беларуси составляют на белорусском, поэтому важно, чтобы ИИ умел понимать такие тексты и отвечать на вопросы по ним.

Сколько стоит «Майбах»

— Сколько организаций вам удалось убедить, что это полезно?

— Не столь много, — говорит Радченко. — На рынке Беларуси это восемь компаний.

Пилотных проектов было больше, но не все дошли до промышленной эксплуатации. Причину технический директор видит в том, что у части заказчиков еще не сложилось понимание, что именно покупается и зачем. Осторожность вокруг новой технологии он сравнивает с историей 1С: когда-то и там многие не хотели отказываться от привычного учета, теперь это стандарт, хотя не все белорусские компании до нее до сих пор дошли.

Из коммерческих примеров Радченко приводит предприятие, которое печет хлеб и поставляет его в торговые сети. За первый месяц после внедрения один только ИИ-агент (программа, которая сама выполняет цепочку действий), возвращающий «спящих» клиентов, принес, по его данным, 75 тысяч белорусских рублей.

— Наши продукты доступны и их экономическая эффективность видна практически сразу, — отвечает Радченко. — Расчет всегда от клиента и от объема работы. Есть, условно говоря, «Жигули», а есть «Майбах», и тут уже что захочет клиент.

Коробочные решения дешевле, для них есть прайс. Лицензия стоит от 18 тысяч белорусских рублей в год, возможна и оплата за каждого пользователя.

Выездная команда приезжает в закрытую сеть заказчика, разворачивает систему, настраивает адаптеры и обучает сотрудников, которые потом ведут первую линию поддержки, а вторую берет на себя «Квантэк». Начинается все с IT-аудита, то есть с описания процессов и систем компании: любой процесс, который можно описать, можно автоматизировать, уверен технический директор. Многим предприятиям сначала нужно собрать данные в порядок, и Радченко называет это «подготовкой человека к операции». Заказчик должен получить нужный результат и не остаться с ИИ для галочки. Начать можно и с демонстрации на данных заказчика вместе с оценкой сроков и стоимости.

Почему без программистов пока не обойтись

К вайб-кодингу Даниил Радченко относится скептически. Термин появился в феврале 2025 года: Андрей Карпаты (один из сооснователей OpenAI, в прошлом директор по ИИ в Tesla) назвал так работу, при которой человек полностью отдается «вайбам» и забывает, что код вообще существует. Для прототипа такой подход хорош, но строить на нем серьезные системы, по мнению Радченко, нельзя.

«Вайб-кодинг — это хлипкая система, которая держится на тонком скотче, — говорит он о программной архитектуре. — Мы видим красивую картинку в TikTok или Instagram: я завайб-кодил и стал цифровой компанией. Нет, так не работает».

Он предлагает два примера, чтобы было более наглядно. Первая — запуск ракеты: важно то, что находится под землей и под капотом, и если там бардак, система далеко не улетит. Вторая — электрощиток. В Интернете ходят ролики, где сначала показывают клубок проводов, а потом аккуратный щиток, в котором любой откроет дверцу и увидит, какой провод куда идет. С кодом так же: снаружи продукт выглядит рабочим, а внутри полный хаос, и вайб-кодинг, по мнению Радченко, этот хаос создает. «ИИ ускоряет, вопросов нет, — говорит он. — Но без профессиональных знаний не построить грамотную архитектуру».

Опасения Радченко подтверждают и исследования. По отчету Veracode (компания, специализирующаяся на безопасности приложений) за 2025 год, в 45% случаев ИИ-модели выдали код с уязвимостями: на 80 тестовых задачах проверили более сотни моделей. Оговорка в том, что исследование проводил производитель систем защиты, а модели с тех пор продвинулись. Впрочем, технический директор Veracode Йенс Весслинг отметил тогда, что модели пишут все более корректный код, но безопасность при этом не улучшается.

Логика у Радченко простая: «Если бы Искусственный интеллект мог сам выдавать такие архитектуры, специальность обычного программиста давно бы пропала». Возражение о том, что корпорации сокращают людей, он принимает частично. ИИ-агенты и правда работают как сотрудники, но их кто-то создает, и создают их те самые «олдскульные» программисты. По его наблюдению, компании не нужен большой штат сеньоров (опытных специалистов), достаточно одного-двух, которые понимают логику процесса. Джуниору (начинающему специалисту) можно дать ИИ, который будет объяснять и показывать, чтобы человек понимал, как все устроено под капотом, мог заглянуть в систему и поставить провода верно.

К тому же в вайб-кодинге, замечает он, никто не думает о том, что будет при поломке или кибератаке.

— Вайб-кодинг, по факту, круто и быстро для MVP, — говорит Радченко. — Мы слепили презентацию и плюс-минус приблизили ее к рабочей. Ну а дальше что?

— Дальше к вам?

— Да. Дальше все равно надо нанимать команду специалистов, чтобы это заработало в промышленном масштабе.

Отстает ли Беларусь в «гонке ИИ»

Со стороны отставание выглядит очевидным, и цифры мировой гонки его подтверждают. По данным индекса ИИ Стэнфордского университета, частные инвестиции США в ИИ достигли в 2025 году 285,9 млрд долларов, а Китая — 12,4 млрд, причем авторы оговаривают, что китайские частные цифры занижены из-за государственных фондов. Тем не менее к марту 2026 года лучшие американские и китайские модели, по оценке индекса, разделяло всего 2,7%.

Технический директор «Квантэк» спокойно оценивает положение Беларуси: по собственным разработкам страна пока догоняет лидеров, но не изолирована от мировых технологий и располагает сильными IT-специалистами. По его мнению, у нашей страны уже есть неплохой цифровой суверенитет, то есть способность самостоятельно развивать и поддерживать важные IT-системы. При нынешнем уровне кадров страна может стать более независимой в сфере информационных технологий.

Ощущение сильного отставания он связывает прежде всего с тем, как о проектах рассказывают публично. Например, Казахстан активно продвигает свой суперкомпьютерный кластер Alem.Cloud: он построен на 64 серверах с ускорителями Nvidia H200 и в ноябре 2025 года занял 86-е место в мировом рейтинге TOP500. По словам Радченко, в Беларуси о многих разработках говорят заметно меньше, поэтому обычным людям трудно понять, что именно происходит в этой сфере. И сам он считает, что государство серьезно финансирует развитие IT и связанных технологий.

Компания в этой нише не единственная. Радченко упоминает национальную большую языковую модель, которую, по его словам, делает Министерство связи и информатизации, а подробностей об этом в открытых источниках немного. Государственная программа «Цифровая Беларусь» на 2026-2030 годы, как объяснял министр связи и информатизации Кирилл Залесский, нацелена на отечественную экосистему цифровых решений для населения, бизнеса и государства. Спрос внутри страны, по наблюдениям Международного делового альянса, складывается из вполне конкретных задач: белорусский бизнес чаще всего просит обработку документов, внутренних ассистентов по корпоративным базам знаний и клиентскую поддержку, а активнее всех заказывают финансовый сектор и компании с большим объемом регламентированных процессов. Под все это подводят и нормативную основу: по данным Госстандарта, для применения в области ИИ уже готовы 42 стандарта, до конца года появится еще 20-25, а к 2030 году набор дойдет примерно до 100 документов.

Чего не хватает, Радченко формулирует так: «У заказчиков еще нет накопленного опыта работы с такой технологией, а пока руководитель не знает, что покупает, пилот остается пилотом. К этому добавляется дефицит специалистов, которые понимают, что у системы под капотом, и дорожающее «железо». Но успехи «Квантэк», что называется, «на лицо». Компания работает не просто с чувствительными данными, а очень и очень чувствительными. Ей доверяют серьезные государственные организации, например, Конституционный суд. И все больше компаний понимают, что кроме того, что хранить информацию нужно дома, ее еще нужно и дома обрабатывать.

Подписывайся на наш Telegram и не пропусти главные новости!