Коротко: кому это действительно нужно
Закрытый контур — это размещение языковой модели и данных внутри вашей инфраструктуры, без передачи переписок во внешние сервисы. Он нужен там, где данные регулируются или составляют коммерческую тайну: медицина, финансы, госсектор, промышленность, юридические практики. Малому бизнесу в услугах он почти никогда не нужен — там задача закрывается облачной моделью российского провайдера и грамотной обработкой персональных данных.
Разница в стоимости между этими сценариями — на порядок. Поэтому первый вопрос не «как развернуть локально», а «что именно вы защищаете».
Три схемы размещения
- Облачная модель российского провайдера. Обращения уходят в GigaChat или YandexGPT, данные не покидают юрисдикцию РФ. Самый быстрый и дешёвый путь, подходит большинству.
- Выделенный контур у провайдера. Модель работает в изолированном окружении на мощностях облака, доступ ограничен вашей сетью. Компромисс между контролем и стоимостью.
- Полный on-premise. Открытая модель разворачивается на вашем железе, внешних вызовов нет вообще. Максимальный контроль и максимальные требования к ресурсам.
Выбор между ними определяется не «уровнем паранойи», а конкретным требованием регулятора или службы безопасности. Общая логика защиты данных в проектах разобрана в материале ИИ-агент и безопасность данных.
Персональные данные: что важно на практике
Требования по обработке персональных данных выполнимы во всех трёх схемах — вопрос в том, как устроен процесс:
- согласие клиента на обработку и понятная политика, а не мелкий шрифт;
- хранение данных на серверах в России;
- минимизация — агенту передаётся только то, что нужно для ответа, а не вся карточка клиента;
- обезличивание в логах: телефон и ФИО не должны лежать в открытом виде в истории диалогов;
- разграничение доступа к переписке внутри компании.
Практический разбор по требованиям — в статье ИИ-бот и 152-ФЗ. Важно: закрытый контур сам по себе не делает вас соответствующим закону, он лишь снимает вопрос трансграничной передачи.
Что теряется в on-premise
Честный обмен: вы получаете полный контроль и платите за него качеством ответов, скоростью и деньгами на железо.
- Качество модели. Открытые модели, которые реально разворачиваются локально, слабее флагманских облачных. На простых сценариях разница незаметна, на сложных консультациях — вполне.
- Скорость запуска. Облако — недели, локальное развёртывание с закупкой и настройкой железа — месяцы.
- Стоимость владения. Появляются серверы с ускорителями, их обслуживание и люди, которые это поддерживают.
- Обновления. В облаке модель улучшается сама, локально — вы обновляете её руками.