Локальный AI · в вашем контуре

ИИ, который не отправляет ваши данные наружу

Корпоративный AI-ассистент на локальной модели: ответы и поиск по вашим документам плюс OpenAI-совместимый API для ваших систем. Работает на вашем сервере — данные не покидают контур, 152-ФЗ.

Данные в контуре

Ничего не уходит за периметр компании.

On-premise / офлайн

Работает на вашем сервере, без внешних API.

По вашим документам

RAG по базе знаний, СЭД, регламентам.

152-ФЗ

Без зарубежных облаков и трансграничной передачи.

Что умеет

Задачи, где локальная модель работает уже сейчас — без отправки данных во внешние сервисы.

Саммари переписки, встреч и длинных документов
Поиск и ответы по корпоративным документам (со ссылками на источник)
Расшифровка звонков и голосовых — офлайн
RAG-агенты по базе знаний и регламентам
Классификация и извлечение данных из текстов
Встраивание в ваши системы через API
OpenAI-совместимый API

Подключите свои системы за минуты

Сервис говорит на том же API, что и OpenAI. Системы, которые уже умеют работать с ним, переключаются на ваш локальный ИИ сменой адреса и ключа — без переписывания кода.

  • Чат-комплишены и эмбеддинги по стандартному API
  • Ключи доступа, лимиты и журналирование в админке
  • Интеграции под ваши процессы — поверх API
переключение клиента
# было — облако за рубежом
base_url = "https://api.openai.com/v1"

# стало — ваш контур
base_url = "https://ai.вашдомен.ru/v1"
api_key  = "<ваш ключ>"

# дальше код не меняется:
client.chat.completions.create(
    model="dm-local",
    messages=[...]
)
Готовая система, а не презентация

Что уже работает внутри

Веб-админка для управления ключами, базой знаний и сервером. Скриншоты — из живой системы.

1 / 6

Дашборд: расход токенов и запросов по каждому ключу

OpenAI-совместимый API

chat, embeddings, models — подключение сменой адреса и ключа.

API-ключи с лимитами

Лимит токенов на ключ, привязка к модели и базе знаний, журнал расхода.

База знаний (RAG)

Загрузка PDF/DOCX/TXT, ответы со ссылками на источник.

Коннекторы

Авто-наполнение из папок и по URL, синхронизация по расписанию.

Мультитенантность

Несколько компаний на одном сервере, изоляция данных.

Вход и роли

Локальный пароль и LDAP/Active Directory, роли доступа.

Мониторинг

CPU, память, диск и состояние модели в реальном времени.

Бэкапы

Ручные и по расписанию, восстановление и хранение копий.

Облако vs локальный AI

Облачный ChatGPT / Claude

  • — данные уходят за рубеж
  • — заблокированы в РФ
  • — конфликт со 152-ФЗ
  • — зависимость от внешнего API и оплаты за токены

Локальный AI в вашем контуре

  • данные остаются в вашем периметре
  • работает в РФ и офлайн
  • соответствует 152-ФЗ
  • без внешних зависимостей, модель бесплатна

Как поставляется

Под ваш масштаб и требования к контуру.

On-premise

Разворачиваем в вашей инфраструктуре, на вашем оборудовании. Максимальный контроль, данные не покидают контур. Лицензия + внедрение + сопровождение.

от 300 000 ₽разово

+ внедрение 150–400 тыс ₽. Железо — ваше.

Managed (подписка)

Разворачиваем и сопровождаем на сервере в РФ, вы получаете готовый сервис и API. Быстрый старт без закупки железа. Помесячная подписка.

от 120 000 ₽/мес

Сервер с GPU, модель и сопровождение включены.

Цены ориентировочные, «от». Модель ИИ — открытая и бесплатная; вы платите за внедрение, сопровождение и инфраструктуру. Точную смету готовим под задачу.

Локальный AI — частые вопросы

Чем это лучше ChatGPT или облачных сервисов?

Главное отличие — данные не покидают ваш контур. ChatGPT и подобные сервисы отправляют запросы за рубеж, заблокированы в РФ и конфликтуют со 152-ФЗ. Локальный AI работает на вашем сервере или в облаке в РФ, без передачи данных третьим лицам.

Какая модель используется и сколько это стоит по лицензии?

Используются открытые модели (Qwen, русско-оптимизированные T-lite/T-pro, Saiga) — лицензионных платежей за саму модель нет. Вы платите за внедрение, поддержку и инфраструктуру. Ориентировочно: управляемый сервис — от 120 000 ₽/мес, лицензия on-premise — от 300 000 ₽ разово плюс внедрение. Точную смету готовим под вашу задачу.

Какое железо нужно?

Для быстрых ответов нужен сервер с видеокартой (GPU). Базовой конфигурации с одной современной картой хватает для работы с документами и десятка одновременных пользователей. Можем развернуть на вашем оборудовании или в облаке в РФ.

Можно ли подключить к нашим системам?

Да. Сервис предоставляет OpenAI-совместимый API — системы, которые уже умеют работать с таким API, переключаются на ваш локальный ИИ сменой адреса и ключа. Плюс делаем интеграции под ваши процессы.

Поставим AI-ассистента по вашим документам

Развернём в вашем контуре, подключим к вашим системам по API. Данные не покинут периметр.

Расскажите о задаче — предложим решение

Внедрить готовый продукт или разработать систему с нуля. Ответим в течение рабочего дня.

Пришлём доступ к демо-стенду в течение рабочего дня.

Нажимая кнопку, вы соглашаетесь с политикой обработки персональных данных (152-ФЗ).