Проверяется отключением интернета
Самая простая проверка того, что данные не уходят: мы показываем, что система отвечает при физически отсоединённом внешнем канале. Ваша служба безопасности смотрит трафик сама.
Разворачиваем открытые модели на вашем оборудовании, подключаем к вашим документам и встраиваем туда, где сотрудники уже работают. Веса, промпты и конфигурации остаются у вас — привязки к нашему сопровождению нет.
Обследование с расчётом железа — от 200 000 ₽Пилот на ваших документах — 2–4 неделиРаботаем по NDA
Логотипов и «99,9% доступности» здесь не будет: доступность зависит от вашей инфраструктуры, а не от нас. Четвёртое условие — то, о чём подрядчики обычно молчат.
Самая простая проверка того, что данные не уходят: мы показываем, что система отвечает при физически отсоединённом внешнем канале. Ваша служба безопасности смотрит трафик сама.
Сколько видеокарт и какой памяти нужно — считается на обследовании, до того как вы что-то купите. Заранее говорим и про вариант без видеокарт.
Модель, дообученные веса, промпты, конфигурации и обучающая выборка — ваши. Никакой привязки к нашему сопровождению.
Открытая модель в контуре отвечает иначе, чем самая большая облачная. На пилоте мы это показываем на ваших вопросах, а не рассказываем словами.
Отправить документ в чужой API значит передать его третьему лицу. Для информации ограниченного доступа этого достаточно, чтобы запретить ИИ целиком.
Модель не видела ваших регламентов и договоров, поэтому отвечает правдоподобно, но не про вас.
Запрет без замены не работает: рабочие документы уходят в чужие чаты с личных устройств, и это никак не отследить.
Лимиты, изменение цен, отключение доступа. Процесс, встроенный в чужой сервис, останавливается вместе с ним.
Персональные данные и объекты категорирования накладывают ограничения, под которые облачная модель не подходит.
Непонятно, что происходит с запросом после отправки, кто его видит и сколько он хранится.
Шесть отличий, которые видно сразу. Это не «одно лучше другого»: если у вас нет ограничений по данным, облако дешевле и быстрее стартует.
Что понадобится именно вам — становится ясно после обследования. Дообучение предлагаем только если пилот показал, что без него не обойтись.
Llama, Qwen, Mistral, GigaChat, YandexGPT в вариантах для своего железа. Подбираем размер под задачу и под то, что у вас есть.
Индексация регламентов, договоров и архивов. Ответ собирается из найденных фрагментов и ссылается на исходный документ.
Когда общей модели не хватает: адаптация под вашу терминологию, форму документов и принятые формулировки.
1С, CRM, портал, внутренний мессенджер. Модель отвечает там, где человек уже работает, а не в отдельном окне.
Вопросы по регламентам, помощь с документами, подсказки оператору. С правами доступа: кто что может спрашивать.
Квантизация, батчинг, очередь запросов. Вариант без видеокарт тоже считаем и честно говорим, где он не годится.
Разграничение доступа, журнал запросов, защита от подмены инструкций, фильтрация того, что модель не должна отдавать.
Обновление моделей, дообучение на накопленном, разбор жалоб на качество ответов.
Ориентиры, чтобы прикинуть порядок затрат до разговора. Точную конфигурацию считаем на обследовании — до того, как вы что-то закупите.
Требования определяет не «мощность ИИ», а три вещи: размер модели, число одновременных пользователей и длина документов, которые она читает. Первое мы подбираем, второе называете вы, третье выясняется на ваших материалах.
Четыре блока, и качество ответа определяет второй, а не третий: модель отвечает по тому, что нашёл поиск.
Каждый этап закрывается актом. Остановиться можно после пилота — расчёт железа и результаты испытаний остаются у вас.
Смотрим задачи, документы и то, что у вас уже стоит. Подбираем размер модели и считаем конфигурацию железа. На выходе — расчёт до закупки.
Разворачиваем, подключаем ваши документы, показываем ответы на ваших реальных вопросах. Здесь видно, хватает ли модели.
Правила поиска, границы ответов, разграничение доступа. Дообучение — только если пилот показал, что без него не обойтись.
Подключаем к порталу, мессенджеру или учётной системе, чтобы модель отвечала там, где человек работает.
Контрольный список вопросов с ожидаемыми ответами, замер скорости на реальном числе пользователей, проверка при отключённом интернете.
Обновление моделей, дообучение на накопленных исправлениях, разбор жалоб на качество.
Первый разбор — про изолированный контур, где наружу не уходит ни одного обращения.
Облачные сервисы запрещены, а помощь сотрудникам нужна: регламенты объёмные, меняются часто.
Регламенты и инструкции лежат в сетевых папках и почте, ответ ищут по двадцать минут.
Чертежи, паспорта и регламенты разложены по папкам и шкафам, часть — сканами разного качества.
Заказчиков не называем — договоры это запрещают. Зато по каждой работе написано, что изменилось у людей после сдачи и чем это проверяется.
Конкретный набор зависит от задачи и от того, что уже стоит у вас. Всё перечисленное работает внутри периметра.
Требования по категорированию и локализации, работа без выхода наружу, журнал обращений.
Персональные данные и банковская тайна, помощь оператору по регламенту, разбор документов.
Врачебная тайна, поиск по протоколам и инструкциям, подсказки по нормативам.
Техническая документация, регламенты, инструкции по оборудованию, помощь дежурной смене.
Если ИИ запрещён политикой безопасности — это не отказ от ИИ, а требование к тому, где он живёт.
Сорок минут созвона: какие задачи, какие документы, что уже есть из железа и что запрещает служба безопасности. По итогам назовём размер модели, конфигурацию и порядок затрат.
Зависит от размера модели, числа одновременных пользователей и длины документов. Для ассистента по документам обычно хватает одной видеокарты с 24 ГБ памяти. Точную конфигурацию считаем на обследовании — до того, как вы что-то закупите.
Можно, на малой модели и процессоре. Ответ идёт заметно медленнее, и для десятков одновременных пользователей это не подойдёт. Мы честно говорим, где такой вариант годится, а где нет.
На общих вопросах открытая модель в контуре обычно слабее самой большой облачной. На ваших документах разрыв меньше: там решает не размер модели, а качество поиска по вашей базе. Разницу показываем на пилоте, на ваших реальных вопросах.
Пилот на тестовом контуре — две-четыре недели с момента, когда есть железо и документы. Полная настройка с интеграцией и разграничением доступа — два-три месяца.
Для поиска по документам дообучение вообще не нужно — достаточно самих документов. Дообучение имеет смысл, когда у вас своя терминология и формы, и мы предлагаем его только если пилот показал, что без него не обойтись.
Вам. Веса, дообученные версии, промпты и конфигурации передаются по акту. Привязки к нашему сопровождению нет: развернуть и обновлять сможет ваш администратор или другой подрядчик.
Обследование с расчётом железа — от 200 000 ₽. Пилот — от 400 000 ₽. Проект целиком, с интеграциями и разграничением доступа, — от 3 000 000 ₽. Стоимость оборудования считается отдельно и остаётся у вас как актив.