+7 (906) 808-86-64

Разработка корпоративной RAG-системы

RAG — это когда модель отвечает не «из головы», а по вашим документам и показывает, откуда взяла ответ. Регламенты, договоры, инструкции, прайсы, переписка — всё, что сейчас ищут поиском по папкам и спрашивают у коллег.

Оценить задачу Показать пример

Коротко

Что это
Поиск по документам компании, который отвечает текстом и даёт ссылку на источник.
Кому
Компаниям, где ответ на типовой вопрос лежит в документе, а спрашивают человека.
Цена
Работы от 100 000 ₽. Обращения к модели и серверы — отдельно.
Срок
2–4 недели при готовых документах и решённом доступе.

Что получите

Как устроено

  1. Разбираем документы

    Смотрим, что у вас есть: форматы, объём, кто обновляет, есть ли дубли и устаревшие версии. Это самый частый источник сюрпризов.

  2. Режем на фрагменты и индексируем

    Документ делится на куски, каждый получает векторное представление. По вопросу находятся подходящие куски, и уже они уходят в модель вместе с вопросом.

  3. Настраиваем правила ответа

    Что отвечать, чего не отвечать, когда переводить на человека, как оформлять ссылку на источник.

  4. Проверяем на ваших вопросах

    Собираем список реальных вопросов сотрудников и прогоняем. Смотрим не «красиво ли», а сходится ли ответ с документом.

  5. Подключаем и обучаем

    Ставим туда, где будут спрашивать, показываем, как обновлять базу и читать журнал.

Как документ становится ответом

Шесть шагов. Ни на одном из них модель не «придумывает»: она видит только те куски ваших документов, которые нашлись по вопросу и которые этому человеку разрешено видеть.

  1. Ваши документыРегламенты, договоры, инструкции, прайсы. Папка, портал или выгрузка.
  2. Разбор и фрагментыДокумент режется на куски по смыслу. У каждого остаётся адрес: файл, раздел, дата.
  3. ИндексКаждый фрагмент получает числовое представление — по нему ищут не по словам, а по смыслу.
  4. Вопрос сотрудникаПроверяются права: ищем только среди того, что этому человеку можно видеть.
  5. Найденные фрагментыТри-пять кусков, которые ближе всего к вопросу. Больше не нужно — иначе модель тонет.
  6. Ответ со ссылкойМодель отвечает ТОЛЬКО по этим кускам и приводит источник. Не нашла — говорит «не знаю».

Что спросит ваша служба безопасности

Ответы на эти шесть вопросов нужны до начала работ. Мы даём их письменно — и в том числе там, где ответ «это не наша зона».

Где предел

Здесь то, чего мы не обещаем. Без этого разговора проект разваливается на третьей неделе, а не на первой.

Что можем показать

Состав работ

Как принимаем работу

Договариваемся об этом до начала, а не после.

Сколько стоит

Старт — от 100 000 ₽ · Бизнес — от 180 000 ₽ · Корпоративный пилот — от 300 000 ₽

Это стоимость работ по внедрению. Отдельно считаются: обращения к модели (облачной — по счётчику, своей — сервером), лицензии на ваше ПО, инфраструктура и сопровождение. Точную цифру называем после того, как увидим объём документов, список интеграций и критерии приёмки.

Что входит в каждый пакет →

Сопровождение после запуска

Про это спрашивают первым, а на сайтах об этом молчат. Выбор за вами, и «без сопровождения» — рабочий вариант: система остаётся вашей в любом случае.

Вопросы, которые задают

Чем RAG отличается от дообучения модели?

Дообучение зашивает знания в модель: чтобы поменять один пункт регламента, нужно переучивать и перепроверять всё. RAG держит знания отдельно — поменяли документ, ответ поменялся сразу. Для корпоративных документов, которые правятся постоянно, RAG и дешевле, и честнее: видно, откуда взят ответ.

Данные уйдут наружу?

Зависит от того, где стоит модель. Облачная — запросы уходят провайдеру, и это надо решать до начала работ. Модель в вашем контуре — ничего не уходит, но нужен сервер с видеокартой. Мы считаем оба варианта и показываем разницу в деньгах.

Сколько документов потянет?

Объём ограничивает не поиск, а порядок в документах. Тысячи файлов — обычная история. Проблема начинается там, где лежит пять версий одного регламента и непонятно, какая действует.

Сколько это стоит в месяц после запуска?

Складывается из обращений к модели и хостинга. Для облачной модели считаем по вашему ожидаемому числу вопросов, для своей — по железу. Цифру называем на расчёте, а не в прайсе: она зависит от объёма, а не от пакета.

Смотрите также

Покажем на вашей задаче

Напишите пару слов о том, что хотите поправить в работе. Расскажем, как это ляжет на ваши процессы, и покажем вживую — обычно отвечаем в тот же рабочий день.

Укажите телефон или почту — как вам удобнее.

Нажимая кнопку, вы соглашаетесь с политикой конфиденциальности.