Agentic Web Search для Битрикс24
Как встроить свои идеи в продукт изнутри?
Ещё в начале года писал, что начал консультировать Битрикс24 (кто сидит в чатике точно видел) ну и вы видели у меня на гите пару сервисов к Битрикс
Дошли руки рассказать про один из проектов и про то как это выглядит внутри, и что же я там навоял =)
Три месяца назад всё началось с "Привет, не хочешь помочь с поиском?"
А на этой неделе мы запустили поиск в прод
За эти три месяца я хорошо узнал AI-команду Битрикс24 и там офигеть какие крутые ребята работают ❤️
Еще вышел
BitrixGPT 5.5 Agent
Часть его веб агент (за него я по большей части и отвечал в этой связке) сделан по образу изолированного цикла от общего пайплайна агента, уже крутится в проде и доступен миллионам на порталах
Идея простая как пеплексити лайк системы только вот нужны реалии РФ, выпустили публичный API за три месяца внутри корпорации я сам, честно, не ожидал
Там отдельная история про AI SDLC/PDLC (можно подробнее скажите вы, точно раскрою в следующих сериях скажу я вам)
Что сложного спросите вы?
Взял cloude code + codex
Кинул промпт
Взяли ReAct + OAASDK
Дали прод сервер и погнали?
Это ровно то, с чего я стартовал, и работает оно отвратительно (а чаще просто неконтролируемо) так как вся система работает на внутренней модели
Голая связка выдаёт уверенный бред с цитатой из статьи десятилетней давности
Весь проект это обвязка вокруг этой наивной схемы
Три вещи, которые реально сдвинули качество
И не забываем что сервис должен выдержать 1000 RPS минимум и проектируем все с этим заделом
Grounding
Научили модель молчать, когда факта в выдаче нет, а не досочинять. Был показательный баг — агент выдумывал французские городки, которых не существует в природе. Температуру в пол, обязательная цитата [N] на каждый тезис, нечего процитировать — ответа нет
Плюс аккуратный подбор параметров запуска модели и работа с harness вокруг
Скучно, зато не врёт =)
Query expansion
"Че там по ставке?" для модели это мусор.
Агент сам разворачивает такой вопрос в 3–4 нормальных запроса к Яндексу: решение по ключевой ставке, последнее заседание ЦБ, прогнозы на 2026
Без этого шага точность падала почти вдвое это не ощущение, это замер до/после
Бенчи
Прогнали 3800+ тяжёлых вопросов: FreshQA, SimpleQA и свой внутренний хардкор по Рунету там, где англоязычные бенчи бесполезны
Вышло 93.7% (это на нашем внутреннем бенче по Рунету на нём мы и меряем реальную повестку)
На части сценариев это выше, чем показывает большинство решений
И еще несколько важных подсистем
Контроль цикла и выхода из него
Цитаты (и правильная постановка в стриминг)
Контроль кол-ва источников
Проверка источников
Вот так это работает и вроде все опять просто, агент дёргается по API прямо с портала Битрикс24 как отдельная сущность
Не надо поднимать свою инфру, индексы, воевать с галлюцинациями берёшь эндпоинт и получаешь штуку, которая шарит в текущей повестке и цитирует источники
И, что важно, адаптирована под текущую инфраструктуру
Уже живое, тыкайте на
порталах раскатка идет, зашито в основной цикл агента только попросите поискать в интернете (или он это определит сам)
Затестите напишите, как вам точность на своих запросах
Фидбек приветствуется
Обсуждение 22
Обсуждение не доступно в веб-версии. Чтобы написать комментарий, перейдите в приложение Telegram.
Обсудить в Telegram