Ssylka

Методика оценки качества чат-ботов: сравнение LLM и Intent-based решений

Эксперимент, сравнивший чат-бота на основе LLM (GPT-4o) и бота на интентах, показал, что LLM-решение выиграло по общему впечатлению и суммарной оценке критериев, таких как актуальность и проактивность. Однако, LLM-бот проигрывал в скорости ответа, стабильности работы и достоверности информации, иногда выдавая «галлюцинации».
Методика оценки качества чат-ботов: сравнение LLM и Intent-based решений
Изображение носит иллюстративный характер

Тестирование проводилось на базе действующего бота компании КНАУФ. Фокус-группа оценивала ботов по ряду критериев, включая понятность функционала, решение поставленной задачи, общее впечатление и соответствие утверждениям, опирающимся на принципы дизайна разговорных интерфейсов.

Анализ комментариев респондентов выявил, что бот на интентах лучше воспринимался как справочник для пользователей, знающих, что ищут, в то время как LLM-бот лучше справлялся с общими вопросами. При этом классическое решение получило высокую оценку за навигацию и лаконичность, а LLM-версия была многословной.

В ходе эксперимента подтвердилась гипотеза о целесообразности гибридного подхода, сочетающего прописанные скрипты и LLM для улучшения навигации и обработки нестандартных ситуаций. Red политики компании в целом оказались полезными при работе над личностью бота.


Новое на сайте

15267Каково на самом деле жить с болезнью Паркинсона? 15264Как деревянный забор помогает сохранить популяцию малых крачек в Ситон-Карью? 15263Жизнь после падения: как живопись вернула смысл Джонни фоксу 15262XorDDoS: масштабное возвращение и коммерциализация опасного ботнета 15261Как убедительно сыграть "битлз" на экране? Акценты, аутентичность и вызовы... 15260Чем удивляет пасхальная художественная выставка на острове Мэн? 15259Следы возможной жизни обнаружены на далёкой экзопланете K2-18b 15258Почему сакура в северной Ирландии стала символом дружбы и перемен? 15257Детский взгляд на Бедфорд: новый путеводитель глазами школьников 15256Семейная книга против собачьих экскрементов: как трехлетняя звезда TikTok борется за... 15255Музыка, которая меняет правила игры: как Empara Mi завоевала саундтреки телевидения и... 15254Как изменится жизнь Бортон-он-зе-Уотер после нового эксперимента с парковкой... 15253Скрытая сикстинская капелла штата Мэн: уникальные фрески южного Солонского дома собраний