Исследователи из Сколтеха и Центра практического искусственного интеллекта Сбербанка предложили новый метод TOHA для обнаружения галлюцинаций в больших языковых моделях, работающих в системах генерации с дополненным поиском (RAG). Этот подход анализирует топологическую структуру карт внимания модели и позволяет идентифицировать реакции, которые не поддерживаются предоставленным контекстом. Метод не требует обучения дополнительных моделей и использует лишь небольшое количество аннотированных данных для настройки.
Новости от techxplore



