По словам профессора, галлюцинация — не инженерный артефакт и не дефект архитектуры трансформеров: механизм attention неизбежно содержит появление галлюцинаций; существуют статистические ограничения, которые не преодолеет ни одна текущая архитектура, масштаб или оптимизация. Математическое обоснование: множество всех функций из целых чисел в целые континуально, множество вычислимых функций счётно — LLM реализуют только вычислимые функции, поэтому не могут точно отобразить всю область задач. Теорема: для любого вычислительно перечислимого множества всегда найдётся такая входная последовательность, на которой LLM неизбежно ошибётся.
Галлюцинации — это баг или фича?
Share This Story, Choose Your Platform!
About the Author: Тимофей Ермолаев
Более 10 лет сфере управления ИТ и автоматизации бизнеса в капиталоемких отраслях (энергетика, строительство, производство). Понятным языком рассказываю бизнесу, как приземлить хайп вокруг LLM и нейросетей на реальные процессы бэк-офиса.


Leave A Comment