LLM (Large Language Model, большая языковая модель) — это нейросеть, обученная на гигантском объёме текста, которая умеет отвечать на вопросы, писать, переводить, суммировать и писать код. В отличие от обычной поисковой системы, она не ищет готовый ответ в базе, а достраивает наиболее вероятное продолжение текста токен за токеном. Именно из этой простой задачи — многократно повторённого предсказания следующего токена на триллионах текстов — вырастают способности рассуждать, переводить и объяснять.
Слово «большая» в аббревиатуре означает, что в модели сотни миллиардов настраиваемых параметров и триллионы единиц текста для обучения.


Leave A Comment