Более крупные модели галлюцинируют реже, но более убедительно. Базовая цель остаётся прежней (предсказание токена, а не проверка истины), поэтому сильные стороны делают ошибочные ответы правдоподобнее: точнее воспроизводят паттерны, генерируют более длинные связные объяснения, из-за чего ошибки труднее заметить. Масштаб снижает частоту, но не исключает уверенной выдумки.