LLM предсказывает следующий токен (слово или часть слова) на основе контекста. Несмотря на простую задачу, масштаб и архитектура Transformer позволяют «понимать» сложные инструкции, писать код, переводить и анализировать.
Галлюцинации (уверенные, но ложные факты), знания ограничены датой обучения, контекстное окно ограничено, дорого масштабировать.