Нейросеть, обученная на огромных массивах текста, которая генерирует и понимает язык — основа ChatGPT, GigaChat, YandexGPT.
Большая языковая модель — это нейросеть, которая обучена на огромном корпусе текстов (книги, статьи, код, диалоги) предсказывать, какое слово или часть слова должно идти следующим. В процессе такого обучения модель неявно усваивает грамматику, факты о мире, стили письма и логические связи — этого достаточно, чтобы отвечать на вопросы, писать тексты, переводить и рассуждать по цепочке.
Ключевое отличие LLM от более ранних языковых моделей — архитектура трансформер и масштаб: современные LLM обучены на сотнях миллиардов и триллионах токенов и содержат от нескольких миллиардов до триллиона параметров. Именно масштаб дал качественный скачок: способности вроде few-shot обучения и рассуждений появляются только у достаточно крупных моделей.
В России к LLM относятся GigaChat (Сбер) и YandexGPT (Яндекс) — обе участвуют в независимых замерах вроде Полярного теста AI Радар наравне с зарубежными моделями.
LLM — это подкласс нейросетей, специализированный на языке и построенный на архитектуре трансформер. Не любая нейросеть — LLM, но любая LLM — нейросеть.
Малые и квантованные версии открытых LLM (например, на базе Llama или ruGPT) можно запускать локально; топовые модели вроде GPT-5 или GigaChat Max требуют серверных мощностей и доступны только через API.
Нет — модель может «галлюцинировать», то есть уверенно выдавать неверную информацию. Это фундаментальное свойство статистической генерации, а не баг конкретной модели.