Модель, устроенная по аналогии с нейронами мозга: слои узлов, которые учатся находить закономерности в данных.
Нейросеть — это вычислительная модель, вдохновлённая устройством биологического мозга: множество простых элементов («нейронов»), организованных в слои и соединённых весовыми коэффициентами. Каждый нейрон получает числа от предыдущего слоя, суммирует их с учётом весов и передаёт результат дальше через нелинейную функцию активации.
Обучение нейросети — это процесс подбора весов методом обратного распространения ошибки: модели показывают пример, сравнивают её ответ с правильным, и корректируют веса так, чтобы ошибка уменьшилась. После миллионов таких итераций на больших данных сеть начинает обобщать закономерности и работать на новых, ранее не виденных примерах.
Современные ИИ-продукты — от распознавания лиц до генерации текста ChatGPT — построены на нейросетях разной архитектуры: трансформеры для языка, свёрточные сети для изображений, диффузионные модели для генерации картинок.
ИИ — широкое понятие, включающее любые методы имитации интеллектуального поведения, в том числе не-нейросетевые (например, экспертные системы). Нейросеть — один, сейчас самый успешный, из подходов к ИИ.
Зависит от задачи: простые модели могут иметь 2-3 слоя, современные LLM — десятки и сотни слоёв («глубокое обучение» и означает работу с многослойными сетями).
Нет в человеческом смысле — она выполняет заданные вычисления над числами. Ощущение «мышления» возникает из-за качества и объёма усвоенных данными закономерностей.