Зачем нужен этот раздел
Половина непонимания в теме ИИ-агентов — не про сложность, а про словарь. Человек читает инструкцию, спотыкается о «контекстное окно» и «квантизацию» и решает, что тема не для него.
Здесь короткие объяснения без академизма. Каждый термин — отдельная страница, потому что вопрос обычно приходит по одному, а не списком.
С чего начать
Четыре понятия, без которых не читается ничего остального:
- LLM — что вообще такое большая языковая модель.
- Токены — единица, в которой считают и объём, и деньги.
- Контекстное окно — почему нейросеть «забывает» начало разговора.
- Промпт — и почему это не «заклинание».
Что отличает агента от чата
Один термин: вызов инструментов. Это способность модели не рассуждать о действии, а выполнить его. Всё остальное в теме агентов — надстройка над этим механизмом.
Дальше идут:
- MCP, API, webhook — как агент дотягивается до внешних систем.
- RAG — как заставить модель отвечать по вашим документам, а не по памяти.
- Мульти-агент и оркестрация — когда агентов несколько.
Термины, вокруг которых больше всего путаницы
Галлюцинации — не сбой и не «модель врёт». Это следствие того, как модель устроена, и потому не лечится настройкой, а обходится проверкой.
Квантизация — что означают Q4 и Q8 в именах локальных моделей и почему один и тот же размер может весить вдвое больше. Практическое применение — при подборе модели под железо.
Как пользоваться
Термин можно искать по сайту — страницы названы по самому слову. Если объяснение показалось слишком коротким, в конце каждой страницы стоит ссылка на материал, где термин работает на практике: словарь без применения запоминается плохо.