Prog Academy
RU UA
ШІ та машинне навчання

Що таке LLM (велика мовна модель)?

LLM (Large Language Model, велика мовна модель) — це нейромережа, навчена на величезних обсягах тексту, яка прогнозує наступний фрагмент тексту. Саме на LLM працюють ChatGPT, Claude, Gemini та інші AI-асистенти.

Механіка LLM простіша, ніж здається: модель отримує текст, розбиває його на токени й прогнозує найімовірніший наступний токен. Повторюючи це знову і знову, вона породжує звʼязну відповідь. Уся «майстерність» моделі — це мільярди числових параметрів, налаштованих так, щоб такі прогнози були осмисленими.

Модель не зберігає документи й не шукає в інтернеті сама по собі. Вона працює лише з тим, що вміщується в її контекстне вікно — поточний запит, історію листування та передані їй матеріали. Щоб дати моделі доступ до свіжих або внутрішніх даних, використовують RAG чи підключення інструментів.

LLM та AI — це не одне й те саме

AI — це вся галузь загалом, включно з компʼютерним зором, рекомендаційними системами та прогнозуванням. LLM — один конкретний тип моделі всередині неї, спеціалізований на мові. Кожна LLM — це AI, але далеко не кожен AI — це LLM.

Повʼязані терміни

Generative AI

Генеративний AI (GenAI) — це клас моделей штучного інтелекту, які створюють новий контент: текст, зображення, аудіо, відео або код. На відміну від класичних моделей, що обирають відповідь із готових варіантів, генеративні моделі породжують результат з нуля.

Token

Токен — це мінімальний шматочок тексту, яким оперує мовна модель: слово, частина слова або розділовий знак. Модель не бачить літери та слова напряму — вона читає й генерує саме послідовність токенів.

Context Window

Контекстне вікно — це максимальний обсяг тексту в токенах, який мовна модель може тримати «перед очима» за один раз: системний промпт, історія діалогу, додані файли та її власна відповідь. Усе, що не вмістилося, для моделі просто не існує.

Transformer

Трансформер — це архітектура нейромережі, на якій побудовані всі сучасні мовні моделі. Її ключова ідея — механізм уваги (attention): обробляючи кожне слово, модель одночасно дивиться на всі інші слова тексту й вирішує, які з них важливі для розуміння.

Hallucination

Галюцинація — це відповідь мовної моделі, яка звучить упевнено й правдоподібно, але фактично хибна: вигадана цитата, неіснуюча функція бібліотеки, придуманий номер закону чи посилання, яке нікуди не веде.

Prompt

Промпт — це текстовий запит, який ви надсилаєте мовній моделі: завдання, питання, інструкція разом з усіма даними, потрібними для відповіді. Промпт повністю визначає, що модель побачить і, відповідно, що вона відповість.