LLM (Large Language Model, большая языковая модель) — это программа, которую обучили на огромном объёме текста угадывать, какое слово должно идти следующим. На этом принципе работают ChatGPT, Claude, Gemini и другие чат-помощники. Они отвечают на вопросы, пишут тексты, разбирают таблицы и код, хотя по устройству продолжают текст по вероятности.
Как это работает
Модель не хранит факты карточками, как база данных, и сама по себе в интернет не ходит. В ней заложены статистические связи между словами, выученные при обучении, и ответ она собирает по кусочку, выбирая то, что обычно идёт дальше в похожем тексте. Кусочки эти называются токенами.
Для бизнеса отсюда следуют две вещи. Первая: у модели нет собственного свежего поискового индекса, за актуальными данными она обращается к поисковику через отдельный инструмент, если он подключён. Вторая: модель может уверенно написать неправду, потому что текст выглядит правдоподобно, даже когда факт неверен. Это называют галлюцинациями.
Пример
Допустим, вы просите модель посчитать доставку для заказа на $350 при тарифе 4% от суммы. Ответ $14 она даст без труда: правило простое, и всё нужное есть в вопросе. А вот сегодняшний тариф конкретной службы доставки она может не знать или назвать неверно, если этих данных не было в обучении и вы их не дали.
Частые ошибки
- Пользоваться моделью как справочником свежих цен, правил и дат. Для этого нужен поиск или ваши данные, переданные в вопросе.
- Считать все модели одинаковыми. Они различаются размером, обучением и доступом к инструментам, и от этого зависит, какие задачи им можно доверить.
- Не проверять результат там, где ошибка дорого стоит: цифры, юридические формулировки, медицинские советы.
Готовые примеры вопросов к модели под задачи рекламы собраны в статье как использовать AI и ChatGPT в Google Ads. Откуда модели на самом деле берут источники и почему им не нужен файл llms.txt, разобрано в материале llms.txt поставили 38 тысяч сайтов. На какие поисковые индексы опираются ChatGPT и Claude, когда ищут свежие данные в сети, и почему сайту компании важно в них попасть, разобрано в материале продвижение в нейросетях.
Частые вопросы
Нет. LLM — один из видов ИИ, он работает с текстом. Искусственный интеллект шире: туда входят, например, распознавание изображений и рекомендательные системы.
Да. Модель отвечает из того, что выучила при обучении. Доступ к свежим данным из сети подключается отдельным инструментом.
Она подбирает ответ по вероятности, а не сверяет его со справочником. Если точного факта не было в обучении, модель может выдать ответ, верный по форме и неверный по сути.