Lab Leadersлаборатория роста бизнеса

AI

LLM (большая языковая модель)

LLM: программа, обученная на огромном объёме текста предсказывать следующее слово. На этом принципе построены ChatGPT, Claude, Gemini и другие чат-помощники.

Фёдор Шеришев

LLM (Large Language Model, большая языковая модель) — это программа, которую обучили на огромном объёме текста угадывать, какое слово должно идти следующим. На этом принципе работают ChatGPT, Claude, Gemini и другие чат-помощники. Они отвечают на вопросы, пишут тексты, разбирают таблицы и код, хотя по устройству продолжают текст по вероятности.

Как это работает

Модель не хранит факты карточками, как база данных, и сама по себе в интернет не ходит. В ней заложены статистические связи между словами, выученные при обучении, и ответ она собирает по кусочку, выбирая то, что обычно идёт дальше в похожем тексте. Кусочки эти называются токенами.

Для бизнеса отсюда следуют две вещи. Первая: у модели нет собственного свежего поискового индекса, за актуальными данными она обращается к поисковику через отдельный инструмент, если он подключён. Вторая: модель может уверенно написать неправду, потому что текст выглядит правдоподобно, даже когда факт неверен. Это называют галлюцинациями.

Пример

Допустим, вы просите модель посчитать доставку для заказа на $350 при тарифе 4% от суммы. Ответ $14 она даст без труда: правило простое, и всё нужное есть в вопросе. А вот сегодняшний тариф конкретной службы доставки она может не знать или назвать неверно, если этих данных не было в обучении и вы их не дали.

Частые ошибки

  • Пользоваться моделью как справочником свежих цен, правил и дат. Для этого нужен поиск или ваши данные, переданные в вопросе.
  • Считать все модели одинаковыми. Они различаются размером, обучением и доступом к инструментам, и от этого зависит, какие задачи им можно доверить.
  • Не проверять результат там, где ошибка дорого стоит: цифры, юридические формулировки, медицинские советы.

Готовые примеры вопросов к модели под задачи рекламы собраны в статье как использовать AI и ChatGPT в Google Ads. Откуда модели на самом деле берут источники и почему им не нужен файл llms.txt, разобрано в материале llms.txt поставили 38 тысяч сайтов. На какие поисковые индексы опираются ChatGPT и Claude, когда ищут свежие данные в сети, и почему сайту компании важно в них попасть, разобрано в материале продвижение в нейросетях.

Частые вопросы

Связанные термины

Термин

Токен (в нейросетях)

Токен: кусочек слова или текста, которым нейросеть измеряет объём запроса и ответа. От числа токенов зависят скорость, ограничения и стоимость работы с моделью.

Термин

RAG (генерация с поиском)

RAG: схема, где модель перед ответом сама находит нужные фрагменты в ваших документах и только потом формулирует ответ, опираясь на них, а не на общую память.

Термин

Промпт

Промпт: текст запроса, который вы отправляете нейросети. От того, как он сформулирован, зависит качество и точность ответа.

Термин

ИИ-агент

ИИ-агент: нейросеть, которой дали доступ к вашим системам и право действовать. Она сама читает отчёты, меняет настройки и пишет письма в пределах выданных прав.

Термин

Галлюцинации нейросети

Галлюцинации: случаи, когда нейросеть уверенно выдаёт неверный факт, источник или цифру. Текст звучит правдоподобно, но содержание не подтверждается реальностью.

Статьи по теме