Чат-боты, пишущие тексты и код, — это большие языковые модели (LLM). Понимать их устройство на уровне идеи — значит понимать и их силу, и их слабости.
LLM обучена на огромных объёмах текста предсказывать следующее слово. Из этого простого механизма вырастает умение писать, переводить, объяснять. Обратная сторона — галлюцинации: модель генерирует правдоподобный текст, не проверяя его истинность. Уверенный тон ответа ничего не говорит о его достоверности.
Модель может выдать несуществующую статью с убедительным названием, автором и годом. Не «соврала» — сгенерировала правдоподобное продолжение текста.
Промпт: «Мурлычет на подоконнике…» — следующее слово модель выбирает из распределения вероятностей.
Цель: сгенерируй слово при низкой температуре (≤0.25) и при высокой (≥0.7) — сравни результат.
Правило работы с LLM: черновик — модели, ответственность — человеку. Факты, цифры и ссылки из ответа проверяются так же, как слова незнакомого стажёра.
Что такое «галлюцинация» LLM?