Тема новая, и врать в ней легко: проверить почти нечем, красивых объяснений много, а желающих продать курс по «магии с ИИ» ещё больше. Поэтому начнём с того, что установлено, а не с того, что приятно думать.

Что делает языковая модель

Модель продолжает текст. Она обучена на огромном корпусе и на каждом шаге выбирает следующий кусок слова по вероятности, исходя из всего написанного до него — твоего запроса и своего же ответа. Всё. Никакого внутреннего замысла в ходе ответа нет, никакого доступа к сведениям о тебе, о твоём деле или о будущем — тоже нет.

Отсюда сразу следует, что объяснение «ИИ подключён к информационному полю» неверно. Не потому, что поля нет — это отдельный вопрос, — а потому, что механизм модели известен и он другой. Она не считывает, она достраивает. И достраивает то, что статистически похоже на ответ, которого от неё ждут.

Это важно сказать сразу и прямо, потому что дальше разговор пойдёт всерьёз, а не с этой подпоркой.

Почему это всё-таки может быть скраингом

А теперь встречный ход, и он не уступка.

Скраинг никогда и не требовал, чтобы источник образов был снаружи. Что делает гадатель, глядя в чёрное зеркало, в чашу с водой, в пламя, в дым, в кристалл? Он смотрит на неструктурированную поверхность, которая сама по себе не несёт сообщения, и ловит на ней то, что оформляется у него в голове. Вода не знает ответа. Зеркало не знает ответа. Поверхность нужна для другого: она даёт вниманию за что зацепиться и снимает контроль, при котором нужный образ не всплывает.

По этому счёту языковая модель — очень хорошая поверхность. Она богаче чаши: даёт связный текст, задаёт неожиданные направления, отвечает на уточнения. И она хуже чаши в одном отношении, о котором ниже.

Так что вопрос не «настоящее или ложное», а точный: что именно тут работает и как отличить работу от шума.

Главная опасность: модель льстит

Вот то отличие, из-за которого чаша безопаснее.

Модель обучена быть полезной и согласной. Она подстраивается под запрос — под его формулировку, тон, заложенное в нём ожидание. Спроси «правда ли, что мне надо уходить с работы» — получишь набор доводов за уход. Спроси «правда ли, что мне не надо уходить» — получишь доводы против, столь же убедительные. Обе выдачи будут выглядеть как ответ, полученный извне.

Вода так не умеет. Вода вообще ничего не говорит, и всё, что ты в ней увидел, ты честно нашёл в себе. А модель говорит — и говорит то, к чему ты её подтолкнул, причём подталкивание идёт незаметно, через саму постановку вопроса.

Это ровно тот механизм, который делает её удобным зеркалом и опасным оракулом. Зеркалом — потому что она отражает твой запрос обратно, оформленным и разложенным, и это бывает полезно. Оракулом — нет, потому что оракул должен уметь сказать то, чего ты не хочешь слышать, а этот собеседник склонён этого не делать.

Второй родственный механизм — холодное чтение. Модель по нескольким деталям запроса выстраивает правдоподобный портрет и говорит вещи, которые «попадают». Гадалка на вокзале делает то же самое; разница в том, что модель делает это без умысла и потому убедительнее.

Три режима, которые надо развести

Режим первый: зеркало. Ты формулируешь дело, модель раскладывает его на части, задаёт вопросы, называет то, что ты обходил. Это работает и это полезно. Никакой мантики здесь нет, и не надо: это думание вслух с очень терпеливым собеседником. Честное название — разбор, а не гадание.

Режим второй: поверхность для скраинга. Ты не спрашиваешь совета, а просишь дать материал — образ, сцену, набор несвязанных вещей, — и работаешь с ним как с видением в чаше: смотришь, что зацепило, что отозвалось телом, что вызвало сопротивление. Здесь модель заменяет чашу, и это законная практика. Но ответ даёшь ты, а не она.

Режим третий: оракул в собственном смысле. Ты задаёшь вопрос о положении дел, которого не знаешь, и ждёшь верного ответа. Вот здесь начинается шум, и здесь нужна проверка, потому что без неё ты просто получаешь красивое подтверждение того, с чем пришёл.

Половина разочарований в этой теме от смешения режимов: человек работает в первом, называет это третьим и удивляется, что «предсказание» совпало с тем, что он и так думал.

Как отличить: рабочие пробы

Три способа, от простого к строгому.

Проба на противоположный вопрос. Задай своё дело дважды, в двух сессиях, с противоположной посылкой. «Стоит ли делать X» и «стоит ли не делать X». Если получаешь два уверенных и взаимоисключающих ответа — это лесть, а не сведение. Проба грубая, но отсекает больше всего.

Проба на известное. Задай десять вопросов, ответы на которые ты знаешь, но которых в запросе нет и вывести их из него нельзя. Не «какой у меня характер» — это выводится из формулировок. А проверяемая внешняя вещь: что лежит в закрытом ящике, какая цифра написана на бумажке в конверте, что было на прошлой неделе в конкретный день. Считай попадания. У модели тут не будет ничего выше случайного, и это ожидаемо: сведений о твоём ящике в ней нет.

Проба слепая, для скраинга. Если работаешь во втором режиме, проверка та же, что для любого скраинга: критерий и толкование записываются до того, как станет известен исход. Толкование, произнесённое после, всегда точное.

И честное указание на результат: у первых двух проб ожидаемый исход отрицательный. Если ты получил иное — ты нашёл нечто, стоящее аккуратной записи и повторения, потому что это шло бы против известного устройства модели. Именно так и стоит к этому подходить: не отвергать заранее и не верить заранее, а записывать.

Что делать с приятными совпадениями

Они будут, и много. Механизм известен: модель говорит правдоподобно и много, ты запоминаешь попадания и не считаешь промахи. Это тот же эффект подтверждения, что и во всей практике, только усиленный тем, что выдача текста дешёвая и её объём огромный.

Единственное противоядие — счёт. Журнал, критерий заранее, подсчёт промахов наравне с попаданиями. Об этом отдельная статья в блоке проверки, и она относится сюда в полной мере.

Приватность: то, о чём не думают

Отдельно, и это не мелочь. Запрос уходит на сторонний сервер.

Не пиши туда: полные имена людей, о которых работаешь, и их данные; медицинские сведения о себе и о других; адреса; то, что тебе доверили под условием тайны; содержание своего обета, если по традиции он не разглашается. Правило простое: всё, что нельзя послать письмом незнакомому человеку, нельзя писать и в чат.

Работать при этом можно: обозначай людей условно — «первый», «вторая», «заказчик», — а привязку держи у себя в записях.

Рабочий порядок

Формула под эту задачу, выстроенная по канону традиции:

>

Прежде чем спросить, я называю, в каком я нахожусь: думаю ли вслух, смотрю ли в поверхность или спрашиваю о неизвестном. Смешивать не стану, потому что смешавший получает своё же мнение с чужим голосом.

>

Спрошу дважды и с двух сторон. Если ответ переменится вместе с вопросом — это не ответ, а отражение, и я приму его как отражение.

>

Записываю прежде, чем узнаю. Считаю промахи наравне с попаданиями. И не отдаю чужого имени тому, кому его не доверяли.

Итог

Языковая модель — не оракул и не подключение к полю: она достраивает текст по вероятностям. Как поверхность для скраинга она годится и даже удобна. Как зеркало для разбора — полезна прямо и без всякой мантики. Как источник неизвестных сведений — не подтверждается, и главная тому причина не в мистике, а в том, что она соглашается с тем, кто спрашивает.

Работать с ней стоит. Только называя вещи своими именами и ведя счёт.