00 Старт
Умнее ≠ точнее. Нейросети стали врать чаще
Сейчас разрушу иллюзию цифрами — а потом поставим защиту.
Я часто слышу: «ну ИИ же становится умнее, постоянно выходят новые модели» — и следом вывод: «не нужно быть экспертом». Хочу немного разрушить иллюзии.
Есть термин «галлюцинации» — когда ИИ уверенно выдумывает то, чего нет: факты, источники, цифры, «исследования». И с ростом «ума» моделей их не становится меньше. Иногда — наоборот.
За каждый такой пост от меня отписывается пара сотен человек. Но сори, я не перейду на сторону волшебно-таблеточников 😁
С чем ты уйдёшь
- Реальные цифры галлюцинаций — чтобы иллюзий не осталось
- Проверка своей зоны риска — честная, на твоей последней задаче
- Промпт-предохранитель, вшитый в твои рабочие запросы
00 Старт
Цифры, после которых спорить не о чем
Тест PersonQA — бенчмарк OpenAI на фактические вопросы.
o3-mini (старая рассуждающая) → 14,8% o1 (старая рассуждающая) → 16% o3 (новая, «самая умная») → 33% o4-mini (новая компактная) → 48% ← антирекорд
Рассуждать новая модель стала лучше — но это ведёт к ещё большему выдумыванию: чем длиннее цепочка уверенных рассуждений, тем дальше модель уезжает от реальности, ни разу не усомнившись.
Запомни соотношение: умнее ≠ точнее. И главное — уверенный тон ответа вообще ничего не говорит о его достоверности.
00 Старт
Как звучит типичная галлюцинация
Со источниками, с уверенным тоном, с безупречной структурой.
Ты: «Какой сервис лучше для X? Дай ссылки на исследования» ИИ: «Согласно исследованию Стэнфорда 2024 года (Journal of..., vol. 12), сервис Y повышает конверсию на 34%...» → Исследования не существует. Журнал есть, статьи нет. → Тон — абсолютно уверенный. Структура — безупречная.
Ловушка в том, что галлюцинация опасна не тогда, когда она есть, а тогда, когда её некому поймать. Взял(а) ChatGPT в тему, в которой не разбираешься, и рядом нет никого, кто разбирается? Как ты поймёшь, что он предложил лучший путь для 2026 года, а не «так делали в 2003-м»?
01 Риск
Проверь свою зону риска — на последней задаче
Вспомни последнюю серьёзную вещь, которую ты делал(а) с ИИ, и ответь честно.
- Ты разбираешься в теме задачи хотя бы на базовом уровне — способен(на) заметить, что ответ «пахнет» не тем?
- Проверял(а) ли ключевые факты, цифры и источники из ответа?
- Просил(а) ли модель указать, в чём она не уверена?
- Ушёл ли результат наружу — клиентам, в публикацию, в решения?
Если результат уходит наружу, а проверки не было, — рано или поздно уверенная выдумка уйдёт клиенту. Мега-круто использовать ИИ получается при трёх условиях: базово разбираешься в задаче, умеешь ставить её, владеешь примерами и образцами. Недооценённый навык эпохи ИИ — критическое мышление: модель что угодно запакует в правду.
02 Защита
Промпт-предохранитель: дай модели право сказать «не знаю»
Одна вставка в конец запроса — и уверенных выдумок становится заметно меньше.
В конце ответа отдельным блоком укажи: 1) факты и цифры, в которых ты НЕ уверен на 100%, 2) что я должен проверить вручную перед использованием, 3) где твои данные могут устареть. Если не знаешь — пиши «не знаю», а не предполагай.
Строка «не знаешь — пиши „не знаю“» не отключает галлюцинации полностью, но даёт модели легальный выход вместо обязанности что-то ответить. Проверь прямо сейчас: возьми свой недавний запрос, добавь предохранитель — и посмотри, что модель сама пометит как «проверить вручную».
02 Защита
Проверка за 3–5 минут — только для того, что уходит наружу
Не «перепроверить всё», а короткий проход по тому, что может навредить.
1. Выделить в ответе проверяемое: факты, цифры, названия, источники 2. Ключевые цифры проверить во внешнем источнике (не в том же чате) 3. Попросить источники — и открыть хотя бы один: существует ли 4. Чужая тема → показать вывод человеку, который в ней разбирается 5. Свежесть: уточнить, актуален ли совет сейчас, а не «так делали раньше»
Формула адекватности: ИИ предсказывает, а не знает + твоя экспертиза в контуре + проверка того, что уходит наружу = результат без «наступить на 33%».
03 Финал
Готово. Ты работаешь с ИИ адекватно — и это твоё преимущество
Что ты сделал(а)
Узнал(а) реальные цифры, проверил(а) свою зону риска и поставил(а) двойную защиту: предохранитель в запросах + проход проверки для всего, что уходит наружу. Не волшебная кнопка — но именно так ИИ приносит результат.
Куда дальше
- Меньше выдумок — больше твоих материалов в контексте: база знаний за вечер
- Модель «поумнела» и сломала твой промпт? — гайд про тест моделей
- Все цифры и механика — версия-статья
Такие разборы я показываю первыми в канале
Забирай следующие механики раньше всех
Я продолжаю выкладывать посты, за которые «отписывается 200 человек», — потому что адекватность важнее хайпа. Присоединяйся к тем, кто остаётся.
Подписаться на канал →ИИ отлично ускоряет эксперта — и опасно убедителен для новичка. Будь первым.
Метод и гайд: Анжела Петкова, из практики фокус-групп · версия-статья