00 Старт
Вышел Claude Fable 5.1. Главное в нём — не «стал умнее»
1 сентября Anthropic выкатила новую модель. Я разобрала, что в ней реально важно — без бенчмарко-порно.
Каждый релиз нам продают как «умнее на X%». Скучно и бесполезно. У Fable 5.1 интересно другое: он дольше работает сам (без твоего «нянчинья» каждые пять минут), дешевле в реальных задачах при том же прайсе — и у него есть одна главная ручка, которая решает больше, чем любой промпт.
Этот гайд — не пересказ пресс-релиза. Мы проверим все три вещи на твоей реальной задаче.
С чем ты уйдёшь
- Задача-марафон, отданная модели целиком — с промптом под неё
- Понимание ручки effort: когда крутить вниз и экономить, когда вверх
- Два фикса письма: новая модель пишет лучше, но плотнее — лечится одной строкой
00 Старт
Три цифры, которые стоит знать (остальные — шум)
Из всех бенчмарков релиза для нас с тобой важны эти.
Агентный ресёрч (Terminal-Bench-Science): 24,7% → 52,6% — ×2 Сложные задачи в браузере (Browserbase): 57% → 82% Реальная стоимость работы: до −25% обычные задачи, до −45% агентные — при НЕизменном прайсе (модель тратит меньше токенов; кэш подешевел на 75%)
Дальше — не мои пересказы, а кейсы и приёмы с рынка, с авторами и ссылками. Проверяй первоисточники сам(а) — я только собрала и перевела на человеческий.
00 Старт
Кейсы с рынка: кто уже проверил — и что намерил
Три источника с цифрами и фамилиями, не «эксперты говорят».
- Ramp (финтех) — модель крутила ML-эксперименты 38 часов без присмотра, сама переоценивая гипотезы по ходу. Разбор VentureBeat.
- Millennium (хедж-фонд) — Fable 5.1 отследил редкий программный сбой, который команда расследовала годами. Тот же источник.
- CodeRabbit (Хуан Пабло Флорес и Гоутам Кишор Виджай) — прогнали 45 ревью-задач со 105 известными проблемами: точность выросла на 4,5 п.п., «придирок» стало на 186 меньше — модель научилась сдержанности: делает, что просили, и не лезет чинить всё вокруг. И неожиданное: высокий уровень размышлений оказался медленнее низкого без прироста качества на их задачах. Полный отчёт CodeRabbit.
01 Марафон
Суперсила 1: длинные задачи. Найди свой марафон
Какая задача у тебя лежит месяцами, потому что «это же на полдня разбираться»?
Задача: [ЗАДАЧА] Результат: [ЧТО НА ВЫХОДЕ]
01 Марафон
Приём с рынка №1: цель вместо 22 шагов
Ken Huang («Agentic AI»): «твои тщательно выстроенные пошаговые промпты делали результат хуже».
Его живой пример: промпт-инструкция из 22 шагов дал результат хуже — включая три ошибочных шага из самой инструкции. Замена на «цель + причина + ограничения» дала результат лучше и за меньшее число заходов. Фишка — слово «потому что»: причина измеримо улучшает микрорешения, которые модель принимает сама. Разбор Ken Huang.
Я работаю над задачей: [ЗАДАЧА] — потому что мне нужно: [ЗАЧЕМ / ЧТО НА ВЫХОДЕ]. Не расписываю шаги — спланируй их сам(а). Веди задачу от начала до конца, не останавливаясь на полпути и не спрашивая разрешения на то, что я уже описал(а). Две просьбы по ходу: 1. После каждого крупного этапа — апдейт в 1–2 строки: что сделано, что дальше. 2. Данных не хватает — не выдумывай: спроси один раз, собрав вопросы вместе. [приложи материалы или дай доступ к папке/файлам]
Страховки — из официального гайда Anthropic по промптингу Fable 5.1: модель иногда работает молча (просьба об апдейтах чинит) и может остановиться раньше, спросив разрешение на уже описанное («веди до конца» чинит).
02 Ручка effort
Суперсила 2: одна ручка вместо танцев с промптами
Effort — сколько модель «думает». Пять положений: low, medium, high, xhigh, max.
Официальная позиция Anthropic: effort — главный регулятор качества, скорости и цены на Fable 5.1. Выбор правильного уровня решает больше, чем почти любая оптимизация промпта.
Старт: high (дефолт). Дальше пробуй вниз:
medium → примерно то же качество, что Fable 5 на максимуме,
но дешевле. Рабочая лошадка для повседневного.
low → часто обгоняет модели классом ниже по цене за задачу.
Для простого и массового.
xhigh/max → только для самого сложного: модель может долго
думать перед длинным ответом — это нормально.
Нюанс low: модель реже сама лезет в поиск — если нужна
свежая информация, попроси искать явно.Перевожу на русский: «дорогая топ-модель» и «дешёвая быстрая» — теперь одна и та же модель с ручкой. Не переключайся между моделями — крути effort. Шпаргалка собрана из гайда Anthropic и наблюдения Ken Huang: low-уровень Fable часто обгоняет прошлые модели на максимуме — экономика перевернулась.
03 Письмо
Суперсила 3 (с подвохом): пишет лучше — но плотнее
Меньше штампов и канцелярита. Зато предложения длиннее, абзацы реже.
Из официального гайда Anthropic: письмо Fable 5.1 — «шаг вперёд относительно прежних моделей, меньше дежурных фраз». Мой опыт совпадает. Но там же описаны два побочных эффекта — и оба лечатся строкой в промпте (фиксы ниже — адаптация их формулировок):
Убери всю манерную прозу: без метафор-украшений и фраз, которые существуют, чтобы покрасоваться. Есть буквальная формулировка — используй её. Короткие предложения, чаще абзацы.
Используй списки и подзаголовки там, где контент многосоставный — не бойся структуры. (Новая модель, в отличие от старых, злоупотребляет не буллетами, а их отсутствием — проси структуру явно.)
И проверь свои старые промпты: если в них остались правила «не используй жирный и списки» (мы все их писали против старых моделей) — убери. На Fable 5.1 они делают ответы беднее, чем нужно.
03 Письмо
Мелочи, которые приятно знать
Три факта без действий — но они всплывут в разговорах.
- Меньше ложных отказов. Anthropic заявляет ~60% меньше срабатываний защиты «на пустом месте» (проверялось в Claude Code). Если модель всё же отказала на безобидном — переформулируй вопрос позитивно: не «нет ли тут ошибок компиляции?», а «есть ли в этой программе баги?».
- Невидимые вотермарки. Тексты Fable 5.1 несут невидимую маркировку (требование EU AI Act для моделей после 02.08.2026); API определения — в закрытом превью для регуляторов и медиа. Практический вывод прежний: финальный штрих руками — твой текст должен быть твоим по сути, а не только по подписи.
- Fable vs Mythos. Это одна и та же модель: Mythos 5.1 — версия с ослабленными ограничителями для проверенных организаций (кибербез, лайфсайенс). Тебе нужен Fable.
Ты знаешь три суперсилы (марафоны, effort, письмо), два фикса и три факта для светских бесед про ИИ 😄
04 Финал
Стоит ли переходить? Провери на своей задаче, а не по обзорам
Что ты сделал(а)
Отдал(а) модели задачу-марафон с двумя страховками, понял(а) ручку effort и починил(а) письмо одной строкой. Решение о переходе теперь принимает твоя задача, а не пресс-релиз.
Куда дальше
- Правило перехода: одна и та же задача, тот же промпт, effort medium — сравни с текущей моделью по своим критериям. 15 минут, метод из гайда про тест моделей
- Длинные задачи упираются в контекст? Собери модели базу знаний — марафоны становятся качественнее на порядок
- Источники и авторы: анонс Anthropic · официальный гайд по промптингу Fable 5.1 · Ken Huang — интент-фрейминг · CodeRabbit — замеры на 45 задачах · VentureBeat — цены и кейсы Ramp/Millennium
Разборы релизов — первыми в канале
Следующий релиз разберём раньше обзорщиков
Каждую громкую модель я прожимаю через свои задачи — и рассказываю в Telegram-канале, что реально работает, а что маркетинг.
Подписаться на канал →Правило вечное: модели меняются — метод проверки на своей задаче остаётся.
Метод и гайд: Анжела Петкова, из практики фокус-групп · версия-статья