avatar
Refat Talks: Tech & AI
@nobilix
09.06.2026 19:39
Итак, вышла Claude Mythos Fable 5.

Соберем что мы об этом знаем в одну кучу и будем дополнять.

- Официальный блогпост с видео-демками и графиками, ютуб-тизер и Системная карта с деталями.

- Claude Fable 5 и Mythos 5 - это одни и те же веса, но с разными предохранителями. Fable для всех, Mythos - для доверенных партнеров

- Новый класс моделей "Mythos-class". SOTA почти на всех бенчмарках, самые большие отрывы - на длинных и сложных задачах. Бенчи пересказывать не буду - посмотрите в блогпосте и постепенно появляются все больше независимых.

- в 2 раза дороже Опуса: $10 за млн входных токенов, $50 за млн выходных.

- Доступна в Claude (все платные подписки), Claude Code и по API. Если не видите в CC - обновитесь claude update.

- Всех расстроило это: В подписках включена до 22 июня, дальше по кредитам. То есть через пару недель вероятно будет API баланс равный цене вашей подписки (например $100), а выше него - уже только при оплате за API-токены. Пишут что могут включить в саму подписку позже если найдут достаточные мощности.

- Every дали доступ за 5 дней: их видео-обзор и статья - там paywall, но прочитал и вот суть:
- Fable как "warp-двигатель для кода": амбициозные штуки одним промптом, но для понятных и коротких задач дорого и медленно.
- Скачок виден на больших автономных билдах, а не на рутине.
- На их внутреннем инженерном бенче: Fable 91/100 (Opus 4.8 - 63 и GPT-5.5 - 62).
- Сделал клон их продукта "Proof" (collaborative document editor) с одного промпта без доступа к исходному коду за ≈3 часа.
- В другом тесте снял скриншоты собственной работы на desktop и mobile, нашёл визуальные дефекты и починил - QA встроен в рабочий цикл без отдельного промпта.
- По их наблюдениям чинит корневую причину, а не симптом.
- Пишут что старые скиллы могут ограничивать новые модели (например Fable делает PowerPoint лучше, когда ему сказали вообще не использовать скилл, а просто дали бренд-гайдлайны)
- При этом текст пишет не чуть хуже Opus-а
- Самое сильное преимущество вне кода - суждение, особенно с большим контекстом


- Кто еще получил ранний доступ к модели? Пост Ethan Mollick, Claire Vo - подкаст How I AI

- впечатления о проактивности модели от Simon Willson

- Про предохранители: когда пишешь запросы про кибербез, био/хим и дистилляцию, срабатывает защита и переключает на Opus (в <5% сессий как пишут), и тебя об этом уведомляют. Но ложные срабатывания реальны: на reddit уже ловят баны за легитимный dual-use. Обещают уменьшать false positive.

- Когда вообще брать Fable. Модель заточена под долгие автономные/агентные задачи: "может работать днями, и чем длиннее задача, тем больше отрыв". На коротких правках разницы с Opus 4.8 часто не почувствуешь, а платишь 2x. Именно на ней Борис Черный видимо почувствовал силу Loop Engeneering.

- Интересно что максимум effort не всегда дает лучше результат - об этом пишут Every на своих тестах письма.

- Шуточный Elevator-bench уже давненько был исчерпан, но если интересно, то вот лифт Fable.

- Мои тесты пока скромные: работает визуально даже быстрее (видимо потому что делает меньше tool-колов) и внимательнее, но у меня не так много задач с которыми Opus 4.8 не справлялся бы, надо больше тестить.

——

- позже еще выяснилось, что Anthropic скрытно ограничивала Fable 5 на задачах разработки конкурирующих frontier-моделей - через steering-векторы и правку промптов модель тихо деградировала(~0.03% запросов). После критики исследователей Anthropic признала ошибку ("мы сделали неверный выбор и приносим извинения") и откатила политику, пообещав делать любые ограничения видимыми.

UPD: 12 июня власти США распорядились заблокировать доступ иностранцев к моделям Anthropic Fable 5 и Mythos 5, из-за чего компании пришлось полностью отключить обе модели для всех пользователей.
👍 31
🔥 17
9
❤‍🔥 6
39 66 5.5K

Обсуждение 39

Обсуждение не доступно в веб-версии. Чтобы написать комментарий, перейдите в приложение Telegram.

Обсудить в Telegram

Refat Talks: Tech & AI

11.4K
Заметки про технологии, GenAI и глобал стартапы, прагматично и без лишнего хайпа. Эксперт по разработке и внедрению enterprise-grade AI автоматизаций, строю AI-first компании. Co-founder devstark.com и spreadsimple.com
лс @refatametov
Открыть в Telegram