Anthropic выпустила Claude Fable 5.1 и Mythos 5.1
Anthropic обновила пятую генерацию флагманов. Claude Fable 5.1 вышла в общий доступ, API-имя claude-fable-5-1, подписчики Pro, Max, Team и Enterprise получают её сразу. Mythos 5.1 построена на той же модели, но с ослабленными safeguard'ами и выдаётся только по программам доверенного доступа для кибербезопасности и наук о жизни. Программу Life Sciences Verification Anthropic создала вместе с правительством США, на старте Mythos доступна ограниченному кругу американских организаций. Эта же версия работает внутри продукта Claude Security.
В Terminal-Bench 4.0 Fable 5.1 набирает 55,8% против 42,0% у Fable 5 и 52,3% у Opus 5, у Mythos 5.1 показатель доходит до 60,9%. Terminal-Bench-Science 0.1 вырос с 24,7% до 52,6%, AutomationBench с 17,1% до 31,4%. В OSWorld 2.0 модель даёт 41,7% в строгом режиме против 36,1% у предшественницы, в GDPval-AA v2 набирает 1853 балла против 1723.
Чтение кэша подешевело на 75%, до $0,25 за миллион токенов. Ставки ввода ($10/млн) и вывода ($50/млн) не изменились. Типичная нагрузка стала дешевле примерно на 25%, для агентных сценариев экономия доходит до 45%. Модель уже доступна на AWS, Google Cloud и Azure.
Защиты стали точнее: ложных срабатываний в кибербезопасности на 60% меньше, Fable 5.1 разрешили находить уязвимости в коде, хотя генерация эксплойтов и пентесты по-прежнему уходят на модели Opus. На безобидные биологические вопросы safeguard'ы срабатывают на 85% реже. Из научных демо: Mythos 5.1 спроектировала белковые байндеры с hit rate около 50% при типичных 10–15%, а Fable 5.1 построила карту высот трети поверхности Венеры с разрешением 2–3 км вместо прежних 10–20 км.