Сьогодні вийшли Claude Fable 5.1 і Mythos 5.1. Головне не в тому, що вона розумніша - а в тому, що агентні задачі стали до 45% дешевші.
Ціна за токени лишилась та сама, $10 за млн вхідних і $50 за млн вихідних. Але читання з кешу впало з $1 до $0.25 за млн - вчетверо. Для агентів, які по сто разів перечитують один і той самий контекст, це і є основна стаття витрат.
По бенчмарках:
⚡ Terminal-Bench-Science - 52.6% проти 24.7% у Fable 5. Більш ніж удвічі
⚡ AutomationBench (бізнес-воркфлоу) - 31.4% проти 17.1%
⚡ Terminal-Bench 4.0 (агентний код) - 55.8%, у Mythos 5.1 аж 60.9%
⚡ CursorBench, OSWorld, Humanity's Last Exam - виграє скрізь, але вже без вау-відриву
Заодно підтягнули запобіжники: на 60% менше хибних спрацювань у кібербезпеці і на 85% - на нешкідливих біологічних питаннях. Тобто модель нарешті перестане відмовлятись читати твій докер-лог, бо там слово «exploit».
Model ID -
claude-fable-5-1. Вже в Claude Code, claude.ai, Bedrock, Google Cloud і Azure.Найсмішніше в анонсі: Millennium каже, що модель знайшла рідкісний краш, який їхні інженери не могли пояснити чотири роки.





