Компания Anthropic представила обновленные версии своих моделей Claude Fable 5.1 и Mythos 5.1. Модель Fable 5.1 продемонстрировала значительный прирост в области кодирования, агентных задач и научных исследований, набрав 52,6% в тестах Terminal-Bench Science, что значительно превышает 24,7% предыдущей версии.
Согласно данным, типичные задачи теперь стали примерно на 25% дешевле, а в сложных агентных сценариях экономия может достигать 45%. Mythos 5.1, в свою очередь, ориентирована на задачи в области кибербезопасности и жизни наук, что расширяет возможности применения моделей в различных сферах.
Развитие Claude для длинных автономных сценариев подчеркивает стремление Anthropic улучшить функциональность своих моделей, позволяя им не только генерировать текст, но и выполнять более сложные задачи. Это обновление может значительно повлиять на эффективность работы в ряде отраслей, включая разработку программного обеспечения и безопасность данных.