Investing.com02:52Федеральная резервная система США планирует дальнейшие повышения процентных ставокInvesting.com02:36Председатель ФРС Логан призывает к повышению ставок на 50 базисных пунктов и болееPhys.org00:40Новый метод генерации почти неразличимых фотонов для квантовой связиFast Company00:30Университет Вермонта исследует применение цифровых двойников в медицинеOilPrice23:40Китай приостанавливает экспорт топлива в октябре на фоне глобального дефицита дизеляFortune20:54Paramount и Warner Bros. завершили сделку на $111 миллиардов с обязательством выпускать 30 фильмов в годCarscoops20:30GM и LG Energy приближаются к производству новых батарейCryptoPotato19:59Evernorth получает одобрение акционеров для выхода на Nasdaq с XRPArs Technica19:28Искусственный интеллект Ataraxos одержал победу в игре StrategoOilPrice19:00Историческая сделка по сверхпроводникам приближает коммерческое использование термоядерного синтеза

vestka

Anthropic представляет обновленные модели Claude Fable и Mythos

Компания Anthropic представила обновленные версии своих моделей Claude Fable 5.1 и Mythos 5.1. Модель Fable 5.1 продемонстрировала значительный прирост в области кодирования, агентных задач и научных исследований, набрав 52,6% в тестах Terminal-Bench Science, что значительно превышает 24,7% предыдущей версии.

Согласно данным, типичные задачи теперь стали примерно на 25% дешевле, а в сложных агентных сценариях экономия может достигать 45%. Mythos 5.1, в свою очередь, ориентирована на задачи в области кибербезопасности и жизни наук, что расширяет возможности применения моделей в различных сферах.

Развитие Claude для длинных автономных сценариев подчеркивает стремление Anthropic улучшить функциональность своих моделей, позволяя им не только генерировать текст, но и выполнять более сложные задачи. Это обновление может значительно повлиять на эффективность работы в ряде отраслей, включая разработку программного обеспечения и безопасность данных.

Главное

  • Модель Claude Fable 5.1 набрала 52,6% в тестах Terminal-Bench Science.
  • Экономия на типичных задачах составляет примерно 25%.
  • В сложных агентных сценариях экономия может достигать 45%.

Упомянуто

Важное из дайджеста

Открыть полный дайджест →