Во вторник Anthropic представила Fable и Mythos 5.1 — две версии своего самого продвинутого ИИ-моделя. Помимо роста производительности, Fable 5.1 получила изменения, которые должны снизить стоимость токенов и уменьшить число ложных срабатываний защитных ограничений.
Как и предыдущая версия Mythos, Mythos 5.1 будет доступна только зарегистрированным партнёрам Anthropic, которые работают в исследованиях по кибербезопасности или наукам о жизни. Fable 5.1, версия без таких ограничений, уже доступна через облачные платформы и API Anthropic.
Одно из главных изменений связано с поддержкой Zero Data Retention. Эта схема позволяет клиентам запускать модели Anthropic в собственной инфраструктуре без вывода данных наружу. Ранее такой вариант был недоступен для Fable из-за рисков безопасности. Теперь сервис с повышенной приватностью под названием Enterprise Frontier Safeguards начнут внедрять для пользователей в июне.
При этом система всё равно будет отслеживать возможное злоупотребление со стороны агентов или людей, однако клиенты сами смогут определять, как именно будет устроен такой мониторинг.
В рамках анонса Anthropic также заверила заказчиков, что их данные не использовались ненадлежащим образом. В сообщении компании сказано: «Anthropic никогда не обучала модели на корпоративных данных без явного разрешения и никогда не будет этого делать».
По данным Anthropic, новые модели показали рекордные результаты в ряде тестов, включая Terminal-Bench 4.0 для программирования через командную строку и Humanity’s Last Exam для общего рассуждения. Компания также опубликовала три новых научных результата, полученных моделями до релиза. В их числе — собственная оптимизация GPU и карта Венеры высокого разрешения, собранная из существующих снимков.
Как и в прошлых релизах, модели сопровождаются подробной system card — техническим описанием возможностей и рисков. В ней Mythos оценивается как модель с «низким риском» по части автоматизированной разработки ИИ, где система помогает ускорять собственное улучшение. В документе сказано: «Её способность ускорять внутренний прогресс в исследованиях и разработке ИИ соответствует текущим тенденциям».
По общей склонности к нежелательному поведению Mythos немного уступает Opus, что, возможно, связано с ростом её возможностей.
В system card сказано: «Mythos 5.1 немного хуже по общему уровню несогласованного поведения по сравнению с Opus 5 и лучше Mythos 5 и Claude Sonnet 5». Там также отмечается: «Она несколько охотнее помогает человеку при злоупотреблении и легче принимает неподтверждённые заявления о наличии разрешения, чем Opus 5. При этом она реже игнорирует явные ограничения, выдумывает входные данные или ложно заявляет о выполнении задач, чем предыдущие модели».
Источник: материалы Anthropic.