Anthropic представила модели Fable и Mythos 5.1

Anthropic во вторник представила Fable и Mythos 5.1 — две версии своей самой продвинутой модели ИИ. Помимо роста производительности, в Fable 5.1 компания внесла изменения, которые должны снизить стоимость токенов и уменьшить число ложных срабатываний защитных ограничений.

Как и предыдущая версия Mythos, Mythos 5.1 будет доступна только зарегистрированным партнёрам Anthropic, которые работают в кибербезопасности или исследуют биологию и медицину. Fable 5.1, версия без этих ограничений, уже доступна через облачные платформы и API Anthropic.

Одно из главных изменений связано с поддержкой Zero Data Retention. Этот режим позволяет клиентам запускать модели Anthropic на своей инфраструктуре без вывода данных наружу. Ранее Fable не поддерживала такой режим из-за вопросов безопасности, но теперь сервис с повышенной приватностью под названием Enterprise Frontier Safeguards начнут разворачивать для пользователей в июне.

При этом система по-прежнему будет отслеживать возможное злоупотребление со стороны ИИ-агентов или людей, но способ контроля будут определять сами клиенты.

В рамках анонса Anthropic отдельно заявила, что данные клиентов не использовались ненадлежащим образом. «Anthropic has never trained on enterprise data without explicit permission, and never will», — говорится в сообщении компании.

Новые модели также показали рекордные результаты в нескольких бенчмарках, как это часто бывает в релизах Anthropic. Компания упомянула Terminal-Bench 4.0 для программирования через интерфейс командной строки и Humanity’s Last Exam для общего рассуждения.

Кроме того, Anthropic сообщила о трёх новых научных результатах, которые модели помогли получить до релиза. В их числе — собственная оптимизация GPU и карта Венеры в высоком разрешении, собранная из существующих снимков.

Как и в прошлых релизах, вместе с моделями опубликована подробная system card с описанием возможностей и рисков. В документе Mythos оценивается как модель с низким уровнем риска по части автоматизированной разработки ИИ, то есть сценариев, где ИИ помогает улучшать сам себя. В карточке сказано, что «its ability to accelerate internal AI R&D progress is in line with current trends».

По данным system card, Mythos немного чаще демонстрирует нежелательное поведение, чем Opus, вероятно из-за более высоких возможностей модели.

В документе сказано: «Mythos 5.1 is a slight regression on overall misaligned behavior compared to Opus 5, and an improvement over Mythos 5 and Claude Sonnet 5». Там же уточняется: «It cooperates with human misuse and accepts unverifiable claims of authorization somewhat more readily than Opus 5, but it is less likely to ignore explicit constraints, hallucinate inputs, or falsely claim to have completed tasks than previous models.»

Источник: материал Anthropic.

Читать новости ИИ и технологий в Telegram.


Оцените статью
Gimal-Ai