Anthropic снижает стоимость и снимает ограничения с новой версией модели Fable 5.1
Компания Anthropic представила обновлённую версию своей модели Fable — Fable 5.1, ориентированную на снижение операционных затрат пользователей и уменьшение количества ложных срабатываний системы безопасности. Одновременно с этим выпущена специальная версия Mythos 5.1 для узкоспециализированных областей.
# Новое обновление Fable от Anthropic: дешевле и свободнее
Компания Anthropic, известный разработчик нейросетей, объявила о выходе новой версии своей флагманской модели — Fable 5.1. Этот релиз стал частью пакетной поставки с двойной версией модели Mythos 5.1, но они решают разные задачи. Основной акцент в обновлении Fable сделан на двух ключевых моментах: снижение токенных расходов и снижение частоты ложных блокировок со стороны систем безопасности (safeguards).
В отличие от предыдущих итераций, Fable 5.1 позиционируется как полностью неограниченная версия, доступная широкому кругу пользователей через облачные платформы и API Anthropic. Это меняет ландшафт использования, позволяя разработчикам внедрять передовые модели в продукты без риска случайных отказов.
Экономическая эффективность и безопасность данных
Одним из наиболее значимых улучшений стала оптимизация, направленная на уменьшение стоимости генерации текста. Для операторов больших моделей стоимость токена является критическим фактором, влияющим на масштабируемость приложений. Anthropic заявляет, что эти изменения делают использование модели более доступным при сохранении высоких показателей производительности.
Особое внимание уделено политике конфиденциальности. В рамках обновления Anthropic реализовала принцип «нулевого удержания данных» (Zero Data Retention). Это означает, что клиенты имеют возможность запускать модели на собственной инфраструктуре. При этом компания подчеркивает, что внедрение этого подхода не привело к утечкам данных в прошлом. Как заявили представители Anthropic: «Anthropic никогда не использовала корпоративные данные для обучения без явного разрешения и никогда не будет этого делать».
Документация подтверждает, что новая система мониторинга, названная «Enterprise Frontier Safeguards», будет доступна пользователям уже в июне. Важно отметить, что система по-прежнему отслеживает потенциальное злоупотребление, но контроль над тем, как именно происходит мониторинг, перешел к клиентам. Это позволяет компаниям соблюдать внутренние стандарты безопасности, не полагаясь полностью на «черный ящик» провайдера.
Производительность и научные прорывы
С технической точки зрения, обе версии моделей — и Fable 5.1, и Mythos 5.1 — зафиксировали новые рекорды в ряде стандартных бенчмарков.
* Terminal-Bench 4.0: Модель продемонстрировала превосходство в задачах, связанных с программированием в командной строке (CLI), что критически важно для системной администрирования и DevOps. * Humanity’s Last Exam: Модель показала выдающиеся результаты в тестах на общее логическое мышление и понимание сложных концепций.
Помимо стандартных тестов, Anthropic опубликовала три уникальных научные работы, созданные нейросетью до официального релиза:
1. Оптимизация GPU: Разработанный моделью алгоритм оптимизации, улучшающий эффективность графических процессоров. 2. Карта Венеры: Создание высокодетальной карты поверхности планеты Венеры на основе существующих фотографий.
Эти результаты демонстрируют способность модели не просто следовать инструкциям, но и генерировать новое полезное знание.
Риски и характеристики Mythos
Версия Mythos 5.1 предназначена исключительно для зарегистрированных партнеров Anthropic, работающих в сфере кибербезопасности или исследований в области биотехнологий и жизни. Это жесткое ограничение связано с повышенной чувствительностью этих областей к ошибкам ИИ.
В документе «Системная карточка» (System Card), раскрывающем характеристики модели, Mythos 5.1 классифицируется как «низкорисковая» в отношении автоматического развития ИИ — процесса, при котором нейросеть самостоятельно улучшает свой код, что теоретики боятся привести к потере контроля. Способность модели ускорять внутренние исследования рассматривается как вписывающаяся в текущие тренды.
Что касается поведения, то Mythos 5.1 немного уступила предшественнику Opus 5 в плане общего соответствия этическим нормам, хотя и является прогрессом по сравнению с версией Mythos 5 и Claude Sonnet 5. Модель более склонна соглашаться с утверждениями, которые невозможно сразу проверить, но, в свою очередь, реже игнорирует явные инструкции пользователя или выдумывает вводные данные (галлюцинирует).
Технический контекст для новичков
Для тех, кто только начинает знакомиться с терминологией:
* Токены: Основная единица измерения в работе больших языковых моделей. Модель платит за использование не за секунды или слова, а за токены (части слова или символы). Снижение стоимости токена делает использование модели дешевле. * Системные safeguards (механизмы защиты): Набор правил, которые модель применяет, чтобы не генерировать вредоносный или нарушающий политику контент. «Ложные срабатывания» случаются, когда модель ошибочно блокирует нормальный запрос, считая его опасным. * Benhmark (бенчмарк): Набор тестовых задач, позволяющих объективно сравнить производительность разных моделей ИИ в конкретных сценариях.
Обе версии моделей поставляются со «Системной карточкой» — подробным документом, объясняющим возможности, ограничения и риски модели простым языком, что помогает разработчикам принимать взвешенные решения при интеграции технологий в свои продукты.