Что изменилось
Anthropic объявила о серьёзном обновлении биологических защит своей модели Fable 5. Раньше система часто ошибочно блокировала запросы, связанные с биологией, и переключала их на менее мощную версию — Opus 5. Теперь, по данным компании, число таких переключений сократилось примерно на 85% во всех продуктовых интерфейсах. Это значит, что обычные пользователи заметно реже будут сталкиваться с отказами при обращении к медицинской или образовательной тематике: например, при интерпретации анализов, разборе симптомов или изучении биологии в учебном процессе.
Важно, что обновление затрагивает и профессиональную сферу. Врачи и другой медицинский персонал смогут получать больше поддержки от Fable 5 при решении клинических задач, не отвлекаясь на внезапные «отфутболивания» к Opus 5. Для самой компании это шаг к более естественному использованию модели в повседневных сценариях, где биологический контекст нужен, но не несёт серьёзных рисков.

Почему биология была под запретом
Изначально Fable 5 запустили с почти полной блокировкой биологических запросов. Это не случайность, а осознанный компромисс: модель обладает очень мощными возможностями в этой области и может превосходить экспертов в ряде сложных задач. В руках злоумышленников такой потенциал способен значительно ускорить разработку биологического оружия — по оценкам Anthropic, прирост возможностей атакующего существенен.
Проблема в том, что грань между полезным и вредным применением ИИ в биологии крайне размыта. Даже лечение болезней иногда требует работы с опасными соединениями: живые вакцины или препараты, созданные на основе токсичных компонентов, — яркие примеры. Искушённый злоумышленник может использовать эту неоднозначность, чтобы замаскировать свои настоящие намерения под безобидный исследовательский запрос. Ситуацию усугубляет и прогноз из ежегодной оценки угроз разведсообщества США за 2026 год: развитие синтетической биологии и геномного редактирования способно породить новые биологические угрозы, а ряд государств, вероятно, продолжают наступательные программы биологического и химического оружия.
Чтобы снизить риски, компания пошла на сознательное ограничение: модель открыли для других областей, но биология оказалась почти полностью закрыта. Такой выбор объяснялся просто — цена ошибки в dual-use сфере потенциально катастрофична.
Как работает защита сейчас
В основе обновлённой системы лежат safety-классификаторы — автоматизированные ИИ-модули, которые распознают запросы на выполнение защищённых биологических задач или выявление вредного вывода. Когда такой классификатор срабатывает, запрос автоматически перенаправляется на Opus 5, у которого биологические возможности значительно скромнее.
Разработка точных классификаторов — сложная инженерная задача. Нужно корректно разделять допустимые и недопустимые запросы, настраивать систему так, чтобы она не давала ни ложных срабатываний, ни пропусков, а также защищать её от jailbreak-атак. На старте Anthropic использовала намеренно широкий биологический классификатор, чтобы скорее предоставить пользователям доступ к Fable 5, а уже затем исследовать и уточнять его поведение. Если бы компания решила дождаться более совершенных защит, общий запуск модели пришлось бы отложить на недели или даже месяцы.

Что осталось недоступным
Несмотря на значительное улучшение, Fable 5 всё ещё переключается на Opus 5 для запросов, относящихся к категории dual-use. Это касается вирусологии, токсикологии и молекулярного дизайна. Поэтому модель пока не подходит для профессиональных биологических исследований или разработки лекарств — здесь слишком высоки риски, что ответы будут использованы во вред.
Anthropic, впрочем, заявляет, что не собирается останавливаться. В планах — создание доверенных путей доступа к передовым биологическим возможностям модели для квалифицированных специалистов. Это позволит закрыть существующий разрыв между безопасностью и полезностью ИИ в биомедицине, не открывая при этом «ящик Пандоры» для злоумышленников.
Выводы
Обновление защит Fable 5 — заметный шаг в сторону баланса между практической пользой и безопасностью. Меньше ложных срабатываний означает, что модель становится полезнее в образовании, медицине и повседневных консультациях. Однако ключевые риски dual-use сохраняются, и компания осознанно оставляет за собой право «рубить» самые опасные запросы. Остаётся надеяться, что развитие доверенных механизмов доступа позволит использовать мощь ИИ и в серьёзных биологических исследованиях, не создавая при этом новых угроз.



