models
Улучшение мер безопасности Fable 5 в области биологии
Anthropic обновила меры безопасности модели Fable 5, значительно снизив количество ложных срабатываний при биологических запросах, что позволяет расширить её применение в научных и медицинских задачах.
AS1 NewsИсточник: anthropic.com
Компания Anthropic внесла изменения в систему защиты модели Fable 5, направленные на снижение числа ложных срабатываний при обработке биологических запросов. В результате обновления количество таких случаев уменьшилось примерно на 85%, что позволяет пользователям получать более широкий спектр помощи в области биологии, медицины и образования.
Fable 5 теперь может эффективнее помогать в интерпретации лабораторных результатов, понимании симптомов и обучении биологическим концепциям. В то же время, модель продолжает ограничивать доступ к более опасным функциям, таким как virology, toxicology и molecular design, чтобы предотвратить возможное злоупотребление.
Для обеспечения безопасности, Anthropic использует автоматические системы классификации, которые определяют, когда запросы могут иметь двойное назначение или представлять угрозу. В случае с опасными запросами, модель перенаправляет их на менее способную версию — Opus 5. Этот механизм позволяет сохранять баланс между доступностью и безопасностью.
Обновление классификаторов проводилось с учетом обратной связи экспертов и включает новые правила, позволяющие более точно различать безопасные и потенциально опасные запросы. В результате, модель стала менее чувствительной к benign-биологическим вопросам, что расширяет возможности её использования в научных и образовательных целях.
Несмотря на прогресс, Anthropic признает, что совершенствование системы безопасности — это непрерывный процесс. Компания продолжит работу над снижением ложных срабатываний и расширением доверенных путей доступа для исследователей, чтобы обеспечить безопасное использование передовых биологических возможностей модели.
Обновление повышает безопасность и расширяет возможности использования модели Fable 5 в биологических задачах, при этом сохраняется контроль за потенциально опасными запросами.