Anthropic оптимизировала работу фильтров безопасности в модели Claude 3.5 Sonnet, сократив число ложных блокировок биологических запросов на 85%. Ранее избыточная осторожность системы приводила к тому, что большинство легитимных научных вопросов перенаправлялись на менее производительную модель Opus 3. При этом компания сохранила строгие ограничения для тем, связанных с вирусологией и токсикологией.
Обновление направлено на улучшение пользовательского опыта для исследователей и специалистов, работающих в области биологии. Ранее жесткие настройки безопасности часто препятствовали выполнению стандартных задач, так как алгоритмы классифицировали безобидные запросы как потенциально опасные. Теперь модель точнее определяет контекст, позволяя пользователям получать ответы на общие биологические темы без принудительного переключения на другие версии ИИ.
Несмотря на смягчение фильтров, Anthropic продолжает придерживаться политики «двойного назначения». Запросы, которые могут быть использованы для создания биологического оружия или работы с опасными патогенами, остаются под строгим контролем. Компания использует многоуровневую систему оценки рисков, чтобы сбалансировать доступность полезных инструментов для науки и предотвращение злоупотреблений технологией.
Ключевые факты
- Количество ложных срабатываний биологических фильтров в Claude 3.5 Sonnet снизилось на 85%.
- Изменения призваны устранить проблему избыточной блокировки легитимных запросов, характерную для предыдущих версий.
- Строгие ограничения сохраняются для чувствительных областей, включая вирусологию и токсикологию.
- Ранее при срабатывании фильтров безопасности система автоматически перенаправляла пользователей на модель Opus 3, которая обладает меньшей скоростью работы.
