Anthropic ослабила биологические ограничения Claude Fable 5: ложных блокировок стало на 85% меньше.
Anthropic обновила систему защиты Claude Fable 5 для запросов по биологии и медицине. Раньше модель намеренно блокировала почти все биологические запросы: если классификатор видел потенциально рискованную тему, запрос автоматически отправлялся в Opus 5, менее мощную в этой области модель.
Главной проблемой стали массовые ложные срабатывания. После переработки классификаторов в Anthropic заявляют о снижении биологических fallback-переключений примерно на 85%.
Теперь Claude Fable 5 сможет заметно чаще помогать с обычными задачами:
- объяснением результатов анализов;
- разбором симптомов;
- образовательными вопросами по биологии;
- некоторыми клиническими задачами для специалистов.
Полностью ограничения не исчезли. Запросы, связанные с профессиональными dual-use направлениями, включая вирусологию, токсикологию и молекулярный дизайн, по-прежнему могут переключаться на Opus 5.
Причина в возможностях самой модели: Anthropic утверждает, что Claude Fable 5 уже превосходит экспертов в отдельных сложных биологических задачах, поэтому слишком свободный доступ к таким возможностям компания считает потенциально опасным.
После обновления Anthropic ожидает сокращение общего числа fallback-переключений примерно на 67% в Claude.ai, 55% в Cowork, 17% в Claude Code и 7% через Claude Platform.
По сути, Anthropic пытается решить одну из главных проблем AI-безопасности: как не урезать полезные возможности frontier-модели только потому, что те же знания теоретически можно применить во вред.
Подробнее: https://www.anthropic.com/news/improving-fable-5-s-biology-safeguards

