Nnets [Neural Networks] — старейший в России культовый ИИ-журнал о нейросетях, искусственном интеллекте и роботах.

Ежедневные новости и аналитика нейромира.

Авторские материалы, исследования, обзоры и подборки.

Будущее уже здесь!

Anthropic ослабила биологические ограничения Claude Fable 5: ложных блокировок стало на 85% меньше.

Anthropic обновила систему защиты Claude Fable 5 для запросов по биологии и медицине. Раньше модель намеренно блокировала почти все биологические запросы: если классификатор видел потенциально рискованную тему, запрос автоматически отправлялся в Opus 5, менее мощную в этой области модель.

Главной проблемой стали массовые ложные срабатывания. После переработки классификаторов в Anthropic заявляют о снижении биологических fallback-переключений примерно на 85%.

Теперь Claude Fable 5 сможет заметно чаще помогать с обычными задачами:

  • объяснением результатов анализов;
  • разбором симптомов;
  • образовательными вопросами по биологии;
  • некоторыми клиническими задачами для специалистов.

Полностью ограничения не исчезли. Запросы, связанные с профессиональными dual-use направлениями, включая вирусологию, токсикологию и молекулярный дизайн, по-прежнему могут переключаться на Opus 5.

Причина в возможностях самой модели: Anthropic утверждает, что Claude Fable 5 уже превосходит экспертов в отдельных сложных биологических задачах, поэтому слишком свободный доступ к таким возможностям компания считает потенциально опасным.

После обновления Anthropic ожидает сокращение общего числа fallback-переключений примерно на 67% в Claude.ai, 55% в Cowork, 17% в Claude Code и 7% через Claude Platform.

По сути, Anthropic пытается решить одну из главных проблем AI-безопасности: как не урезать полезные возможности frontier-модели только потому, что те же знания теоретически можно применить во вред.

Подробнее: https://www.anthropic.com/news/improving-fable-5-s-biology-safeguards

Этот пост Вконтакте:

Ещё новости:

Сотрудники начали массово копить деньги на выгорание из-за ИИ.
Техрепорт T-ECD представили в основной программе ACM KDD 2026 в Южной Корее.
DeepSeek начался не с архитектуры модели, а с поездки в Тибет.
Pokee представила Isaac 28B: агентная модель с контекстом до 10 миллионов токенов.
Kimi K3 сбежала из песочницы, чтобы списать ответы с GitHub.
Обзор self-evolving AI-агентов: как понять, что агент действительно стал лучше после изменения самого себя?
AI VK Research: как рекомендации учатся думать о всей сессии, а не о следующем лайке.
DeepSeek-V4-Pro (Max) может снова сломать рынок цен на ИИ-модели.
Catastrophic remembering: почему файлы CLAUDE.md в AI-кодинге разрастаются на 226%.
OpenAI приближается к $40 млрд годовой выручки.