# Anthropic 放寬 Claude Fable 5 生物防護，誤擋回退減少約 85%；dual-use 請求仍轉交 Opus 5，專業研究與藥物開發尚不適用

> 📖 本站完整內容索引（documentation index）：[llms.txt](/llms.txt)

> 原作者：Claude (@claudeai) · 策展與摘要：EasyVibeCoding · 平台：X (Twitter) · 熱度：🔥🔥🔥 · 日期：2026-08-07

> 原始來源：https://x.com/claudeai/status/2085563808773189680

## 證據與延伸閱讀

- [Claude Fable 5 更新防護，fallback 減 85%](https://www.anthropic.com/news/improving-fable-5-s-biology-safeguards) — 官方文件

## 中文摘要

Anthropic 放寬 Claude Fable 5 生物防護，誤擋回退減少約 85%；dual-use 請求仍轉交 Opus 5，專業研究與藥物開發尚不適用。

這項調整讓 Fable 能處理更廣泛的日常健康與教育問題，同時維持對高風險 biology 應用的限制。

![](https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/ddd0d879131b975e.webp)
> ▲ 上（A，上線時）：分界線緊貼 Benign 右緣，連安全邊際的良性請求也被攔下；下（B，本次更新）：Benign 區大幅擴張、安全邊際縮窄，分界線右移，但安全邊際與 dual-use、有害內容仍在受保護側。

**可用範圍** 使用者在解讀檢驗結果、了解症狀或學習 biology 時，預期會遇到更少被轉交的情況；醫療專業人員也能在更多臨床任務上獲得 Fable 支援。不過，Anthropic 表示，Fable 仍會把被判定為 dual-use 的要求 fallback 至 Opus 5，包括 virology、toxicology 與 molecular design，因此目前還不能用於專業 biology 研究與藥物開發。

**安全取捨** Anthropic 認為，AI 在 biology 與 medicine 具有最大的正面影響潛力，但同一套能力也可能被用來研發生物武器。Anthropic 表示，其能力評估顯示 Fable 5 在部分高複雜生物任務上可勝過專家，也可能給惡意行為者他處取不到的能力。治療研究有時必須處理危險物質，例如活疫苗需要培養目標病原體；降血壓藥 captopril 的開發也曾涉及從蛇毒分離會導致人體血壓驟降的有毒成分。由於善意研究與惡意用途難以區分，Fable 5 上線初期幾乎封鎖所有 biology 查詢，藉此降低誤用可能造成的災難性風險。

**分類器調整** 系統使用較小型的 safety classifiers，判斷要求是否涉及受保護的 biology 任務或有害輸出；一旦觸發，就將要求重新導向生物能力較弱的 Opus 5。Anthropic 近幾週重寫 classifier constitution、納入內外部專家意見、更新訓練資料並重新訓練模型，讓分類器更能區分良性與 dual-use 查詢，大致仍會攔截有害與 dual-use 研究內容。官方也承認仍會存在 false positives，並計畫透過 trusted access pathways，逐步為研究人員提供更強模型的安全使用管道。詳見 Anthropic 的[官方說明](https://www.anthropic.com/news/improving-fable-5-s-biology-safeguards)。

## 媒體內容

**▲ 上（A，上線時）：分界線緊貼 Benign 右緣，連安全邊際的良性請求也被攔下；下（B，本次更新）：Benign 區大幅擴張、安全邊際縮窄，分界線右移，但安全邊際與 dual-use、有害內容仍在受保護側。**

**數據表（1）A: Fable safeguards (at launch)**

| 項目 | 數值 |
| --- | --- |
| Description | Stronger safeguards than our usual models. |
| Allowed | Benign |
| Safeguarded | Safety margin (e.g. textbook biology and medicine, e.g. benign research biology and medicine), Dual use research biology (e.g. vaccine development, toxicology), Harmful (e.g. recognizable historic weapons) |
| Classifier boundary | Positioned between Benign and Safety margin |

**數據表（2）B: Fable safeguards (now)**

| 項目 | 數值 |
| --- | --- |
| Description | More precise safeguards allow for benefits that do not compromise on safety. |
| Allowed | Benign, Safety margin |
| Safeguarded | Dual use research biology, Harmful |
| Classifier boundary | Positioned between Safety margin and Dual use research biology |

## 標籤

功能更新, Claude, Anthropic, Claude
