# Cognition 宣布 Claude Fable 5 整合至 Devin

> 📖 本站完整內容索引（documentation index）：[llms.txt](/llms.txt)

> 原作者：Cognition (@cognition) · 策展與摘要：EasyVibeCoding · 平台：X (Twitter) · 熱度：🔥 · 日期：2026-06-10

> 原始來源：https://x.com/cognition/status/2064398549073453266

## 證據與延伸閱讀

- [FrontierCode 基準測試獲第一名](https://devin.ai/blog/claude-fable-5-available-in-devin)
- [Nubank 案例效率提升與成本降低](http://devin.ai/)

## 中文摘要

Cognition 宣布 Claude Fable 5 整合至 Devin。

**最新模型整合**
Cognition 於 2026 年 6 月 10 日宣布，最新的「Claude Fable 5」模型現已全面支援 Devin 的各項服務，包括「Devin Cloud」、「Devin Desktop」以及「Devin CLI」。使用者可透過「Devin Cloud」的「Ultra」Agent 體驗此模型，該版本專為處理長週期任務與複雜除錯場景所設計。儘管效能提升，Cognition 透過調整「harness」設定，將「Ultra」的運行成本控制在預設 Devin Agent 的 140% 以內。

**效能與基準測試**
「Claude Fable 5」在 Cognition 自有的工程基準測試「FrontierCode」中獲得第一名。該基準測試專注於真實世界的工程任務，評估指標包含程式碼的「可合併性（mergeability）」與「品質」。

![](https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/3713ae3399ec4b00.jpg)
> Claude Fable 5 在 FrontierCode 基準測試中取得 46.3% 的分數，榮登第一名，顯著超越 Claude Opus 4.8 與 GPT-5.5 等模型。

- 該模型具備優異的長週期推理與除錯能力。
- 支援開箱即用的工具泛化能力，涵蓋從「MCP」整合到電腦操作（computer use）等多種應用。
- 在提升評分表現的同時，優化了模型輸出與「token」使用量的比例，避免過度消耗資源。

![](https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/2068dde3486eca41.jpg)
> 根據 Cognition 官方推文，Claude Fable 5 在 FrontierCode 基準測試中榮登第一名，在不同的平均輸出 token 數量下皆展現出領先其他模型（如 Opus 4.8、GPT-5.5 等）的最高加權評分（最高達 46.2%）。

**實際應用案例**
Cognition 同步分享了金融科技公司「Nubank」利用 Devin 進行大規模程式碼重構的案例。面對擁有 8 年歷史、超過 600 萬行程式碼的單體架構 ETL 系統，Nubank 透過「Devin」將任務拆解並自動化處理：
- 透過針對性的微調（fine-tuning），Devin 在處理資料類別遷移任務時，速度提升 4 倍，單項子任務耗時從 40 分鐘縮短至 10 分鐘。
- 最終實現了 8 至 12 倍的工程效率提升，並將遷移成本降低超過 20 倍。
- 該專案證明了 Devin 在處理重複性高、邊緣案例複雜的工程任務時，能有效協助工程師將精力轉向核心業務開發。

欲了解更多資訊或開始使用，請造訪 [Devin 官方網站](https://devin.ai) 或閱讀 [官方部落格說明](https://devin.ai/blog/claude-fable-5-available-in-devin)。

## 媒體內容

**Claude Fable 5 在 FrontierCode 基準測試中取得 46.3% 的分數，榮登第一名，顯著超越 Claude Opus 4.8 與 GPT-5.5 等模型。**

**數據表**

| 項目 | 數值 |
| --- | --- |
| Gemini 3.1 Flash Lite | 4.8 |
| MiniMax M2.5 | 5.3 |
| SWE-1.6 | 5.5 |
| MiniMax M2.7 | 6.0 |
| Kimi K2.5 | 6.9 |
| Claude Sonnet 4.6 | 15.1 |
| Kimi K2.6 | 16.0 |
| Gemini 3.1 Pro | 16.7 |
| GPT-5.4-mini | 17.8 |
| Claude Opus 4.7 | 23.0 |
| GPT-5.5 | 25.5 |
| Claude Opus 4.8 | 34.3 |
| Claude Fable 5 | 46.3 |

**根據 Cognition 官方推文，Claude Fable 5 在 FrontierCode 基準測試中榮登第一名，在不同的平均輸出 token 數量下皆展現出領先其他模型（如 Opus 4.8、GPT-5.5 等）的最高加權評分（最高達 46.2%）。**

**數據表**

| 系列名 | 起始 (x, y) | 最佳 (x, y) | 結束 (x, y) |
| --- | --- | --- | --- |
| Fable 5 | (21k, 37.2%) | (42k, 46.2%) | (66k, 44.8%) |
| Opus 4.8 | (20k, 21.1%) | (62k, 34.2%) | (88k, 31.2%) |
| GPT-5.5 | (8.5k, 21.1%) | (25.5k, 25.5%) | (25.5k, 25.5%) |
| Opus 4.7 | (17k, 17.9%) | (32k, 26.9%) | (32k, 26.9%) |
| Gemini 3.1 Pro | (19k, 16.5%) | (19k, 16.5%) | (19k, 16.5%) |
| Kimi K2.6 | (41.5k, 16.1%) | (41.5k, 16.1%) | (41.5k, 16.1%) |
| Sonnet 4.6 | (28k, 13.6%) | (34k, 15.1%) | (38k, 13.1%) |
| GPT-5.4-mini | (34.5k, 12.1%) | (88k, 17.8%) | (88k, 17.8%) |
| Kimi K2.5 | (19k, 6.8%) | (19k, 6.8%) | (19k, 6.8%) |
| MiniMax M2.7 | (30.5k, 5.9%) | (30.5k, 5.9%) | (35.5k, 5.5%) |
| MiniMax M2.5 | (25k, 5.5%) | (25k, 5.5%) | (25k, 5.5%) |
| Gemini 3.1 Flash-Lite | (10k, 1.8%) | (13.5k, 4.8%) | (14k, 4.3%) |

## 標籤

Agent, 功能更新, Claude, Cognition, Devin, Anthropic
