# Meta Muse Spark 1.2 拿下 Video-to-Website 第一，三類評測進入價格優勢 Pareto frontier

> 📖 本站完整內容索引（documentation index）：[llms.txt](/llms.txt)

> 原作者：Design Arena (@DesignArena) · 策展與摘要：EasyVibeCoding · 平台：X (Twitter) · 熱度：🔥🔥 · 日期：2026-08-20

> 原始來源：https://x.com/DesignArena/status/2090498670685020639

## 證據與延伸閱讀

- [Meta Muse Spark 1.2 拿下 Video-to-Website 第一，三類評測進入價格優勢 Pareto frontier。](https://x.com/DesignArena/status/2090498670685020639)
- [模型能力：coding-focused 更新版並具備自改進循環](https://research.meta.ai/blog/multimodal-intelligence-of-muse-spark-1-2) — 官方文件

## 中文摘要

Meta Muse Spark 1.2 拿下 Video-to-Website 第一，三類評測進入價格優勢 Pareto frontier。

**評測成績**：Design Arena 於 2026 年 8 月 21 日分享，Muse Spark 1.2 在各類別的排名如下：

- Video-to-Website：Elo rating 1279，排名第一。

![](https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/fdbfd67c63a060a1.jpg)
> Muse Spark 1.2 在 DesignArena 的 Video-to-Website 評測中以 Elo 評分 1279 取得第一名。

- Image-to-HTML：Elo rating 1252，排名第二。

![](https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/b4e71f7463297597.jpg)
> Muse Spark 1.2 在 Image to HTML 項目以 Elo rating 1252 獲得第 2 名，僅次於 Kimi K3 的 1266 分。

- Image-to-Frontend：Elo rating 1272，排名第三。

![](https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/5ff490fe75fb0fd7.jpg)
> Muse Spark 1.2 在 DesignArena 的 Image-to-Frontend 評測中以 1272 的 Elo 評分名列第 3 位。

Muse Spark 1.2 的價格為每 1M input tokens 1.25 美元、每 1M output tokens 4.25 美元。Design Arena 認為，它在上述三個類別都同時具備競爭力與價格優勢，並向 Meta 團隊表示祝賀。

**模型能力**：Meta 於 2026 年 8 月 20 日發布的介紹指出，Muse Spark 1.2 是 Muse Spark 1.1 的 coding-focused 更新版，重點放在視覺理解、推理與程式開發。模型能將圖片或影片中的版面、階層與風格轉換成可運作的網頁或遊戲，並重新檢查產出結果，形成持續改進的 loop；先前示範中，它曾把終端機上傳的影片轉成可操作的訂房頁面。

![](https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/98614e4c47219c4c.png)
> 以淺灰白為背景的藍色線條抽象向量圖，中心點向外輻射出多道帶有箭頭的對稱曲線，並散布著微小的藍色粒子點綴。

**工具與延伸應用**：Meta 表示，Muse Spark 1.2 在能使用工具時的多模態能力提升最明顯，因為模型可以更仔細檢查視覺輸入，再把觀察結果納入推理。其應用也延伸到機器人控制與音訊視覺理解：專用版本可擔任機器人的大腦與協調器，呼叫工具、觀察結果並反覆執行，直到任務完成；同時整合影片理解、密集描述、網頁開發、即時搜尋與空間定位。

![](https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/9923c35243772618.png)
> GPT 5.6 Sol 在 ZeroBench (With Tools) 以 54.6% 得分領先，Muse Spark 1.2 則以 54.0% 居次。

**評測與可用性**：Meta 同步預告 WildArtifactBench，這套內部評測以 Agent 與人工評審比較產出物，使用勝率與 Elo scores 衡量實際效用，並先釋出 10 項任務。Muse Spark 1.2 已可透過 Meta Model API 與 Muse Code 使用；Meta 也預告將發布 open weights。

## 媒體內容

**Muse Spark 1.2 在 DesignArena 的 Video-to-Website 評測中以 Elo 評分 1279 取得第一名。**

**數據表**

| 項目 | 數值 |
| --- | --- |
| Muse Spark 1.2 | 1279 |
| Kimi K3 | 1243 |
| Muse Spark 1.1 | 1236 |
| Gemini 3.6 Flash | 1218 |
| Kimi K2.6 | 1200 |
| Kimi K2.7 Code | 1194 |
| Kimi K2.5 (Thinking) | 1192 |
| Gemini 3.5 Flash | 1191 |
| Qwen3.6 Plus | 1175 |
| Gemini 3.1 Pro Preview | 1157 |
| GLM 5V Turbo | 1155 |
| MiMo-V2.5 | 1144 |

**Muse Spark 1.2 在 Image to HTML 項目以 Elo rating 1252 獲得第 2 名，僅次於 Kimi K3 的 1266 分。**

**數據表**

| 項目 | 數值 |
| --- | --- |
| Kimi K3 | 1266 |
| Muse Spark 1.2 | 1252 |
| GPT-5.6 Sol (Medium) | 1251 |
| Gemini 3.7 Flash | 1249 |
| Claude Fable 5 | 1244 |
| Qwen3.8 Max | 1239 |
| Claude Opus 5 | 1231 |
| GPT-5.5 | 1230 |
| Gemini 3.6 Flash | 1228 |
| Grok 4.5 | 1221 |
| Muse Spark 1.1 | 1220 |
| Claude Opus 4.7 | 1210 |
| GPT-5.6 Terra | 1207 |
| Gemini 3.5 Flash | 1203 |
| Kimi K2.7 Code | 1198 |
| Claude Sonnet 5 | 1192 |
| Kimi K2.6 | 1191 |
| Claude Opus 4.8 | 1186 |
| Qwen3.7 Plus | 1186 |
| Nex N2 Pro | 1183 |

**Muse Spark 1.2 在 DesignArena 的 Image-to-Frontend 評測中以 1272 的 Elo 評分名列第 3 位。**

**數據表**

| 項目 | 數值 |
| --- | --- |
| Kimi K3 | 1296 |
| Claude Fable 5 | 1273 |
| Muse Spark 1.2 | 1272 |
| Grok 4.6 | 1260 |
| Gemini 3.6 Flash | 1247 |
| Grok 4.5 | 1238 |
| GPT-5.6 Sol (XHigh) | 1232 |
| Muse Spark 1.1 | 1227 |
| Claude Opus 4.8 | 1222 |
| Claude Opus 4.7 | 1215 |
| GPT-5.6 Sol (Medium) | 1207 |
| MiniMax M3 | 1198 |
| Claude Sonnet 5 | 1188 |
| Claude Sonnet 4.6 | 1181 |
| K2.7 Code | 1172 |
| Gemini 3.5 Flash | 1169 |
| Grok 4.3 | 1145 |
| GPT-5.5 | 1143 |
| Gemini 3 Pro Preview | 1125 |
| GPT-5.6 Terra | 1124 |

**GPT 5.6 Sol 在 ZeroBench (With Tools) 以 54.6% 得分領先，Muse Spark 1.2 則以 54.0% 居次。**

**數據表**

| 項目 | 數值 |
| --- | --- |
| GPT 5.6 Sol | 54.6% |
| Muse Spark 1.2 | 54.0% |
| Opus 5 | 47.5% |
| Muse Spark 1.1 | 46.0% |
| Gemini 3.7 Flash | 30.0% |

## 標籤

功能更新, Benchmark, VLM, Meta
