分享這篇:

影片總結

OpenAI GPT-5.6 與 Grok-4.5 帶動模型競賽,主持人認為數位工作型 AGI 可能一至兩年內到來。

OpenAI、SpaceXAI 與 Meta 在兩天內接連推出 GPT-5.6、Grok-4.5、Muse Spark 1.1。主持人最看好 GPT-5.6:它在工作任務與程式生成上勝過多數模型,還用 16 分鐘做出能玩的《皇室戰爭》遊戲;他認為 ChatGPT Work 的工具與檢查流程也助攻不少。Grok-4.5 則以約三分之一的 Opus 4.7 成本取得相近水準,Muse Spark 雖讓 Meta 追近 Google,工具使用與產品配套仍有差距。綜合排名中,GPT-5.6 與 Fable 5 位居第一級,Grok-4.5 和 Opus 4.8 居次。最後主持人提出,現有模型已具備完成六至八成數位工作的能力,瓶頸在算力成本、工具與 Harness;若成本持續下降,數位 AGI 可能一至兩年內出現,但高階目標設定與品質判斷仍需人類。

章節

  1. 0:00幣安:7,000 支美股與 ETF、代幣化證券及約 3% 卡片回饋
  2. 2:17最近生活:氛圍學院預計一個月內上線,衝刺期還遇上世足與 MSI
  3. 3:37本集內容:兩週四款新模型登場,聚焦排名與 Digital AGI
  4. 5:43GPT-5.6:Sol Max 指數得 59 分,僅次於 Fable 5 的 60 分
  5. 10:43GPT-5.6 體感:Sol 略輸 Fable 5,Max 測試額度幾乎燒光
  6. 13:02GPT-5.6 工作:ChatGPT Work 搬移四十多筆行事曆且正確避開重複項目
  7. 18:26GPT-5.6 Coding:16 分鐘做出會用箭雨與迷你皮卡反制的皇室戰爭遊戲
  8. 23:39GPT-5.6 CP 值:每題約 15,000 Token,低於 Fable 5 的 33,000 Token
  9. 28:09Anthropic 慌了:算力短缺與 AI 風險溝通爭議,面臨 GPT-5.6 搶用戶
  10. 32:45ChatGPT 語音:更新為可打斷的邊聽邊講模式,支援即時翻譯
  11. 35:42Grok-4.5:1.5 兆參數、成本約 Opus 4.7 三分之一
  12. 43:24Muse Spark 1.1:追近 Google,但同成本不及 GPT-5.6 Luna
  13. 45:44Meta 的 AI 實力:Manus 收購撤銷之際,部署 3,000 人 RL 團隊
  14. 52:05Meta 的 AI 實力:2026 年預計部署 7GW,研究文化仍待驗證
  15. 58:31綜合模型排名:GPT-5.6、Fable 5 居 Tier 1,Grok-4.5 勝在性價比
  16. 1:00:22什麼時候有 AGI?主持人認為現有模型已具 60% 至 80% 數位工作能力
  17. 1:05:51什麼時候有 AGI?GPT-5.6 Sales Kit 案例與 Agent 速度瓶頸
  18. 1:10:13什麼時候有 AGI?Token 降本後一年半至兩年可能達成數位 AGI

這是 Tier 1 公開摘要

每章重點、段落總結、心智圖由分享者控制是否公開。想看完整分析?自己提交一支。

同頻道的其他分析

相關主題的分析