Share:

Video summary

OpenAI GPT-5.6 與 Grok-4.5 帶動模型競賽,主持人認為數位工作型 AGI 可能一至兩年內到來。

OpenAI、SpaceXAI 與 Meta 在兩天內接連推出 GPT-5.6、Grok-4.5、Muse Spark 1.1。主持人最看好 GPT-5.6:它在工作任務與程式生成上勝過多數模型,還用 16 分鐘做出能玩的《皇室戰爭》遊戲;他認為 ChatGPT Work 的工具與檢查流程也助攻不少。Grok-4.5 則以約三分之一的 Opus 4.7 成本取得相近水準,Muse Spark 雖讓 Meta 追近 Google,工具使用與產品配套仍有差距。綜合排名中,GPT-5.6 與 Fable 5 位居第一級,Grok-4.5 和 Opus 4.8 居次。最後主持人提出,現有模型已具備完成六至八成數位工作的能力,瓶頸在算力成本、工具與 Harness;若成本持續下降,數位 AGI 可能一至兩年內出現,但高階目標設定與品質判斷仍需人類。

Chapters

  1. 0:00幣安:7,000 支美股與 ETF、代幣化證券及約 3% 卡片回饋
  2. 2:17最近生活:氛圍學院預計一個月內上線,衝刺期還遇上世足與 MSI
  3. 3:37本集內容:兩週四款新模型登場,聚焦排名與 Digital AGI
  4. 5:43GPT-5.6:Sol Max 指數得 59 分,僅次於 Fable 5 的 60 分
  5. 10:43GPT-5.6 體感:Sol 略輸 Fable 5,Max 測試額度幾乎燒光
  6. 13:02GPT-5.6 工作:ChatGPT Work 搬移四十多筆行事曆且正確避開重複項目
  7. 18:26GPT-5.6 Coding:16 分鐘做出會用箭雨與迷你皮卡反制的皇室戰爭遊戲
  8. 23:39GPT-5.6 CP 值:每題約 15,000 Token,低於 Fable 5 的 33,000 Token
  9. 28:09Anthropic 慌了:算力短缺與 AI 風險溝通爭議,面臨 GPT-5.6 搶用戶
  10. 32:45ChatGPT 語音:更新為可打斷的邊聽邊講模式,支援即時翻譯
  11. 35:42Grok-4.5:1.5 兆參數、成本約 Opus 4.7 三分之一
  12. 43:24Muse Spark 1.1:追近 Google,但同成本不及 GPT-5.6 Luna
  13. 45:44Meta 的 AI 實力:Manus 收購撤銷之際,部署 3,000 人 RL 團隊
  14. 52:05Meta 的 AI 實力:2026 年預計部署 7GW,研究文化仍待驗證
  15. 58:31綜合模型排名:GPT-5.6、Fable 5 居 Tier 1,Grok-4.5 勝在性價比
  16. 1:00:22什麼時候有 AGI?主持人認為現有模型已具 60% 至 80% 數位工作能力
  17. 1:05:51什麼時候有 AGI?GPT-5.6 Sales Kit 案例與 Agent 速度瓶頸
  18. 1:10:13什麼時候有 AGI?Token 降本後一年半至兩年可能達成數位 AGI

This is a Tier 1 public summary

Whether the chapter key points, section summaries and mind map are public is up to the person who shared it. Want the full analysis?Submit one yourself.

More from this channel

Related analyses