Share:

Video summary

主持人實測 GPT-6 Astra,16 分鐘重建 DGX Spark,機器人手臂測試拿下 95 分。

OpenAI 發表 GPT-6 Astra 後,主持人實測認為它是目前最聰明的模型,並指出預訓練規模擴大,可能代表 OpenAI 解決了過去的訓練問題。Astra 的 3D 能力尤為突出:僅憑 DGX Spark 多角度照片,16 分鐘便在 Blender 重建出近乎一致的模型;主持人也讓它製作可遊玩的 3D 市集。機器人手臂測試中,Astra 得 95 分,遠高於 Fable 的 40 分;電腦操作、資安與 ARC-AGI-3 評測也有大幅進展。不過,主持人認為它的 UI 設計品味與簡報表現仍不理想,知識工作能力也未見明顯提升。節目最後提醒,模型能力進步後,舊有 Skills 和 Prompt 可能反而拖累表現,應重新檢視,先讓模型自行找方法完成工作。

Chapters

  1. 0:00NordVPN:支援 10 台裝置、兩年方案加贈 4 個月
  2. 2:15Astra 多次帶來 AGI 感,主持人認為數位 AGI 已近一步
  3. 7:15Astra 首次擴大預訓練,OpenAI 承認過去兩年曾遇瓶頸
  4. 11:35Astra 傳聞耗資 10 億美元訓練,Plus 用戶可從 Work 使用
  5. 16:53Astra 能力總覽:3D、電腦操作與 ARC-AGI-3 表現突出
  6. 19:06Astra 3D 建模示範:一週生成曼哈頓,並重建 DGX Spark
  7. 24:46Astra 16 分鐘重建 DGX Spark,額度僅用約 1% 至 2%
  8. 30:23Robocurve 測試:Astra 手臂任務 95 分,Fable 5.1 得 40 分
  9. 35:02電腦使用:Astra 四分鐘完整 QA 氛圍學院互動單元
  10. 41:19電腦使用的意義:Astra 可操作舊系統,銜接企業 MCP 轉型
  11. 47:02Coding 能力:Astra 做出最佳皇室戰爭遊戲,但 UI/UX 品味普通
  12. 50:54知識工作能力:三十站台北行程與 OpenStreetMap 路徑圖
  13. 56:47資安能力:Astra 新漏洞 ExploitBench 得 39 分,遠勝 GPT-5.6 Sol
  14. 59:25通用智能:Astra 在 ARC-AGI-3 得 99.9 分,標準 Harness 得 62 分
  15. 1:03:14Skills 要過時了:Astra 不用 Blender Skills 也能重建物件
  16. 1:07:05Skills 要過時了:模型逐步內化流程,Prompt 回歸定義工作

This is a Tier 1 public summary

Whether the chapter key points, section summaries and mind map are public is up to the person who shared it. Want the full analysis?Submit one yourself.

More from this channel

Related analyses