Import AI 第 474 期:柏拉圖式心智空間、Google 籌備將 TPU 送入太空、智譜啟動外層 RSI 循環
Import AI 第 474 期聚焦柏拉圖式心智假説、Google 籌備將 TPU 送入太空及智譜以 GLM-5.3 加速自身推理基建。機械人研究者指出,領域仍欠缺可擴展的通用後訓練配方;他們介紹的 EXPO(-FT) 仍在早期發展,未廣泛使用。
Import AI 第 474 期聚焦柏拉圖式心智假説、Google 籌備將 TPU 送入太空及智譜以 GLM-5.3 加速自身推理基建。機械人研究者指出,領域仍欠缺可擴展的通用後訓練配方;他們介紹的 EXPO(-FT) 仍在早期發展,未廣泛使用。
YC 2026 夏季批次的 236 家公司中,91% 與 AI 相關,創業方向由應用層轉向模型以下的基礎設施及實體世界。與春季批次相比,模型以下公司佔比由 8% 升至 20%,應用層由 55% 降至 39%;推出自主 Agent 的公司比例由 45% 降至 33%。夏季批次有 45 家公司交付實體硬件,為春季批次的兩倍;另有 21 家公司投入算力建設。
蘇度、螞蟻靈波、自變量與破殼的四位代表,在「2026 Inclusion 外灘大會」圓桌上討論具身智能的路線分歧與商業化。討論聚焦仿真與真機數據、GPT-6 Astra 對具身行業的衝擊,以及高成功率、泛化性和客户持續付費等商業化指標。
多家機械人初創公司正嘗試透過記錄人類動作、聘人操作機械人等方式,增加機械人訓練數據。目前最大型的公開機械人任務數據集 ABC-130K 只有 3,500 小時示範;模擬訓練有助步行等任務,但複雜操作受到模擬與現實差距限制。另有公司讓人類佩戴手套或外骨骼完成日常工作,以收集更豐富的動作數據。
文章將具身智能機械人訓練數據分為人類數據與機械人數據,前者包括網絡及第一身視角影片、UMI 和動作捕捉,後者包括遙操作及模擬生成數據。YouTube 每日上載逾 720,000 小時影片,Open X-Embodiment Dataset 則有 1,150 至 2,000 小時實際機械人操作數據;但網絡影片欠缺力、扭矩等物理訊號,也面對人與機械人身體形態不同造成的轉移障礙。
Google 在 2023 年宣佈 RT-2,將多模態大語言模型訓練成可直接生成機械人動作的 VLA 模型,帶動以此架構為基礎的機械人研究熱潮。文章梳理 Physical Intelligence 等團隊以動作分段、強化學習、記憶和視覺推理改善機械人操作與複雜任務能力,並探討 VLA 與世界模型的關係。
人形機械人雖在舞蹈和跑步等示範中取得進展,但物件操作、任務泛化、長時間工作及安全部署仍有多重障礙,短期內難以追上人類工作者。Physical Intelligence 示範完成 15 項操作挑戰中的 10 項,但機械人完成大部分任務所需時間是人類的 4 至 10 倍,成功率為 52%。