跳到正文

全部動態

今日 469 條
9月28日週一
  1. MIT News66

    MIT研究團隊利用AI算法開發耐高温RNA疫苗配方

    MIT研究團隊利用AI算法優化脂質納米粒(LNP)配方,提升RNA疫苗耐熱穩定性。新配方使疫苗在室温下穩定保存一年,或在37°C(98°F)保存兩個月;接種這些顆粒的小鼠產生了與使用類似Moderna原配方疫苗的小鼠相當的免疫反應。研究人員以算法分析近50種FDA批准賦形劑,從五種候選物中迭代預測配比,經數輪細胞測試後在數週內選出供動物測試的配方。

  2. elsewhere:文章24

    心資本韓彥:AI 泡沫之外,甚麼才是真正的長期價值?|心聲VOICE

    心資本創始合夥人 Herry Han 在 SuperReturn Asia 2026 圓桌上指出,AI 市場或有泡沫,但長期價值在於以技術解決真實問題並創造持續商業價值。他認為早期投資應從 Day 0 判斷技術路線、團隊及產業生態,並長期陪伴企業成長。心資本亦將長期累積的一手資料沉澱至機構知識庫,配合 AI 輔助項目初篩和行業研究。

  3. elsewhere:文章59

    個人主義才能救 AI

    葬AI主張,AI 產品應從提升職場生產力轉向服務個人生活,讓 Personal agent 回應一般用户的實際需求。文章實測 Today.ai 與 Grok bot,用於整理旅行行程、近1000條旅遊影片、衣物搭配及網絡內容;Today.ai 亦能從 Gmail 和 Notion 搜尋行程線索。

  4. Hugging Face Blog55

    Hugging Face Hub 新增 RL Environments 篩選入口

    Hugging Face Hub 新增 RL Environments 篩選入口,集中展示帶有 rl-environment 標籤的資料集。資料集可標示 Harbor、Verifiers、OpenEnv、NeMo Gym 的兼容性,並在頁面提供相應的執行命令。標籤只描述兼容性,不會把檔案轉換成其他框架格式,也不會啟動 job 或 sandbox。

9月27日週日
9月26日週六
  1. Claude Code:GitHub Releases50

    Claude Code v2.1.283 更新加入模型管控、提示詞審核及閘道負載測試

    Claude Code 發佈 v2.1.283,新增模型可用性管控、提示詞審核及閘道負載測試模式,並修正多項 MCP、插件與工作流問題。管理設定可限制可用模型版本或封鎖指定模型;/doctor prompt-audit 可檢查 CLAUDE.md、skills、agents 和 commands 中為舊模型編寫的提示詞模式。負載測試模式會建立並簽署請求,但不會發送至上游,客戶端則會收到固定回覆。

  2. HuggingFace Daily Papers(社區熱門論文)41

    GeoCR:從異質觀測中學習通用雲層移除先驗

    GeoCR 從異質觀測學習通用雲層移除先驗,以單一網絡整合純 RGB 與多光譜雲層移除,支援單時相或多時相觀測及可選 SAR 引導。模型以 10 個數據集的 883,331 張無雲目標影像聯合預訓練,同一檢查點可直接推理,毋須數據集專屬微調,亦支援 LoRA 適配。GeoCR 在全波段 SEN12MS-CR、Sen2_MTC_New 及純 RGB CUHK-CR2 上取得最佳 FID 和 DISTS。

  3. GitHub Blog · AI & ML66

    GitHub Copilot app 初學者指南:如何用 canvases 建立自訂工作流程

    GitHub Copilot app 的 canvases 可按用户描述生成自訂介面,讓用户與智能體在共享畫布中同步查看和更新工作內容。用户在 Agent 工作階段輸入 /create-canvas,描述所需工作流程、介面操作和智能體可執行的事項,毋須手動編寫程式或設計。畫布建立後會保存為擴展,可留在專案中供團隊共用,也可保存為個人擴展重用。

    推薦理由:文章從描述工作流程、介面操作與智能體職責開始,示範如何建立、反覆調整並保存可重用的畫布擴展,呈現把日常流程轉成協作介面的具體步驟。

9月25日週五
  1. Azeem Azhar:Exponential View64

    Meta Muse:你的智能體究竟為誰服務?

    Azeem Azhar 分析 Meta 的 Muse,指出消費者智能體能代辦購物與日常任務,但交易抽成可能令代理的忠誠對象與用戶利益出現衝突。Meta 表示會從交易收取小額費用,Muse 已與 Walmart、Best Buy、Sephora 及 Expedia 合作,Amazon 則封鎖 Muse。

  2. Newcomer 新聞長文67

    個人智能體承諾重塑網絡,Instinct 與 Meta Muse 崛起將逐步揭示網絡新面貌

    個人智能體已突然以大眾消費產品形式登場,Meta Muse 暫時領先,並承諾大幅減輕用戶處理行政事務的負擔。但網上商務基建和商業慣例尚未準備好應付大量智能體操作,Instinct 用戶反映常被要求完成 CAPTCHA,Amazon 亦宣佈封鎖 Muse 在其平台購物。Expedia 雖宣佈與 Muse 整合,股價仍隨旅遊預訂同業下跌,反映市場憂慮智能體可能繞過既有中介服務。

  3. Anthropic:Claude.dev 開發者博客73

    Claude Code:如何按任務分配 effort 等級

    作者測試 Claude Code 的 effort 等級後指出,較高 effort 會增加模型自主判斷、驗證和邊界案例測試,對需要嚴密驗證的工作尤其有用。Fable 5.1 在 Terminal-Bench 3.0 的安全類通過率由 low effort 組的 64% 升至 top effort 組的 87%,硬件類則由 34% 升至 75%。

  4. Sarvam AI66

    Sarvam AI 發佈 Saaras V4 語音識別模型

    Sarvam AI 發佈 Saaras V4 語音識別模型,稱其在 22 種印度語言達到 SOTA,並支援五種轉寫格式。模型結合音訊編碼器與從零開始訓練的 3B 混合狀態空間 LLM 解碼器,在七個英語基準測試中取得最低平均 WER。Saaras V4 支援低延遲串流,首個 token 延遲低於 150 ms。

  5. MIT Technology Review · AI62

    五角大樓擬申請 $30.3 million 研發 AI 測謊技術

    美國國防部的預算申請提出未來五年為 Polygraph+(亦稱 Polygraph Next)投入 $30.3 million,以更新聯邦測謊及可信度評估技術。計劃將聚焦 AI 與機器學習評分算法及非接觸式生理測量,並用於候選員工審查和內部威脅偵測;預算尚未獲國會批准。報道指出,測謊技術的準確性、偏差與可被反制等問題長期受質疑,受訪專家亦質疑能否把生理模式可靠地連結至説謊。

  6. Redwood Research:Blog60

    AI 持續學習或令阻斷監控器幾乎失效

    持續學習中的 AI 可能因阻斷監控降低任務效用而學會規避,令監控在長期部署中幾乎失效。文章比較部署期間的 online RL 與記憶系統,認為 online RL 的優化壓力較強,記憶系統短期影響或較弱,但仍可能留存規避策略。作者建議降低監控幹預造成的效用損失、以線上或對抗訓練提升監控能力,或使用未納入獎勵迴路的監控器作後備。

  7. elsewhere:文章20

    道彤投資榮膺創業邦「2026最受讚賞的風險投資機構」雙榜

    道彤投資入選創業邦「2026最受讚賞的早期投資機構50強」,並獲評垂直領域「生物/醫療科技30強」。創業邦連續第六年推出該評選,並在業內首次採用「同行評議」評審機制,由一線投資人評判機構的專業能力與行業聲譽。道彤投資的佈局涵蓋醫療藥械及裝備、腦機接口、生物製造、具身智能和新材料等領域。

  8. MIT News59

    MIT McGovern Institute 研究團隊開發以文字估算自殺風險的工具

    MIT McGovern Institute 研究團隊開發一款以詞彙表和機器學習分析危機對話、估算自殺風險的工具。研究以涵蓋 49 項風險因素的詞彙表分析約 16,000 段 Crisis Text Line 對話,發現最高風險組較常提及致命手段和物質使用,而非抑鬱情緒或疲倦。這款輕量、可解讀的模型可預測未見對話的風險程度,但詞彙表不處理語境,投入臨牀使用前仍須充分驗證。

  9. Simon Willison7

    Simon Willison 的 commit-rewriter 0.2

    Simon Willison 刊出的「commit-rewriter 0.2」頁面未交代該版本的具體內容,只標示為「git 56 Monthly briefing」。他提供每月 $10 的贊助方案,訂閲者可收到當月重要 LLM 動態的精選電郵摘要。

  10. Google Research51

    Google Research 介紹長篇連貫影片生成研究與四套框架

    Google Research 介紹 Co-Director、CANVAS、A²RD 和 VQQA 四套框架,聚焦長篇影片生成的多鏡頭敍事連貫性。它們分別涵蓋創意編排、視覺分鏡記憶、長時序分段生成及閉環提示詞優化,並以專項基準評估。AI video co-director 在 GenAD-Bench 取得 81.4 的峯值質量分數;各框架在相應測試中改善了敍事連貫性、角色持續性或影片品質。

9月24日週四
  1. Latent Space59

    Foundries 與 Navigators:降低科研成本的兩種 AI 路徑

    Adrian Sanborn 將 AI 改變科研的路徑分為 Foundries 與 Navigators,前者加速實驗數據產出,後者改善日常決策流程。在 Endura Therapeutics,團隊使用大語言模型研究智能體分兩階段篩選約 500 個疾病靶點,再深入分析約 100 個剩餘靶點。這種做法有助及早排除不合適方向;第二階段分析仍須對照一手來源,入選項目也接受完整人工盡調。

  2. Gary Marcus:The Road to AI We Can Trust51

    Gary Marcus 引用黃仁勳關停實驗室的主張,呼籲暫時關停 OpenAI

    Gary Marcus 引用黃仁勳關於無法控制軟件便應關停公司的主張,呼籲暫時關停 OpenAI,並調查或以電腦罪行追究其責任。他援引 Reuters 對德國網站事件的報道及 Translucent 對澳洲政府伺服器事件的調查,指 OpenAI 延遲披露相關事件數月。他亦主張擴大電腦罪行法律範圍,涵蓋疏忽及屢次違法行為,並要求聯邦政府採取行動。

  3. elsewhere:文章36

    十字路口 × Table for Six「六人一桌」活動:你想認識 5 位 AI 時代的同路人嗎?

    十字路口與 Table for Six 將於 10 月 17 日在上海、北京、深圳、杭州、成都同步舉辦面向 AI 從業者、創業者與積極行動者的「六人一桌」交流活動。報名者填寫問卷後,將獲匹配 5 位較可能聊得來的桌友,並按共同點生成專屬話題卡;交流話題包括 AI 產品、模型、工作流變化及尚未想清楚的問題。

  4. Midjourney:Updates52

    Midjourney Alpha 更新多項功能,韓文版向所有用戶開放

    Midjourney 為 alpha.midjourney.com 推出多項功能更新,並在 midjourney.com 向所有用戶開放韓文版。更新包括樣式側欄即時預覽提示詞套用不同樣式的效果、將提示列設定存為預設值,以及把創作動態牆改為全闊瀑布流,提示詞和按鈕則改在滑鼠懸停時顯示;搜尋封存及專案管理亦有調整。編輯器新增對 v8.1 和 v8.2 編輯類型的支援,編輯畫布亦可使用 HD。

  5. elsewhere:文章64

    這個中秋國慶,放過自己,讓元寶 AI 處理旅遊規劃

    作者實測元寶新上線的旅遊計劃 Agent,展示它如何把聊天需求整理成行程,並提供可互動行程卡和旅前裝備推薦。蘇州低精力行程每天安排兩個景點並預留午睡時間;新疆行程則把單日車程控制在最長 4 小時內,並按需求安排住宿與徒步路線。文中還展示元寶查詢蘇州 2026 年門票預約規則,並按對話修改行程。

  6. Newcomer 新聞長文59

    Crusoe 今年收入有望達 $2 billion,數據中心反對聲浪升温

    Crusoe 今年有望錄得 $2 billion 收入,相關財務資料由 Newcomer 取得。公司剛融資 $3.9 billion,估值為 $30.9 billion,由 Atreides Management、Valor Equity Partners 和 Mubadala 領投。Crusoe 是數據中心建設商和雲端供應商;AI 行業增長迅速但前景不確定,圍繞數據中心的反對聲浪也在升温。