Google 旗下雲端保安公司 Wiz 本週四聯同 Google DeepMind 正式推出 Scan for Good 計劃,以網絡保安專用模型 Gemini 3.8 Flash Cyber 及自動滲透測試代理 Red Agent,在獲授權的前提下掃描醫院、市政機構、鐵路營運商及非牟利組織的對外系統,找出攻擊路徑後由人類研究員核實及通報。
Microsoft Research 最新發表的論文《LLMs Corrupt Your Documents When You Delegate》揭示一個令企業決策層必須正視的事實,即使是市面上最頂尖的大型語言模型(LLM)在處理長時間及多步驟的檔案編輯工作時平均會默默損壞 25% 的檔案內容,而所有受測模型的平均檔案劣化幅度更高達 50% 。