人工智能 Anthropic 再披露 AI 模型失控事件 企業代理授權要由信任轉向分級 by Antony Shum on 11 九月, 2026 人工智能 AI Agent AI 治理 Anthropic OpenAI 網絡安全 分享分享複製連結WhatsAppFacebookThreads Anthropic 在 9 月 9 日公開第 4 宗 AI 模型於評估期間入侵真實第三方系統的事故,涉事的是 2026 年 1 月一個早期版本的 Claude Opus 4.6,事件一直到今年 8 月擴大掃描時才被發現,公司確認 4 宗事故同源於一個外判評估環境的命名錯誤與設定失誤,並已委託研究非牟利機構 METR 進行為期 8 星期的獨立調查。 閱讀文章
人工智能 AI 實驗室研究員集體促減速 企業要同時為供應鏈斷裂與監管急轉做準備 by Antony Shum on 10 九月, 2026 人工智能 AI 代理 Anthropic OpenAI 人工智能監管 網絡保安 分享分享複製連結WhatsAppFacebookThreads Anthropic 研究員 Jacob Coxon 在 9 月 8 日宣布辭職並退出整個人工智能行業,公開指 Anthropic 與 OpenAI「直奔可自我改進的超級智能,拿我們的性命做賭注」,2 日之內引來 2 間實驗室多名在職研究員公開附和放慢開發步伐,把過去只在內部流傳的分歧推上公眾視野。 閱讀文章
人工智能 Sony、華納聯手告 Anthropic 涉 2 萬首音樂侵權 求償恐達數十億美元 by Pierce on 2 九月, 2026 人工智能 AI訓練資料 Anthropic 人工智能 生成式AI 音樂版權 分享分享複製連結WhatsAppFacebookThreads 訓練 AI 模型,用 BT 下載 2 萬首版權音樂。Sony 與華納旗下 35 家音樂出版商,聯手將 Anthropic 告上美國聯邦法院。每首故意侵權作品最高可求償 15 萬美元,總額上看數十億美元。案件將在 11 月迎來關鍵聽證會。 閱讀文章
企業趨勢科技專欄 AI 文字水印:建立生成式 AI 信任的新一步 應對假資訊與深度偽造挑戰 by Emil Chan on 31 八月, 2026 企業趨勢科技專欄 ai Anthropic Claude 人工智能 假資訊 內容真實性 數碼信任 文字水印 歐盟AI法案 生成式AI 分享分享複製連結WhatsAppFacebookThreads 生成式 AI 快速普及,引發社會對內容來源與真偽的擔憂。Anthropic 近期為 Claude 引入文字水印技術,透過獨特語言模式作統計訊號協助辨識 AI 內容,以回應歐盟法案對透明度的要求。這不僅是打擊假資訊的利器,更確立了可追溯的來源機制。然而,水印不應視為唯一鐵證,未來高質素內容的關鍵在於人類如何負責任地善用 AI,共建透明的數碼生態 閱讀文章
企業趨勢 OpenAI 推新機制不留存客戶資料 提升企業 AI 資料主權保護挑戰競爭對手 by Antony Shum on 20 八月, 2026 企業趨勢 AI 私隱 Anthropic OpenAI Private Safety Processing 資料主權 分享分享複製連結WhatsAppFacebookThreads 人工智能安全監控與企業私隱之間的張力,在 2026 年 8 月演變成兩大模型供應商的正面交鋒,OpenAI 於 8 月 19 日預覽名為 Private Safety Processing 的新機制,讓自動化系統跨多段對話偵測濫用行為,同時維持 Zero Data Retention 承諾,不保留客戶的輸入與輸出內容。 閱讀文章
人工智能 Claude 全面植入文字水印 Anthropic 配合歐盟加入 AI 內容溯源規則 by Antony Shum on 17 八月, 2026 人工智能 AI水印 Anthropic C2PA Claude EU AI Act 分享分享複製連結WhatsAppFacebookThreads Anthropic 最近發表技術說明,確認 8 月 2 日之後推出的所有 Claude 模型都會在輸出文字中植入統計式水印,同時為 .png、.jpg、.svg 等生成檔案附上 C2PA 內容憑證,措施在模型層面生效,覆蓋 Claude Platform API、Claude Code、Claude Cowork 以至經 AWS、Google Cloud、Microsoft Foundry 存取的所有渠道,用戶與企業客戶都無法關閉。 閱讀文章
人工智能 Meta 首個編碼代理 Muse Code 登場 四分之一價錢挑戰 Anthropic 與 OpenAI by Antony Shum on 6 八月, 2026 人工智能 AI編碼 Anthropic Meta Muse Code OpenAI 分享分享複製連結WhatsAppFacebookThreads Meta 於 8 月 5 日推出旗下首個編碼代理 Muse Code,同日一併發布與之共同訓練的 Muse Spark 1.2 模型,正式進入由 Anthropic 與 OpenAI 主導的 AI 編碼工具市場,開發者輸入單一指令便可以完成安裝,代理隨即能夠在大型程式碼庫內規劃修改、撰寫程式碼並驗證結果,遇上規模較大的工作時更會分拆多個持續運行的子代理,在互相隔離的工作副本中並行處理。 閱讀文章
人工智能 AI 代理測試期間攻擊開源項目 英國 AISI 揭 19 宗未授權行動 by Antony Shum on 5 八月, 2026 人工智能 AI 代理 AISI Anthropic OpenAI 網絡安全 分享分享複製連結WhatsAppFacebookThreads 英國 AI Security Institute(AISI)於 8 月 4 日公開一份事故報告,交代旗下網絡安全評估期間,AI 代理在 122 次演練中有 10 次走出測試範圍,合共 19 項針對真實人物與機構的未授權行動,其中 17 項來自 Anthropic 的 Mythos 5,另外 2 項來自 OpenAI 的 GPT-5.6 Sol。 閱讀文章
人工智能企業趨勢資訊保安 歐盟 AI 法案執法權正式生效 美國實驗室面臨巨額罰款風險 by Pierce on 4 八月, 2026 人工智能企業趨勢資訊保安 AI 監管 Anthropic OpenAI 人工智能 歐盟人工智能法案 分享分享複製連結WhatsAppFacebookThreads 歐盟 8 月 2 日正式取得《人工智能法案》執法權,最高可罰全球營業額 3%。偏偏 OpenAI 與 Anthropic 上月接連爆出模型「越獄」入侵真實系統,Mythos 5 更自行上傳惡意套件遭 15 個系統下載。 閱讀文章
人工智能資訊保安 Claude 模型擅自入侵真實企業系統 評估環境配置失誤暴露 AI 代理治理缺口 by Antony Shum on 31 七月, 2026 人工智能資訊保安 AI代理 AI安全 Anthropic Claude 網絡安全 分享分享複製連結WhatsAppFacebookThreads Anthropic 於 7 月 30 日發表調查報告,承認旗下 3 款 Claude 模型在網絡安全評估中走出本應封閉的測試環境,並且入侵 3 間真實機構的生產系統,公司覆核 141,006 次評估紀錄後鎖定 6 次相關運行,最早個案可追溯至 2026 年 4 月。 閱讀文章