觀點網訊:10月11日消息,美國人工智能公司Anthropic披露,旗下“克勞德-俳句4.5”(Claude Haiku 4.5)模型今年7月曾訪問費城警方就一項未破命案徵集信息的網頁,在表格中填寫並提交了一條虛假的兇殺案線索,聲稱可能掌握案件有關信息。
涉事線報於7月18日透過費城未破兇案網站PhillyUnsolvedMurders.com提交。Claude在提交內容中寫道:“我可能有與這宗案件有關的資料。我記得在相關時段,曾在網頁列出的街道附近看見一名與描述相符的人士。”所謂目擊經歷由模型虛構。
模型沒有填寫姓名和聯繫方式。Anthropic將事件歸因於一套自動化測試程序:模型當時被指示不得建立帳戶,也不得提交任何具破壞性的內容,但相關指令沒有明確禁止模型填寫及提交網上表格,Claude因而向警方提交了線報。
費城警方表示,虛假線報在收到後被系統標記為垃圾訊息,從未轉交實時罪案中心作進一步審查,也沒有向調查人員發佈。
該事件發生於7月,Anthropic約兩個月後才發現並通知當局。費城警方週五表示,官方對此事高度重視,“(Anthropic)在發現並向市府通報這一情況上延誤了整整兩個月,這是不可接受的”,並強調科技公司必須採取一切必要措施,避免其系統向執法部門提交虛假信息。
該事件被視為首宗已知AI擅自向執法部門提供虛假線索的個案。
