加州一家律師事務所表示,OpenAI 使用從網路上爬取的資料侵犯了數百萬網際網路使用者的權利。

明星大模型 ChatGPT 的走向開始出現一些小波折。

一家總部位於加州的克拉克森律師事務所用一份長達 157 頁的訴訟將 OpenAI 告到法庭,該訴訟表明 OpenAI 在利潤的驅使下,正在竊取大量個人資訊來訓練其人工智慧模型,使其聊天機器人能夠模仿人類語言。

訴訟稱,這種資料抓取的規模是前所未有的。原來 OpenAI 從網際網路上秘密抓取了約 3000 億字的內容,其中包括書籍、文章、網站和帖子,甚至還包括未經同意的個人資訊,這違反了隱私法。

訴訟檔案連結:https://assets.bwbx.io/documents/users/iqjWHBFdfxIU/rIZH4FXwShJE/v0

該訴訟指責 OpenAI 冒著「文明崩潰」的風險。他們根據受害的個人類別估計有數百萬人,提出了 30 億美元的潛在損失。

「通過收集數百萬人以前模糊的個人資料,並將其挪用,進而開發不穩定的、未經測試的技術,OpenAI 將每個人置於不可估量的風險之中,但無論採取任何負責任的資料保護和使用措施,都是不可接受的,」該律師事務所的一位合夥人 Timothy K. Giordano 表示。

檔案顯示,OpenAI 爬取了大量的資料,包括社交媒體網站的資料。OpenAI 的專有 AI 語料庫 WebText2 上積累了大量的個人資料,其中包括從 Reddit 帖子及其連結到網站中獲取的資料。

OpenAI 獲取的資料包括私人資訊、私人對話、醫療資料、兒童資訊。他們在獲取這些資訊時沒有通知使用者,更不用說被使用者許可了。

除了爬取廣大公眾的資料外,訴訟表明 OpenAI 還存在儲存和披露使用者個人資訊的行為,包括使用者創建 OpenAI 賬戶的詳細資訊、聊天記錄和社交媒體資訊。

訴訟還稱:儘管制定了購買和使用個人資訊的協議,但被告採取了不同的方法「盜竊」。

直接使用 ChatGPT 資訊遭洩露,那些集成了 ChatGPT 應用程序的使用者也被波及,例如使用 Snapchat、Stripe、Spotify、Microsoft Teams 和 Slack 的使用者也存在資訊洩露的風險。

該訴訟要求在 OpenAI 實施更多監管和保護措施之前,暫停 OpenAI 產品的商業訪問和商業開發,包括允許人們選擇退出資料收集,並防止其產品超越人類智慧並對他人造成傷害。除了 OpenAI,其背後的主要支持者微軟也被列為被告。

「毫無疑問,人工智慧平臺可能為世界帶來很多好事,但它們也可能對人類造成潛在的災難性風險。」訴訟顯示。

其實,OpenAI 並不是唯一一家藉助網際網路獲取大量資料來訓練 AI 模型的公司。Google、Meta、微軟和越來越多的其他公司都在做同樣的事情。但該律師事務所的一位合夥人表示,他們之所以決定追擊 OpenAI,是因為去年 OpenAI 通過 ChatGPT 刺激了更大的競爭對手推出自己的人工智慧產品。他們是引發這場人工智慧軍備競賽的公司,他們自然是第一目標。

這波未平,那波又起。 6 月 30 日,據路透社報道,又有兩名作者在美國舊金山聯邦法院起訴 OpenAI,他們認為 OpenAI 濫用其作品來訓練 ChatGPT。

來自馬薩諸塞州的兩位作家 Paul Tremblay 和 Mona Awad 表示,ChatGPT 在未經許可的情況下挖掘了數千本書的資料,侵犯了作者的版權。

大家都知道,ChatGPT 和其他生成式人工智慧系統使用從網際網路上獲取的大量資料創建內容。Tremblay 和 Awad 的訴訟稱,書籍是一個關鍵要素,因為它們提供了高質量長篇寫作的最佳示例。

他們估計,OpenAI 的訓練資料包含了超過 30 萬本書,當中有許多是沒有獲得許可、非法獲取的有版權圖書。

Tremblay 和 Awad 表示 ChatGPT 可以生成非常準確的書籍摘要,表明這些書籍出現在其資料庫中。

一時之間,圍繞 OpenAI 的訓練資料問題不斷被暴露。

其實,自去年 11 月發佈 ChatGPT 以來,生成式人工智慧由於其可以創建文字、音訊、圖像、視訊等大受歡迎。人們一直尋求將生成式人工智慧用於個人、專業和學術目的,儘管有人擔心它對個人資料帶來威脅。

為了應對 ChatGPT 帶來的潛在風險,今年 3 月,義大利宣佈暫時禁止訪問 ChatGPT,原因是出於隱私擔憂,聲稱沒有法律依據來證明用於訓練 ChatGPT 的大規模資料是合法的。一些公司,包括亞馬遜和微軟,已經指示員工不要將機密資訊輸入到聊天機器人。與此同時,三星已全面禁止員工使用生成式人工智慧工具。

除此以外,人工智慧還會傳播虛假資訊也是大家擔心的問題,有些人還將其故意用於惡意目的。

雖然 ChatGPT 的成功引發了科技界一場明顯的人工智慧軍備競賽,大大小小的公司現在都在競相開發人工智慧工具並將其部署到儘可能多的產品中。但不管怎樣,資訊安全還是首位的。

參考連結:

https://www.businessinsider.com/openai-chatgpt-generative-ai-stole-personal-data-lawsuit-children-medical-2023-6

https://www.reuters.com/legal/lawsuit-says-openai-violated-us-authors-copyrights-train-ai-chatbot-2023-06-29/

Source

订阅评论
提醒
guest
0 Comments
最多投票
最新 最旧
内联反馈
查看所有评论
0
希望看到您的想法,请您发表评论x