国精产品一区一区三区mba下载,国产免费av一区二区三区,国产三级片在线观看,国产免费内射又粗又爽密桃视频,国产精品综合一区二区三区

當前位置:主頁 > 聚焦 > 正文
OpenAI阻止網絡爬蟲抓取數據,避免數據被用于訓練AI模型
來源:驅動中國作者:洞察網2023-08-08 18:09:28


【資料圖】

驅動中國2023年8月8日消息,據悉,OpenAI 旗下 GPT 模型的訓練需要大量的網絡數據,這可能涉及到數據隱私和版權等問題。為了解決這些問題,OpenAI 最近推出了一個新功能,讓網站可以阻止其網絡爬蟲(web crawler)從其網站上抓取數據訓練 GPT 模型。

網絡爬蟲是一種自動化的程序,可以在互聯網上搜索和獲取信息。OpenAI 的網絡爬蟲名為 GPTBot,其會以一定的頻率訪問各種網站,并將網頁內容保存下來,用于訓練 GPT 模型。

OpenAI 在其博客文章中表示,網站運營者可以通過在其網站的 Robots.txt 文件中禁止 GPTBot 的訪問,或者通過屏蔽其 IP 地址,來阻止 GPTBot 從其網站上抓取數據。OpenAI 還表示,“使用 GPTBot 用戶代理(user agent)抓取的網頁可能會被用于改進未來的模型,并且會過濾掉那些需要付費訪問、已知收集個人身份信息(PII)、或者有違反我們政策的文本的來源?!睂τ诓环吓懦龢藴实膩碓?,“允許 GPTBot 訪問您的網站可以幫助 AI 模型變得更加準確,并提高它們的通用能力和安全性?!?/p>

[責任編輯:linlin]

標簽:

相關文章

評論排行
熱門話題
最近更新