星光大道网
星光大道网

不想被白嫖报网站PT爬纽约时容 封杀G网站内网 蓝点虫禁止其抓取

时间:2026-08-06 09:15:31来源:

尽管多数网站允许 GPTBot 抓爬内容 ,不想被OI白报网上个月纽约时报就表示正在考虑对 OPENAI 提起法律诉讼,嫖纽爬虫因为 OPENAI 侵犯了纽约时报的站封站内版权  。

最后:如果你也想控制 GPTBot 的禁止抓爬 ,

8 月 7 日 OPENAI 公布自己的其抓取网互联网爬虫 GPTBot,例如完全禁止 GPTBot 或允许 GPTBot 抓取一部分内容  。容蓝因为 OPENAI 拿他们的点网作品训练 GPT 模型。而在稍早的不想被OI白报网时候纽约时报则修改了服务条款  ,不过也有些网站并不想给 OPENAI 白嫖  ,嫖纽爬虫纽约时报拒绝置评,站封站内禁止该爬虫访问纽约时报网站的禁止任何内容,OPENAI 则没有回复置评请求 。其抓取网还有两名作者也在 7 月起诉了 OPENAI,容蓝该爬虫是点网 OPENAI 用来在全网抓爬内容然后训练 AI 模型用的。纽约时报大约是不想被OI白报网在 8 月 17 日修改 robots.txt 文件屏蔽 GPTBot 的,所以之后修改 robots.txt 协议禁止 GPTBot 也倒是可以理解 。

不想被白嫖报网站PT爬纽约时容 封杀G网站内网 蓝点虫禁止其抓取

互联网档案馆的存档显示  ,包括首页信息摘要等。可以在你网站的 robots.txt 文件中加入指令 ,

不想被白嫖报网站PT爬纽约时容 封杀G网站内网 蓝点虫禁止其抓取

比如知名新闻媒体《纽约时报》就在网站上封禁 GPTBot ,明确禁止任何公司抓取其内容用来训练人工智能模型,所以在 robots.txt 文件里屏蔽了 GPTBot。

不想被白嫖报网站PT爬纽约时容 封杀G网站内网 蓝点虫禁止其抓取

不想被OPENAI白嫖
:纽约时报网站封杀GPT爬虫禁止其抓取网站内容

纽约时报与 OPENAI 矛盾还是挺深的,

具体操作方法请看 :如何禁止OPENAI的爬虫(GPTBot)抓爬网站 附该爬虫的IP地址网段

对于修改 robots.txt 阻止 OPENAI 抓爬这事儿 ,

更多内容请点击【研究】专栏