Perplexity被曝偷偷抓取禁网站内容 Cloudflare揭露规避手段 - 微新创想

2025-08-05 10:27:44 AI动态 109 次阅读

根据互联网基础设施提供商 Cloudflare 发布的最新研究报告，人工智能初创公司 Perplexity 在抓取网站内容时被指控无视明确的阻止指令。Cloudflare 指出，他们发现 Perplexity 在尝试抓取网页时会隐藏自身身份，以此规避网站的访问偏好设置。图源备注：图片由AI生成，图片授权服务商Midjourney

Perplexity 等人工智能产品通常依赖于从互联网收集海量数据来支持其功能，但这些初创公司长期以来在未获许可的情况下抓取文本、图像和视频。近年来，许多网站通过部署标准的 Robots.txt 文件来应对这一问题，该文件明确指示搜索引擎和AI公司哪些页面可被索引，哪些页面需被禁止。然而，这些措施的实际效果并不理想。Cloudflare 的分析显示，Perplexity 似乎通过修改其机器人的“用户代理”来规避这些限制。所谓“用户代理”，是指用于识别网站访问者设备类型和版本的信息信号。此外，Cloudflare 还观察到 Perplexity 更改了其自治系统网络（ASN），这一数字标识用于识别互联网上的大型网络。通过对数万个域名和数百万个请求的分析，Cloudflare 凭借机器学习和网络信号监测技术成功识别了这一爬虫行为。

Perplexity 发言人 Jesse Dwyer 对 Cloudflare 的指控提出反驳，称其博客文章为“带有商业目的的宣传”。他补充表示，文中截图并未显示实际访问内容。他还进一步声明，Cloudflare 提及的爬虫并非 Perplexity 所属。Cloudflare 表示，他们最初注意到这些问题的原因是客户投诉 Perplexity 仍持续抓取其网站内容，尽管这些网站已通过 Robots 文件明确禁止该爬虫访问。Cloudflare 的深入分析表明，Perplexity 不仅使用了其声明的用户代理，在被阻止时还会伪装成模拟 Google Chrome 的通用浏览器。最终，Cloudflare 决定将 Perplexity 的爬虫从其验证列表中移除，并部署新技术来阻止其抓取活动。

值得注意的是，Cloudflare 近期对人工智能爬虫表达了强烈反对，并推出了一个创新市场，允许网站所有者向访问其网站的AI爬虫收取费用，以此保护网站内容。Cloudflare 首席执行官马修·普林斯曾公开警告，人工智能正在破坏互联网的商业模式，特别是对出版商的盈利模式造成冲击。这并非 Perplexity 首次面临未经授权抓取的指控，去年《连线》杂志等媒体就曾指控 Perplexity 抄袭其原创内容。

划重点：? Cloudflare 指控 Perplexity 在抓取内容时忽视网站的阻止指令
? Perplexity 通过更改用户代理和网络标识试图绕过网站保护措施
? Cloudflare 推出市场允许网站向 AI 爬虫收费，以保护网站内容

2026年01月14日

02:03

阿斯利康GLP-1减肥药二期数据发布时间及市场影响

2026年1月14日，阿斯利康首席财务官在重要会议上透露，备受瞩目的GLP-1减肥药第二阶段临床试验数据预计将在今年内正式公布。这款处于研发关键节点的创新药物，有望成为阿斯利康在代谢疾病治疗领域的重要布局，进一步巩固其在该领域的领先地位。虽然具体发布时间尚未确定，但市场普遍预期这一关键数据的公布将对后续研发进程及市场预期产生深远影响。阿斯利康方面表示，将继续...

02:03

福特宣布增岗生产汽油卡车响应国内燃油车需求

2026年1月14日，美国白宫新闻秘书卡罗琳·莱维特在一场备受瞩目的新闻发布会上宣布了一项重大经济举措。根据她的声明，福特汽车公司将在当日正式宣布一项新增工作岗位计划，并重启汽油动力卡车的生产。这一决策背后，是美国政府对传统燃油车型持续强劲市场需求的高度重视，同时也是对加强本土制造业就业的坚定承诺。白宫方面表示，此举旨在通过振兴传统汽车产业，为美国工人创造更...

01:03

波音2025年交付600架飞机 737型号占大头产能稳步恢复

2025年，波音公司凭借不懈努力，成功交付了600架飞机，这一数字不仅彰显了其生产实力的稳步回升，更成为航空业复苏的重要里程碑。在众多机型中，737系列表现尤为突出，全年交付量高达447架，占据了总交付量的绝大部分，充分证明了该机型在全球市场依然保持着强大的竞争力。这一亮眼成绩的背后，是波音公司多年来的持续投入与艰难转型。面对过去生产瓶颈与安全事件带来的重重...

00:32

甘肃河西多地现沙尘暴

1月13日夜间，甘肃河西多地出现沙尘天气，局地发生沙尘暴。受西北气流中强风速下传影响，武威市民勤县出现明显沙尘暴，能见度显著下降。甘肃省气象局已监测到相关天气过程，提醒公众减少外出，注意防护。此次沙尘天气对交通和空气质量造成一定影响。

00:32

容百科技收上交所问询函要求披露宁德时代1200亿采购协议细节

2026年1月14日，容百科技收到上交所问询函，被要求核实并补充披露与宁德时代签署的超1200亿元磷酸铁锂正极材料采购协议相关事项。根据公告，双方协议自2026年第一季度起至2031年，容百科技将向宁德时代供应约305万吨磷酸铁锂正极材料。问询函要求公司说明现有产能与协议产量差异较大的情况下，是否具备履约能力，并补充披露产能建设、年度交付计划、价格调整机制...

00:32

Meta裁员超千人聚焦AI可穿戴设备

2026年1月13日，Meta启动新一轮裁员，主要涉及Reality Labs部门。此次裁员影响约10%员工，即超过1500个岗位，旨在将资源从元宇宙转向AI可穿戴设备和移动功能开发。公司首席技术官Andrew Bosworth确认，受影响员工自1月14日起陆续收到通知。Meta发言人表示，此举是为提升业务可持续性，将缩减虚拟现实项目投入，并将资金转移至今...

00:32

《逃离鸭科夫》将首度联动《逃离塔科夫》

1月12日，《逃离鸭科夫》官方在B站及X平台暗示即将开启首次游戏联动。通过提及‘两个共通人格’‘强大战斗力’等线索，以及展示持锤与持枪的两只鸭子形象，明显指向《逃离塔科夫》中的经典Boss塔基拉和基拉。此举引发粉丝热烈猜测与互动，评论区普遍认定了此次联动角色。目前官方尚未正式官宣联动细节，但已引发广泛关注。

2026年01月13日

23:32

macOS 26窗口圆角设计致拖拽失效

2026年1月13日，多位用户反馈在升级至macOS 26后，调整窗口大小功能出现响应问题。尽管窗口视觉上为圆角设计，但系统仍沿用方形窗口的19*19像素触发区域逻辑，导致75%的触发区落在窗口外部。开发者指出，用户习惯点击的绿色区域实际无法触发操作，仅红色区域有效。此设计不一致造成操作困扰，苹果尚未发布修复补丁。

23:32

谷歌市值突破4.09万亿美元创新高

2026年1月13日，谷歌股价上涨超2%，总市值达4.09万亿美元，续创历史新高。此次增长得益于其Gemini人工智能模型将为苹果Siri等AI功能提供技术支持的消息推动。该合作标志着两大科技巨头在人工智能领域深化协作，进一步拓展AI在智能设备中的应用。市场分析认为，技术整合将增强双方竞争力，推动股价持续走强。

23:32

河南金星啤酒递表港交所

2026年1月13日，河南金星啤酒股份有限公司正式向港交所递交上市申请。联席保荐人为中信证券与中银国际。此举标志着该公司推进资本市场布局的重要一步。上市募集资金将用于产能提升、市场拓展及品牌建设。金星啤酒成立于1982年，总部位于河南，是中国较早的民营啤酒企业之一。此次赴港上市，意在增强全国竞争力并寻求更广阔发展空间。

23:32

死了么APP将启用全球品牌名Demumu

2026年1月13日，死了么APP宣布将在新版本中启用全球化品牌名Demumu。该决策由团队审慎讨论后作出，旨在推动品牌国际化进程。此次更名不涉及公司主体及运营模式变更，原有功能与服务保持不变。用户在更新应用后将逐步看到新品牌标识的呈现。此举被视为其拓展海外市场的重要一步。

23:32

长征六号改成功发射遥感五十号01星开门红开启航天新篇章

2026年1月13日，中国航天事业再传捷报，太原卫星发射中心成功见证了一幕壮丽的太空之舞。当日，长征六号改运载火箭以雷霆万钧之势升空，精准将遥感五十号01星顺利送入预定轨道。此次发射任务不仅圆满成功，更标志着中国航天在2026年的发射征程中实现了开门红，为全年航天事业奠定了坚实基础。长征六号改运载火箭作为中国航天领域的重要力量，此次表现再次彰显了其卓越的运...