The Webs Digital Locks have Never had a Stronger Opponenta day agohttps://blog.pixelmelt.dev/the-webs-digital-locks/大语言模型大幅降低了逆向工程网页代码所需的成本和时间,使得新手也能轻松破解防护措施。当前的JavaScript代码防护措施可被高级大语言模型在几分钟内破解,暴露出之前更难获取的数据和知识产权。防御者难以跟上步伐,因为大语言模型能够快速分析并绕过混淆、源代码映射甚至商业反机器人措施。这个问题的不对称性有利于攻击方:自动化逆向现有复杂性比生成新的防御复杂性更容易。例如,从打包的应用程序中重建源文件,以及使用大语言模型以极小的努力破解专有在线阅读器。
Matt’s Script Archive: The Scripts That Reshaped The Weba day agohttps://feed.tedium.co/link/15204/17365463/matts-script-archive-retrospective20世纪90年代中期,高中生马特·赖特创建了简单的网络工具,如留言簿、联系表单以及流行的WWWBoard论坛,这些工具托管在“马特脚本档案”网站上。他的脚本被非开发者广泛采用,但存在大量安全漏洞,其中文本计数器工具的一个严重10.0级CVE漏洞允许以root权限远程执行代码。nms项目旨在提供马特不安全脚本的直接替代品,但由于网络开发和安全实践的变化,该项目已约20年未更新。易用工具与安全之间的张力反映了现代的“氛围编码”现象;马特的脚本既是民主化的推动力,也是安全风险。域名worldwidemart.com(原托管马特脚本档案的网站)由一位爱好者重新启用,旨在保护脚本历史遗产,侧重于教育而非垃圾信息。赖特本人后来承认其代码已过时,并推荐使用nms,这体现了新手与专业开发者视角之间的差距。
What's the best way to do authentication in modern applications18 days agohttps://neciudan.dev/most-secure-way-to-store-auth-tokenJWT(JSON Web Token)通常用于身份验证,但将其存储在本地存储中易受跨站脚本攻击,因为页面上的任何JavaScript都能读取本地存储。使用带有Secure和SameSite=Lax等标志的HTTP-only Cookie可以防止JavaScript读取令牌,降低了在跨站脚本攻击中令牌被窃取的风险。Cookie存在跨站请求伪造攻击的风险,但可以通过使用CSRF令牌、SameSite属性以及检查Origin或Sec-Fetch-Site等请求头来缓解。无状态JWT存在撤销问题;而使用HTTP-only Cookie存储不透明会话ID的服务端会话允许立即使会话失效,对于单应用程序来说更为安全。对于OAuth或第三方令牌,应采用后端为前端模式,将令牌存储在服务器端,浏览器仅持有HTTP-only会话Cookie,从而防止令牌暴露给JavaScript。刷新令牌轮换和重用检测通过使被盗的刷新令牌失效并强制重新认证来增强安全性。设备绑定会话凭证将会话与硬件绑定,防止被盗Cookie被长期使用,但目前该技术的采用仍有限。对于React应用,应在API包装器中集中处理令牌管理,以管理令牌刷新并防止并发的刷新请求导致登出。
Prismata: Confining cross-site prompt injection in web agents19 days agohttps://arxiv.org/abs/2607.08147Prismata 是一种用于网络代理的防御机制,旨在防止跨站提示注入攻击。它通过为页面内容生成动态信任标签并限制代理能力,强制执行上下文最小权限原则。该系统提供结构性限制保障,以限制标签错误范围,确保标签权限只能降低。Prismata 无需开发者注释,因此适用于广泛的网站。它在保持良性任务实用性的同时,显著降低了攻击成功率。
An Update on the scraper situation19 days agohttps://lwn.net/SubscriberLink/1080822/990a8a5e2d379085/AI机器人网络通过住宅代理进行的爬虫攻击正在压垮网站,利用数百万台通常未被主人知晓的受感染设备制造过量流量。像Bright Data等公司提供'道德'住宅代理网络,利用免费VPN或SDK将用户设备变为爬虫终端。这种爬取行为被认为是由训练AI模型的数据需求增长所驱动,推动方包括企业和政府机构等多种实体。网站正在实施防御措施,如Anubis工作量证明系统、验证码、付费墙和登录关卡,以减轻爬虫影响。LWN已采用网站优化和选择性访问控制来保护其网站,同时尽量减少对合法用户和搜索引擎的干扰。近期对IPIDEA和NetNut等网络的取缔暂时减少了攻击,但问题依然存在,表明需要更持久的解决方案。人们担心持续的爬虫行为威胁开放互联网,可能迫使更多内容进入限制性屏障之后,损害其创新潜力。
Web-based cryptography is always snake oil24 days agohttps://www.devever.net/~hl/webcrypto基于网页的'端到端'加密本质上存在缺陷,因为服务器运营者——本应是加密防范的对象——分发客户端代码,并可能推送恶意更新。这类加密系统自相矛盾,因为它们未能将防范对象与提供实施方案的实体分离,本质上等于内置了后门。公司采用'蛇油'加密主要是作为一种法律策略,以规避授权和传票义务,而非提供真正的安全性。法律上依赖这种模式风险很高,拉瓦比特案和苹果与FBI案等政府行动表明,当局能够且确实会要求妥协。网络平台的限制性本质使客户端代码分发与服务绑定,若不进行范式转变,就无法构建真正有意义的加密系统。诸如利用服务工作者配合子资源完整性等潜在修复方案存在局限,例如首次使用信任问题以及用户验证挑战。
Your Site, your rules: new AI traffic options for all customersa month agohttps://blog.cloudflare.com/content-independence-day-ai-options/一年前,Cloudflare 宣布首个“内容独立日”,旨在帮助网站所有者屏蔽AI爬虫,并推出了按次爬取付费市场。关于AI爬虫的讨论已从单纯屏蔽训练演变为寻求精细化解决方案,认识到网站所有者需要比单纯屏蔽所有自动化更丰富的选项。小型网站面临两难选择:允许AI训练以获得可见性,或屏蔽训练并面临无法被检索的风险,这种现状不公平地偏向大型搜索引擎提供商。AI现已集成到谷歌应答引擎等众多服务中,使搜索从AI排序结果转向直接在结果页面提供答案。Cloudflare更新后的方案根据行为将爬虫分为搜索型、代理型和训练型三类,而非仅标注为AI爬虫,以提供更透明的控制机制。新的管理选项允许网站所有者基于这三种使用场景控制AI流量,默认设置为屏蔽广告页面的训练型和代理型爬虫,同时允许搜索型爬虫。像Googlebot这样的多功能爬虫将根据其所有行为类型进行处理,客户可在2026年9月15日前选择退出默认配置。BotBase作为企业客户的可见性工具正式推出,可追踪所有已知爬虫并进行分类,支持精细化管理和过滤。robots.txt引入了新的“内容使用”信号,允许网站所有者指定爬虫使用内容的方式——即时使用、参考使用或完全使用——从而增强对内容重用的控制。“已验证”爬虫的定义已更新为与基于类别的许可机制保持一致,验证流程对爬虫运营商也更加透明和开放。Cloudflare通过Forwarded标头实验传递信任机制,确保可信运营商即便经过多层中介仍能保持访问权限。这些变革旨在赋予网站所有者更多内容使用控制权,提升透明度,并适应不断发展的网络生态,所有新功能现已全面上线。