程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
CloakBrowser 深度解析:用源码级补丁绕过所有反爬虫检测——开源 Stealth Chromium 如何做到 30/30 测试全过
编程
CloakBrowser 深度解析:用源码级补丁绕过所有反爬虫检测——开源 Stealth Chromium 如何做到 30/30 测试全过
2026-05-16 01:14:57 +0800 CST
view 884
CloakBrowser通过49个C++补丁修改Chromium源码,实现真正的stealth浏览器自动化。本文深度解析其技术原理、架构设计、实战应用,以及与playwright-stealth等工具的本质区别。
CloakBrowser
浏览器自动化
反爬虫
Chromium
Stealth
Playwright
Python
JavaScript
开源
AI_Agent
Obscura:30MB Rust无头浏览器,AI Agent与爬虫的隐形核武器
编程
Obscura:30MB Rust无头浏览器,AI Agent与爬虫的隐形核武器
2026-05-18 06:40:33 +0800 CST
view 785
纯Rust无头浏览器Obscura,30MB内存70MB体积,真实V8+CDP全兼容,内置Stealth反检测+3520 tracker阻断,Puppeteer/Playwright零修改接入。
开源项目
Rust
无头浏览器
AI Agent
反爬
10个优秀的开源无头浏览器—自动化测试、爬虫、RPA 操作利器
综合
10个优秀的开源无头浏览器—自动化测试、爬虫、RPA 操作利器
2024-11-19 09:36:25 +0800 CST
view 2636
无头浏览器是一种没有图形用户界面的Web浏览器,能够在后台执行任务,广泛应用于自动化测试、网络爬虫和数据抓取。它通过编程接口支持控制,提升测试效率并节省资源。主流工具包括Puppeteer、Selenium、Playwright等,适合在CI/CD流程中使用,但可能无法完全模拟真实用户体验。
开源工具
自动化
Web技术
测试
爬虫
Scrapling深度解析:自适应反检测Python爬虫框架——从单页脚本到AI Agent数据管道的完整实战指南
编程
Scrapling深度解析:自适应反检测Python爬虫框架——从单页脚本到AI Agent数据管道的完整实战指南
2026-07-05 19:12:37 +0800 CST
view 358
深度解析Scrapling自适应Python爬虫框架:分层Fetcher架构、自适应元素追踪、反检测技术、Spider框架、MCP/AI Agent集成。从架构原理到生产实战,含完整代码示例与Scrapy对比迁移指南。
Scrapling
Python
爬虫
Web Scraping
自适应抓取
反检测
MCP
AI Agent
HTML 解析器性能深度横评:从 Lexbor 的 SIMD 优化到 BeautifulSoup 的易用性权衡——2026 年爬虫基础设施选型指南
编程
HTML 解析器性能深度横评:从 Lexbor 的 SIMD 优化到 BeautifulSoup 的易用性权衡——2026 年爬虫基础设施选型指南
2026-06-30 07:15:57 +0800 CST
view 357
深度解析2026年主流HTML解析器性能差异:从Lexbor的SIMD指令集优化、Arena内存分配器到BeautifulSoup的设计权衡,附完整基准测试数据与生产级选型指南。
HTML解析器
性能优化
爬虫
Lexbor
BeautifulSoup
lxml
SIMD
Arena分配器
Scrapling 深度实战:自适应智能爬虫框架完全指南——从动态渲染到全站并行的工程化实践(2026)
编程
Scrapling 深度实战:自适应智能爬虫框架完全指南——从动态渲染到全站并行的工程化实践(2026)
2026-06-02 19:16:20 +0800 CST
view 653
Scrapling 是2026年GitHub Trending的黑马项目,今日暴涨1468星。本文深度解析其自适应解析引擎、浏览器自动化集成、性能优化策略,并通过完整电商爬虫实战,带你掌握这一颠覆传统爬虫开发体验的新一代框架。
Python
爬虫
Scrapling
Web Scraping
自适应解析
CloakBrowser 深度实战:当浏览器隐身技术遇上AI自动化——从Playwright替代方案到反机器人检测绕过完全指南(2026)
编程
CloakBrowser 深度实战:当浏览器隐身技术遇上AI自动化——从Playwright替代方案到反机器人检测绕过完全指南(2026)
2026-06-12 12:47:40 +0800 CST
view 769
深度解析CloakBrowser——基于Chromium的开源隐身浏览器,通过浏览器指纹伪造、JavaScript运行时修改、网络层伪装、智能人类行为模拟等多层次技术,成功绕过现代反机器人检测系统。
CloakBrowser
浏览器隐身
反机器人检测
Playwright替代
自动化爬虫
AI自动化
Scrapling 深度实战:自适应爬虫与AI协同完全指南
编程
Scrapling 深度实战:自适应爬虫与AI协同完全指南
2026-05-24 01:33:32 +0800 CST
view 518
Scrapling是2026年GitHub增长最快的Python爬虫框架(29.8k+ Star),通过自适应选择器和AI协同解决传统爬虫痛点。本文深度剖析其架构设计与实战应用。
Python
爬虫
Scrapling
WebScraping
AI Agent 浏览器自动化深度拆解:当无头浏览器决定「为 AI 而生」——从 Playwright 到 Lightpanda、CloakBrowser,2026 年三大架构范式如何重新定义自动化性能与反检测的终极形态
编程
AI Agent 浏览器自动化深度拆解:当无头浏览器决定「为 AI 而生」——从 Playwright 到 Lightpanda、CloakBrowser,2026 年三大架构范式如何重新定义自动化性能与反检测的终极形态
2026-08-05 14:54:15 +0800 CST
view 64
深度拆解2026年三大AI Agent浏览器自动化架构:Lightpanda用Zig重写渲染引擎实现11倍速、CloakBrowser源码级指纹修补通过30/30反检测测试、browser-act/skills原生MCP集成人类接管,附完整代码实战与选型指南
浏览器自动化
AI Agent
Lightpanda
CloakBrowser
Playwright
反检测
无头浏览器
MCP
Zig
Chromium
自动化测试
网页爬虫
指纹伪装
性能优化
Scrapling 深度实战:从自适应解析到生产级爬虫架构——现代 Web 数据采集的工程化完全指南(2026)
编程
Scrapling 深度实战:从自适应解析到生产级爬虫架构——现代 Web 数据采集的工程化完全指南(2026)
2026-06-03 18:18:58 +0800 CST
view 504
Scrapling 52K Star 自适应爬虫框架深度实战
Scrapling
Web Scraping
Python
Adaptive Scraping
爬虫
MCP
AI Agent
python-bloomfilter:一个布隆过滤器的库!
综合
python-bloomfilter:一个布隆过滤器的库!
2024-11-19 06:20:14 +0800 CST
view 1891
python-bloomfilter是一个高效的布隆过滤器库,适用于快速判断元素是否存在于大规模数据集中。本文介绍了库的安装、基本用法、高级特性及实际应用案例,如网络爬虫去重。布隆过滤器具有高空间效率和快速查询能力,支持并集操作和持久化,适合大数据处理和缓存系统等场景。
Python
数据处理
算法
网络爬虫
高效存储
Crawl4AI 深度实战:让 LLM 理解网页语义——从声明式数据提取到生产级爬虫架构的完全指南(2026)
编程
Crawl4AI 深度实战:让 LLM 理解网页语义——从声明式数据提取到生产级爬虫架构的完全指南(2026)
2026-06-04 10:16:48 +0800 CST
view 491
深度解析 Crawl4AI——LLM 友好的开源爬虫框架,通过声明式数据提取和语义理解,将网页数据采集效率提升 300% 以上。
Crawl4AI
爬虫
LLM
异步
RAG
Python
Scrapling 深度实战:当 Python 爬虫学会"隐形"与"自愈"——从指纹伪装到自适应解析、反检测架构与生产级数据采集的完全指南(2026)
编程
Scrapling 深度实战:当 Python 爬虫学会"隐形"与"自愈"——从指纹伪装到自适应解析、反检测架构与生产级数据采集的完全指南(2026)
2026-06-18 07:26:30 +0800 CST
view 413
Scrapling 是下一代 Python 爬虫框架,天生隐形+自适应解析+统一API,零配置绕过Cloudflare/Datadome/Akamai,网站改版后自动重定位元素,一个框架覆盖静态/动态/反检测三种模式
Scrapling
Python
爬虫
反检测
自适应解析
Web Scraping
Scrapling 深度解析:Python 自适应爬虫框架——从智能元素追踪到全规模爬取的全链路技术实战
编程
Scrapling 深度解析:Python 自适应爬虫框架——从智能元素追踪到全规模爬取的全链路技术实战
2026-05-05 00:34:50 +0800 CST
view 687
深度解析Python自适应爬虫框架Scrapling,涵盖核心概念、架构分析、代码实战、性能优化,对比传统爬虫痛点,介绍自适应元素追踪、反爬绕过、MCP集成等特性。
Python
爬虫
Scrapling
自适应
AI集成
Crawl4AI 深度解析:50K+ Stars 的 LLM 友好型爬虫如何用零配置 Markdown 输出 + MCP 协议 + 深度爬取把整个互联网变成 AI 的「知识后花园」——从异步浏览器池到 RAG 管道的完整实战指南
编程
Crawl4AI 深度解析:50K+ Stars 的 LLM 友好型爬虫如何用零配置 Markdown 输出 + MCP 协议 + 深度爬取把整个互联网变成 AI 的「知识后花园」——从异步浏览器池到 RAG 管道的完整实战指南
2026-07-07 11:44:37 +0800 CST
view 324
深度解析GitHub 50K+ Stars的Crawl4AI LLM友好型爬虫:零配置Markdown输出、Fit Markdown智能过滤、MCP协议原生集成、异步浏览器池并发爬取、深度爬取崩溃恢复、LLM驱动结构化提取、Docker安全加固v0.9.0。从架构原理到RAG管道生产级实战,含完整代码示例与Firecrawl/Jina Reader全面对比。
Crawl4AI
爬虫
LLM
RAG
MCP
Web Scraping
AI
开源
Markdown
数据管道
Scrapling 深度实战:当「自适应爬虫」颠覆传统抓取——52k+ Star 的 Python 爬虫框架从原理到生产级部署完全指南(2026)
编程
Scrapling 深度实战:当「自适应爬虫」颠覆传统抓取——52k+ Star 的 Python 爬虫框架从原理到生产级部署完全指南(2026)
2026-06-05 10:09:08 +0800 CST
view 613
Scrapling是2026年GitHub上52k+ Star的Python自适应爬虫框架,支持自动绕过Cloudflare、网站改版后自动恢复元素定位、内置Spider框架与MCP Server。
Python
Web Scraping
Scrapling
爬虫
开源项目
LLM驱动的强大网络爬虫工具
综合
LLM驱动的强大网络爬虫工具
2024-11-19 07:37:07 +0800 CST
view 1879
CyberScraper2077是一款强大的网络爬虫工具,利用OpenAI模型以高精度提取数据,适合数据分析师和信息获取者。它具备AI驱动的提取、精美的Streamlit界面、多格式支持、隐身模式等特性,确保用户能够高效、道德地抓取所需信息。项目提供详细的安装和使用指南,支持Windows和Unix/MacOS系统。
网络爬虫
数据分析
人工智能
软件工具
开源项目
Lightpanda 深度解析:用 Zig 重写无头浏览器——AI 时代自动化基础设施的技术革命(2026 完全指南)
编程
Lightpanda 深度解析:用 Zig 重写无头浏览器——AI 时代自动化基础设施的技术革命(2026 完全指南)
2026-05-28 18:36:07 +0800 CST
view 539
Lightpanda 用 Zig 从头实现无头浏览器,内存占用仅为 Chromium 的 1/10,启动速度快 10 倍,是 AI 时代自动化基础设施的技术革命。
Lightpanda
Zig
无头浏览器
AI自动化
Web爬虫
Python异步编程深度实战:从asyncio底层原理到万级并发爬虫的生产级调优完全指南(2026)
编程
Python异步编程深度实战:从asyncio底层原理到万级并发爬虫的生产级调优完全指南(2026)
2026-06-06 02:40:15 +0800 CST
view 581
2026年最新Python异步编程深度教程,从asyncio底层原理到万级并发爬虫的生产级调优,包含完整代码示例和性能优化技巧
Python
异步编程
asyncio
并发爬虫
bb-browser:你的浏览器就是API,5K+Star的AI浏览器神器
案例
bb-browser:你的浏览器就是API,5K+Star的AI浏览器神器
2026-05-06 23:11:21 +0800 CST
view 1619
5K+Star的bb-browser让AI直接使用你的真实Chrome浏览器,把网站当API用。支持36平台103条命令,Twitter/GitHub/知乎/雪球全覆盖,零密钥零爬虫,MCP无缝集成Claude Code
AI浏览器
CDP
MCP集成
Claude Code
Cursor
爬虫替代
浏览器自动化
36平台
PHP爬虫利器:QueryList,让网页数据抓取变得简单高效
编程
PHP爬虫利器:QueryList,让网页数据抓取变得简单高效
2025-09-02 10:11:37 +0800 CST
view 1135
QueryList是一个基于phpQuery的PHP数据采集工具,提供jQuery风格的DOM解析和数据抓取功能。它支持复杂的HTTP请求、编码处理和内容过滤,适合各种数据采集需求。安装简单,使用直观,能够高效处理网页数据,尤其适合已经使用PHP技术栈的开发者。QueryList的设计理念使得数据采集变得优雅而高效。
数据采集
PHP工具
爬虫技术
Lightpanda 深度实战:18K+ Star 的 Zig 语言无头浏览器——从零构建到 AI Agent 原生集成的全链路架构解析
编程
Lightpanda 深度实战:18K+ Star 的 Zig 语言无头浏览器——从零构建到 AI Agent 原生集成的全链路架构解析
2026-05-07 20:06:57 +0800 CST
view 770
深入解析 Lightpanda 浏览器:用 Zig 从零构建的 AI 专用无头浏览器,内存仅 Chrome 的 1/16,速度快 9 倍,原生支持 CDP 和 MCP 协议。
浏览器
Zig
AI自动化
无头浏览器
爬虫
CDP
Puppeteer
CloakBrowser 深度实战:当反检测从「JS 伪装」进化到「源码级隐身」——从 Chromium 底层补丁到绕过所有反爬的生产级完全指南(2026)
编程
CloakBrowser 深度实战:当反检测从「JS 伪装」进化到「源码级隐身」——从 Chromium 底层补丁到绕过所有反爬的生产级完全指南(2026)
2026-06-15 19:47:12 +0800 CST
view 417
本文深度解析 CloakBrowser 的底层原理、架构设计和实战用法,讲解如何通过源码级修改绕过所有反爬检测,是 Playwright 用户的终极反检测方案。
CloakBrowser
反检测浏览器
Chromium源码修改
Playwright替代
爬虫技术
自动化
CloakBrowser 源码级反检测实战:从 Chromium 49 处底层补丁到 100% 绕过反爬的生产级完全指南(2026)
编程
CloakBrowser 源码级反检测实战:从 Chromium 49 处底层补丁到 100% 绕过反爬的生产级完全指南(2026)
2026-06-15 19:49:04 +0800 CST
view 445
本文深度解析 CloakBrowser 的底层原理、架构设计和实战用法,讲解如何通过源码级修改绕过所有反爬检测,是 Playwright 用户的终极反检测方案。
CloakBrowser
反检测浏览器
Chromium源码修改
Playwright替代
爬虫技术
自动化
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
下一页