ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

5 个月 32 个版本:insane-search 从 0.4.0 到 0.16.3 的完整演进史

5 个月 32 个版本:insane-search 从 0.4.0 到 0.16.3 的完整演进史 5 个月 32 个版本insane-search 从 0.4.0 到 0.16.3 的完整演进史【免费下载链接】insane-searchAuto-bypass for blocked websites in Claude Code — Phase 0→3 adaptive scheduler, no API keys项目地址: https://gitcode.com/gh_mirrors/in/insane-searchinsane-search 是一个面向 Claude Code 的公开网页读取插件当普通抓取遇到 403、验证码或 WAF 拦截时它通过 Phase 0→3 自适应调度器逐级升级访问路线无需任何 API 密钥即可取回干净的公开内容。从 2026 年 4 月的 0.4.0 到 9 月的 0.16.3这个项目在 5 个月里连发 32 个版本完整记录都写在 CHANGELOG.md 中。版本全景一条越来越稳的演进曲线整个演进可以概括为 4 个阶段奠基 → 打磨 → 智能跃迁 → 安全与减法。先看关键节点阶段版本日期一句话主题️ 奠基0.4.02026-04-22Python 引擎 四层验证器 7 个 WAF 画像 打磨0.5.2 → 0.7.306-21 ~ 06-22跨平台修复、多语言 README、Phase 0 强制路由 智能跃迁0.8.0 → 0.10.106-22 ~ 07-22自学习路由、内容安全封装、重试与内容救援️ 加固0.11.0 → 0.13.007-23 ~ 07-29Markdown 默认输出、PDF 提取、429 修复、Threads 视频✂️ 减法0.14.008-06移除内部 API 挖掘回归只用公开路线 冲刺0.15.0 → 0.16.308-24 ~ 09-08X 免密钥搜索、浏览器兜底修复、单次采集0.4.x 奠基期引擎 规则一次成型0.4.0 是第一个有结构化记录的大版本一次性搭好了骨架engine/Python 包统一入口python3 -m engine URL内部是探测 → 验证 → 检测 → 规划 → 执行 → 报告的网格调度器见 fetch_chain.py四层挑战分类器不再把 HTTP 200 当成功而是区分STRONG_OK / WEAK_OK / CHALLENGE / BLOCKED实现在 validators.py7 个 WAF 产品画像Akamai、Cloudflare Turnstile、F5、AWS WAF 等配置在 waf_profiles.yamlR1–R7 规则体系写进 SKILL.md 的硬约束比如跑完整个网格才允许说抓不到R6、禁止写死站点名R3配套的 bias_check.py 是一个 CI 门扫描代码里是否偷偷写死了某个站点防止插件 fossil 化——这套思路后来被其他同类插件借鉴。0.5.x → 0.7.x 打磨期细节决定成败这一段节奏极快0.7.0 到 0.7.3 一天内连发 4 个版本主题是让它真的到处都能用0.5.2Star 请求改为可选、跨语言提示0.6.0 引擎大修多样性调度器让小预算覆盖全部 TLS 家族与 URL 变换类覆盖 3/10 → 10/10、验证器 v2 把误判 5/11 降到 0/11、新增 SSRF 防护safety.py0.7.0 强制 Phase 0 路由phase0.pyReddit 走.rss、X 走 syndication、YouTube 走 yt-dlp——不再依赖 AI记得去试而是引擎强制执行0.7.1–0.7.3README 重做成图文落地页并一口气提供 5 语言版本含 README.zh.md0.8.0 → 0.10.x 智能跃迁从能抓到会记、敢抓、抓得干净0.8.0 自学习U5learning.py 记住哪个路线上次打通了第二次访问同一个站点直接优先重试成功路线连续两次被真拦截的学习记录会被淘汰30 天不用自动清理0.9.0 内容安全封装抓回的网页正文被标注为untrusted_public_webCLI 输出包裹[BEGIN UNTRUSTED WEB CONTENT]边界行防止网页里的注入指令骗过 AI 代理0.9.1–0.9.2激活 Patchright 浏览器兜底修复 Windows/venv 下 yt-dlp 被误报未安装的问题0.10.0 内容救援瞬态状态码429/502…指数退避重试PDF 自动转文本JSON-LD 文章体救援正文比摘要还短的 SPA 空壳页面0.10.1 安全加固给所有救援解析器加输入上限2MB 扫描窗口、25MB PDF 拒绝线防解压炸弹0.11.0 → 0.13.0 加固期质量、边界与媒体0.11.0原始 HTML 成功路径默认转成结构化 Markdownmarkdownify新增正文提取resiliparse与 PDF 提取pdfplumber故意不用 AGPL 协议的 PyMuPDF14 站点实测通过率 9/14 → 12/140.12.0–0.12.1新增protocol_stealth_chrome路线nodriver 裸 CDP、Kasada/Imperva 新画像修复 429 误杀浏览器兜底的缺陷0.13.0Threads 视频路由落地——yt-dlp 没有提取器引擎直接从页面内联 JSON 里解析签名 CDN 视频地址0.14.0 的减法一次难得的删代码版本这是整个演进史中最值得新手学习的一版主动砍掉了内部 API 挖掘子系统endpoint_miner、auto_forge、站点配方把文档里的特定站点示例改成 WAF 产品级通用指南并把免责声明改得更诚实——它是一个 dual-use 工具用户需自行遵守目标站点条款。启示能力越大边界越重要。insane-search 始终只做公开内容读取遇到登录墙和付费墙会如实报告authentication required而不是硬闯。0.15.0 → 0.16.3 冲刺期最后一公里0.15.0X 关键词搜索摆脱了对付费 API 的依赖——Brave/Yahoo 免费发现 推文端点复核结果附带研究级的来源溯源0.16.0修复市场安装版浏览器兜底永远死掉的问题Node 依赖首次使用时安装到~/.insane-search/node并复用CDP 路线转 headful 模式实测通过 Cloudflare Turnstile0.16.1–0.16.2URL 中凭证参数打码url_masking.py新增m_prefix_subdomain变换让 Naver Blog 等门户子域名 18 连败变为 3 次尝试内成功0.16.3--json-content一次采集同时返回正文、元数据与 tracePDF 解析器改为按需加载新手上手三步开始使用在 Claude Code 中安装插件marketplace 安装 /reload-plugins脚本见 setup/setup.sh不需要学任何命令——直接像平时一样提问比如总结一下这篇 YouTube 视频或看看 Reddit 上大家在聊什么遇到拦截时 insane-search 自动接管依赖curl_cffi、yt-dlp 等首次使用时自动安装延伸阅读看懂这个项目的关键文件想看什么去哪里每个版本的完整细节CHANGELOG.md平台覆盖与参考索引PLATFORMS.mdR1–R7 规则与内容契约skills/insane-search/SKILL.md浏览器兜底方案选型references/playwright.md调度器与升级信号references/fallback.md回归测试几乎每个版本都带测试engine/tests/总结回看 5 个月 32 个版本insane-search 的成长路径非常清晰先用规则和引擎把穷尽重试做扎实再叠加自学习、内容安全与媒体能力然后在 0.14.0 主动做减法守住边界最后用连续小版本把最后一公里修平。对新手来说它 CHANGELOG.md 里的每一版都值得读——这是一个开源项目如何保持快速迭代与长期可信平衡的教科书级样本。【免费下载链接】insane-searchAuto-bypass for blocked websites in Claude Code — Phase 0→3 adaptive scheduler, no API keys项目地址: https://gitcode.com/gh_mirrors/in/insane-search创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表