Search King

無敵機人協作搜尋器——搜圖、搜文字、讀網頁、深度爬取、反爬網站抓取,一台機器,十八路引擎。

五種行為

搜圖 / 搜文字 / 讀網頁 / 深度爬取 / 平台抓取

引擎矩陣

12 路圖片引擎 + 6 路文字引擎

六種後端

從無頭瀏覽器到真實瀏覽器,層層兜底

工作流

遇驗證碼自動換路,全掛切真人模式

版權可追溯

每個結果都帶來源與許可證記錄

快速上手

一行命令,裝上就用

一台機器,五種乾法

行為參數正交組合,一個工具應付所有內容採集場景。

行為、後端、修飾器參數自由搭配,互不干擾——這也讓命令行可預測、可自動化。

  • 搜圖(默認):直接輸入關鍵詞即開搜,支持按引擎、按免費站過濾。
  • 搜文字:`--search`,走 6 路文字引擎鏈,可關瀏覽器用純 HTTP 快速搜尋。
  • 讀網頁:`--read`,提取正文,支持多個 URL 並行。
  • 深度爬取:`--crawl`,基於 Crawl4AI 深度提取,輸出 Markdown。
  • 平台抓取:`--fetch`,專門抓雪球帖子、B 站視頻與合集。

十八路引擎,誰行誰上

十二路圖片 + 六路文字,覆蓋主流與地區性搜尋引擎。

  • 圖片(12):Unsplash、Pexels、Pixabay、Burst、Bing、百度、Brave、DuckDuckGo、Yandex、搜狗、360、Google。
  • 文字(6):Bing、百度、Google、DuckDuckGo、Brave、搜狗。
  • 免費商用優先:`--free` 只走帶免費商用許可證的攝影站,版權風險可控。
  • 引擎鏈自動回退:單個引擎掛了或被攔截,自動換下一個,不中斷。

六種後端,層層兜底

從最輕到最重,按被攔截的程度逐漸升級。

  • edge:系統 Edge 瀏覽器(默認)。
  • chromium:Playwright 內置 Chromium,跨平台一致。
  • cloak:CloakBrowser 反偵測,專門過 Cloudflare 類防護。
  • lite:純 HTTP,最快,只用於文字搜尋。
  • opencli:真實 Edge + 保持會話,抗 WAF,抓雪球和 B 站。
  • manual:你瀏覽、工具提取——反爬到最後,真人兜底。

遇到攔截,就換一條路

CAPTCHA 自動跳過,引擎自動回退,真人瀏覽兜底。

Search King 把「被攔」當成常態來處理:任何模式遇到驗證碼或攔截,自動跳過換下一個引擎;全都掛了,切手動模式由真人完成。

  • 驗證碼自動跳過:不卡死、不提交,直接換路。
  • 深度抓取轉文件:爬取結果落到 Markdown,方便二次處理。
  • 並發下載:選中圖片批次下載,全程帶來源與許可證記錄。

版權,不是事後補救

靠一張圖解決版權問題的時代過去了——來源要可查,許可要可追溯。

圖片下載不是交差,而是交付可用的素材。Search King 始終攜帶來源文件與許可證資訊,讓每一次下載都能說清「這圖從哪來、能不能商用」。

裝上,就能用

安裝依賴,一行命令開跑。

python scraper.py "猫"
python scraper.py "猫" --free --download -o pics
python scraper.py --search "AI 2026" --backend lite
python scraper.py --read https://example.com --backend cloak
Playwright Crawl4AI CloakBrowser yt-dlp Python 3.8+