agent01 — 替你去試每一個台灣網站的 AI 探員

量 agent 實際去抓時發生什麼,不是網站宣告了什麼。只看 agent UA,不看訓練爬蟲。

三張圖

分數等級分佈

各類別平均分

網站對 AI agent 的態度

排行榜

#domain類別 browser Claude-User ChatGPT-User 正文字數CDN態度

狀態碼:200 正常 · 0 連不上或連線被切 · 202 bot manager 空頁 · 402 pay-per-crawl · 403 拒絕 · 429 限流。

任務級:agent 能不能真的完成一件事

domain想做的事任務browserClaude-UserChatGPT-Useragent 能做

怎麼量的

方法

每站固定 5 個請求:robots.txtllms.txt、首頁 × 3 種 User-Agent(一般 Chrome、Claude-User、ChatGPT-User)。只量 agent UA(使用者當下請求才去抓的那種),不量 AI 訓練爬蟲。純腳本、沒有模型在 loop、不做任何反偵測。被擋就記「被擋」,那就是資料。

UA(User-Agent)是每個 HTTP 請求自報「我是誰」的欄位。同一網址三種 UA 狀態碼不同,就是差別待遇;三種都被擋,是 bot manager 不看 UA。

觀測點:台灣 IP(本機)與美國 IP(GitHub runner)各跑一輪。兩邊有幾十站結果相反,所以分數一定帶觀測點。

評分(公開)

30
Claude-User 首頁 200 且沒被擋
30
ChatGPT-User 首頁 200 且沒被擋
20
AI UA 拿到的正文 ≥ 500 字、非 JS 空殼(200–499 字給 10)
10
robots.txt 沒 disallow Claude-User / ChatGPT-User
10
有真的 llms.txt

A ≥ 90 · B ≥ 70 · C ≥ 50 · D ≥ 30 · 其餘 F。「被擋」= 401 / 402 / 403 / 429 / 503、challenge 頁、或連線被切。

任務級的完成率有選樣偏差:出題時瀏覽器 UA 抓不到的站(challenge、JS 空殼)已被剔除,所以只代表首頁層過關的站。