首頁 / 技術指南 / GPTBot 與 OAI-SearchBot
Guide
GPTBot 與 OAI-SearchBot 差在哪?
OpenAI 目前有三支爬蟲,用途完全不同。想被 ChatGPT 搜尋引用卻擋掉 OAI-SearchBot,是最常見也最可惜的設定錯誤。
三支爬蟲對照
| 爬蟲 | 用途 | 什麼時候來 | 觀測次數 | 取得內容 |
|---|---|---|---|---|
GPTBot | 收集模型訓練資料 | 自主排程探索 | 503 | 65.2% |
OAI-SearchBot | 建立 ChatGPT 搜尋索引 | 自主排程探索 | 809 | 81.0% |
ChatGPT-User | 使用者在對話中要求讀取特定網址 | 使用者觸發,即時 | 864 | 91.4% |
取得內容的比例依序遞增,反映的正是它們的行為差異:ChatGPT-User 抓的是使用者當下指定的網址,幾乎都存在;GPTBot 自主探索,會碰到較多已失效的路徑。
最常見的設定錯誤
想被 ChatGPT 搜尋引用,卻擋掉 OAI-SearchBot。很多網站把「AI 爬蟲」當成一件事處理,看到
Disallow 就一起擋,結果連搜尋索引一起擋掉了。這三支的決策其實是三個獨立問題:
- 要不要提供訓練資料?→ GPTBot
- 要不要出現在 ChatGPT 搜尋結果?→ OAI-SearchBot
- 使用者主動貼你的網址時,要不要讓它讀?→ ChatGPT-User
多數網站對這三題的答案不會相同。常見的組合是:擋訓練、開搜尋、開使用者請求。
對應的 robots.txt
# 不提供訓練資料,但希望出現在 ChatGPT 搜尋中
User-agent: GPTBot
Disallow: /
User-agent: OAI-SearchBot
Allow: /
User-agent: ChatGPT-User
Allow: /
每個群組都要寫完整。robots.txt 的群組不會繼承
User-agent: * 的規則。若你在通用群組裡有 Disallow: /admin,那條規則對上面三個群組完全無效,必須在每個群組內重複。Anthropic 也是同樣的結構
Anthropic 同樣有三支對應角色的爬蟲,設定邏輯一致:
| Anthropic | 對應的 OpenAI 角色 | 本站觀測次數 |
|---|---|---|
ClaudeBot | GPTBot(訓練) | 2,225 |
Claude-SearchBot | OAI-SearchBot(搜尋索引) | 489 |
Claude-User | ChatGPT-User(使用者請求) | 671 |
完整清單與 User-Agent 字串見AI 爬蟲目錄。
常見問題
只允許 OAI-SearchBot、擋掉 GPTBot,ChatGPT 還能引用我嗎?
可以。搜尋索引由 OAI-SearchBot 建立,與訓練資料是不同的管道。不過允許被索引不保證會被引用——是否引用由 AI 平台在回答時決定。
OAI-SearchBot 來過,就代表 ChatGPT 會引用我嗎?
不代表。爬蟲造訪只表示內容被取得。是否在回答中使用、是否附上來源連結、是否提到你的品牌,是後面三個獨立的問題。
資料來源
- OpenAI — Bots and crawlers
- Anthropic — Web crawling
- 第一手觀測:兩個正式站台,2026-06-18 ~ 2026-09-08。