先推翻這套說法的,是原本提出它的人。SEO 研究者 Suganthan Mohanadasan 在 2026 年 6 月逆向拆解 ChatGPT 的網路封包,當時的結論是:OpenAI 自建的那個搜尋索引(在 ChatGPT 伺服器回應裡被標成「labrador」)是一層只留給大型出版商的授權名單。2026 年 7 月 14 日,他自己發文更正——一位義大利讀者用免費帳號擷取的紀錄顯示,沒有簽約的小網站,走的跟路透社、衛報、華爾街日報、維基百科是同一條管線。法國 SEO 顧問公司 Resoneo 從另一個方向走到同一個答案:2026 年 7 月用瀏覽器擴充功能擷取了 1,249 則 ChatGPT 回答,發現 labrador 給沒有 OpenAI 內容授權合約的網站的引用,在格式、長度、更新頻率上,跟簽約合作媒體拿到的完全一樣。Search Engine Journal 在 2026 年 8 月 11 日報導了這份資料。同一份資料真正分得出高下的,是頁面本身:Resoneo 檢視的 534 個被引用頁面裡,463 個有 H1 標籤,這 463 個裡有 387 個(83.6%)的引用摘要直接照抄 H1 的文字,摘要總長上限大約 200 字元。而且這些結論都有時效。OpenAI 大約在 2026 年 7 月 21 日停止在搜尋結果裡標示擷取管線的名稱,兩邊調查用來辨識 labrador 的那個訊號就這樣關掉了,所以這件事只能證實到 2026 年 7 月中,現在沒辦法用同一套方法重驗一次。
可信度:中。兩組研究者各做各的,方法都寫出來、任何人都能自己打開來看,最後得到同一個結論,這是真的互相印證。但證據也就到這裡:兩份都不是 OpenAI 官方認可的資料,Resoneo 是商業 SEO 顧問公司,把這份自家資料公開,有一部分是為了推廣自己的 Chrome 擴充功能和顧問服務。而且兩邊用來辨識 labrador 的那個管線標籤,OpenAI 已經拿掉了。
- Resoneo 在 2026 年 7 月擷取了 1,249 則 ChatGPT 回答。在免費帳號的樣本裡,自建的 labrador 索引處理了大部分顯示出來的搜尋結果。
- 另一組付費帳號、深度思考模式的樣本共 16,407 筆搜尋結果,Google 擷取占大約 75%,自建的 labrador 索引占大約 24%(資料來源:Resoneo,發布於 think.resoneo.com/chatgpt-retrieval/)。
- Resoneo 檢視的 534 個被 ChatGPT 引用的頁面裡,463 個有 H1 標籤,這 463 個裡有 387 個(83.6%)的引用摘要直接沿用 H1 的文字,摘要總長上限大約 200 字元。
- Mohanadasan 在 2026 年 7 月 14 日撤回他 2026 年 6 月提出的「授權層級」說法——一位義大利讀者用免費帳號擷取的資料顯示,沒有簽約的小型網站,跟路透社、衛報、華爾街日報、維基百科走的是同一條擷取管線。
掌握 AI 搜尋的每一步
會牽動你排名和 AI 引用的每個變化,加上該怎麼應對——趁還沒讓你付出代價之前。免費,每週三次。
如果你正在評估要不要跟 OpenAI 談內容授權,而目的是讓自己在 ChatGPT 免費版的回答裡被引用:照這份資料看,授權不是那個開關。我們在 2026 年 7 月 8 日就寫過 ChatGPT 搜尋底下不只一條管線——當時 labrador 在將近一萬次執行裡提供了 88.1% 的主要搜尋來源,而且換一條管線,被引用的網址就跟著換。Resoneo 這次的擷取把 labrador 是什麼講清楚了:它是 OpenAI 自己的索引,不是外包給第三方的檢索供應商。真正對操作端有用的是後面那一句:到 2026 年 7 月中為止,沒簽約的網站拿到的引用,跟路透社、衛報那些簽約合作媒體拿到的,格式、長度、更新頻率完全一樣。
確定會影響結果的那個開關在機制面,而且一點都不氣派。引用摘要是拿頁面的 H1 標籤,再加上後面大約 150 個字元組成的,總長上限大約 200 字元。所以 H1 如果只寫了一個主題,沒有結論也沒有數字,ChatGPT 抄走的就是那個主題。範本如果在第一段前面先印了欄目名、作者、日期,那幾行就把 H1 後面那 150 個字元佔掉了,ChatGPT 抄走的就是那幾行。有沒有簽約,完全不進入這個計算。
授權合約在別的地方還是可能有價值,只是這份資料一項都沒測到:付費版和深度思考模式的擷取結構(Resoneo 那組樣本裡,Google 擷取占了大約 75%),還有著作權方面的保障。不要拿這個發現去結束那種談判。也要把時效一起記著:OpenAI 已經把兩邊調查在讀的那個標籤拿掉了,所以誠實的講法是,這件事到 2026 年 7 月中成立,現在沒有人能重跑一次驗證。
建議行動:
- 盤點你商業價值最高、還有最常被引用的那幾頁的 H1,把只寫主題、沒有結論也沒有數字的通通改掉。那是 ChatGPT 引用摘要照抄的前面大約 50 個字元。
- 請網站團隊看一下頁面範本裡,緊接在 H1 後面會渲染出什麼,把佔掉後面那 150 字元的欄目小標、作者列、日期區塊拿掉或縮短。
- 如果你們在談 OpenAI 內容授權是為了免費版被引用以外的理由,把那個理由另外寫下來——Resoneo 這份資料完全沒有驗證付費版或著作權保障那些情境。
Search Engine Journal: "ChatGPT's Search Index Serves Small Sites Too, Data Shows" by Matt G. Southern, August 11, 2026. https://www.searchenginejournal.com/chatgpts-search-index-serves-small-sites-too-data-shows/585388/
Resoneo: "ChatGPT Retrieval" report (primary data — browser-extension capture of 1,249 ChatGPT answers, July 2026). https://think.resoneo.com/chatgpt-retrieval/
Suganthan Mohanadasan: "How ChatGPT Picks Sources, Part 2" (correction published July 14, 2026). https://suganthan.com/blog/how-chatgpt-picks-sources-part-2/
Prior Novastacks GEO Beat coverage (arc origin): "ChatGPT citations shift when its hidden search pipeline switches — 11.6% of prompts changed primary source across repeated runs," GEO Beat run 2026-07-10.