AI 要用你網站的內容,舊做法是派爬蟲抓整頁 HTML,自己猜哪段是價格、哪段是規格。微軟 2025 年開源的 NLWeb 反過來:把你原本就有的 Schema.org 結構化資料接上檢索與語言模型,開成一個能用自然語言查詢的端點,AI 不用猜,直接問。每個 NLWeb 實例同時是一台 MCP server——代理接上的不是順便爬到的頁面,是能直接呼叫的工具。
判斷很直接:NLWeb 入料準不準,全看 Schema.org 標得乾不乾淨、公司名產品名地點這些實體一不一致——體質好的站,NLWeb 把既有的功變現;體質爛的站,開成端點只是把混亂放大給 AI 看,它不是捷徑,是一面照妖鏡。潑冷水一樣老實:NLWeb 還是開源實驗,不是業界標準,裝了不代表被主流 AI 引用。
留意的對象很明確:內容量大、查詢密集的電商、目錄、媒體、知識庫,現在就該關心;中小企業官網不必急著自架伺服器,把力氣留給結構化資料和實體一致性——這是介面怎麼換都用得到的地基。詳見 geoweb.tw。