2026 年 9 月 18 日,OpenAI 發表 Astra for Law。多數報導的標題是「OpenAI 進軍法律業」,但真正該被劃線的不是模型,是它一併公布的另一件事:OpenAI 自己蓋了一座涵蓋超過 2.3 億個 URL 的美國法律搜尋索引,內容包括判例法、成文法、行政法規、法院規則與行政裁決,且每日新增。OpenAI 公布的評測是:在最高推理強度下,Astra for Law 的整體正確性通過率為 54.0%,而同一個 GPT-6 Astra 搭配一般網路搜尋只有 38.7%——相對提升約 40%。
這個數字對做 SEO 與 GEO 的人,比對律師更重要。過去兩年整個 AEO/GEO 產業建立在一個前提上:模型回答問題時會去檢索「開放網路」,所以內容結構夠好、來源夠權威、被引用得夠多,就有機會出現在 AI 答案裡。這個前提正在被拆掉。法律 AI 是垂直 AI 裡最有錢的一塊——Harvey 今年 3 月以 110 億美元估值募 2 億美元,9 月再以 155 億美元估值募 5.5 億,年化營收從 1 月的 1.9 億跳到 3.5 億美元以上;瑞典的 Legora 以 55.5 億美元估值募 5.5 億,ARR 破 1 億美元、客戶超過 1,000 家。法律 AI 軟體市場 2026 年約 55.9 億美元,母體的全球法律科技市場約 311 億美元。錢夠多,才值得自己蓋索引。
賽道形狀因此改變。Harvey 與 Legora 是應用層兩強,Thomson Reuters 用 CoCounsel 與 HighQ 守住「專業資料庫 + 工作流」的老地盤。OpenAI 沒有正面打,而是往下挖一層:同步推出 26 個外掛,夥伴含 Thomson Reuters、Harvey、Legora、iManage——估值 155 億美元的 Harvey,現在是 OpenAI 平台上的一個掛件。Thomson Reuters 的回應寫得很技巧:「當 AI 變得更開放、更可互通,價值不在連接性本身。」翻譯過來是:我們不想只當一個 plugin。
這跟台灣的中小企業有什麼關係?關係在一個問題:你的產業會不會是下一個被建索引的?會,你現在的 GEO 努力就會在那天大幅貶值;不會,你反而拿到一個變輕的戰場。接下來解三件事:怎麼判斷你在哪一邊、三類讀者這週該做什麼、以及不花 SaaS 訂閱的 DIY 路線。
事件細節:它發表的不是模型,是准入資格
先把技術定位講清楚。Astra for Law 不是新的基礎模型,是 GPT-6 Astra 針對法律工作的配置:專用法律搜尋索引、法律分析與書寫的客製指令、事務所端治理控制。官方說明指出,選定事務所先透過 Trusted Access 計畫在 ChatGPT 與 Codex 中使用,API 稍後以 gpt-6-astra-law 開放。
同一天還有兩件事:ChatGPT for Word 正式推出,可直接在 Word 裡校對與取得建議修改;以及 GPT-5.5 將於 2026 年 10 月 14 日從 ChatGPT、ChatGPT Work 與 Codex 全面退場。第二件沒什麼人寫,但對把 GPT-5.5 寫死在自動化流程裡的公司,那是 26 天的倒數計時。
回到索引。2.3 億個 URL 不是「爬了很多網頁」,而是針對一個法域的權威來源做結構化收錄並每日更新。這件事過去只有 Westlaw、LexisNexis 這種百年資料庫公司在做,門檻不在技術,在授權與維護成本。OpenAI 選擇自己做,代表它判斷:在高價值垂直領域,檢索品質的上限由索引決定,不由模型決定。54.0% 對 38.7% 就是證據——同一個模型,換一個索引,差 15 個百分點。
三類讀者的立刻行動
品牌主/中小企業老闆
- 做一次索引風險判斷:你的產業有沒有一組公開、結構化、權威的來源(法規、專利、藥證、標準、公開財報、政府標案)?有,你就在名單上。
- 在名單上:停止投資「產出更多科普內容」,改投資「成為那個索引會收錄的來源」——公會文件、官方登錄資料、標準制定參與。
- 不在名單上(在地服務、B2B 製造、消費品牌):開放網路仍是主戰場,未來兩年競爭反而會變輕。
行銷/SEO 操作者
- 在 AI 可見度報表加一個欄位:這個查詢是開放網路檢索回答的,還是平台自建索引回答的。優化手段完全不同。
- 追蹤「引用來源的組成」而不只是「有沒有被引用」。引用集中到少數機構型來源,代表那個查詢群已經被索引化。
- 把第一方資料(站內搜尋詞、客服問題、業務常見疑問)當主要素材。那是平台索引拿不到的東西。
開發者/接案商
- 檢查所有專案裡寫死的模型字串。GPT-5.5 在 10 月 14 日退場,寫死的地方會在那天靜默失敗。
- 把模型名稱抽成設定值,並為每個 AI 功能寫 10 到 20 題的最小回歸測試。換模型跑一次就知道壞在哪。
- 賣「私有垂直索引」而不是「串 ChatGPT」。後者是一週的工作,前者是收月費的資產。
工具比較表
| 方案 | 定位 | 規模/估值 | 適用情境 |
|---|---|---|---|
| OpenAI Astra for Law | GPT-6 Astra 法律配置 + 自建 2.3 億 URL 索引 | 正確率 54.0%(vs 一般網搜 38.7%) | 美國法域、已採用 ChatGPT 的事務所 |
| Harvey | 應用層龍頭,agent 導向 | 估值 155 億美元、年化營收 3.5 億美元以上 | 大型事務所與企業法務 |
| Legora | 協作式法律工作台 | 估值 55.5 億美元、ARR 破 1 億美元、1,000+ 客戶 | 中大型法務團隊、重視協作流程 |
| Thomson Reuters CoCounsel + HighQ | 專業資料庫 + 案件脈絡 + 治理 | 母體法律科技市場約 311 億美元的既有龍頭 | 需要受監管級稽核軌跡的機構 |
| 自建 RAG(開源) | 自有文件的私有索引 | 月成本可壓在 NT$2,000 以內 | 台灣法域、內部文件、無公開權威索引可用 |
前四者的功能會快速趨同。分開它們的是索引的所有權,以及誰對錯誤負責。
不會告訴你的事
反向觀點一:54.0% 的另一面是 46%。而且這是最高推理強度下的數字。相對提升 40% 是個好看的框架,絕對值卻代表接近一半的題目沒通過整體正確性檢查。在法律場景,這不是「還不錯」,是「必須逐句覆核」。
反向觀點二:沒有 API 日期,也沒有定價。OpenAI 公開承認兩項都還沒定。對要編預算的人來說,這目前只能算佔位,不能算可採購的產品——而先佔位、後定價的產品,通常不便宜。
反向觀點三:2.3 億個 URL 是覆蓋量,不是有效性。法律檢索最難的不是找到那個判例,是判斷它還算不算數。官方說明強調來源每日新增,對「被推翻的判例如何標記」著墨有限。覆蓋高而有效性標記弱,會製造一種危險的錯覺:看起來有出處。
反向觀點四:生態夥伴同時是競爭者。估值 155 億美元的 Harvey,現在是 26 個外掛之一。這種結構在平台史上極少穩定超過兩年,Thomson Reuters 的回應已經先把話講在前面。
不花 SaaS 訂閱的 SMB 替代方案
如果你的產業還沒有人替你建索引,那就自己建一個小的。這件事在 2026 年的成本已經低到不值得猶豫:
- 第 1 週|來源盤點:列出產業裡 20 到 50 個權威來源(主管機關公告、公會文件、標準、廠商規格書、自家歷史提案與客服問答)。這步是人做的。
- 第 2 週|抓取與正規化:排程每日抓取,轉純文字,保留來源 URL 與日期。一台入門 VPS 就夠。
- 第 3 週|混合檢索:向量檢索(開源 embedding)搭配關鍵字檢索(PostgreSQL 全文檢索或 BM25),兩路合併重排。純向量在專有名詞上會輸得很難看。
- 第 4 週|引用與時效標記:每個回答附來源 URL 與抓取日期,並標示是否已被更新版本取代。這是你唯一能贏大廠的地方——你知道哪份文件過期了。
月成本可壓在 NT$2,000 以內。它不會比 OpenAI 的索引大,只需要在你的領域裡比公開網路準。
常見問題 FAQ
Astra for Law 可以用在台灣的法律問題嗎?
它的索引是美國法域。用在台灣法律問題上等於用錯的索引檢索,錯誤率只會更高。台灣法域目前只能自建索引或使用本地供應商。
這代表 GEO/AEO 沒用了嗎?
不是,而是 GEO 分成兩種戰場。在平台自建索引的垂直領域,優化重點從「內容品質」變成「來源准入」;在沒有自建索引的領域,開放網路檢索仍然主導,原本做法依然有效,競爭壓力還會下降。
GPT-5.5 10 月 14 日退場,我要做什麼?
全專案搜尋模型名稱字串,把寫死的地方抽成設定值;再為每個 AI 功能建立 10 到 20 題固定回歸測試,換模型後比對輸出。多數公司踩的坑不是「模型不見了」,是「模型換了但沒人發現輸出變了」。
自建索引要多少工時?
涵蓋 20 到 50 個來源、每日更新、附引用標註的最小可用版本,約 80 到 120 小時。持續成本不在開發,在來源清單維護——需要懂這個產業的人每季看一次。
我的觀點
主流解讀是「OpenAI 進軍法律業,Harvey 危險了」。我的判斷不同:OpenAI 進軍的不是法律業,是索引業。法律只是第一個被證明「垂直索引打得贏開放網路」的領域,因為它同時滿足三個條件:來源權威且結構化、錯誤代價極高、客戶付得起。符合這三條的還有醫藥、會計與稅務、政府採購、醫材與食品法規。
所以 contrarian 判斷是:未來 18 個月,OpenAI 會再推出至少兩個垂直索引;每多一個,開放網路在那個領域的 GEO 價值就歸零一次。把「AI 可見度監測」當主力產品在賣的服務商,正在賣一個會被逐個領域關掉的量表——不是它不準,是它量的那個東西會在特定領域消失。
對 ScriptWalker 這種 Laravel + Flutter 工作室,啟示很具體:與其接「幫我串 ChatGPT」,不如賣「私有垂直索引建置與維護」。技術棧不難,Laravel + pgvector 加全文檢索就能起步;難的是產業來源盤點,而那正好是長期合作才會有的資產。串 API 是一次性收入,索引維護是月費。
資料來源
- 第一手:OpenAI — Introducing Astra for Law
- 第一手:OpenAI Help Center — Astra for Law
- 第一手:Harvey 官方公告 — 110 億美元估值募資
- 第一手:Legora 官方公告 — ARR 突破 1 億美元
- 第三方:The Next Web — Harvey 以 155 億美元估值募 5.5 億美元
- 第三方:Artificial Lawyer — OpenAI Launches Astra For Law
- 第三方:LawSites — OpenAI Releases Astra for Law
- 第三方:The Next Web — OpenAI launches Astra for Law and its own legal research index
想把公司的文件變成可檢索的資產?
如果你手上有大量內部規格、報價、合約、客服問答,卻只能靠人腦記得在哪一份檔案裡,我們提供私有垂直索引的建置與維護服務,起價 NT$120,000,含來源盤點、混合檢索與引用時效標記。
- Email:[email protected]
- 電話:0916-224-047
- LINE:@ufv9089p