Browse AI 是什麼?
Browse AI 是代管式無程式碼網頁擷取與監控平台。使用者安裝 Recorder,示範導覽並選擇欄位或列表,系統將操作轉為「Robot」:可接受參數、翻頁、擷取結構化資料列、截圖並排程重複。部分常見來源也有預設機器人。
結果可留在工作區,也可透過 CSV、Google Sheets、Airtable、Amazon S3、REST API、Webhook、Zapier、Make、Pabbly 等進入工作流程;官方也將它定位為 LLM/RAG 的即時網頁內容。因此它不只是一次性爬蟲,而可能成為正式資料來源,必須同時管理可靠性、授權、隱私和血緣。
機器人、監控與可靠性
機器人可以開啟頁面、登入、點擊、輸入參數、展開隱藏內容、翻頁、造訪詳情頁、擷取欄位並比較後續執行。Deep Scraping 能把列表和詳情合成完整紀錄,但每個詳情頁都是獨立 Task 與成本。
無程式碼不等於免維護。按鈕改名、DOM 變動、A/B Test、地區語言、Cookie 彈窗、Session 過期、Proxy 被封、無限捲動或 JS 延遲,都可能造成缺失、錯位甚至「成功但空」。CAPTCHA 與住宅代理也不能保證完整或合法。
正式環境應定義預期資料列與必填欄位,驗證型別/唯一性,定期與來源抽樣對帳,保留來源 URL 和擷取時間,對漂移告警並隔離巨大變化,同時準備授權資料源或人工備援。登入/未登入、桌面、地區、翻頁和錯誤狀態都要測試。
現行價格與 Credit 成本
Free 每月 50 Credits、2 個網域、3 使用者;Personal 年繳 $228 含全年 12,000 Credits、5 網域、3 使用者,月繳方案 $48/2,000;Professional 年繳 $828 含全年 60,000、10 網域、10 使用者,月繳起價 $87/5,000;Premium 年繳起價折合 $500/月,含 600,000+、客製上限和代管設定。另有更高額度、網域 Add-on 與 Top-up。年繳額度全年可彈性使用,但週期末歸零;標準資料保留顯示為 90 天。
標準網站每個 Task 至少 1 Credit,10 列或 1 張截圖為 1。Premium 來源最低/倍數為 2–10。100 項列表約 10 Credits,但繼續存取 100 個詳情頁至少再加 100;每三天監控 10 個詳情頁約每月 100,尚未計入 Premium、重試、截圖或下游步驟。必須以真實 PoC 估算並預留失敗和重訓空間。
憑證、資料與安全
隱私政策稱需登入時可能收集 Origin URL、使用者名稱、Session Cookie、Local Storage 參數與密碼,密碼加密。Browse AI 表示加密輸入不會記入日誌,支援人員看不到加密輸入,只有使用者明確要求後才可存取 Robot 且行為受監控;其稱已完成 SOC 2 Type II,並提供 Trust Center。
價格表的標準保留為 90 天,而隱私政策對其他個資採用目的和法定義務期間。應分別確認結果、截圖、執行日誌、Cookie、憑證、備份、匯出、支援材料和刪除帳號後的保留。使用專用最小權限帳戶,避免個人憑證,限制 Workspace 角色/API Key,停用 Robot 時立即撤權和輪替。
條款稱客戶保留 Customer Data 權利,但授予提供/改善服務及產生彙總資料所需的處理許可。隱私政策明確「不用于訓練通用 AI/ML」的僅是 Google Workspace API 資料,不能擴大成所有資料的統一不訓練承諾;敏感情境需審查正式 DPA 和 Trust 證據。
抓取權利與下游 AI
能開啟頁面不等於獲准收集、再發布、建立人物剖析或出售內容。自動化前記錄來源所有者、存取方式、條款、robots 指引、Rate Limit、著作權/資料庫權、個資法律基礎、告知/刪除義務、合約限制和允許的下游目的。登入資料、人物檔案、醫療/金融、未成年人、著作權媒體與競爭性再發布需要更高審查。
採用緩慢可預測的排程、快取未變動頁面、只收集必要欄位、執行刪除/抑制並按需標示來源。若輸出進入 LLM,模型供應商成為新的資料目的地,有獨立訓練、保留、地區與 Prompt Injection 風險。每列保留 Provenance,把抓來的指令當不可信資料而非可執行命令。
結論
Browse AI 是手動瀏覽與工程化資料管線之間的實用橋梁。Recorder、監控、整合和低門檻免費方案,適合驗證一個獲授權來源能否形成有用工作流程。
上線仍需正式環境紀律:驗證 Schema/完整性,按詳情頁和頻率計算 Credits,隔離憑證,縮短保留,記錄來源許可並治理每個匯出。最好的機器人不只是持續執行,而是資料始終準確、獲授權、可追蹤且經濟。
