BrowserSkill打通登錄瀏覽器
騰訊開源了一款名為 BrowserSkill 的瀏覽器技能框架,主打讓智能體(Agent)直接調用真實瀏覽器完成各類操作。這則消息由開發者社群帳號「」披露後,迅速在技術圈引發討論。與市面上多數依賴無頭瀏覽器(headless browser)或模擬 HTTP 請求的方案不同,BrowserSkill 選擇了一條更貼近日常使用情境的路線——「接管現有瀏覽器」,把重點放在打通已經處於登錄狀態的瀏覽環境。從公開資訊來看,BrowserSkill 的整體架構由三個部分組成:CLI、瀏覽器擴展,以及一個接入 Shell 的代理層。
三者分工明確,各自承擔不同環節的職責,共同構成一套可被智能體驅動的瀏覽自動化體系。其中,瀏覽器擴展負責與瀏覽器本體通訊。它像是框架伸進瀏覽器內部的觸手,負責建立連結、傳遞指令與回收執行結果,是整套方案能「接管」瀏覽器的關鍵所在。CLI 則提供了統一的操作入口。使用者或上層系統可以透過命令列方式下達指令,不必深入理解底層通訊細節,就能觸發對應的瀏覽行為,降低了接入與測試的門檻。至於接入 Shell 的代理層,是這套框架最具特色的一環。
它讓智能體能夠以命令列的方式觸發瀏覽操作,等於在 Agent 與瀏覽器之間架起了一座橋樑:Agent 輸出命令、代理層負責轉譯與轉發、擴展在瀏覽器端執行,最終把結果回傳給智能體。這種「CLI+擴展+Shell 代理」的三段式拆分,帶來的好處相當直接。首先是登錄態得以沿用——使用者早已登入的網站,不必重新走一遍認證流程;其次是 Cookie 能夠直接複用,避免了模擬請求時頻繁遭遇的驗證與封鎖;再來是既有分頁也能被納入操作範圍,讓自動化流程更接近真人在瀏覽器中的實際行為。換句話說,BrowserSkill 想解決的核心痛點,正是長期困擾瀏覽器自動化領域的「認證斷層」。
傳統方案往往需要重新登錄、維護獨立的 Cookie 容器,或面對日益嚴格的反自動化機制;而接管真實瀏覽器的思路,則試圖把這些障礙降到最低。這條技術路線並非憑空出現。近一年來,「讓 Agent 操作真實瀏覽器」逐漸成為智能體落地的重要方向之一。無論是自動填表、資料抓取、跨站操作,還是需要登錄權限的複雜任務,真實瀏覽器環境往往比無頭方案更能貼近生產場景。BrowserSkill 的出現,正好踩在這個需求點上。市場反應也印證了這股熱度。該項目目前累積約 4.1k 顆星,單日新增約 1.3k 顆星,成長曲線相當陡峭。
對一個開源項目而言,單日破千的漲幅並不多見,顯示開發者對這條技術路線抱有相當高的關注與期待。這種熱度背後,反映的是社群對「真實瀏覽器+智能體」組合的普遍看好。相較於重新造輪子去模擬瀏覽行為,直接接管一個已經登錄、已有上下文的瀏覽器,在工程上顯然更省力,也更接近使用者真正想要的自動化體驗。不過,熱度並不等於成熟。就目前公開資訊而言,BrowserSkill 的實際能力邊界仍有待釐清:它能處理多複雜的頁面互動?面對動態載入、驗證碼或風控機制時表現如何?多分頁、多帳號情境下是否穩定?這些問題都還沒有足夠的公開驗證。穩定性同樣是觀察重點。
接管真實瀏覽器雖然規避了部分認證難題,卻也意味著要面對瀏覽器版本差異、擴展權限限制、頁面結構變動等現實變數。框架能否在長時間運行與高頻操作下保持可靠,仍需更多使用者實測。此外,登錄態的沿用雖然便利,卻也牽涉安全與隱私層面的考量。當智能體能直接操作已登錄的瀏覽環境,權限邊界該如何界定、操作紀錄如何留存、敏感資料如何保護,都是這類方案走向實用時無法迴避的課題。整體而言,BrowserSkill 以「接管現有瀏覽器」為切入點,透過 CLI、瀏覽器擴展與 Shell 代理層的三段式架構,嘗試為智能體提供一條更貼近真實使用情境的操作路徑。
它能否從一時的關注熱潮,沉澱為被廣泛採用的基礎設施,關鍵仍在於能力邊界與穩定性能否經得起更多使用者的檢驗。
Related
相關文章

長安汽車首席專家譚歡:未來要用機器人造車、賣車,讓機器人上車、造機器人
作者:清源 責編:清源 評論: 9 月 18 日消息,在今天(18 日)的第 22 屆中國汽車產業發展(泰達)國際論壇“新賽道生態專場:具身智能新賽道”活動中,長安汽車首席專家、長安天樞智能機器人公司總經理譚歡在演講中指出,AI 正推動以物理具身智能為核心的基礎設施革新,汽車未來形態是“汽車機器人”—— 自學習、自組織、自進化的組合智能體。

具身智能技術路線尚未定型,基礎設施卻先收斂
具身智能技術路線尚未成形,但基礎設施需求已開始收斂,重點從製造機器人轉向持續迭代機器人能力。百度集團沈抖指出,智能體能力邊界快速擴展,進入規模化部署階段,但機器人學習新任務與跨環境適應性仍待突破。

88小時抵一個人思考4000年,OpenAI核心研究員:除了自我進化,更可怕的是AI正學會“隱藏自己”
AI正在把4000年的人類認知勞動壓縮進88小時,OpenAI研究員Noam Brown坦言連他自己也被進展速度持續震驚。AI正在把過去需要數千年完成的認知勞動壓縮到數天。真正的問題已經不只是模型能否變得更聰明,而是實驗能否跟上、人類能否在模型繼續自我改進前確認它仍然安全。
Agent辦事、花式P圖、動嘴玩電腦……實測Wildcat Lake輕薄本玩AI有多爽
作者 | ZeR0 編輯 | 漠影 桂林依山傍水,連城市的輪廓,都是一座座山勾勒出來的。抬眼一望,便是翰墨丹青般的自然光景,既沉靜婉約,又意境悠遠。這種乾淨的留白之美,早已被古人融入山水畫藝中,幾筆山石,一帶煙雲,餘下的留給水色,也留給看畫的人。 淨,並非空無一物,而是通過剋制的取捨,讓真正重要的東西凸顯出來。這與今年推出的第三代英特爾酷睿處理器(代號Wildcat Lake)的設計理念不謀而合。

吳恩達回應AI末日論:別被科幻敘事帶偏,應解決現實工程問題
吳恩達曾參與創辦Google Brain和Coursera。吳恩達稱,科技行業早期曾放大AI潛在災難性風險,以獲取關注並影響監管方向;近兩週相關討論再次升溫,也可能存在類似動機。他認為AI確實存在現實風險,尤其包括網絡安全等領域,但不認同將人類滅絕風險作為當前AI發展的核心判斷依據。

智譜 GLM-5.3-FlashX 模型上線,更快、更流暢
作者:汪淼 責編:汪淼 評論: 感謝網友 Agent 的線索投遞!9 月 18 日消息,智譜今日宣佈推出 GLM-5.3-FlashX(最高 200 tokens/s),為企業與開發者帶來更快、更流暢的模型體驗。智譜官方表示,GLM-5.3-Flash 此前以“Ox Alpha”之名與全球開發者見面,獲得海內外開發者的廣泛認可,調用量持續攀升。