生活分享

H Company 發布 Holo4:可同時操作畫面、程式碼與 API 的電腦操作代理模型

H Company 於 2026 年 9 月 28 日發表 Holo4 代理模型系列,提供 27B 與 35B-A3B 兩種規模,並宣稱能以單一模型操作 GUI、程式碼、MCP 與 API。以下整理其公布內容、自評基準數據與對一般讀者的意義。

閱讀時間約 6 分鐘

H Company 發布 Holo4:可同時操作畫面、程式碼與 API 的電腦操作代理模型
圖片:Mokaair (Original editorial artwork)

H Company 發布了什麼

H Company 於 2026 年 9 月 28 日在 Hugging Face 部落格公布 Holo4,稱其為新的代理模型系列。「代理模型」指的是不只回答問題、還能自己一步步動手完成任務的 AI。Holo4 有兩種規模:27B 稠密模型,以及 35B-A3B 混合專家(Mixture of Experts)模型。名稱中的 B 代表以十億計的參數量,參數越多,模型通常越大;「稠密」表示每次運算都動用全部參數,「混合專家」則是每次只啟用其中一部分(A3B 即約 30 億個),以節省運算。兩者都可透過該公司的 H Models API(讓其他程式付費呼叫模型的服務介面)使用。該公司同時發布 Holotron 3 的更新版本 Holotron4 Nano。

H Company 在 Hugging Face 列出 Holo4 的完整集合,提供 FP16、FP8 與 GGUF 等不同精度與封裝格式的模型檔案。該公司也表示 Holo4 相較其 Qwen 基礎模型有顯著提升,並指 Qwen3.8 27B 是 Holo4 27B 的基礎模型。

H Company 發布 Holo4:可同時操作畫面、程式碼與 API 的電腦操作代理模型
Mokaair 編輯查核流程 · 圖片:Mokaair (Original editorial artwork)
閱讀完整文字說明

消息會先蒐集來源、獨立查核,再交由 Jev 判斷。

「一個模型通吃各種介面」是什麼意思

H Company 表示,大多數代理模型只針對單一介面訓練:專注圖形介面(GUI,也就是一般人看到的視窗與按鈕)的模型沒有螢幕就無法運作,偏好工具呼叫的模型則在沒有 API(軟體之間互相溝通的介面)的應用程式前受困。該公司稱 Holo4 可以在螢幕上點擊與輸入、撰寫並執行自己的程式碼,並呼叫 MCP(一種讓 AI 連接外部工具的標準介面)或 API 工具,依任務選用合適方式。

根據 H Company,Holo4 可在桌面、網頁、Android、程式碼沙盒(與正式系統隔開、可安全執行程式的環境)及商業 API 上執行,各情境都是同一個模型、以相同方式呼叫,不需要為不同平台挑選不同模型。

H Company 公布的基準數據

H Company 引用的 OSWorld 2.0 是用來測試 AI 操作桌面電腦能力的學術基準,AutomationBench 則測試 AI 使用 API 的能力;該公司稱兩者分別是這兩個領域最難的學術基準之一。

數據全部來自 H Company 的 Hugging Face 文章;該公司註明各模型的版本、測試框架與任務子集不同。
模型OSWorld 2.0 得分(據 H Company 整理)備註
Holo4 27B61.7%H Company 自家模型
Holo4 35B-A3B30.9%H Company 自家模型
Opus 5.581.8%H Company 列為對照
Opus 570.2%H Company 引述 OpenAI 發布圖表
GPT-5.6 Sol66.2%H Company 引述 OpenAI 發布圖表

H Company 表示 Holo4 在長流程任務上僅落後最強的封閉模型,且參數量少了數個數量級、成本低得多。該公司說明,成本是依每次代理執行的輸入與輸出 token(AI 處理文字的計量單位,也是計費依據)估算,Holo4 以 H Models API 費率計價。至於 AutomationBench,H Company 表示 Holo4 的分數與成本是在其內部測試框架中量測,並表示待評估後將公布 Holo4 在私有測試集上的結果。

實際任務範例與訓練方式

H Company 以相同提示與測試框架,比較 Holo4 27B 與其基礎模型 Qwen3.8 27B 在專業軟體上的表現,並公布各自的呼叫次數與 token 用量。這些數字反映的是完成過程中的用量,本身並不代表哪個模型做得更好:

  • Godot 製作 Pac-Man 遊戲:Holo4 27B 使用 68 次呼叫、2.4M token、268 行程式;Qwen3.8 27B 使用 197 次呼叫、11.4M token、327 行程式。
  • FreeCAD 建模艾菲爾鐵塔:Holo4 27B 使用 84 次呼叫、1.3M token;Qwen3.8 27B 使用 60 次呼叫、1.0M token。
  • FreeCAD 建模 H 標誌:Holo4 27B 使用 94 次呼叫、1.5M token;Qwen3.8 27B 使用 118 次呼叫、1.9M token。

訓練方面,H Company 表示 Holo4 透過監督式學習與強化學習,在大量環境與任務上訓練,其中包括其 Agentic Task Factory 產生的任務。該公司形容這是一套內部流程,只靠文件(例如真實網站或開源軟體的截圖)就能建立可互動的環境與可驗證的任務,至今已在網頁應用程式、MCP 伺服器與桌面環境中產生約 10,000 個任務。該公司也表示重建了測試框架,也就是負責執行模型動作、並在數百個步驟中管理上下文的程式迴圈;最大的改動是讓代理擁有可追蹤數百個步驟的可靠記憶,以及在桌面機器本身上的 shell(輸入指令操作電腦的命令列)。

對一般讀者的意義

「電腦操作代理」指的是能像人一樣看著畫面、點選按鈕、輸入文字,或改用程式與 API 完成工作的 AI。若 H Company 的說法成立,企業未來或許不必為每個平台分別準備不同模型,就能自動化跨越網頁、桌面軟體與內部系統的流程。對一般使用者而言,這類技術目前主要影響的是工作場所的自動化工具,而非日常消費產品。

同時也要記得,讓 AI 直接操作電腦代表它能執行真實動作。任何組織若考慮導入這類代理,都應先在隔離環境測試、限制其可存取的帳號與資料,並保留人工審核重要操作的步驟。本文僅為新聞整理,不構成採購建議。

常見問題

Holo4 是誰推出的?什麼時候發布?

由 H Company 於 2026 年 9 月 28 日在 Hugging Face 部落格發表。

Holo4 有哪些版本?

根據 H Company,Holo4 有 27B 稠密模型與 35B-A3B 混合專家模型兩種規模,都可透過 H Models API 使用;該公司同時發布了 Holotron4 Nano。

Holo4 真的比其他模型便宜又好用嗎?

H Company 表示 Holo4 以低得多的成本與前沿模型競爭,但在其公布的 OSWorld 2.0 數據中,Holo4 27B 的 61.7% 仍低於 Opus 5.5 的 81.8%。這些數據由該公司自行整理,且其註明各模型的測試條件不同,目前未見獨立驗證。

可以自己檢查這些基準結果嗎?

H Company 表示已開源公開基準分數背後的每一條執行軌跡,可在 trajectories.hcompany.ai 重播,或從 Hugging Face 下載。

Holo4 可以在哪些平台上運作?

H Company 表示 Holo4 可在桌面、網頁、Android、程式碼沙盒及商業 API 上執行,且都是同一個模型、以相同方式呼叫。

查看同分類最新消息

最新旅遊情報攻略

資料來源

生活分享