라이프스타일
H Company, Holo4 공개: 화면·코드·API를 모두 다루는 컴퓨터 사용 에이전트 모델
H Company는 2026년 9월 28일 Holo4 에이전트 모델 시리즈를 발표했습니다. 27B와 35B-A3B 두 가지 규모로 제공되며, 단일 모델로 GUI, 코드, MCP, API를 다룰 수 있다고 밝혔습니다. 공개 내용과 자체 벤치마크 수치, 일반 독자에게 주는 의미를 정리했습니다.
읽는 데 약 8분

H Company가 발표한 내용
H Company는 2026년 9월 28일 Hugging Face 블로그에서 Holo4를 새로운 에이전트 모델 시리즈로 공개했습니다. 여기서 '에이전트 모델'은 질문에 답만 하는 것이 아니라 소프트웨어를 직접 조작해 작업을 수행하는 AI를 뜻합니다. Holo4는 27B 덴스 모델과 35B-A3B 전문가 혼합(Mixture of Experts) 모델 두 가지 규모로 나옵니다. 27B, 35B는 모델 크기를 나타내는 파라미터 수(각각 약 270억, 350억 개)이며, 덴스 모델은 모든 파라미터를 항상 사용하고 전문가 혼합 모델은 작업마다 모델의 일부만 골라 사용하는 구조입니다. 둘 다 H Models API로 이용할 수 있습니다. 회사는 Holotron 3의 업데이트 버전인 Holotron4 Nano도 함께 공개했습니다.
H Company는 Hugging Face에 Holo4 전체 컬렉션을 올렸으며, 모델 파일 형식으로 FP16, FP8, GGUF를 제공합니다. 회사는 또한 Holo4가 기반인 Qwen 모델보다 크게 향상되었다고 밝혔으며, Qwen3.8 27B가 Holo4 27B의 기반 모델이라고 설명했습니다.
자세한 설명 보기
출처를 수집하고 독립적으로 검증한 뒤 Jev가 판단합니다.
'하나의 모델로 모든 인터페이스를 다룬다'는 의미
H Company에 따르면 대부분의 에이전트 모델은 하나의 인터페이스만을 대상으로 학습됩니다. 그래픽 인터페이스(GUI, 화면의 버튼과 메뉴)에 특화된 모델은 화면이 없으면 작동하지 못하고, 도구 호출을 선호하는 모델은 API(프로그램끼리 데이터를 주고받는 창구)가 없는 애플리케이션 앞에서 막힙니다. 회사는 Holo4가 화면에서 클릭과 입력을 하고, 스스로 코드를 작성·실행하며, MCP(AI가 외부 도구와 서비스에 연결하는 방식)나 API 도구를 호출하는 등 작업에 맞는 방식을 선택할 수 있다고 설명합니다.
H Company에 따르면 Holo4는 데스크톱, 웹, Android, 코드 샌드박스(코드를 안전하게 실행하는 격리 공간), 상용 API에서 실행할 수 있으며, 어느 환경이든 같은 모델을 같은 방식으로 호출합니다. 플랫폼별로 다른 모델을 고를 필요가 없다는 것입니다.
H Company가 공개한 벤치마크 수치
OSWorld 2.0은 AI가 데스크톱 컴퓨터를 얼마나 잘 조작하는지 측정하는 학술 벤치마크(성능 비교 시험)이며, H Company는 이를 해당 분야에서 가장 어려운 벤치마크 가운데 하나로 소개했습니다.
| 모델 | OSWorld 2.0 점수(H Company 정리) | 비고 |
|---|---|---|
| Holo4 27B | 61.7% | H Company 자사 모델 |
| Holo4 35B-A3B | 30.9% | H Company 자사 모델 |
| Opus 5.5 | 81.8% | H Company가 비교 대상으로 제시 |
| Opus 5 | 70.2% | H Company가 OpenAI 발표 차트 인용 |
| GPT-5.6 Sol | 66.2% | H Company가 OpenAI 발표 차트 인용 |
H Company는 Holo4가 장기 작업에서 최상위 폐쇄형 모델에만 뒤처질 뿐이며, 파라미터 수는 몇 자릿수 적고 비용은 훨씬 낮다고 주장합니다. 회사 설명에 따르면 비용은 에이전트 실행 1회당 입력·출력 토큰(AI가 처리하는 텍스트 단위)을 기준으로 추정했으며, Holo4는 H Models API 요금으로 계산했습니다. API 활용 능력을 보는 벤치마크인 AutomationBench에 대해서는 Holo4의 점수와 비용을 자체 내부 실행 환경에서 측정했다고 밝혔고, 평가를 마친 뒤 비공개 테스트 세트에서의 Holo4 결과를 공개하겠다고 했습니다.
실제 작업 사례와 학습 방식
H Company는 동일한 프롬프트와 실행 환경으로 Holo4 27B와 기반 모델 Qwen3.8 27B의 전문 소프트웨어 작업 성능을 비교하고, 각각의 호출 횟수와 토큰 사용량을 공개했습니다.
- Godot으로 Pac-Man 게임 제작: Holo4 27B는 호출 68회, 2.4M 토큰, 코드 268줄. Qwen3.8 27B는 호출 197회, 11.4M 토큰, 코드 327줄.
- FreeCAD로 에펠탑 모델링: Holo4 27B는 호출 84회, 1.3M 토큰. Qwen3.8 27B는 호출 60회, 1.0M 토큰.
- FreeCAD로 H 로고 모델링: Holo4 27B는 호출 94회, 1.5M 토큰. Qwen3.8 27B는 호출 118회, 1.9M 토큰.
학습과 관련해 H Company는 Holo4가 지도 학습과 강화 학습을 통해 다양한 환경과 작업에서 훈련되었으며, 여기에는 자사 Agentic Task Factory가 생성한 작업도 포함된다고 밝혔습니다. 이 내부 도구는 지금까지 웹 애플리케이션, MCP 서버, 데스크톱 환경에서 약 10,000개의 작업을 생성했습니다. 회사는 모델의 동작을 실행하고 수백 단계에 걸친 맥락을 관리하는 실행 환경(하네스)도 재구축했으며, 가장 큰 변화는 에이전트가 수백 단계를 추적할 수 있는 신뢰성 있는 메모리와 데스크톱 머신 자체의 셸(명령어 입력 창)을 갖추게 한 것이라고 설명했습니다.
일반 독자에게 주는 의미
'컴퓨터 사용 에이전트'란 사람처럼 화면을 보며 버튼을 클릭하고 텍스트를 입력하거나, 코드와 API를 활용해 작업을 완수하는 AI를 말합니다. H Company의 주장이 사실이라면, 기업은 앞으로 플랫폼마다 다른 모델을 준비하지 않고도 웹, 데스크톱 소프트웨어, 내부 시스템을 넘나드는 업무를 자동화할 수 있을지도 모릅니다. 일반 사용자에게 이런 기술은 현재로서는 일상 소비자 제품보다 주로 직장의 자동화 도구에 영향을 줍니다.
동시에 AI가 컴퓨터를 직접 조작한다는 것은 실제 행동을 실행할 수 있다는 뜻임을 기억해야 합니다. 이러한 에이전트 도입을 검토하는 조직은 먼저 격리된 환경에서 테스트하고, 접근 가능한 계정과 데이터를 제한하며, 중요한 작업에는 사람의 검토 단계를 두어야 합니다. 이 글은 뉴스 정리일 뿐이며 구매 권고가 아닙니다.
자주 묻는 질문
Holo4는 누가, 언제 발표했나요?
H Company가 2026년 9월 28일 Hugging Face 블로그에서 발표했습니다.
Holo4에는 어떤 버전이 있나요?
H Company에 따르면 Holo4는 27B 덴스 모델과 35B-A3B 전문가 혼합 모델 두 가지 규모가 있으며, 모두 H Models API로 이용할 수 있습니다. 회사는 Holotron4 Nano도 함께 공개했습니다.
Holo4는 정말 다른 모델보다 저렴하고 성능이 좋나요?
H Company는 Holo4가 훨씬 낮은 비용으로 최첨단 모델과 경쟁한다고 밝혔지만, 공개된 OSWorld 2.0 수치에서 Holo4 27B의 61.7%는 Opus 5.5의 81.8%보다 낮습니다. 이 수치는 회사가 자체 정리한 것이며, 모델별 테스트 조건이 다르다고 명시되어 있고, 현재 독립 검증은 확인되지 않았습니다.
이 벤치마크 결과를 직접 확인할 수 있나요?
H Company는 공개 벤치마크 점수의 근거가 되는 모든 실행 궤적을 오픈소스로 공개한다고 밝혔으며, trajectories.hcompany.ai에서 재생하거나 Hugging Face에서 내려받을 수 있습니다.
Holo4는 어떤 플랫폼에서 작동하나요?
H Company에 따르면 Holo4는 데스크톱, 웹, Android, 코드 샌드박스, 상용 API에서 실행할 수 있으며, 모두 같은 모델을 같은 방식으로 호출합니다.
같은 주제의 글
라이프스타일
NVIDIA, DGX Spark 64GB 모델 출시: 10월 23일 판매 시작, 시작가 4,999달러, 두 대 연결 시 128GB
NVIDIA는 2026년 10월 2일 개인용 AI 컴퓨터 DGX Spark에 더 저렴한 64GB 메모리 모델을 추가한다고 발표했다. 10월 23일부터 Acer, ASUS 등 6개 제조사를 통해 공급되며, 주요 대상은 자신의 기기에서 AI 모델을 실행하려는 개발자와 연구자다. NVIDIA가 공개한 사양, 두 대 연결에 관한 설명, 그리고 일반 독자에게 갖는 의미를 정리했다.
라이프스타일
Google Cloud, Spanner queues 정식 출시 발표: 메시지 큐를 데이터베이스 트랜잭션에 통합해 AI 에이전트 신뢰성 겨냥
Google Cloud가 Spanner queues 정식 출시를 발표했다. 메시지 생성을 데이터베이스 트랜잭션의 일부로 만들어 AI 에이전트의 '상태'와 '동작'이 어긋나는 문제를 해결하겠다는 것이다. 공식 설명, 주요 기능, 일반 독자에게 갖는 의미를 정리했다.
라이프스타일
GPT-6.1 Sol 출시: 새 버전 Sol, API·Codex·ChatGPT Work에서 제공, Chat에는 없음
OpenAI는 2026년 9월 29일 GPT-6.1 Sol을 출시했습니다. API 이름은 gpt-6.1-sol이며, Plus, Pro, Business, Enterprise, Edu 요금제의 Codex와 ChatGPT Work가 출시 시 제공 범위에 포함되고(Enterprise와 Edu는 관리자가 켜야 함), Free와 Go는 출시 시 포함되지 않으며, Chat에는 없습니다(2026년 9월 확인).
라이프스타일
Claude Sonnet 5.5 출시: 정가는 Sonnet 5와 같고, API·클라우드 플랫폼·Claude.ai에서 사용 가능
Anthropic은 2026년 9월 28일 Claude Sonnet 5.5를 출시했습니다. API 정가는 Sonnet 5와 같고(100만 tokens당 입력 2달러, 출력 10달러), Claude.ai, API, 여러 클라우드 플랫폼에서 사용할 수 있으며, 위험도가 높은 사이버 보안 요청은 Sonnet 5로 되돌려 처리됩니다(2026년 9월 확인).
최신 여행 소식·가이드

가이드도쿄
도쿄 어디에 묵을까? 신주쿠·우에노·도쿄역·시부야·아사쿠사·이케부쿠로·긴자 일곱 지역 비교: 공항 교통, 숙박세, 짐 배송까지
도쿄 어디에 묵을까? 신주쿠, 우에노, 도쿄역, 시부야, 아사쿠사, 이케부쿠로, 긴자 일곱 지역을 같은 기준으로 비교한다. 나리타·하네다 공항에서 오는 방법, 교통 노선, 주변의 볼거리, 동네 분위기, 적합한 여행자를 비교표와 야마노테선 안내도로 살펴보고, 2026년 9월에 확인한 도쿄도 숙박세(2027년 4월부터 3%)와 공항 택배로 짐을 보내는 규정도 정리했다.
- 예산
- 호텔

가이드도쿄
도쿄 교통패스 선택법: Suica/Welcome Suica, Tokyo Subway Ticket, JR Pass는 살 만할까?
도쿄를 처음 여행한다면 먼저 1인당 IC 카드 한 장으로 탈 때마다 결제한다(Welcome Suica는 보증금이 없고 28일간 유효). 하루에 지하철을 4번 이상 타면 2,000엔짜리 Tokyo Subway Ticket 72시간권을 추가하고, 간사이에 가지 않고 도쿄만 여행한다면 JR Pass는 반드시 손해다. TOURIST PASMO, iPhone의 Suica, 도쿄 Metro 하루권의 이용 가능·불가 범위를 결정도로 비교한다. 가격은 2026년 9월 확인.
- 교통
- 예산

가이드도쿄
도쿄 디즈니랜드·디즈니씨 가이드: 티켓 가격, 판타지 스프링스 Fantasy Springs, 디즈니 프리미어 액세스 DPA와 스탠바이 패스 이용법, 첫 방문에는 어느 파크가 좋을까
도쿄 디즈니 하루짜리 패스포트는 변동 가격제로, 2026년 9월에는 평일 대부분이 9,900엔, 주말이 10,900엔이다. 공식 홈페이지에서 매일 14:00에 두 달 뒤 같은 날짜의 티켓을 판매한다. 무료 프라이오리티 패스는 공식 서비스 목록에서 빠져 대기 시간을 줄이는 방법은 유료 디즈니 프리미어 액세스(한 사람당 한 번 1,000~3,500엔)뿐이다. 운영 시간, 25주년 행사, 스탠바이 패스, 엔트리 리퀘스트, 판타지 스프링스 이용법, 첫 방문 때 디즈니랜드와 디즈니씨 중 어디를 고를지도 담았다. 2026년 9월 공식 홈페이지에서 확인했다.
- 추천 일정
- 가족 여행