让 AI 整理一份业务资料,往往要先点网页,再运行代码,最后把结果写进没有专用接口的软件。Holo4 想用同一个模型包办这些步骤:它既能读屏、点击和输入,也能写并运行代码,还能调用 MCP——连接工具与数据源的开放协议——以及传统 API。这样,开发者不必为桌面、网页、Android 或代码沙箱分别选择模型。
Holo4 提供 27B 稠密模型和 35B-A3B 混合专家模型;后者把参数分给多个“专家”,每次只启用一部分,以控制运算量。作者称,两款模型经过监督学习和强化学习训练,面向真实业务流程。在测试长流程桌面操作的 OSWorld 2.0 上,Holo4 27B 得分 61.7%,低于 Opus 5.5 的 81.8%;35B-A3B 得分为 30.9%。团队还公开了公开基准对应的操作轨迹,方便逐步回放。不过,材料也提醒,不同模型采用的版本、测试工具和任务子集并不完全一致,因此成本与成绩只能谨慎横向比较。