无问芯穹与基元律动联合发布首个Agent-Native模型NeoHorse

2026-09-09 15:47:52 来源: 科技日报 点击数:

科技日报记者 李均

9月8日,基元律动联合无问芯穹,与清华大学、北京大学、阿里巴巴等机构推出首个Agent-Native模型NeoHorse-1。该模型包含4B和9B两个版本,旨在将Agent使用工具、接收反馈和修正错误的经验系统性转化为模型自身能力。

基元律动由前华为诺亚方舟实验室主任、盘古大模型负责人王云鹤创办,公司此前开发的开源Routing Harness系统OpenSquilla,为NeoHorse训练提供核心语料;无问芯穹则为NeoHorse训练及推理提供底层基础设施支撑与Infra优化技术能力。双方联合清华大学、北京大学团队参与算法和训练方法研究,共同探索提升Agent后训练数据利用效率和训练效果的新路径。

与传统模型依赖公开语料和教科书式“问答”数据不同,NeoHorse大量引入真实Agent任务中的结构化执行轨迹,包括何时搜索、何时调用工具、工具返回什么、下一步如何走、走错了如何回头。这些轨迹记录的并非“题和答案”,而是“做事的过程”。团队利用轨迹数据中隐含的路由难度信号组织课程学习,让模型先接触低难度样本、再逐步过渡到复杂轨迹,并结合策略蒸馏纠偏模型自身真实偏差。

在覆盖Harness Agent、工具使用、代码和指令遵循的10项基准评测中,经Agentic Post-Training的NeoHorse-1 4B模型未加权平均分位居同类模型之首,在五项基准上超过Qwen3.5-9B底座模型。提升最为集中的是流程清晰、反馈可观察、结果可验证的任务类型;而9B版本在复杂状态维护、长程调试和失败恢复中仍保持明显优势。

基于无问芯穹的底层基础设施和Infra优化技术能力,模型NeoHorse-1在研发中获推理优化、弹性训练系统等有力支持,实现大量推理(积累轨迹),显著提升训练效率及稳定性。面向推理场景,无问芯穹深耕计算通信重叠、序列并行通信等一系列模型推理优化关键技术,从单点优化走向系统级协同优化,从集群规模优化到跨集群优化,过去一年已实现推理成本下降90%,未来仍有10倍下降空间。在模型训练中,无问芯穹通过DynaTrain弹性训练系统将传统分布式训练“启动即锁定”的刚性模式改造为可在线增删GPU、可在线整体迁移的动态训练,在千卡以上规模中将单机故障恢复开销从传统方案的十几分钟压缩至5秒内。

NeoHorse-1的发布也是一次面向RSI方向的单轮工程验证:Agent执行轨迹,评测暴露能力短板,训练选择随之调整,模型完成更新并重新返回Harness。

依托多元异构、软硬协同、自主式AI等技术优势,无问芯穹实现对前沿大模型稳定高效训练的系统级支持。面向Agentic AI时代,无问芯穹已推出Agentic Infra产品与服务体系。该体系立足基础设施,向下汇聚能源与芯片,向上支撑模型与应用,不仅提升底层资源向AI生产力转化的规模与效率,更以基础设施智能体蜂群赋能资源规模扩展、Token生产效率提升,支持Agentic AI的持续进化。目前,无问芯穹正服务千余家AI企业与科研机构,覆盖大模型开发与运行全生命周期,持续输出高质量、大规模、高效率的AI生产力。

(受访单位供图)

责任编辑:孙莹
网友评论
最热评论
没有更多评论了

抱歉,您使用的浏览器版本过低或开启了浏览器兼容模式,这会影响您正常浏览本网页

您可以进行以下操作:

1.将浏览器切换回极速模式

2.点击下面图标升级或更换您的浏览器

3.暂不升级,继续浏览

继续浏览