资讯

基元律动发布模型NeoHorse,探索Harness驱动的RSI路径

雷峰网·2026/9/8 06:31:00🔗 原文

📋总体概括

基元律动(TokenRhythm)联合无问芯穹、清华、北大、阿里等机构发布首个Agent-Native模型NeoHorse-1,含4B和9B两个版本。该模型以自研Routing Harness系统OpenSquilla产生的执行轨迹为核心训练语料,保留工具调用与环境反馈的完整过程,结合路由信号、Agent执行监督和在策略蒸馏进行后训练。评测显示4B版在11项基准中未加权平均分最高,并在五项基准上超过Qwen3.5-9B底座。这是将Agent执行经验转化为模型能力的递归自我改进(RSI)单轮工程验证。

关键信息

  • 基元律动由前华为诺亚方舟实验室主任、盘古大模型负责人王云鹤创办,联合无问芯穹、清华、北大、阿里等机构推出NeoHorse-1。
  • NeoHorse-1包含4B和9B两个版本,定位为首个Agent-Native模型,将工具使用、反馈接收和纠错经验内化为模型能力。
  • 训练语料以Routing Harness系统OpenSquilla产生的执行轨迹为核心,经完整性检查和多维质量评估后用于后训练。
  • 4B版在11项Agent执行、工具交互、代码和指令遵循基准中未加权平均分最高,并在五项基准上超过Qwen3.5-9B底座。
  • 改善集中于流程清晰、反馈可观察、结果可验证的任务;更大模型在复杂状态维护、长程调试和失败恢复中仍占优。

🔥犀利点评

这是AI公司而非体育公司的事,但从产业视角看,关键点在于:小模型靠执行轨迹超越大一号的底座,验证了「用Harness数据喂模型」这条RSI路径的可行性。不过所谓RSI目前只是单轮工程验证,五项基准的领先也集中在可验证任务上,长程调试等硬骨头仍是大模型的天下。故事讲得漂亮,真本事还要看下一轮递归能不能跑通。

本文由本站自动聚合,以下为原始来源:前往 雷峰网 阅读全文