StartLux 开源决策模型公开评测成绩超 Jev 登顶榜首
7 小时前

成立不到5个月的上海AI企业StartLux,推出了完全开源的决策模型StartLux-Decision。在Decision Index 0.2.1的38项基准测试中,该模型有31项成绩超越热门模型Jev,综合得分领先近6分。在36局国际象棋对弈中,它赢下了35局,成为当前公开评测下全球最强的开源决策模型。StartLux-Decision推出了五档参数量版本及对应的量化模型,支持本地部署。它针对高频判断场景进行了优化,具有响应速度快、调用成本低的特点,能够填补本地智能系统的高频决策层级,与通用大模型形成分工,提升整体运行效率。该模型从立项到完成首轮研发验证仅用了3天时间,这得益于团队长期搭建的Auto Research异构多模型协作研发体系,目前该体系已推进到RSI三级阶段。此次发布是StartLux本地智能系统架构按计划落地的一部分,团队后续将持续推进系统整合,预计年内将推出首个面向公众的本地智能体验版本。