近日,中国信通院人工智能研究所公布的可信AI大模型基准测试(MCP专项)结果显示,上海StartLux公司研发的本地大模型StartLux-V1.0-27B-Preview以27B参数量取得综合性能排名第二,超越284B的DeepSeek-V4-Flash和198B的Step-3.7-Flash,性能进入万亿参数模型能力区间。
该测试覆盖位置导航、网页搜索、浏览器自动化、金融分析等6类任务,StartLux在位置导航排名第一,在浏览器自动化、金融分析等任务上与1.6T参数的DeepSeek-V4-Pro并列第一。StartLux基于Qwen3.6-27B进行后训练,采用AI训练AI(Auto Research)方法,实现小模型性能跃升。
业内认为,本地模型正成为趋势,Google、Meta、NVIDIA等纷纷推出本地模型。StartLux-V1.0-27B-Preview可在消费级PC上运行,公司计划年内推出本地智能解决方案,并持续研究扩散式语言模型等新架构。