据量子位9月3日报道,退隐十年的盛大网络联合创始人陈大年复出,创办本地模型公司StartLux(原点星辉)。该公司首款模型StartLux-V1.0-27B-Preview在中国信通院MCP专项测试中综合排名第二,仅次于参数规模达1.6万亿的DeepSeek-V4-Pro,两者差距仅1.3个百分点。

陈大年是中国初代程序员,曾与陈天桥共同创办盛大网络,并孵化出国民级产品“WiFi万能钥匙”。此次复出,他把方向押在本地模型上。报道称,他在盛大创新院18周年聚会上提出“AI时代有八条非共识”,其中四条均强调本地模型,包括“本地模型会完全摧毁云端市场”“模型拼参数的玩法要OUT了”。StartLux便被描述为全球第一家真正意义上的本地模型公司,专注可在消费级PC上直接运行的小参数模型商业化。

StartLux-V1.0-27B-Preview只有27B参数,却与万亿级云端模型同场竞技。中国信通院可信AI大模型基准测试MCP专项围绕真实应用场景设置位置导航、网页搜索、浏览器自动化、金融分析、代码仓库管理、3D设计六类任务,并综合评估Agent的多工具协同、复杂任务执行和真实环境交互能力。结果显示,StartLux-V1.0-27B-Preview综合得分39.25%,排名第二,超过284B参数的DeepSeek-V4-Flash-0731和198B的Step-3.7-Flash,落后DeepSeek-V4-Pro 1.3个百分点。位置导航、金融分析和浏览器自动化三个单项均列第一。与同为27B的基座模型Qwen3.6-27B相比,该模型得分高出5.34个百分点。

量子位的报道还展示了两场与Claude Sonnet 4.6的实战对比。在计算微软股票投资回报时,Claude因未修正2025年1月8日为非交易日而得到错误结论;StartLux则先回查原始数据,再验证目标日期附近的行情,计算出可复核的正确答案。在浏览器查询机票任务中,StartLux用时约95秒、操作12步,找到新加坡飞北京、不落大兴机场的299美元直飞经济舱;Claude用时两百多秒、操作21步,最低报价为556美元。

在技术路径上,StartLux-V1.0-27B-Preview以Qwen3.6-27B为基座,利用自研的Auto Research后训练方法,让模型在真实工具环境中自主执行任务,根据反馈调整策略,强化任务理解、工具选择、参数构造、多步执行、状态检查和结果验证等能力。陈大年认为Scaling Law是“过路神仙”,“没有它,AI起不来。但它只是从AI的发展路径上路过,未来不一定属于它。”在他看来,大模型技术路径正在分化,继续堆参数并非唯一通解。

报道称,Meta、Google、NVIDIA近期也在加码本地小模型,但大多处于实验或偏极客阶段,以本地模型产品化为主的目前只有StartLux。公司团队中,联合创始人兼CTO郭权玮拥有国立阳明交通大学计算机科学博士学位,曾任幻量科技首席算法科学家;联合创始人罗永祥曾担任摩根士丹利亚洲董事总经理。陈大年透露,StartLux计划年内面向企业和个人用户推出第一代本地智能解决方案,目标是让部署像安装Office一样一键完成。