9月29日,量子位和爱范儿分别报道了IQuest Research的IQuest-Q1与匿名模型Space Bunny Alpha。前者展示了从生成小游戏到定位强化学习训练故障的能力,后者过去一周在海外AI圈走红,可依据手绘草图生成可交互网页。

据量子位报道,IQuest-Q1采用decoder-only Transformer主干和稀疏MoE架构,总参数约320B,激活参数约15B。其官宣信息显示,模型参与自身研发迭代:方案经人类研究者通过后,经验证的模型更新、训练资产和研究流程进入下一轮;每轮积累的数据流程、训练配置、评估方法和工具成为后续版本可复用的资产。

实测中,量子位用约200字提示词让IQuest-Q1生成竖屏手机HTML游戏《国庆卧室保卫战》,游戏含NPC和血条,可用枕头攻击、回床回血,结束后随机给出奶茶、炸鸡、看电影等目标提示,战果可保存。另一项官方Blog案例显示,一场RL训练Reward曲线未按预期爬升,研究人员让IQuest-Q1基于Claude Code CLI分析训练日志、落盘轨迹并从代码库反向追查,最终定位到RL框架接入Scaffold时文本回传与轨迹拼接环节:推理服务在文本解码时额外插入一个空格,导致生成文本与回传历史错位、多轮生成中断;修复后训练恢复正常。

量子位称,IQuest-Q1在仓库级代码生成NL2Repo、网络安全基准CyberGym、终端Terminal-Bench 2.1、代码长程任务DeepSWE v1.1等评测中表现不俗。其团队至知创新研究院IQuest Research在7月底至8月提出MuonH优化、UBio-MolFM和稀疏权重分解;9月16日参与提出的ModularRSI自进化框架登上Hugging Face日榜第二,将Agent在Terminal-Bench 2.0和SWE-Bench Verified的准确率从47.57%、73.40%提升至52.43%、76.45%。

据爱范儿报道,Space Bunny Alpha没有技术报告,也没有大模型公司认领,只在OpenRouter和OpenCode上线,随后靠网友实测冲上两个平台日调用量第一。OpenRouter称其反应快、一次能记住很多内容;用户反馈它能看图、写代码,也能打开工具、修改文件,把任务逐步做完。

爱范儿测试显示,将一张唱片店手绘草图交给Space Bunny Alpha,不到5分钟得到一个可打开的网站。模型能识别圆圈代表唱片、波浪线代表介绍、写着“买”的方框代表按钮,以及购物袋旁箭头代表动画方向,并自行补全背景和排版。更随意的草图可生成可逛的3D网页,转动镜头能看到家具侧面,点唱片会抽出封套,点试听台则唱片上转盘、唱针落下并旋转。在对比测试中,它与GPT-6 Astra生成体素风格日式花园时细节更胜一筹;在火箭发射场景中表现几乎可与Sol 6、Grok 4.7和Gemini 3.8 Flash媲美,搭建约3分钟。

爱范儿将其接入DeepSeek Harness后,模型能写文件、启动项目、调用浏览器检查结果,完成太空探索、喷墨占地小游戏和液氧甲烷发动机展台等项目。在3D《桃花源记》测试中,结果符合桃花源特点,但与Opus 5.5的高完成度场景相比,画面少一些细节和质感,复杂3D运动也不如GPT-6 Astra。液氧甲烷发动机教学展品任务中,模型给出银灰金属、管路、涡轮泵、预燃室、燃烧室和钟形喷管,并提供剖视、爆炸图和部件说明,整体可直接交付。爱范儿同时提到,部分网友反馈的“过度思考”问题在推理强度调至Max后出现,任务完成时长可能比旗舰模型更久。

Space Bunny Alpha的身份尚未确定。有人从“太空兔”联想到月之暗面Kimi,但爱范儿称更科学的线索来自分词特征:有研究员用50条字符串进行两轮测试,结果显示它与测试过的八个MiniMax版本全部匹配;开源项目stealthprint也报告了与MiniMax模型相符的分词特征。MiniMax Code仓库的测试代码在9月18日写进“MiniMax-M3.1”配置,包含一百万上下文、强制思考、low/high/max推理档,比兔子上架早五天;9月27日MiniMax静默上线M3.1-Flash-Preview,规格类似。目前该模型在OpenRouter和OpenCode上均可免费调用。