Space-Bunny 匿名模型观察:0.03 倍积分、1M 上下文,以及模型选型的算术题

本文基于 WorkBuddy 模型面板里新出现的匿名模型 Space-Bunny 做一次技术向观察。它倍率 0.03x、正在限时折扣,上线十天登顶全球调用量榜首,却至今无人认领。我们按「背景、问题、实操、结论」的顺序,把它的数据、身份猜测、实测口碑和正确用法拆开讲清楚,重点落在「模型选型是一道算术题」这件事上。

这两天我打开 WorkBuddy,模型面板里多了一个名字,Space-Bunny。标着「限时折扣」,倍率 0.03x。它自我介绍那一栏写的是「匿名」,没有发布会,没有技术报告,没有跑分海报。

9 月 23 日上线那天,OpenRouter 上就这么挂着,价格是零。然后三天之后,它登顶了。

9 月 27 号单日,它在 OpenRouter 上被调用了约 3.99 万亿 token,在 OpenCode 上约 8.3 万亿,两个平台同时第一。到 10 月 2 号,OpenRouter 周榜上它以 33.5 万亿排第一,把 DeepSeek V4.1 Flash、腾讯自家的 Hy4 preview、GPT-5.6 Luna 全压在身后。一周之前它还是个查不到的东西。

为什么这件事值得写,得先说倍率表。9 月底我给一帮特教老师上线下课讲选模型,把倍率一个个念过。

那堂课我还强调了一句,千万别用自动,自动消耗积分厉害。然后 10 月 2 日,我的面板里多了 0.03 这一档,它旁边还有另一个 0.03。

不是最便宜那一档独享便宜,是最便宜那一档,开始有并列了。

0.03 和 1.62 之间差了 54 倍。这个数字决定你一天跟 AI 说话要花多少钱。这不是一个「哪个模型更强」的问题,这是一个「你打算让 AI 干多重的活」的问题。

这个我不敢下结论。四种说法我全摆出来,你自己判断。

线索最多的是分词器。有人拿 50 组字符串比对切分结果,说它跟 MiniMax 家族完全吻合,其他厂商一个都对不上;有人用中文问它是谁家的,它自称 MiniMax;還有人在 MiniMax 开源仓库里提前五天翻到 M3.1 的配置,1M 上下文、三档推理,全对得上,9 月 28 号官方上线的 M3.1-Flash-Preview 规格也能对上。

第二种更浪漫。名字里有「太空」又有「兔子」,还赶上中秋,有人说这是月之暗面。

第三种,腾讯混元。有网友猜是 Hy4 正式版,也有人反驳,说腾讯以前都是直接上,没这个躲躲藏藏的习惯。

第四种纯粹开玩笑。太空加兔子,有人说是不是 SpaceX。

这四种我一个都不排除,也一个都不认定,因为截至今天没有任何一方认领。

上一个这么干的我有印象。8 月有个叫 Ox Alpha 的,免费六天,8 月 26 日揭晓是智谱的 GLM-5.3-Flash,然后立刻转收费。剧本有先例,先匿名免费跑真实数据,跑量够了再公布身份,然后收钱。

有测评博主出九道题对比同档快模型,评价是「速度挺快,交付可以,长程调度也还不错」;有人丢给它四个活儿同时布置,第一轮全跑通。

差话同样真实。有博主在 OpenCode 上测六道题,指令遵循、SVG 动画、浏览器里的操作系统、3D 赛车、Trello 看板,道道差评。最扎心一条是中文提的需求,交出来是英文界面。还有人说这几天升级之后它不太好用了。

同一道游戏题,它跑完 1 分 51 秒,同档另一个 4 分钟。快是真快,但快出来的是基础版,页面完整性不如那一个。工具调用错误率 3.45%。

所以我的判断是,它是一个合格的「底座」,还不是一个合格的「交付器」。

规格先看明白。上下文 1M,能一次塞进一整个代码仓库加一堆文档。能读文字、图片、视频,但只输出文字,它不生成图。思考强度五档,默认就是开的。

你把这几个数字连起来读,它的人设就出来了,一个跑得很快、读得很多、但只肯动嘴不伸手的家伙。

找它有个坑最容易卡住。我看到好几个人问「我面板里怎么没有」。官方文档写得很清楚,任务的第一句话发出去之后,模型选择才会显现。所以你在空着的输入框里翻下拉列表是翻不到的。

更新到最新版,新建一个任务随便发一句话,然后点输入框里那个模型名,比如默认的 Auto,面板弹出来找到 Space-Bunny,看到「限时折扣」选它,再把思考强度拉到极致。

验证点是这句,卡片描述行写着「推理速度极快,编码能力强劲,并支持原生多模态输入的匿名大模型」,下面一行是「10月2日-10月7日,享限时折扣」。看到这个就对了。压根没有这个条目的话,先确认你用的是云上模式,模型选择目前只支持云上。

来源:稀土掘金 原文