匿名模型Space Bunny登顶OpenRouter双榜,Coding实测表现亮眼
2026/09/27 21:40阅读量 3
一款名为Space Bunny的匿名大模型在中秋假期期间迅速崛起,凭借极高的调用速度和优秀的代码生成能力,短时间内冲上OpenRouter及OpenCode双榜日调用榜首。实测显示,该模型在处理Three.js复杂场景构建、macOS应用开发等任务时响应极快,首轮输出即可用,且具备较强的自我修正与细节补充能力。尽管部分用户反馈其“思考过程”冗长,但整体性价比和实用性获得广泛认可,引发业界对其背后厂商的猜测。
事件概述
近期,一款未公开来源的大模型 Space Bunny 在 AI 社区突然走红。该模型通过 OpenRouter API 接入,在短短几天内热度飙升,并成功占据 OpenRouter 和 OpenCode 双榜单的日调用量第一位置。社交媒体上,用户对 Space Bunny 的评价普遍偏向正面,主要集中在“速度快”、“输出效果好”以及“性价比高”等方面。
Coding 能力实测记录
为验证其实际能力,测试者通过 DeepSeek Harness (DSH) 接口对 Space Bunny(内部代号“tuerye”)进行了多项编程任务测试,主要结果如下:
-
3D 场景构建(Three.js)
- 任务:构建一个包含交互式细节的立方体风格天坛。
- 耗时:约 1-2 小时。
- 表现:模型不仅完成了基础交互功能,还自主添加了昼夜循环(约3.5分钟/周期)、天气开关(雨、烟)及时间显示等丰富细节。测试者认为初战效果令人满意,且因 DSH 评分机制问题,主观评价给予高分。
-
macOS 应用开发(闹钟工具)
- 任务:开发一款符合 iOS 风格的 macOS 闹钟应用。
- 耗时:22 分 46 秒。
- 表现:生成的界面简洁霸道,占据全屏。模型考虑了 iOS 硬性限制,但在实现过程中出现了一些逻辑瑕疵(如 README 中的思考记录暴露了某些非预期行为)。不过,经过一轮交互修改后,功能基本完善。
-
macOS 应用开发(悬浮窗工具)
- 任务:制作一个 Mac App,将 DSH 的思考过程以字幕形式浮现在屏幕上。
- 耗时:不到 5 分钟完成初版,不到 15 分钟完成优化版。
- 表现:初版存在窗口无法拖动、遮挡对话框等问题。模型在收到反馈后快速迭代,实现了窗口的自由拖拽,并在无思考内容时缩小窗口体积。虽存在鼠标事件同步的小 Bug,但整体开发效率极高,展现了强大的多轮交互修复能力。
-
多模态理解
- 任务:识别特斯拉擎天柱吧台营业视频中的动作。
- 表现:模型准确回答了机器人行为,但缓存命中率较低(其余任务缓存命中率均在 95% 以上),这可能影响了部分推理成本或速度体验。
核心特征分析
- 速度与效率:Space Bunny 被广泛认为是“Flash 高速模型”的代表,适合高频、经济适用的日常编码任务。其响应速度远超许多传统模型,甚至被用户拿来与 Astra 等高性能模型对比。
- 代码质量与自我修正:首轮输出通常可直接使用,无需大量人工干预。若出现小 Bug,通常只需一轮交互即可解决。这种“快且准”的特性使其成为高效的辅助编程工具。
- “思考过程”争议:部分用户指出 Space Bunny 的输出中包含大量详细的思维链(Chain of Thought),导致响应文本较长。虽然这有助于提升最终结果的准确性,但也引发了关于是否“过度思考”的讨论。测试者认为,只要最终结果正确且速度快,冗长的思考过程并非致命缺点。
行业影响与猜测
- 厂商猜测:由于模型匿名,网友对其归属众说纷纭,猜测涉及 OpenAI (GPT-6)、xAI (Grok)、Meta (Muse Spark) 以及国内头部模型(Kimi, GLM, MiniMax 等)。目前尚无官方认领。
- 市场趋势:Space Bunny 的爆火反映了当前开发者对大模型选型的核心标准:快、准、便宜。随着 Flash 类高速模型成为处理高频任务的主力,Space Bunny 的成功可能预示着市场对高性价比、高吞吐量模型的强烈需求。具体定价策略仍需等待厂商正式公布。
结论
Space Bunny 是一款在 Coding 和多模态领域表现优异的匿名模型。其核心竞争力在于极高的执行效率和良好的代码生成质量,能够显著降低开发者的试错成本和时间成本。尽管存在思考过程冗长等细微问题,但其整体表现足以支撑其在竞争激烈的 LLM 市场中占据重要地位。
