
作者|毕伟豪
编辑|李水青
智东西 9 月 9 日报道,近日,有一款名叫Omen Alpha 的匿名模型突然出现,并凭借其超高性价比迅速引起热议。
上线 5 天后,在 Muse Spark 1.3 Contributor 这款免费模型的冲击下,依然高居 OpenCode 调用量榜单第七,开发者纷纷猜测这是谁家的新模型,有网友评论 "又是来自东方的神秘模型"。





与此同时,这款模型在逻辑推理方面存在一些问题,出现了偏重速度而稍显智力不足的情况。
一、几秒识别民国报纸,25 分钟开发 " 牛来 " 牌 YouTube
实测开始,我们首先验证了 Omen Alpha 的视觉能力,输入一张民国日报的影像,让它识别并整理。




请根据这张 YouTube 网页截图,尽可能 1:1 复刻整个网页,包括顶部导航、搜索框、左侧栏、分类标签、视频卡片网格、字体、间距、圆角、图标等视觉结构,不要只做静态页面,要实现真实可交互的前端。搜索框可以输入并展示搜索结果,侧边栏和分类标签可以切换内容,视频卡片可以点击进入视频详情页,作者可以进入频道页,更多按钮可以弹出操作菜单,并实现基本的返回、推荐视频等交互逻辑,同时做好桌面端和移动端适配。将页面中的所有视频内容全部替换成 " 牛来 " 主题:使用我提供的牛图片作为所有视频封面,并同步修改视频标题、作者、播放量、发布时间、简介、评论等文案,让整个网站看起来像一个真实的 " 牛来主题 YouTube"。完成后请自行运行并检查网页,发现布局、视觉或交互问题后主动修改,最终保证页面不仅视觉上接近 YouTube,而且能够完整操作。
实测中我们发现,Omen Alpha 的前置思考时间非常久,它在动手开发这个网页之前,足足思考了 8 分钟,而整个开发过程也才 25 分钟。

整体网页开发效果给了我们很大的惊喜,页面图片均做了适配,标题和底部评论都生成了有趣的 " 牛来 " 版本,在交互上也非常流畅,播放进度条以及订阅、收藏点赞这些功能都和原网站一样。

二、坦克大战、地牢肉鸽、躲避小球,游戏开发速度快到起飞
来到考验模型综合能力的游戏开发环节,智东西从三个游戏切入,从易到难分为三个档让 Omen Alpha 进行开发。
首先我们让 Omen Alpha 做了一个简单的躲避球小游戏,它用时仅仅只有不到 3 分半钟,还包括了两轮测试。
最终交付的结果是一个非常简易的小游戏,但小球的下落、躲避动作以及得分系统等都非常齐全,具有一定可玩性。

开发一个完整的经典 FC《坦克大战》网页游戏,使用 HTML、CSS 和原生 JavaScript 实现,不依赖任何第三方库。游戏采用复古像素风格,包含玩家坦克移动、射击、敌方 AI 巡逻与攻击、可破坏砖墙、不可破坏钢墙、草地、河流、道具掉落、生命值、积分、关卡升级、Boss、爆炸特效、音效、暂停、重新开始、本地最高分保存等完整玩法,操作流畅、碰撞检测准确、60FPS 运行,并将所有代码封装在一个可直接运行的 HTML 文件中,代码结构清晰且带有中文注释。
Omen Alpha 用时 44 分钟,包括 20 多分钟的规划时间,相比于一些前沿模型,速度要快上不少,画面、墙体、移动、得分和炮弹消除等方面表现不错。但存在一些基础逻辑问题,比如敌方坦克全部堆在左侧,玩家反制空间太小等。
不过值得一提的是,此前智东西在测试一些顶级模型的时候,相同提示词虽然生成结果可玩性会好一些,但同样存在不少问题,从速度和质量上综合考量,Omen Alpha 的表现还是可圈可点的。
最后,智东西输入了一个开放 2D 像素风格地牢肉鸽游戏的提示词,参考《死亡细胞》,看看 Omen Alpha 在动作游戏的开发上表现如何。

Omen Alpha 依旧延续了超长思考时间风格,不过这次由于游戏开发难度比较大,用时接近两小时才完成从规划、开发到测试的全流程,最终效果如下:
可以看到,在没有参考信息的情况下,Omen Alpha 开发的游戏呈现很浓的像素风,肉鸽游戏、人物跳跃、受击等逻辑都正常,但与原作相差较大,打击效果也比较弱,可玩性一般。
三、拿捏 3D 建模,却被洗车问题难倒了
毫无疑问,Omen Alpha 在游戏开发方面的表现还是不错的,结合目前在 OpenCode 中 100 美元的额度,无疑又是一个蹬不完的模型。
但除了游戏开发,其他方面的能力也需要进行测试,智东西选取了3D 建模以及一些特殊问题来测试 Omen Alpha 的逻辑思维能力。
先测试 3D 建模,我们让 Omen Alpha 用 Blender 从零建一架波音 737 风格的民航客机,与网页和游戏开发不同的是,它并没有长时间思考,直接上手开始检测本机 Blender 版本,然后通过 MCP 进行建模。


让人有些意外的是,这款在各方面表现都尚佳的模型,居然直接倒在了经典洗车难题上,而且是不假思索的失败。Omen Alpha 没有任何推理过程,思考几秒钟后直接给出了完美的错误答案。


考虑到洗车难题对于诸多模型都是一个逻辑难题,我们又上传了一份公务员考试模拟题,让 Omen Alpha 直接答题。


虽然不知道 Omen Alpha 是谁家的模型,但从实测效果上看,定位应该是一款主打性价比的轻量级模型。
应该说,这款模型在各方面都具备不俗的实力,超快的生成速度让它能够处理一些复杂性不强的工作,或者承接大型任务的草稿阶段,在目前的套餐内,基本上可以当做涨价之前的 DeepSeek-V4-flash 来猛蹬。
关于这款模型最终被谁认领,大家可以稍微期待一下。


登录后才可以发布评论哦
打开小程序可以发布评论哦