Skip to content
Original
袋鼠帝AI客栈· 袋鼠帝·· 8 days agoAI score50

Space Bunny 实测:3 天登顶全球调用量第一,接入 Codex 做视频与 Skill 蒸馏

Original title: 3天登顶全球调用量第一!神秘太空兔在海外杀疯了...(附实测)

The title and summary in the selected language are awaiting translation.

AI overview

神秘模型 Space Bunny(space-bunny-alpha)3 天登顶全球调用量第一,目前免费,支持 1M 上下文,速度比 DeepSeek 4.1 Flash 快至少一倍。

Full text

The full text in the selected language is awaiting translation. The original is shown for now.

正文配图

目前免费!能力强,速度快过DeepSeek 4.1 Flash,视频蒸馏圣体,赶紧薅吧..

Image

Image

目前免费!能力强,速度快过DeepSeek 4.1 Flash,视频蒸馏圣体,赶紧薅吧..:该段配图

Image

Image

这次我是把Space Bunny接入了Codex,你还别说,相当适配。

1、space-bunny+remotion通过代码做视频

最近老是看到网上有人用 React 写视频,数据驱动视频:

把报表、排行榜、交易记录自动剪成短视频,网页动画转视频(Three.js 场景也能在里面跑)

所以这次想看一下space-bunny-alpha是否也具有这样做动画剪视频的能力

此次挑选的科普题材是人类进化史,做了中文和英文的两个版本,视频中的任何效果都是space-bunny用组件做的包括整个音频,字幕,挺强的!(仔细看视频它居然还能根据视频类型调整中英文字幕的大小)

中文版:

英文版:

它自己还会做动画转场,像这样的动画在视频中不少。

Image

这里我不得不提一嘴,space-bunny也是有视觉能力的,可以边写,边自己看效果,自己优化,对于Coding场景来说,我觉得能自检自查是非常重要的。它能帮我节约大量的时间。

Image

还有这个模型给我的感觉是快!非常快!之前我用Codex搭配GPT的模型,跑个2分钟的视频,至少要半小时。而space-bunny只花了23分钟。

Image

space-bunny居然能够听音频。。还能判断音质好坏🤔,🐂的。

Image

2、用Three.js代码建模还原古文的场景,为教学提供身临其境的感觉

这里使用three.js将桃花源记的场景建模出来,作为教学物料为教学提供便利

同时我还用 deepseek-v4.1-flash 进行了横向对比

先看看Space Bunny的成品示:

可以看到当Space Bunny这个高效率模型持续运行了一个小时后产出的成品确实很不错,它能够跟随文字描述,不断变换场景,甚至流转镜头。不管是逻辑还是画面,镜头都做到了自如。

我们再来看看deepseek那边:

相比较而言deepseek这边,建模会更加细腻一点,但是镜头逻辑比较差,还有时不时会穿模的bug,以及最后居然会轻功水上漂🤣。

测试下来,我觉得这轮各有胜负吧。

但是如果是作为教学,我个人还是更倾向于space-bunny这个版本,因为我觉得镜头、叙事逻辑很重要。

速度方面,Space Bunny确实比DeepSeek 4.1 Flash更快。

这个任务还是比较复杂的,Space Bunny总耗时约1小时35分钟,DeepSeek 4.1 Flash 足足花了3个多小时...

不过接入Codex里面有一点不好,就是第三方模型接入Codex,只有在运行的时候能看到耗时,结束之后耗时就消失了...所以这次我并没有截到图。但上面的耗时是真的。体验下来Space Bunny比DeepSeek 4.1 Flash快了至少一倍。

其实一开始我要做的并不是桃花源记是春江花月夜,你敢相信Space Bunny只花了8分钟就落地了,而且效果看着还不错,但是后续考虑到要按照古文进度进行演示所以就没用春江花月夜了,改用了桃花源记。

Image

过程中space-bunny还能精准的判断到相机的位置,从而修改整个的镜头运行效果

Image

它做到快的同时又很仔细,能保证质量,这样的模型不多。

Image

再来看这里,它的识图能力可以说是相当nice,而且能用到点上,自动截图定位问题,是真滴省心。

Image

3、可视化的实际的地铁路线图

我想把昆明的地铁路线图可视化展示做出来,从根据时间会产生不同变化

Space Bunny成品展示:

可以看到它把昆明的每条地铁线路都成功的展示在了地图上,而且界面做的非常漂亮,而且该有的站点,而且列车进站出站也完全没毛病。

我们再来看看deepseek那边:

这边可以明显看出来有bug,左边有一些字挤在一起了,中间放大以后每个站点看着不太美观,也没有在图中标注每个站点的名字。

这里在开始收集资料的时候,本不用它将地铁线画在地图上,但Space Bunny自己这么做了,说明它确实是在边在找资料的同时,能很好的理解、运用资料。

Image

可以看到,它收集了很多资料,并且能照顾到每一个细节,做了大量的物料出来。

Image

这里是出了点问题,于是我录了一段视频让它自己看。它对视频的理解能力很强。

因为有些时候我们并不能很好的对问题进行一个描述,但是让它自己看,它绝对能看出问题是出在哪里,以及问题是怎么来的。一图胜千言,一条视频更是胜过千言万语。

Image

4、仓颉Skill+视频号内容蒸馏

Image

最近仓颉skill交流群,很多朋友都在问视频蒸馏。

其实我已经悄悄升级了仓颉skill,和video-downloader skill。

用我开源的10.6K Star cangjie-skill(最新版):

https://github.com/kangarooking/cangjie-skill

加上我的这个视频下载处理skill(最新版),就能很方便的蒸馏视频了(只需要提供一个链接):

https://github.com/kangarooking/kangarooking-skills/tree/main/video-downloader

Image

video-downloader负责从你给的链接下载原视频,并让Codex使用调用模型的视觉能力来处理视频(包含字幕提取,语音转文字,视频重点画面识别等等),当所有视频内容被提取成文字后,进一步使用cangjie-skill对视频进行蒸馏。

这次主要蒸馏了三个超过20分钟的长视频,分别是以下三个: 

一个是健康向的视频,一个是影视飓风和亿点点不一样的科普向视频,最后一个是影视飓风他们自己对ai的思考和看法视频

Image

在这次蒸馏,通过3个视频产出了3个skill。

Image

三个视频下载好之后它快速的把视频切割成207帧,而且Space Bunny的读图速度巨快,通过短短几张图片就能把握到视频的核心内容

Image

Space Bunny选择采用密集抽帧,是真的想要去读懂而不是猜一个结果

Image

最终产出了详细的三套skill

Image

针对此每套skill,我都附加了2个问题去提问,并让它给出回答:

1.muscle-reserve-action(肌肉健康skill)

提问:30岁后怎么保住肌肉?

回答:

Image

用仓颉Skill蒸馏Skill,最好用的一点就是从来给你的都是“你应该具体怎么做?”,而不是“我建议你怎么做?”,从视频中蒸馏有价值的内容然后给出你具体的行动步骤。

提问:长辈查出肌少症我怎么提前防?

回答:

Image

详细的给出了解答,该怎么预防,该怎么做。

2.marine-shark-risk-assessment(近岸鲨鱼科普skill)

提问:我想拍鲨鱼,怎么准备?需要什么装备?

回答:

Image

给出了具体的意见,以及该注意的事项,给出了禁止三条不要触碰的红线

提问:观鲨船项目是怎么运作的?我怎么判断一家公司靠不靠谱?

回答:

Image

从不同的方面剖析,这家公司到底靠不靠谱,项目到底能否安全的去体验

3.ai-visual-production-decision (影视飓风ai观点skill)

提问:预算只有 2 万,这个项目该全实拍还是混着AI来?

回答:

Image

这样的回答确实给了我们做视频的导演一些好用的观点,以及方法论,毕竟这可是影视飓风的方法论

提问:我要给品牌拍一支 30 秒广告,用 AI 生成还是实拍?

回答:

Image

如果我是一个做广告的导演,我大概会采用它说的方法。

使用下来,我感觉这只太空兔(Space Bunny)应该是目前蒸馏视频性价比最高的模型了,视觉能力很强,又支持1M上下文,速度还快,简直妥妥的Skill蒸馏圣体,趁现在免费,猛猛蒸馏,猛猛薅吧~

Source: 袋鼠帝AI客栈 · mp.weixin.qq.com