Space Bunny 实测:3 天登顶全球调用量第一,接入 Codex 做视频与 Skill 蒸馏
Оригинальный заголовок: 3天登顶全球调用量第一!神秘太空兔在海外杀疯了...(附实测)
Заголовок и краткое изложение на выбранном языке ожидают перевода.
神秘模型 Space Bunny(space-bunny-alpha)3 天登顶全球调用量第一,目前免费,支持 1M 上下文,速度比 DeepSeek 4.1 Flash 快至少一倍。
Полный текст на выбранном языке ожидает перевода. Пока показан оригинал.
目前免费!能力强,速度快过DeepSeek 4.1 Flash,视频蒸馏圣体,赶紧薅吧..
这次我是把Space Bunny接入了Codex,你还别说,相当适配。
1、space-bunny+remotion通过代码做视频
最近老是看到网上有人用 React 写视频,数据驱动视频:
把报表、排行榜、交易记录自动剪成短视频,网页动画转视频(Three.js 场景也能在里面跑)
所以这次想看一下space-bunny-alpha是否也具有这样做动画剪视频的能力
此次挑选的科普题材是人类进化史,做了中文和英文的两个版本,视频中的任何效果都是space-bunny用组件做的包括整个音频,字幕,挺强的!(仔细看视频它居然还能根据视频类型调整中英文字幕的大小)
中文版:
英文版:
它自己还会做动画转场,像这样的动画在视频中不少。
这里我不得不提一嘴,space-bunny也是有视觉能力的,可以边写,边自己看效果,自己优化,对于Coding场景来说,我觉得能自检自查是非常重要的。它能帮我节约大量的时间。
还有这个模型给我的感觉是快!非常快!之前我用Codex搭配GPT的模型,跑个2分钟的视频,至少要半小时。而space-bunny只花了23分钟。
space-bunny居然能够听音频。。还能判断音质好坏🤔,🐂的。
2、用Three.js代码建模还原古文的场景,为教学提供身临其境的感觉
这里使用three.js将桃花源记的场景建模出来,作为教学物料为教学提供便利
同时我还用 deepseek-v4.1-flash 进行了横向对比
先看看Space Bunny的成品示:
可以看到当Space Bunny这个高效率模型持续运行了一个小时后产出的成品确实很不错,它能够跟随文字描述,不断变换场景,甚至流转镜头。不管是逻辑还是画面,镜头都做到了自如。
我们再来看看deepseek那边:
相比较而言deepseek这边,建模会更加细腻一点,但是镜头逻辑比较差,还有时不时会穿模的bug,以及最后居然会轻功水上漂🤣。
测试下来,我觉得这轮各有胜负吧。
但是如果是作为教学,我个人还是更倾向于space-bunny这个版本,因为我觉得镜头、叙事逻辑很重要。
速度方面,Space Bunny确实比DeepSeek 4.1 Flash更快。
这个任务还是比较复杂的,Space Bunny总耗时约1小时35分钟,DeepSeek 4.1 Flash 足足花了3个多小时...
不过接入Codex里面有一点不好,就是第三方模型接入Codex,只有在运行的时候能看到耗时,结束之后耗时就消失了...所以这次我并没有截到图。但上面的耗时是真的。体验下来Space Bunny比DeepSeek 4.1 Flash快了至少一倍。
其实一开始我要做的并不是桃花源记是春江花月夜,你敢相信Space Bunny只花了8分钟就落地了,而且效果看着还不错,但是后续考虑到要按照古文进度进行演示所以就没用春江花月夜了,改用了桃花源记。
过程中space-bunny还能精准的判断到相机的位置,从而修改整个的镜头运行效果
它做到快的同时又很仔细,能保证质量,这样的模型不多。
再来看这里,它的识图能力可以说是相当nice,而且能用到点上,自动截图定位问题,是真滴省心。
3、可视化的实际的地铁路线图
我想把昆明的地铁路线图可视化展示做出来,从根据时间会产生不同变化
Space Bunny成品展示:
可以看到它把昆明的每条地铁线路都成功的展示在了地图上,而且界面做的非常漂亮,而且该有的站点,而且列车进站出站也完全没毛病。
我们再来看看deepseek那边:
这边可以明显看出来有bug,左边有一些字挤在一起了,中间放大以后每个站点看着不太美观,也没有在图中标注每个站点的名字。
这里在开始收集资料的时候,本不用它将地铁线画在地图上,但Space Bunny自己这么做了,说明它确实是在边在找资料的同时,能很好的理解、运用资料。
可以看到,它收集了很多资料,并且能照顾到每一个细节,做了大量的物料出来。
这里是出了点问题,于是我录了一段视频让它自己看。它对视频的理解能力很强。
因为有些时候我们并不能很好的对问题进行一个描述,但是让它自己看,它绝对能看出问题是出在哪里,以及问题是怎么来的。一图胜千言,一条视频更是胜过千言万语。
4、仓颉Skill+视频号内容蒸馏
最近仓颉skill交流群,很多朋友都在问视频蒸馏。
其实我已经悄悄升级了仓颉skill,和video-downloader skill。
用我开源的10.6K Star cangjie-skill(最新版):
https://github.com/kangarooking/cangjie-skill
加上我的这个视频下载处理skill(最新版),就能很方便的蒸馏视频了(只需要提供一个链接):
https://github.com/kangarooking/kangarooking-skills/tree/main/video-downloader
video-downloader负责从你给的链接下载原视频,并让Codex使用调用模型的视觉能力来处理视频(包含字幕提取,语音转文字,视频重点画面识别等等),当所有视频内容被提取成文字后,进一步使用cangjie-skill对视频进行蒸馏。
这次主要蒸馏了三个超过20分钟的长视频,分别是以下三个:
一个是健康向的视频,一个是影视飓风和亿点点不一样的科普向视频,最后一个是影视飓风他们自己对ai的思考和看法视频
在这次蒸馏,通过3个视频产出了3个skill。
三个视频下载好之后它快速的把视频切割成207帧,而且Space Bunny的读图速度巨快,通过短短几张图片就能把握到视频的核心内容
Space Bunny选择采用密集抽帧,是真的想要去读懂而不是猜一个结果
最终产出了详细的三套skill
针对此每套skill,我都附加了2个问题去提问,并让它给出回答:
1.muscle-reserve-action(肌肉健康skill)
提问:30岁后怎么保住肌肉?
回答:
用仓颉Skill蒸馏Skill,最好用的一点就是从来给你的都是“你应该具体怎么做?”,而不是“我建议你怎么做?”,从视频中蒸馏有价值的内容然后给出你具体的行动步骤。
提问:长辈查出肌少症我怎么提前防?
回答:
详细的给出了解答,该怎么预防,该怎么做。
2.marine-shark-risk-assessment(近岸鲨鱼科普skill)
提问:我想拍鲨鱼,怎么准备?需要什么装备?
回答:
给出了具体的意见,以及该注意的事项,给出了禁止三条不要触碰的红线
提问:观鲨船项目是怎么运作的?我怎么判断一家公司靠不靠谱?
回答:
从不同的方面剖析,这家公司到底靠不靠谱,项目到底能否安全的去体验
3.ai-visual-production-decision (影视飓风ai观点skill)
提问:预算只有 2 万,这个项目该全实拍还是混着AI来?
回答:
这样的回答确实给了我们做视频的导演一些好用的观点,以及方法论,毕竟这可是影视飓风的方法论
提问:我要给品牌拍一支 30 秒广告,用 AI 生成还是实拍?
回答:
如果我是一个做广告的导演,我大概会采用它说的方法。
使用下来,我感觉这只太空兔(Space Bunny)应该是目前蒸馏视频性价比最高的模型了,视觉能力很强,又支持1M上下文,速度还快,简直妥妥的Skill蒸馏圣体,趁现在免费,猛猛蒸馏,猛猛薅吧~
Источник: 袋鼠帝AI客栈 · mp.weixin.qq.com