我发现,大模型厂商一直在吞噬 GitHub
Original title: 我发现,大模型厂商一直在吞噬GitHub
The title and summary in the selected language are awaiting translation.
ChatGPT 上线 Space,可存页面、上传文件、分 Space 管理并支持多人协作,作者认为它正切入 Obsidian、Notion 所在的知识工作区。
The full text in the selected language is awaiting translation. The original is shown for now.
大家好,我是佬刘。
这两天 ChatGPT 上了一个新东西,叫 Space,群里也在讨论,这些功能越来越千奇百怪,已经没精力去了解了!
我看完之后脑子里冒出来的第一个东西,是 Obsidian。
因为 Space 现在干的事情,已经开始往知识工作区走了。
根据介绍,
Space 可以存页面、上传文件,把内容放进不同 Space 里管理;页面可以继续建立子页面,也可以多人协作,再让各自的 ChatGPT 参与修改内容。
我第一反应就是:
这不开始抢 Obsidian、Notion 这些工具的活了吗?
当然,Space和Obsidian现在差得还远。
Obsidian 的本地 Markdown、知识图谱、插件生态等等这些都有自己的价值。Space 现阶段更接近一个 AI 原生的文档和知识工作区。
但我关注的东西不是谁能取代谁。
因为我突然发现一个恐怖的真相:
GitHub 一直在替大模型厂商试产品
回头看这两年的 AI 产品,你会发现很多今天被塞进 ChatGPT、Claude、Gemini 的能力,在更早的时候,都能在 GitHub 上找到一堆类似探索。
一个需求冒出来,一批开发者开始做项目。
项目涨 Star,社区开始用,各种方案互相卷。
然后......
过一段时间,大模型厂商把这类能力收进主产品,然后下一批开源工作者继续重复循环
最典型的一个,浏览器 Agent
2024 年,GitHub 上的 browser-use 开始做一件事情:
让 AI 像人一样操作浏览器。
它可以打开网页、点击、输入、读取页面,再根据任务继续执行。项目到现在已经超过 11 万 Star。
然后到了 2025 年 1 月,OpenAI 发布 Operator。
Operator 的核心体验也很直白:
给 AI 一个浏览器,它可以看页面、点按钮、输入文字、滚动页面,替你完成网页任务。
再到 2025 年 7 月,Operator 的能力被合进 ChatGPT Agent,独立的 Operator 产品开始退出。
这里我不想说到底是谁抄了谁的,因为也没有证据能证明这条因果链。
但产品方向的变化很值得看。
开源社区在探索:
AI 能不能自己操作浏览器?
大模型厂商给出的答案是:
可以,而且这个能力应该进入 ChatGPT。
最后,浏览器 Agent从一个 GitHub 上的新鲜玩法,变成大模型产品的一部分。
编程 Agent 也是一样
2024 年 3 月,OpenHands 的前身 OpenDevin 出现。
它的目标就是做一个开源的软件开发 Agent。
AI 可以进入代码环境、修改代码、执行命令、处理软件开发任务。OpenHands 官方记录显示,这个项目从 2024 年 3 月 12 日开始。
一年多之后,2025 年 5 月,OpenAI 发布我们熟知的 Codex。
今天我们看 Codex,可能会觉得 AI 编程 Agent 本来就应该这样。
但往前倒一年,这套产品形态还在 GitHub 上被一群开源项目疯狂实验。
该给 Agent 什么工具?要不要终端?需不需要 Sandbox?怎么让它读整个代码仓库?......
这些问题,大量开源项目都在替行业试。
最后你会发现,各家产品开始长得越来越像。
上图为deepseek harness界面,下图为Codex界面
再回到 Space
Space 给我这种感觉更甚
我要整理自己的知识,我会去 Obsidian;我要做 PPT,我打开 PowerPoint。
这些工具原来都有自己的边界。
现在大模型厂商开始一点一点跨过去。
Space 开始管页面和文件;ChatGPT Work 开始碰文档、表格、PPT。
模型厂商想做的事情:
它们想成为那个最上层的入口。
也就是,他们想被社会上所有群体所有人看到!
当交互入口变成 AI 后,下面到底用 Obsidian、Chrome、Excel 还是某个 API,感知会越来越弱。
GitHub 的角色也变了
以前我看 GitHub,主要看的是这个项目有什么功能?对我有什么用?
现在我会多看一下
这个项目解决的需求,有没有可能变成下一代大模型的原生能力?
如果 GitHub 上突然冒出来十几个项目,都在解决同一个问题,而且 Star 涨得飞快,那可能说明这个需求已经被开发者验证出来了。
然后,大模型厂商根本不用凭空想产品,因为整个开源社区每天都在帮它们试错。
几个月后,其中一部分需求可能就会出现在某家模型厂商的发布会上。
所以标题里我用了一个词:
吞噬。
这个词选自一部动漫:吞噬星空,里面讲的是主角有吞噬世间万物的能力,越吞噬,越强大。
这里的吞噬,更多时候,它吞的是一种已经被验证过的产品形态。
开源项目负责把想法做出来,把坑踩完,把用户需求暴露出来。
模型厂商拥有模型、算力、用户入口和分发能力,再把这些能力塞进自己的产品。
最终,一款独立工具原来赖以生存的功能,可能变成 ChatGPT 左侧菜单里的一个按钮。
那开源项目还有意义吗?
当然有。
恰恰因为 GitHub 快,大公司才很难把所有创新都锁在自己内部。
一个开发者看到一个需求,几天就能做出第一版,几百个开发者可以同时往几百个方向试。
大厂有自己的资源优势,但这种分布式试错能力很难复制。
而且很多开源项目不会消失。
Obsidian 也不会因为 Space 出来就没人用了。
专业用户会继续需要本地数据、可控性、插件、开放格式和更细的能力。
但对于大量普通用户来说,只要 ChatGPT 里的功能能完成 80% 的任务,他们就少了一个安装新软件的理由。
以后再看到一个 GitHub 爆火项目,第一反应就变成了:
这个功能,半年后会不会出现在 ChatGPT、Claude 或 Gemini 里面?
如果答案有可能是会。
那 GitHub 上今天正在爆火的东西,可能就是下一次大模型发布会的预告片。
万一全部吞噬了呢?
这里是佬刘,一个研究生的实测笔记。
Source: 佬刘AI · mp.weixin.qq.com