Lovable 开源 Rust 预览引擎 OJ,冷启动与内存优于 Vite
Lovable 发布用 Rust 从零实现的预览引擎 OJ,它读取现有 vite.config.ts 并通过兼容层运行真实 Vite 插件,单个二进制、不向项目安装工具链。
推荐理由:Lovable 用 Rust 重写预览引擎 OJ,给出与 Vite 的冷启动和内存对比,以及生产环境灰度数据。
Lovable 发布用 Rust 从零实现的预览引擎 OJ,它读取现有 vite.config.ts 并通过兼容层运行真实 Vite 插件,单个二进制、不向项目安装工具链。
推荐理由:Lovable 用 Rust 重写预览引擎 OJ,给出与 Vite 的冷启动和内存对比,以及生产环境灰度数据。
Graphify C# 是一个基于 Roslyn/MSBuild 的无头索引器,把 C# 解决方案或项目导出为确定性的语义证据,包括精确调用方、引用、实现、继承、重写和参数绑定,可跨重载、泛型和项目边界。
OKF Agent Memory 是一个基于 Open Knowledge Format(OKF)v0.2 的 Git 原生持久项目记忆工具,用双层记忆架构解决上下文窗口关闭后对话重置、架构决策丢失的问题。
文章在 commit 5dc9490b 上阅读 Aider 源码,解释 tree-sitter repo map 如何按依赖图排序并在 --map-tokens(默认 1k token)预算内裁剪,以及 whole、diff、diff-fenced、udiff、editor-diff/editor-whole 各编辑格式分别适配哪类模型。
作者按 commit f7fb0c4b 阅读 OpenHands 仓库,梳理其架构:Agent Canvas 是托管编码智能体的控制中心,真正的智能体在 Software Agent SDK 中,采用单步执行模型,每步依次检查待确认动作、压缩事件历史、查询 LLM、解析响应、确认门禁、执行工具并生成 ObservationEvent。
SWE-agent 论文(arXiv:2405.15793)提出 agent-computer interface(ACI),主张为语言模型智能体设计专用接口,在 SWE-bench 和 HumanEvalFix 上分别取得 12.5% 和 87.7% 的 pass@1。
Simon Willison 转述剑桥大学计算机教授、OCaml 编译器核心维护者 Anil Madhavapeddy 的观察:OCaml 项目补丁刚被公开讨论,约十分钟内就有网站开始探测百分号编码的路径穿越序列,说明自动化监控在盯着公开仓库。
Proliferate 发布开源、可自托管的 AI IDE,可在同一处使用 Claude Code、Codex、OpenCode、Cursor 和 Grok,并保留各自的推理与配置选项,包括 Bedrock、Azure 和自托管推理。
Paper Compute 为每个 grove 引入 clearing,即一套可丢弃、完全隔离的本地 paper console,让多个云平台实例在同一台笔记本上并行运行。
Paper Compute 将 tapes 以 Apache/MIT 双许可开源,并推出 cassettes 集成范式,用于连接、加工和构建 AI trace 数据。
DeepSeek AI 与北京大学在论文中提出时空可组合性,形式化了 DeepSeek Harness 底层开源 TypeScript 微内核 Cordis 的架构。
Simon Willison 发布 alchemy-utils 0.1a0,这是 sqlite-utils 的数据库无关版本,保留 insert、upsert、insert_all、upsert_all、create、update 等核心 API 和表结构自省能力,底层改用 SQLAlchemy 以支持多种数据库引擎。
Paper Compute 推出开源代理 tapes,它位于 agent harness 与推理服务之间,记录流经的全部内容,包括系统消息、输入、思考块、工具调用与结果、输出。
Armin Ronacher 就 Codeberg 修改条款、排除主要由生成式 AI 编写的项目一事发表看法。他认为该规则模糊、难以执行,因为无法给近期项目标注 AI 代码占比,并推测中间派会离开;他更希望 Codeberg 要么明确禁止 LLM 参与,要么只针对垃圾内容和滥用资源单独立规。
Ingot 是面向个人开发者的本地优先库和 MCP server,为 Agent 的 Skill 指令提供证据门禁的变更控制。
ReasonGate 是一个可自托管的开源门禁,检查进入和离开 LLM 的文本,返回可解释的 allow/flag/block 决策并生成机器可读审计记录。
作者 jbwinters 发布 Jacquard,一门面向 AI 编写、人类审查的编程语言,设计方式是让 AI 分析多种主流及小众语言的 AST 后生成新的结构与语法。
作者用周末读完 HuggingFace 开源 Python 编码智能体 Tau 的源码,认为它是目前最清晰的编码智能体架构样本。
作者在多次自建记忆管线后,对 mem0 的架构做了复盘,认为提取、存储、检索三个问题里只有存储和检索值得投入工程精力,提取本质上是一次 LLM 调用加提示词。
Lelu 是一个 MIT 许可的开源授权引擎,位于 AI 智能体与真实操作之间,每次动作先经它返回 allow、deny、human_review 或 compute 四种决策之一,所有决策写入审计日志,引擎可完全跑在本地。
Headroom 是一个开源、本地优先的代理,拦截 LLM API 调用并在请求到达服务商前重写 messages 数组,应用代码和模型都不用改。
推荐理由:Headroom 把上下文压缩放到代理层,读者可据此判断长会话智能体的 token 成本能否降下来。
作者认为 AI 应用长期停留在聊天框,缺的不是模型能力而是界面层,即让智能体渲染真实 UI、把状态变化流回前端并跨会话保持同步的基础设施。CopilotKit 开源了这套界面栈,其核心是走 SSE 的 AG-UI 协议,Google、LangChain、AWS、Microsoft、Mastra、PydanticAI 均已采用,前端因此与后端智能体框架解耦。
Microsoft Defender for Cloud 发现生产环境中的 Mage AI 与 MCP 服务器未启用鉴权,攻击者可执行 shell 命令并获得 cluster-admin 权限,还能窃取同集群工作负载的凭据。
推荐理由:材料给出 Mage AI 与 MCP 服务未鉴权部署导致 RCE 的完整链路,可据此检查自家 Helm chart 与 MCP 配置。
宝玉翻译并解读 Manthan Gupta 对 Hermes Agent 记忆系统的拆解,指出 Hermes 拥有四套记忆:MEMORY.md 与 USER.md 提示词记忆、SQLite 会话存档 session_search、作为程序记忆的 Skills,以及可选的 Honcho 用户建模层。
Gas City 发布 v1.0.0,由 Julian Knutsen 和 Chris Sells 开发,把 Gas Town 拆解为可组合、声明式的 pack,用来组装任意拓扑的协作智能体团队。
Steve Yegge 宣布 Gas Town 和 Beads 同日发布 v1.0.0。Beads 是面向编码智能体的记忆系统与知识图谱,v1.0 用 Dolt 替换了原先 SQLite + JSONL 的架构,双向同步、三方合并和合并冲突等问题被移除,同时支持嵌入式和服务器模式,本周 GitHub star 数突破 20k。
宝玉针对 Claude Code 源码泄漏后满屏的深度分析文章,提出学习大型开源项目的四步方法:先跑起来、从一个功能点切入、动手做二次开发、最后从零搭建。他认为大多数人卡在看了很多但没动手写过,AI 时代让 AI 分析代码太方便,但这种理解是借来的。
Superpowers 作者 Jesse Vincent 称项目 GitHub star 已超 12 万,随之而来大量由智能体自动提交的低质 PR,仓库 PR 拒绝率达 94%。
推荐理由:Superpowers 作者用 94% PR 拒绝率说明智能体批量提 PR 的现状,并给出可复用的 CLAUDE.md 拦截写法。
Paper Compute 发布面向生产环境 AI 智能体的基础设施,包含 tapes 和 stereOS 两个组件。tapes 是零埋点的可观测层,以反向代理形式部署在智能体与推理服务之间,无需 SDK 或改代码,只需一个环境变量,即可捕获并生成可验证、防篡改的执行记录,并支持异常检测。
过去一周有攻击者接连投毒多个开源包,从 Trivy 开始,波及 Telnyx(受影响包约 15 万次/周下载)、LiteLLM(约 2200 万次/周)以及 3 月 31 日被攻击的 axios npm 包(至少 1 亿次/周下载),恶意版本会植入木马窃取安装机器的敏感数据。
作者 Drew Breunig 借用 Eric S. Raymond 的《大教堂与集市》提出第三种软件开发模式 Winchester Mystery House,指开发者用 AI 智能体为自己搭建高度个人化、不断扩张的工具。
TeamPCP 通过被污染的 Trivy GitHub Action 劫持 LiteLLM 的 CI/CD 流水线,窃取 PyPI 发布凭证后发布了带后门的 LiteLLM 1.82.7 和 1.82.8。
推荐理由:复盘 LiteLLM 被投毒事件的三阶段攻击链与 .pth 持久化机制,可帮助排查自身 CI/CD 与 Kubernetes 风险。
Google 工程师开源了面向 Linux 内核的智能体 AI 代码审查系统 Sashiko,此前已在 Google 内部使用,现覆盖 Linux 内核邮件列表的全部提交。
作者在 Claude Code 中设计 Postgres 集成时会话崩溃,上下文窗口关闭导致一小时的设计工作全部丢失,靠此前用 tapes 代理写入本地 SQLite 的请求响应记录才重建了上下文。
Paper Compute 发布 stereOS,一个基于 NixOS 的操作系统,让每个 AI 智能体在 gVisor 用户态虚拟内核和只读 /nix/store 根文件系统命名空间中运行沙箱。
Paper Compute 开源 tapes,一个位于 AI 智能体与推理服务之间的遥测层,用于为每次会话生成可持久保存、可审计的记录。它由代理服务、API server、CLI 客户端和终端 UI 四部分组成,代理服务无需改代码即可拦截并记录智能体与模型提供方之间的流量。
Agentseed 是一个开源 CLI 工具,运行 npx agentseed init 即可读取代码库的语言、框架、命令、架构和约定,生成可直接使用的 AGENTS.md,支持 Copilot、Codex、Gemini、Cursor、Devin 等 20 多种 AI 工具。
Simon Willison 发现英国商业贸易部开源的 sqlite-s3vfs 仓库在 GitHub 上已 404,于是用 Software Heritage 归档恢复了它。
Jesse Vincent 发布开源工具 packnplay,用一条 packnplay run claude --dangerously-skip-permissions 命令即可启动预配置好的临时容器运行编码智能体。
推荐理由:作者把在容器里跑编码智能体的繁琐配置封装成一条命令,并公开了处理 Claude Code 凭据冲突的具体做法。
Terminal-Bench 发布 2.0 版本和 Harbor 包,前者是经过更严格验证、难度更高的智能体评测基准,后者用于评估和优化智能体。Harbor 重写了 Terminal-Bench 的测试框架,支持云端部署容器、面向 RL 和 SFT 的 rollout 接口,并兼容任何可装入容器的智能体。
推荐理由:Terminal-Bench 2.0 与 Harbor 同时发布,读者可了解智能体评测基准的验证方式与云端扩展思路。