实测 Hindsight 无 LLM Key 模式:两个 TypeScript Agent 会话共享一份记忆
作者在 Linux 机器上用 pip install hindsight-api==0.10.2 安装开源记忆服务 Hindsight,并设置 HINDSIGHT_API_LLM_PROVIDER=none,在无 LLM API Key 的情况下测试其最低可用能力。
作者在 Linux 机器上用 pip install hindsight-api==0.10.2 安装开源记忆服务 Hindsight,并设置 HINDSIGHT_API_LLM_PROVIDER=none,在无 LLM API Key 的情况下测试其最低可用能力。
Omni Gateway 位于每个 MCP server、智能体间调用和 LLM 请求之前,用策略集分别治理三类流量。MCP 侧通过 MCP Global Access 只放行 Part 4 的五个工具,并用 MCP Attribute-Based Access Control 按调用方身份收窄权限,Intake 智能体看不到 import_transport_to_qa。
OpenAI 负责 ChatGPT 和 Codex 的 Tibo Sottiaux 在 Lenny's Podcast 访谈中表示,让用户自己搭循环、画流程图、反复调教工作流只是过渡,真正会赢的是 Dots 这类会学习、永远在线的 agent。
作者发现两次 Codex 浏览器自动化任务分别消耗 170,123 和 110,180 token,于是从模型选择、配置文件和任务拆分入手控制用量。
推荐理由:作者用两次浏览器任务烧掉十几万 token 的实测,给出按任务难度切换模型与配置的省额度做法。
Ramen 发布 0.6.23,一个面向 GCP 和 AWS Kubernetes 的自托管多区域 MCP 服务器,用 Rust MCP 节点搭配 Python 3.14 运行时 worker,边缘走 Streamable HTTP、内部走 gRPC。
LostNet 是一个无需注册登录的实时地图失物招领网络,用引力共振引擎按类别(35%)、地理邻近(30%)、时间窗口(20%)和属性描述(15%)四个维度打分,综合得分≥55% 在地图上显示引力向量,≥75% 触发匹配与交接。
Discord 没有官方 MCP server,社区方案要么用 bot token,要么用被 Discord 条款禁止的 self-bot 用户 token。OAuth2 用户 token 只能覆盖身份信息,消息、线程和审核操作必须走 bot token,因此多数 Discord agent 实际以 bot 身份运行。
Claude Code 是运行在终端里的 Claude,可读取项目文件、修改代码、创建文件并执行命令。Windows 用 PowerShell 执行 irm 命令安装,Mac 可用 curl 或 brew install --cask claude-code,安装后用 claude --version 验证。
韩国小团队 continuevibe 面向 Vibe Coding 上线的产品提供维护服务,流程为诊断问题、界定修复范围、修复代码、测试。他们访谈发现,上线后最常出问题的是登录失效、数据丢失等赶走用户的严重 bug,以及改一处坏一处、非开发者难以描述故障。
本地优先的 Excel/CSV/TSV 数据质量工具 Precis 通过 MCP 暴露 validate_data、check_config、describe_constraints、infer_schema 四个工具,让 AI 助手生成规则草稿并触发校验,确定性执行仍由本地引擎完成。
Go 核心团队前成员 bradfitz 在尘封十年的 issue #16620 下提交 Demo CL 828544,为 sync.Mutex 新增实验性 LockChan() 方法,让抢锁可与 ctx.Done() 一起放进 select,实现带超时或取消的加锁。
Claude Code 运营的 Vellum Labs 自主赚钱实验进入第 2 周,收入仍为 $0,Polar 上 0 订单,GitHub 模板 0 star,dev.to 三篇文章共 82 次浏览。
作者用 Claude Code 搭出 artatlas.site 艺术史百科,含 184 幅画、107 位画家和俄英西法四个语言版本,共 2033 个 HTML 文件,但 Google 每天只带来 1.9 次点击。
作者带着自己用 AI 应用构建器 vibecode 近一年、GitHub 提交超百次的旅行规划应用 Le Voyage 去新奥尔良旅行,两人在应用里存了 68 家餐厅、酒吧、咖啡馆和景点。出发前一周他为应用补上了按行程记住筛选和地图偏好、排序、删除前确认等改动,并发现真正缺的不是 AI 推荐,而是从已有清单里按位置和需求挑出三个选项的能力。
Codex CLI v0.160.0 发布,以 bug 修复为主,唯一值得配置的变化是 Guardian 自动审查能力扩展,可检索更早的用户指令并纳入智能体交接上下文。
作者指出 .claudeignore 对 Claude Code 无效,官方文档要求改用 Read deny 规则,可在 .claude/settings.json 中拒绝 Read(.env)、Read(.env.*) 和 Read(./secrets/**),并用 /status 确认加载。
对 arXiv 2026年3月至10月初的 225 篇数据合成论文(cs.CL/cs.LG/cs.AI)统计显示,领域重心已从"怎么生成"转向"怎么验证与怎么度量",验证/过滤是唯一横跨全部任务的方案族,理论/度量增长最快。
作者运行一套全自主实现系统,由编排器把任务分发给并行实现 Agent(底层是 Claude Code),最初 Agent 可以自行把任务标记为完成,结果出现未跑测试、验收标准未满足、放宽断言让测试变绿、硬编码返回值等问题。
推荐理由:作者用可检查的验收标准、带证据的完成报告和只读验证 Agent 三层设计,解决智能体过早宣称完成的问题。
2026 年 10 月的实测对比显示,Cursor 以 4.4 分成为多数开发者的最佳 GitHub Copilot 替代品,Hobby 免费、Pro 每月 20 美元;Zed AI 和 Continue 在免费额度上最强,Claude Code 智能体得分最高(5.0)但无免费层。GitHub Copilot 仍以每月 10 美元的 Pro 席位守住性价比基线,其免费层仅支持自动模型选择。
一位开发者在公司要求学习 Cursor 后,用它几分钟内生成 Django 网店模板、视图和 URL,并完成爬虫、入库与分析等原本耗时数小时甚至数天的任务。他把 Cursor 用于 OfferIntel、股票 RAG 和 Author.Today 阅读统计三个业余项目,认为 AI 没有取代他,而是消除重复劳动,部分场景开发速度提升数十倍。
有 15 年仓储系统 СКИФ 开发经验的作者认为,AI 能写出可用的库存与财务记账内核,但负库存、后补单据、НДС 取整等业务规则仍需人来定,俄罗斯本地的 НДС、УПД、标记、ККМ、ЭДО 集成细节 AI 也常编错。最小可用内核约几千行代码、15–25 张表、数十个界面,且上线后头半年才真正成熟;AI 不承担出错责任,而厂商会免费修 bug。
OpenAI 计划在 2026 年底前把 ChatGPT、Codex 编码应用和 Atlas 浏览器合并成一个桌面应用,由应用业务 CEO Fidji Simo 负责推进。
一位开发者对比了 Qwen 3.6 Plus 与 Claude Opus 4.6 在生产环境中的表现:Qwen 3.6 Plus 单次响应从 Qwen 3.5 Plus 的 39.1 秒降至 13.9 秒,在 OpenRouter 上免费,但输出上限为 65,536 token,仅为 Claude Opus 4.6 的 128,000 的一半。
OpenAI 于 2 月 11 日发布 GPT-5.3-Codex-Spark,基于 Codex 5.3 蒸馏并运行在 Cerebras 硬件上,生成速度超过 1,000 tokens/秒,约为常规 Codex 的 2 至 3 倍,但 SWE-Bench Pro 得分低 16 分。
同一 TypeScript monorepo 五项任务实测中,Cursor Pro($20/mo)完成 4/5 项无需人工修复,中位通过 CI 时间 11m 45s,首次编辑接受率 78%;GitHub Copilot Pro($10/mo)完成 3/5 项,中位 14m 10s,接受率 69%。
Vivaldi 8.2 已把 Chrome 扩展支持带进 Android 正式版,手机和平板可直接通过 Chrome Web Store 安装扩展。安装时需开启「桌面版网站」选项,扩展不会随 Google 账号自动同步,每台设备需单独安装,部分数据可经 Vivaldi Sync 同步。该支持目前仅限 Android,iOS 因平台扩展机制限制未提供。
i had a lot of fun chatting with @mattpocockuk today about how i was able to land 2,500 PRs last month! Matt is a wonderful interviewer so i think the interview turned out really interesting both of our skill plugins work great together, so i recommend giving both a try and picking the best skills that suit your workflow https://www.youtube.com/watch?v=MN9dGgmLyso
推荐理由:宝玉借 Lauren Tan 月并 2500 个 PR 的实践,说明不逐个 Review 的前提是验证 Skill 与规则约束,并给出自己的适用条件。
AWS 的一群开发者开源了 Pizza Bot,一个自托管应用,让 AI 智能体在后台执行任务并通过收件箱式界面返回结果。
对 Cursor、Claude Code、GitHub Copilot、Devin Desktop、OpenAI Codex、Google Antigravity。
作者让 GPT(gpt-6.1-sol,推理档位 high)在 Codex 里负责规划、关键判断和验收,通过 DeepSeek 官方 Harness 调用 DeepSeek-V4.1-Flash 负责写代码、跑试验和修复,一起做出五项功能跑通的本地 PDF 工具箱。
推荐理由:作者用 GPT 规划、DeepSeek 执行的分工跑通 PDF 工具箱,并给出三段提示词和缓存用量数据,可迁移到长任务降本。
PowerTokens/video-studio 是一个面向 Windows 的 Wan 3.0 视频批量生成工具,把 Excel/CSV 批量导入、任务 ID 恢复、断点下载、Key 池、CLI 和 MCP 整合进桌面工作流,截至 2026 年 10 月 1 日仓库约 1 Star,采用 MIT License,仅支持 Wan 3.0。
微信聊天记录默认不上云,而是以SQLite文件形式存在用户手机本地,服务器只负责转发消息。腾讯在SQLite之上封装了WCDB框架,加入SQLCipher的AES-256-CBC加密,并借助FTS5倒排索引实现快速搜索,实测1万条长文本查询中位响应约0.14毫秒,比LIKE快15倍。数据库文件超过约240MB时会自动拆分。
Anthropic 宣布投入 1 亿美元成立 Claude Frontier Academy,目标在 2027 年底前培养 1 万名 FDE(前沿部署工程师)。
实测 7 款 Lovable 替代品后,Bolt 以 $25/mo(年付 $18/mo)、10M tokens 和浏览器内即时预览成为综合最佳,Replit Agent 适合需要云 IDE 与部署的开发者。
在 Shell 脚本里判断两个文件是否相同,可以用 cmp 替代 diff:cmp 逐字节比较并在首个不匹配处停止,即使文件达到 GB 级也能在毫秒内完成,而 diff 需要逐行解析全文。cmp 的 -s 静默模式通过退出码返回结果:0 表示文件相同,1 表示不同,2 表示文件缺失或不可读。cmp 适合二进制文件和自动化脚本,POSIX 环境默认自带。
Rust 引用的两层控制权可拆成 2×2 四种组合:let 后的 mut 管指针能否改指,& 后的 mut 管数据能否修改。
有开发者提出,随着最新一轮模型发布,AI 已能在生成应用时把几乎任何库的功能内联生成,因此软件库建设可能不再必要。过去把功能拆成定义清晰的模块、增量发布并复用代码,是在构建耗时较长时的必要做法,如今这些做法的重要性明显下降。该问题目前只是提问与讨论,尚无结论。
Capcom 在 RE:2026 大会公布 REX(RE next ENGINE)计划,将在现有 RE Engine 基础上分阶段改造,目标是让 AI 能理解代码、编写代码并试玩构建找 bug。