CloudNativePG 1.30.1 修复扩展路径校验绕过与集群切换挂起问题
CloudNativePG 1.30.1 修复了扩展路径校验绕过漏洞:此前含 `..` 的绝对路径可通过验证,运行时解析后能逃出扩展挂载点,现在这类记录会在 admission 检查、主版本升级和已存 Cluster 规格处理时被拒绝或跳过。
CloudNativePG 1.30.1 修复了扩展路径校验绕过漏洞:此前含 `..` 的绝对路径可通过验证,运行时解析后能逃出扩展挂载点,现在这类记录会在 admission 检查、主版本升级和已存 Cluster 规格处理时被拒绝或跳过。
Cloudflare 的 workerd 1.20260924.1 新增 env.AI.websearch 接口,为 Workers AI 提供网页搜索,并把 REST 请求的调用方上下文传给下游 AI Gateway。
Lovable 聊天功能现已免费开放,Free、Pro 和 Business 工作区每天都有免费聊天额度。用户可以让它评估该做哪个创意、把客户反馈整理成计划,或分析已上线应用的代码和 Lovable Cloud 数据库用量。聊天在生成图片、视频或转交 Plan、Build 时仍照常消耗 credits,当前聊天定价(含每日免费额度)适用至 2026 年 10 月 31 日。
Visual Studio Code 1.139 稳定版发布,AI 智能体现在可以在 SSH、Tunnel 和 WSL 远程主机的 Dev Containers 中构建和测试项目,使用容器内配置的工具与依赖。
GitHub 于 9 月 23 日为 GitHub Copilot App 推出本地沙箱,目前处于公开预览,仅适用于使用本地仓库和工作树的会话。沙箱可分别限制文件系统读写路径、外网与局域网访问,以及 Git credentials 和 GitHub CLI 数据的使用,企业策略还能进一步收紧;若操作系统无法应用规则,隔离环境会报错退出而不执行命令。
UiPath 于 9 月 23 日更新 UiPath Platform,Automation Suite 全栈现可在本地 Linux 基础设施上运行,面向有数据存储、安全和环境控制要求的企业。
OpenAI 于 9 月 22 日在 API 发布 gpt-6-sol 和 gpt-6-luna,两者接受文本和图像输入、只生成文本。标准处理下,GPT-6 Sol 每百万输入 token 收费 2 美元、缓存 token 0.20 美元、输出 10 美元;GPT-6 Luna 分别为 0.10、0.01 和 0.50 美元。
systemd 262 于 9 月 22 日发布,可将 PID 1 与 executor 编译为单一静态链接二进制文件,用于小型容器,且不通过 dlopen() 加载额外库、无需 NSS 查找用户和组。
Anthropic 于 9 月 22 日发布旗舰模型 Claude Opus 5.5,面向让智能体执行编程、数据分析等多步任务的开发者与团队,官方称相比 Opus 5 性能提升且成本下降。
推荐理由:Anthropic 官方公布的定价与默认负载成本降幅,可帮开发者判断长时智能体任务的迁移成本。
Cursor 发布 Rollouts 和 Security Review 两个 bot,均面向团队版和企业版开放。
推荐理由:官方给出两个 bot 的监控与安全审查流程,读者可据此判断能否接入现有交付链路。
Lovable 上线 Opus 5.5,官方称其与 Opus 5 结果持平,但完成步数减少三分之一到一半。在 Lovable 内部基准上,Opus 5.5 在 0-to-1 构建和迭代改代码两项与 Opus 5 打平,验证纪律一项高出 4% 到 6%;各档推理强度下每任务步骤数减少 26% 到 57%,输入 token 减少 21% 到 59%,差异在 95% 置信水平上显著。
推荐理由:Lovable 官方给出 Opus 5.5 与 Opus 5 在步骤数和 token 上的对比数据,可据此判断构建效率的实际变化。
Cline CLI 3.0.63 发布,修复了 Windows 下可能从工作目录而非系统 PATH 执行 rg、git、powershell 的问题,恶意仓库放置的 rg.exe 等文件可能在索引阶段、确认提示之前就被执行,新版本在 CLI 及其后台服务启动时禁用该行为。
MiMo-V2.6-Pro debuts as the top open weights model on the Artificial Analysis Intelligence Index (46). At $0.13 per Intelligence Index task, it lands on the Intelligence vs. Cost per Task Pareto frontier @Xiaomi has just released MiMo-V2.6-Pro, an open weights model with major advances in intelligence over its predecessor, MiMo-V2.5-Pro (Intelligence Index: 26). Despite the improvement, it retains the same attractive pricing at $0.435 per 1M input tokens (with a 99% cache-hit discount) and $0.87 per 1M output tokens. This makes MiMo-V2.6-Pro one of the most cost-efficient models to deploy. MiMo-V2.6-Pro is an MoE model with 1.02T total parameters and 42B active parameters. Stay tuned for additional analysis of the model. Check out MiMo-V2.6-Pro full benchmarking breakdown here: https://artificialanalysis.ai
Lovable 与 AWS、CrowdStrike、Databricks、Docker、Google Cloud、Okta、Proofpoint、Salesforce、ServiceNow、Wiz、Zscaler 共同成为 Blueprint Alliance 创始成员,该联盟推动面向企业级 AI 智能体安全与治理的开放参考架构。
俄罗斯团队 Маракуйя ИИ 的智能体框架首次参加 Terminal-Bench 4 和 OSWorld 2 两项基准测试,取得亮眼成绩。
Superpowers 6.4 发布,新增对 Meta Muse、OpenCode 2.0 和 Qwen Code 三个编程智能体的支持,并重写了 executing-plans 技能中的 Native Execution。
Claude Code 从 2.1.277 版本开始支持 AGENTS.md:当文件夹中没有 CLAUDE.md 时,Claude 会检查并使用 AGENTS.md。该支持基于 Claude Code mods 构建,这是其即将推出的定制 Claude Code harness 的方式,属于内置 mod,用户之后也可以自行构建自定义版本的项目指令。
Lovable 发布用 Rust 从零实现的预览引擎 OJ,它读取现有 vite.config.ts 并通过兼容层运行真实 Vite 插件,单个二进制、不向项目安装工具链。
推荐理由:Lovable 用 Rust 重写预览引擎 OJ,给出与 Vite 的冷启动和内存对比,以及生产环境灰度数据。
Cline 发布开源桌面应用 Cline Desktop 的早期版本,把原本在 VS Code 扩展和 CLI 中的智能体运行框架搬进独立工作区,支持并行会话、定时任务和用于扩展工具与集成的 Marketplace。
推荐理由:官方给出桌面端的能力边界与开放入口,读者可据此判断它是否适合承接多智能体并行任务。
开发者 pdfu 在 iOS 27 和 macOS Golden Gate 的私有框架中发现,Apple 的新 Siri 架构设计了与第三方 AI 模型对接的机制。
Cursor 推出「项目」功能,用于承接一项功能、一次迁移或一个完整应用这类长周期工作,可在数月内保持上下文并把任务委派给成千上万个子智能体。项目由云端智能体驱动,协调智能体不写代码,只负责规划、分派并交回成果,需要本机测试时再启动本地智能体;每个项目维护一组在云端和本地机器间同步的文件,持续积累研究成果、artifacts 和对代码库的了解。
推荐理由:官方给出项目式多智能体协作的上下文共享与自动触发机制,可据此判断长周期任务如何被接管。
Lovable 正式启动 Partner Program,分为面向独立开发者和小型机构的 Expert 与面向咨询公司、系统集成商的 Solution Partner 两条路径,并提供 Partner Directory 供企业查找和雇佣伙伴。
Lovable 上线 drafts 功能,为项目创建带独立对话和预览的副本,团队可并行探索同一项目的多个版本,改动只有接受并发布后才会应用到线上应用。该功能适用于任何项目,首个版本仅覆盖前端改动,涉及数据库结构或登录设置的修改仍需在项目对话中完成。
GitHub 在 Copilot CLI 中以研究预览形式推出 Project HydraFusion,通过运行时编排在多个提供商的模型间选择执行方案,用户像选普通模型一样选择它,按各模型标准费率计费。
推荐理由:GitHub 官方给出 HydraFusion 的三种编排模式与三项基准的成本质量对比,可据此判断多模型编排在真实编码任务中的取舍。
OpenAI 于 2026 年 9 月 3 日发布 GPT-6 Astra 与 Astra Pro,首批仅限 Daybreak 网络安全计划企业,ChatGPT 付费版、API 和 AWS 将在随后几天开放。
推荐理由:梳理 GPT-6 Astra 与 Fable 5.1 的基准对比,指出各家测试版本与 harness 不一致,读者可据此判断哪些分数可比。
Cursor 支持自托管机器,代码库、构建产物和密钥都保留在自有基础设施的内部机器上,由智能体在本地处理工具调用。My Machines 用于把单台笔记本或 VM 接入个人工作流,团队池则是面向团队或企业的具名 worker 队列,容量随请求扩容、worker 断开时缩容,池不与代码仓库绑定,并支持闲置机器休眠后在重连窗口内恢复。
推荐理由:官方给出自托管机器的池化调度与沙箱接入方式,读者可据此判断工具执行能否留在自有网络内。
Lovable 现已接入 Fable 5.1,早期测试显示其在修复和改进现有应用上比 Fable 5 最高提升 17%,单任务成本最多降低 31%。该模型在中等和高推理强度下的 UI 与视觉设计质量最高提升 3.5%,并会在完成任务前打开浏览器运行应用进行自我验证。Lovable 正将卡住的会话以及更长、更复杂的任务路由到 Fable 5.1。
WikiSkill 是一个让 Agent Skill 与持久知识库(wiki)协同演化的框架,它把原始执行经验、累积知识和可执行 Skill 分离,并持续将经验沉淀进 wiki 供后续 Skill 更新使用。
Terminal-Bench 发布 4.0 版本,校准任务的时间、CPU 和内存资源,修复 19 个任务并移除 8 个饱和或存在质量问题的任务,所有任务统一设为 8 小时 agent 超时。
Cursor 云端智能体不再需要连接 GitHub 或其他第三方 SCM 提供商,用户可直接输入提示开始工作,Cursor 会在后台创建 Origin 代码仓库。满意后可点击“创建代码仓库”将工作保存到 Origin,并设置私有或内部可见性。Cursor 还能通过端口转发在浏览器中实时预览云端智能体环境,连接 Vercel 账户后点击“发布”即可生成可访问 URL。
斯坦福大学研究人员主导、Terminal-Bench 团队联合全球科研机构专家打造的 Terminal-Bench-Science 0.1 发布,首批含生命、物理、地球、数学和工程科学领域的 70 项任务。
Cline 让八个模型在自家 harness 里做 IMO 2026 六道题,证明由 GPT-5.5 和 Claude Opus 5 双盲按 0–7 分制评分、Gemini 3.1 Pro 仲裁,金牌线为 29 分。
推荐理由:Cline 用同一套 harness 盲评八个模型做 IMO 2026,给出分数与单次成本对照,可看开源权重模型的实际性价比。
Vercel Connect 结束公开测试正式 GA,用运行时按任务申请、自动过期的短期 token 取代长期凭证,应用无需存储 provider secret。
OpenAI 推出 Daybreak,把 ChatGPT、Codex Security 和开源 Codex Security CLI 组合成一套安全防御工作流,覆盖 PR 合并前审查、仓库与漏洞积压排查、CI 定期检查。
推荐理由:官方给出 Codex Security 从 PR 审查、仓库扫描到 CLI 批量扫描的完整用法,可据此判断如何接入现有安全流程。
Simon Willison 用 Claude Code for web 做了一个约 150 行、零依赖的 TypeScript 服务原型,基于 Bun 1.4 实验性的 Bun.WebView 提供 shot-scraper 风格的 JSON API,支持执行 JavaScript 和输出 PNG/JPEG/WebP 截图,无需 Puppeteer 或 Playwright。
Cursor 更新云端智能体和 Cursor harness,让云端智能体可以订阅事件源,在 PR、Slack 讨论串或定时任务有新动态时恢复运行,并持续推进直至完成,修复 CI 问题、处理 bot 评论。
推荐理由:云端智能体从单次执行转向订阅事件、持续跟进 PR 与 Slack 讨论串,读者可据此判断自动化边界的变化。
OpenAI 把驱动 Codex App、CLI 和 IDE 扩展的 harness 开源,并通过 Codex app-server 的客户端协议开放创建线程、启动轮次、接收事件和处理审批请求等能力。
推荐理由:官方公开 Codex harness 与 app-server 协议,读者可据此判断把智能体嵌入自有产品的方式与边界。
Lovable 宣布完成 4 亿美元 C 轮融资,估值达 133 亿美元,由 Menlo Ventures 领投、Scaleup Europe Fund 联合领投。
NVIDIA 发布 Nemotron 3.5 Lightning,一个面向常驻智能体的可定制开源模型,并已在 Cline 中免费提供。
推荐理由:NVIDIA 新开源模型在 Cline 免费开放,读者可据此判断高频智能体调用场景是否值得换用。
Anthropic 宣布从 8 月 14 日起,Pro、Max 和 Team 套餐的新会话默认运行 auto mode,并停止对分类器额外 token 开销收费;Enterprise、Claude API、AWS、Bedrock、Google Cloud 和 Microsoft Foundry 暂时保持可选,计划下个月改为默认。
推荐理由:Anthropic 公布 auto mode 的安全评测数据与内部拦截案例,可据此判断默认权限模式对现有工作流的影响。