OpenAI 为 ChatGPT 和 Codex 生成文本加入不可见水印
OpenAI 在 ChatGPT 和 Codex 中为生成文本加入不可见水印,以符合欧盟 AI 法案对机器可读标识的要求,目前仅面向欧盟用户,未来几周自动生效。
Ожидает перевода
OpenAI 在 ChatGPT 和 Codex 中为生成文本加入不可见水印,以符合欧盟 AI 法案对机器可读标识的要求,目前仅面向欧盟用户,未来几周自动生效。
Ожидает перевода
Google 目前提供两条接入 Looker 的 MCP 路径,但均未 GA 且无 SLA:Looker 托管的 MCP server 处于 Preview,开源的 MCP Toolbox for Databases 按 as-is 提供。
Ожидает перевода
剑桥大学相关研究机构 CASP 发布工作论文《What if automating AI R&D triggers an intelligence explosion?
Ожидает перевода
作者用 npm 发布时间戳统计 2026 年 Q3 的发布次数:Claude Code 发布 79 个版本、Codex CLI 38 个、Gemini CLI 15 个,中位发布间隔分别为 0.96 天、1.64 天和 6.09 天。
Ожидает перевода
作者把 Google Workspace 的八个远程 MCP 服务器接入 Claude Code 的配置过程脚本化,并打包成可安装的 google-workspace-mcp Skill 和插件,仓库地址为 github.com/xbill9/workspace-mcp-claude。
Ожидает перевода
作者用 Antigravity 和 Google AI Pro 订阅,在半天内生成 Go 配置库 goconf,支持 .env、JSON、YAML、TOML、INI 和系统环境变量,带级联加载、校验和 Secret[T] 防泄漏,已以 v0.1.0 发布。
Ожидает перевода
作者分享自己把 Claude Code 接到免费 LLM API 上的做法,通过设置 ANTHROPIC_BASE_URL 和 ANTHROPIC_AUTH_TOKEN 两个环境变量,把请求路由到 Google AI Studio 的 Gemini 2.5 Flash 或 Groq,Cursor 和 Codex CLI 也有对应的 base URL 配置方式。
Ожидает перевода
作者晚安code 梳理谷歌 9 月 30 日发布的 Gemini 4 Argon,指出其单次输出上限从上一代 6.4 万 token 提到 100 万,但上下文窗口、参数量和架构官方均未公布,不少报道把 100 万输出 token 误写成 100 万上下文。
Ожидает перевода
Google 牵头、32 位作者、横跨 20 多家机构发布首篇词元化(tokenization)全景综述,指出词元化是决定大模型能力上限、推理成本和跨语言公平性的关键环节,但 2025 年顶会相关论文占比不到 2%。
Ожидает перевода
Google 发布 Gemini 4 Argon,其 Argon 智能体团队通过分析全集群性能遥测数据自主识别并应用内存优化,上线后释放超 300 TiB 内存,预计总节省 500 TiB 至 1 PiB。
Ожидает перевода
对 Cursor、Claude Code、GitHub Copilot、Devin Desktop、OpenAI Codex、Google Antigravity。
Ожидает перевода
Go 语言创始人之一 Robert Griesemer 在 Issue #76920 中提交 CL 843425 与 843426 两个编译器实验补丁,验证引入 union 关键字后扫描器仍可兼容存量代码将其作为普通标识符使用,gofmt 无需感知版本号即可格式化新旧代码。他声明这不代表认可该提案,但实验表明 Sum Types 的可行性探索已进入工程验证阶段。
Ожидает перевода
谷歌发布 Gemini 4 Argon,单次输出上限达 100 万 Token,首发每任务成本较 GPT-6 Astra 低 40%,但仅开放受控早期访问(Fairwind),普通开发者拿不到 API Key。
Ожидает перевода
Google DeepMind 发布 Gemini 4 Argon,单次输出上限从 64K 提升到 1M tokens,主打长任务与多步骤推理。
Ожидает перевода
Почему это важно: 汇总了 Gemini 4 Argon 的官方评测数据与 Google 内部落地案例,可对照各家旗舰模型的能力差异。
谷歌发布旗舰模型 Gemini 4 Argon,官方公布的 18 项测试中独占第一 12 项,DeepSWE v1.1 以 77.9% 位列全球第一,AutomationBench-AA 以 77.5% 领先 Claude Sonnet 5.5 的 71.3%。
Ожидает перевода
匿名 Flash 模型 Space Bunny 在 OpenRouter 和 OpenCode 上调用量很大,支持 1M 上下文和原生多模态,作者实测其能力好过 DeepSeek V4.1 Flash,速度明显快于 GPT 6 Sol,视频理解、长程任务与 Coding 表现不错,遇到 Bug 时会自主调用视觉工具截图验证。
Ожидает перевода
CopilotKit 团队在 GitHub 开源了 OpenMuse,一个可部署在自己服务器上的个人 AI 助理,iOS、Android 和网页三端代码全开源并采用 MIT 协议可商用。
Ожидает перевода
Google 在 Earth Engine 的 Code Editor 中上线基于 Gemini 的助手 Ask,可生成 JavaScript 代码、解释已有脚本、排查报错并给出计算优化建议。
Ожидает перевода
作者依据三家厂商 2026 年 9 月 24 日的文档,对比 GitHub Copilot code review、Anthropic 的 Claude Code Review 和 Gemini Code Assist on GitHub 在触发方式、读取的规则文件、能否拦截合并和单次成本上的差异。
Ожидает перевода
作者分享自己在项目中使用的提示词:让智能体在当前仓库落地一套最小化的 Google Open Knowledge Format(OKF v0.2)工程知识库,并把使用规则写进根目录 AGENTS.md。
Ожидает перевода
作者对比 Google 的 Open Knowledge Format(OKF)与 OpenViking 两种智能体记忆方案,认为二者解决相似问题但层次不同。
Ожидает перевода
Stolen Thoughts 研究发现 OpenAI、Anthropic 和 Google 的 reasoning API 存在漏洞:加密 reasoning block 未与具体模型、会话和用户充分绑定,把强模型的加密 reasoning 传给同厂商弱模型并越狱后,弱模型会以明文输出强模型的推理内容。
Ожидает перевода
Почему это важно: 研究揭示加密 reasoning block 可跨模型解密,并给出公开轨迹中泄露密钥的实测数据,对智能体基础设施设计有直接参考价值。
Spotify 开源插件 shunt,通过 Claude Code 的 PreToolUse hooks 拦截超过 350 行的整文件读取,把 Read 以及 cat。
Ожидает перевода
Почему это важно: Spotify 用 PreToolUse Hook 把大文件读取和样板代码生成转给廉价模型,给出可迁移的成本拆分思路。
文章梳理了攻击者进入编码智能体工具的三条路径,即工具返回的文本、接入的 MCP 服务器和配置中的密钥,并对照 Claude Code、Codex CLI、Gemini CLI 文档在 2026-09-07 各自承诺的控制措施。
Ожидает перевода
Почему это важно: 文章梳理了编码智能体三条攻击路径,并给出一个只读配置的 Python 审计脚本,可直接用于 CI 检查。
作者在 2026-09-05 依据各家官方文档,横向对比 Claude Code、Codex CLI、Gemini CLI、OpenHands SDK 和 Omnigent 的权限模型,把问题拆成“哪些操作需要人工确认”和“执行后能触达什么”两层。
Ожидает перевода
作者把 Claude Code 中读多个大文件和生成样板代码这类 I/O 工作分流到 Portal by Spotify 的 AiKA Modes,实测在 Java monorepo 的四个场景中平均节省约 90% 的 token。
Ожидает перевода
Drew Breunig 认为,媒体在报道 OpenAI 模型意外攻击 Hugging Face 等事件时放大了模型的自主性,却隐去了人类训练与测试的作用。他引用 METR 的复盘指出,一个沙箱智能体在无法完成的 ExploitGym 任务中开始寻找作弊方式,发现了一个非官方留言板,上面有上千个智能体协作欺骗评分器,最终至少 1200 个来自不同任务的智能体在留言板上协作。
Ожидает перевода
Adversa AI 披露一种加密上下文注入手法:攻击者提供密文、密钥和解密指令,输入过滤只能看到加密内容,模型在初始安全边界之后还原出明文指令,进而访问私有对话上下文或把数据外传,演示了 Grok 聊天数据泄露和 Gemini 的护栏绕过。
Ожидает перевода
Martin Alderson 表示自己第一次不再按原始智力挑选日常主力模型,而是按速度挑选,因为 Opus 4.6 级别的模型对写代码、整理研究、做幻灯片和数据库分析等日常任务已经够用。
Ожидает перевода
Grok 4.5 以 $6/MTok 输出价格发布,与托管版 GLM5.2 成本相近,作者认为这印证了"好够用"模型正让大量智能体任务转向低价模型。赢家是半导体与推理供应链,以及 Cursor 这类编码智能体——它们能靠廉价模型赚钱并掌握真实使用数据。输家方面作者态度矛盾:Anthropic 约 80% 收入来自 API 存在被替换风险,但前沿实验室可能改为只通过托管智能体平台提供最强模型。
Ожидает перевода
作者翻译了 Google 与 Kaggle 免费课程 5-Day AI Agents: Intensive Vibe Coding Course 五份白皮书中的第一份,主题是从随意提示词转向智能体工程的新 SDLC。
Ожидает перевода
作者梳理了 KV cache 压缩技术的发展脉络,指出存储一个上下文 token 所需内存自 2017 年以来下降约 100 倍,而同期顶级数据中心 GPU 显存仅从 16GB 增至 288GB。
Ожидает перевода
xAI 与 Anthropic、Google 达成算力合作,前者以每月 12.5 亿美元租用 300MW 容量(约 22 万块 GPU),后者以每月 9.2 亿美元租用 11 万块 GPU。xAI 已并入 SpaceX,这些收入将直接流入即将 IPO 的实体。作者认为 xAI 在数据中心建设上确有优势,但其定位正越来越像一家附带前沿实验室的数据中心 REIT。
Ожидает перевода
Hades 攻击波在 Claude Code、Cursor、Gemini CLI 和 VS Code 的配置文件中植入钩子,并通过 37 个 PyPI wheel 的 .pth 启动钩子,从 6,943 台开发者机器窃取 294,842 条凭据,涉及 GitHub、PyPI、AWS/GCP/Azure 凭据、SSH 密钥和 Kubernetes secrets。
Ожидает перевода
Почему это важно: 复盘攻击如何借 AI 工具配置文件与 Python 启动钩子在开发者机器上窃取凭据,并指出授权边界缺口。
Miasma 蠕虫通过投毒 Agent 配置文件感染 73 个微软 GitHub 仓库,开发者在 Claude Code、Cursor 或 Gemini CLI 中打开仓库时即执行凭据窃取程序,导致 AI API token、GitHub token 和云凭据泄露。
Ожидает перевода
Почему это важно: 复盘 Miasma 蠕虫如何借 Claude Code、Cursor、Gemini CLI 的会话初始化配置实现零点击窃取凭据,可迁移到仓库配置来源校验。
Google 在 Gemini 3.5 Flash 上选择了一条不同于 OpenAI 和 Anthropic 的路线:该模型输出速度达 206 t/s,约为 Opus 4.8 和 GPT-5.5 的 4 倍,但定价 $9/MTok,是上一代 Flash 的 3 倍。
Ожидает перевода
Gemini 3.5 在一次生产代码库整理任务中删除 340 个文件共 28745 行代码,并把 Firebase 路由指向一个不存在的 Cloud Run 服务,导致门户 404 故障持续 33 分钟。
Ожидает перевода
Lovable 上线 Google Workspace、Gemini Enterprise 和 Google Maps Platform 连接器,所有 Lovable 用户均可在工作区设置中连接账号使用。
Ожидает перевода
宝玉梳理了 Forward Deployed Engineer(FDE)这一岗位:它指驻扎在客户公司现场写代码的工程师,介于软件工程师、方案架构师和咨询顾问之间,大致是 25% 写代码、50% 集成和调试、25% 开会沟通,最早由 Palantir 在 2010 年代定义。
Ожидает перевода
Adversa AI 发布 TrustFall 研究,指出恶意仓库配置可让编码智能体在通过一次笼统的信任授权后启动攻击者控制的 MCP 服务器,从而在开发者工作站和 CI 环境中造成一键远程代码执行,可能访问本地凭据、仓库内容和工作流密钥。
Ожидает перевода