Skip to content

All updates

0 items today
2/3Tue
  1. Vercel · v0 Blog60

    Vercel 发布新版 v0,从生成演示转向生产级应用

    Vercel 发布新版 v0,将其定位从生成演示转向生产级应用和智能体。新版本基于沙箱运行时,可导入任意 GitHub 仓库并自动拉取 Vercel 上的环境变量和配置;新增 Git 面板,让非工程成员也能为每个对话建分支、向 main 提 PR 并在合并后部署;同时提供与 Snowflake 和 AWS 数据库的安全集成,以及默认开启的部署保护和访问控制。

    Awaiting translation

    Why it matters: v0 从生成演示转向生产级应用,给出导入 GitHub 仓库、Git 面板和数据库集成等具体能力变化。

2/2Mon
2/1Sun
  1. Permission Protocol · AI Agent Incident Tracker88

    Moltbook 硬编码 Supabase 密钥泄露 150 万 agent API token,可被完全劫持

    Wiz 研究人员从 Moltbook 生产环境 Next.js 静态 JS 包中提取出硬编码的 Supabase API key,无需认证即可对生产数据库读写,暴露 150 万 agent API token、3.5 万个邮箱地址和私有消息。

    Awaiting translation

    Why it matters: 复盘了硬编码密钥、缺失 RLS 与无授权边界三层叠加如何让 150 万 agent token 可被任意读取。

  2. Martin Alderson62

    两类 AI 用户正在分化,差距惊人

    作者 Martin Alderson 观察到 AI 用户正分化为两类:一类是深度使用 Claude Code、MCP、Skills 等工具的用户,其中不少并非技术出身,财务岗位用它处理原本受限于 Excel 的任务;另一类仍停留在与 ChatGPT 对话的阶段。

    Awaiting translation

1/30Fri
1/29Thu
  1. Permission Protocol · AI Agent Incident Tracker80

    OpenClaw 控制 UI 跨站 WebSocket 劫持漏洞可导致远程代码执行

    OpenClaw 的 Web 控制 UI 存在跨站 WebSocket 劫持漏洞 CVE-2026-25253(CVSS 8.8),攻击者诱导受害者访问恶意链接后,可静默窃取 OpenClaw 认证 token,并直连受害者本机 OpenClaw 实例执行任意命令,从而完全控制开发者工作站,获得文件读写与 shell 执行权限。

    Awaiting translation

    Why it matters: 材料完整还原了 OpenClaw 控制 UI 的 CSWSH 漏洞利用链与授权边界缺失,可据此检查同类本地 Agent 工具的 WebSocket 鉴权。

1/27Tue
  1. Martin Fowler · Exploring Generative AI70

    用 AI 智能体写代码时如何评估内部代码质量:CCMenu 加 GitLab 支持的实测

    Martin Fowler 用给 Mac 应用 CCMenu 增加 GitLab 支持的实验,考察 AI 智能体生成代码的内部质量。他先后用 Windsurf 加 Sonnet 3.5、Claude Code 加 Sonnet 4.5,让智能体参照现有 GitHub 的 API 封装、feed reader 和响应解析三个文件实现 GitLab 版本。

    Awaiting translation

    Why it matters: 作者用给 CCMenu 加 GitLab 支持的实测,展示 AI 智能体在内部代码质量上会引入哪些隐性技术债。

1/26Mon
1/25Sun
1/23Fri
1/22Thu
1/19Mon
  1. Kondasamy Jayaraman · Engineering Blog60

    RAG 入门:构建可用检索系统时没人告诉你的那些事

    作者结合自己搭建多个 RAG 系统的经验,把 RAG 拆成检索与生成两步,指出检索质量决定答案质量,提示词工程无法弥补糟糕的上下文。文中给出具体取舍:分块 300-500 token 并保留 20-30% 重叠,纯向量检索只能找到约 75% 的相关文档,混合检索可提升到 87%,重排能带来 20-35% 的准确率提升但增加 200-500ms 延迟。

    Awaiting translation

1/17Sat
  1. Geoffrey Huntley · Blog62

    Geoffrey Huntley 推荐智能体反向压力一文:用自动化反馈约束 Agent

    Geoffrey Huntley 推荐 Moss 撰写的一篇关于智能体反向压力的文章,认为它值得关注 AI 上下文工程的人细读。文章的核心观点是,过去一年里表现最好的智能体应用,都在智能体周围搭建了结构,为它提供关于质量和正确性的自动化反馈,从而让它能承担更长周期的任务。

    Awaiting translation

  2. Geoffrey Huntley · Blog60

    Geoffrey Huntley:一切皆可成为 ralph 循环

    Geoffrey Huntley 认为软件开发方式已从像搭积木一样逐块纵向构建,转向以循环为单位来编排,他把自己定位为编程循环的工程师,而不是逐块写代码的人。他反对当下流行的多智能体与智能体间通信,理由是智能体本身是非确定性的,多智能体只会像微服务一样带来复杂度,而 ralph 是单仓库、单进程、每轮只做一件事的纵向扩展方案。

    Awaiting translation

1/12Mon
1/11Sun
  1. OpenAI Developer Blog · Codex71

    Skyscanner 如何用 JetBrains MCP 增强 Codex CLI

    Skyscanner 工程师把 OpenAI 的 Codex CLI 接入 JetBrains IDE 的 MCP server,让 Codex 能调用 IDE 的 get_file_problems 检查文件错误、执行预设的 run configurations 跑测试和 lint。

    Awaiting translation

    Why it matters: Skyscanner 工程师把 Codex CLI 接入 JetBrains MCP,让 AI 直接读取 IDE 报错并跑测试,读者可借鉴这套反馈闭环。

1/10Sat
  1. Martin Alderson50

    AI 算力短缺即将到来:从 token 消耗暴涨到 DRAM 供应瓶颈

    随着编码智能体和最新模型推动 token 消耗激增,AI 算力正面临严重短缺。作者估算自己三年内每日 token 消耗增长约 50 倍,目前全球约 10 亿活跃 LLM 用户,而超大规模厂商已承诺数千亿美元资本支出。Macquarie 指出当前 DRAM 供应仅能支撑 15GW 的 AI 基础设施部署,内存供应正成为比电力更难解决的瓶颈。

    Awaiting translation

1/8Thu
1/6Tue
  1. Harper Reed62

    如何从手机远程使用 Claude Code:Tailscale、Mosh 与 TMUX 配置

    作者介绍自己从 iPhone 远程运行 Claude Code 的完整方案,需要解决网络、终端客户端、工作站和工具四件事。网络用 Tailscale 打通任意设备到工作站的连接,终端客户端选 blink,工作站是一台持续供电、网络良好的 Mac;工具层面用 SSH 密钥、Mosh 保持断线后连接可恢复、TMUX 让多个 Claude Code 会话长期运行并随时重连。

    Awaiting translation

1/5Mon
1/1Thu
  1. Permission Protocol · AI Agent Incident Tracker76

    Attackers used Claude Code to conduct reconnaissance and password spraying against the OT environment of a Mexican water utility.

    Dragos’ investigation shows that attackers used Claude Code and OpenAI GPT-4.1 to target the OT environment of a Mexican water company. Claude Code handled broad discovery, identifying vNode industrial gateways, researching vendor credentials, generating password lists, and executing password spraying, while GPT-4.1 handled structured data analysis and Spanish-language output.

    Why it matters: Dragos reconstructed the full chain of how attackers used Claude Code and GPT-4.1 to conduct reconnaissance and password spraying against a Mexican water utility’s OT environment, showing how AI was actually divided across the intrusion lifecycle.

12/31Wed
12/29Mon
12/27Sat
  1. Martin Alderson38

    旅行社用了 10 年崩塌,软件工程师才走到第 3 年

    美国旅行社数量从 2000 年的 124,000 家降至 2012 年的 65,000 家,历时十年;而 LLM 在软件工程领域的采用率从 2022 年的 0% 升至 2025 年的 84%,速度远超当年互联网对旅行社的冲击。作者认为,只会把需求手动翻译成代码的通用型开发者,处境类似当年被 OTA 淘汰的普通旅行社代理。

    Awaiting translation

12/25Thu
  1. The Agentic Engineer · Blog66

    我为什么不再逐行读 AI 生成的代码,改用可视化证据验证

    作者 Matthew Fontana 分享自己不再逐行审查 AI 生成的代码,而是用 Playwright MCP 让智能体截图证明功能可用。他给出的做法是直接提示智能体导航到页面、截图、点击并截图结果,例如让智能体截取空表单、填入非法数据截取校验错误、再正确填写截取成功状态,三张图即可判断表单是否可用。

    Awaiting translation