跳到正文

全部动态

今日 0 条
2/3周二
  1. Vercel · v0 Blog60

    Vercel 发布新版 v0,从生成演示转向生产级应用

    Vercel 发布新版 v0,将其定位从生成演示转向生产级应用和智能体。新版本基于沙箱运行时,可导入任意 GitHub 仓库并自动拉取 Vercel 上的环境变量和配置;新增 Git 面板,让非工程成员也能为每个对话建分支、向 main 提 PR 并在合并后部署;同时提供与 Snowflake 和 AWS 数据库的安全集成,以及默认开启的部署保护和访问控制。

    推荐理由:v0 从生成演示转向生产级应用,给出导入 GitHub 仓库、Git 面板和数据库集成等具体能力变化。

2/2周一
2/1周日
  1. Permission Protocol · AI Agent Incident Tracker88

    Moltbook 硬编码 Supabase 密钥泄露 150 万 agent API token,可被完全劫持

    Wiz 研究人员从 Moltbook 生产环境 Next.js 静态 JS 包中提取出硬编码的 Supabase API key,无需认证即可对生产数据库读写,暴露 150 万 agent API token、3.5 万个邮箱地址和私有消息。

    推荐理由:复盘了硬编码密钥、缺失 RLS 与无授权边界三层叠加如何让 150 万 agent token 可被任意读取。

1/30周五
1/29周四
  1. Permission Protocol · AI Agent Incident Tracker80

    OpenClaw 控制 UI 跨站 WebSocket 劫持漏洞可导致远程代码执行

    OpenClaw 的 Web 控制 UI 存在跨站 WebSocket 劫持漏洞 CVE-2026-25253(CVSS 8.8),攻击者诱导受害者访问恶意链接后,可静默窃取 OpenClaw 认证 token,并直连受害者本机 OpenClaw 实例执行任意命令,从而完全控制开发者工作站,获得文件读写与 shell 执行权限。

    推荐理由:材料完整还原了 OpenClaw 控制 UI 的 CSWSH 漏洞利用链与授权边界缺失,可据此检查同类本地 Agent 工具的 WebSocket 鉴权。

1/27周二
  1. Martin Fowler · Exploring Generative AI70

    用 AI 智能体写代码时如何评估内部代码质量:CCMenu 加 GitLab 支持的实测

    Martin Fowler 用给 Mac 应用 CCMenu 增加 GitLab 支持的实验,考察 AI 智能体生成代码的内部质量。他先后用 Windsurf 加 Sonnet 3.5、Claude Code 加 Sonnet 4.5,让智能体参照现有 GitHub 的 API 封装、feed reader 和响应解析三个文件实现 GitLab 版本。

    推荐理由:作者用给 CCMenu 加 GitLab 支持的实测,展示 AI 智能体在内部代码质量上会引入哪些隐性技术债。

1/26周一
1/25周日
1/23周五
1/22周四
1/19周一
  1. Kondasamy Jayaraman · Engineering Blog60

    RAG 入门:构建可用检索系统时没人告诉你的那些事

    作者结合自己搭建多个 RAG 系统的经验,把 RAG 拆成检索与生成两步,指出检索质量决定答案质量,提示词工程无法弥补糟糕的上下文。文中给出具体取舍:分块 300-500 token 并保留 20-30% 重叠,纯向量检索只能找到约 75% 的相关文档,混合检索可提升到 87%,重排能带来 20-35% 的准确率提升但增加 200-500ms 延迟。

1/17周六
  1. Geoffrey Huntley · Blog62

    Geoffrey Huntley 推荐智能体反向压力一文:用自动化反馈约束 Agent

    Geoffrey Huntley 推荐 Moss 撰写的一篇关于智能体反向压力的文章,认为它值得关注 AI 上下文工程的人细读。文章的核心观点是,过去一年里表现最好的智能体应用,都在智能体周围搭建了结构,为它提供关于质量和正确性的自动化反馈,从而让它能承担更长周期的任务。

  2. Geoffrey Huntley · Blog60

    Geoffrey Huntley:一切皆可成为 ralph 循环

    Geoffrey Huntley 认为软件开发方式已从像搭积木一样逐块纵向构建,转向以循环为单位来编排,他把自己定位为编程循环的工程师,而不是逐块写代码的人。他反对当下流行的多智能体与智能体间通信,理由是智能体本身是非确定性的,多智能体只会像微服务一样带来复杂度,而 ralph 是单仓库、单进程、每轮只做一件事的纵向扩展方案。

1/12周一
1/11周日
  1. OpenAI Developer Blog · Codex71

    Skyscanner 如何用 JetBrains MCP 增强 Codex CLI

    Skyscanner 工程师把 OpenAI 的 Codex CLI 接入 JetBrains IDE 的 MCP server,让 Codex 能调用 IDE 的 get_file_problems 检查文件错误、执行预设的 run configurations 跑测试和 lint。

    推荐理由:Skyscanner 工程师把 Codex CLI 接入 JetBrains MCP,让 AI 直接读取 IDE 报错并跑测试,读者可借鉴这套反馈闭环。

1/10周六
  1. Martin Alderson50

    AI 算力短缺即将到来:从 token 消耗暴涨到 DRAM 供应瓶颈

    随着编码智能体和最新模型推动 token 消耗激增,AI 算力正面临严重短缺。作者估算自己三年内每日 token 消耗增长约 50 倍,目前全球约 10 亿活跃 LLM 用户,而超大规模厂商已承诺数千亿美元资本支出。Macquarie 指出当前 DRAM 供应仅能支撑 15GW 的 AI 基础设施部署,内存供应正成为比电力更难解决的瓶颈。

1/8周四
  1. The Agentic Engineer · Blog60

    用 Gemini 为 AI 工作流加上图像目标检测能力

    作者介绍如何用 Gemini 2.5 Flash 做图像目标检测,让 AI 工作流不仅能描述图片,还能返回物体所在坐标。做法是给模型一张图和自然语言提示词,要求返回含 label 与 box_2d 的 JSON 数组,坐标按 0-1000 归一化,再用 normalize_to_pixels 换算回真实像素。

1/6周二
  1. Harper Reed62

    如何从手机远程使用 Claude Code:Tailscale、Mosh 与 TMUX 配置

    作者介绍自己从 iPhone 远程运行 Claude Code 的完整方案,需要解决网络、终端客户端、工作站和工具四件事。网络用 Tailscale 打通任意设备到工作站的连接,终端客户端选 blink,工作站是一台持续供电、网络良好的 Mac;工具层面用 SSH 密钥、Mosh 保持断线后连接可恢复、TMUX 让多个 Claude Code 会话长期运行并随时重连。

1/5周一
1/1周四
  1. Permission Protocol · AI Agent Incident Tracker76

    攻击者用 Claude Code 对墨西哥水务公司 OT 环境做侦察和密码喷洒攻击

    Dragos 调查显示,攻击者用 Claude Code 和 OpenAI GPT-4.1 针对墨西哥一家水务公司的 OT 环境发起攻击,Claude Code 负责大范围发现、识别 vNode 工业网关、研究厂商凭据、生成密码列表并执行密码喷洒,GPT-4.1 负责结构化数据分析和西班牙语输出。

    推荐理由:Dragos 复盘了攻击者用 Claude Code 与 GPT-4.1 对墨西哥水务 OT 环境做侦察和密码喷洒的完整链路,可看到 AI 在入侵生命周期中的实际分工。

12/31周三
12/29周一
12/27周六
12/25周四
  1. The Agentic Engineer · Blog66

    我为什么不再逐行读 AI 生成的代码,改用可视化证据验证

    作者 Matthew Fontana 分享自己不再逐行审查 AI 生成的代码,而是用 Playwright MCP 让智能体截图证明功能可用。他给出的做法是直接提示智能体导航到页面、截图、点击并截图结果,例如让智能体截取空表单、填入非法数据截取校验错误、再正确填写截取成功状态,三张图即可判断表单是否可用。