Braintrust AWS 账号被入侵,全部客户的 OpenAI、Anthropic、Google API 密钥泄露
2026 年 5 月,攻击者入侵 Braintrust 的 AWS 账号,窃取了集中存储的 org 级 AI 厂商 API 密钥,涉及 OpenAI、Anthropic 和 Google,所有客户被要求立即轮换凭证。
2026 年 5 月,攻击者入侵 Braintrust 的 AWS 账号,窃取了集中存储的 org 级 AI 厂商 API 密钥,涉及 OpenAI、Anthropic 和 Google,所有客户被要求立即轮换凭证。
Google DeepMind CEO Demis Hassabis 在 YC 的 How to Build the Future 直播中表示,当前预训练加 RLHF 加思维链的范式几乎确定会成为 AGI 架构的一部分,但有 50% 概率还需要一两个关键突破,持续学习、长程推理和记忆是三个未解问题。
Andrej Karpathy 在 Sequoia Capital 的 AI Ascent 访谈中提出,Vibe Coding 抬高所有人做软件的下限,Agentic Engineering 则要在用 Agent 提速的同时保住专业软件的质量、安全和责任门槛。
DESIGN.md 是 Google Stitch 提出的 Markdown 设计系统清单,用来告诉编码智能体项目该长什么样,避免每次靠长提示词或截图导致风格漂移。
黄仁勋在 Dwarkesh Patel 两小时专访中称 Nvidia 的使命是"输入是电子,输出是 Token,中间是 Nvidia",并反对把 AI 芯片当武器。他称 Anthropic 采用 TPU 和 Trainium 是特例而非趋势,源于 Nvidia 早年未及时投资 Anthropic;Blackwell 相比 Hopper 能效提升 50 倍,CUDA 的壁垒在于装机量与跨云可移植性。
约翰霍普金斯研究者 Aonan Guan 利用 PR 标题提示词注入,从 Claude Code Security Review、Gemini CLI Action 和 GitHub Copilot 中窃取 API 密钥与 GitHub token。
推荐理由:约翰霍普金斯研究者用 PR 标题注入从三个 AI 编程智能体中窃取凭据,三家厂商均静默修复并支付漏洞赏金。
Google 工程师开源了面向 Linux 内核的智能体 AI 代码审查系统 Sashiko,此前已在 Google 内部使用,现覆盖 Linux 内核邮件列表的全部提交。
Lovable 的基础设施团队公开了其 LLM 供应商负载均衡方案,用于在峰值每分钟超过十亿 token 的流量下避免“model provider unavailable”。
推荐理由:Lovable 公开了每分钟十亿 token 规模下的多供应商负载均衡方案,可借鉴其用 PID 控制器和项目级粘性保住 prompt caching 的做法。
Drew Breunig 分析了 Claude Code、Cursor、Gemini CLI、Codex CLI、OpenHands 和 Kimi CLI 六个 CLI 编程智能体的系统提示词,发现它们长度和指令分布差异明显,原因在于模型校准和用户体验定位不同。
作者介绍如何用 Gemini 2.5 Flash 做图像目标检测,让 AI 工作流不仅能描述图片,还能返回物体所在坐标。做法是给模型一张图和自然语言提示词,要求返回含 label 与 box_2d 的 JSON 数组,坐标按 0-1000 归一化,再用 normalize_to_pixels 换算回真实像素。
2025 年是从“以模型为中心”转向“以智能体为中心”的一年。Claude Code CLI 于 2 月 24 日以预览版发布,同日 GitHub Copilot 在 VS Code 推出 agent mode。
作者 Martin Alderson 认为当前模型进步是一次更微妙的 GPT-4 时刻,但现有基准测不出来。他指出 Gemini 3 Pro Preview 在设计网页和落地页上明显强于其他模型,并给出流程:上传产品 CSS 让模型提取设计系统,再结合产品截图生成 HTML 原型。
作者 mbleigh 认为上下文工程普遍忽视了超链接这一手段,并提出只需一个接受 URI 列表的 read_resources 工具加一个入口 URI,就能让模型按需递归加载上下文。
作者 Martin Alderson 发现 Google AI Studio 的 Gemini API 近两周频繁出现 503 模型过载错误,而官方状态页没有报告。
Google 的 gemini-embedding-001 正被 Box、re:cap、Everlaw、Roo Code、Mindlid、Poke 等产品用于 RAG 与上下文工程。
Google 开源的 Gemini CLI 系统提示词与 Claude Code 高度相似,示例中仅将「11 是质数吗」改为「13 是质数吗」。作者 Jesse Vincent 对比两者后认为,这像是有人让模型「洗」了一遍 Anthropic 的提示词。