Перейти к содержимому

#OpenAI

Сегодня 0 материалов
07.06вс
  1. Permission Protocol · AI Agent Incident Tracker87

    Hades 攻击通过污染 AI 工具配置文件和 PyPI 启动钩子窃取 294,842 条凭据

    Hades 攻击波在 Claude Code、Cursor、Gemini CLI 和 VS Code 的配置文件中植入钩子,并通过 37 个 PyPI wheel 的 .pth 启动钩子,从 6,943 台开发者机器窃取 294,842 条凭据,涉及 GitHub、PyPI、AWS/GCP/Azure 凭据、SSH 密钥和 Kubernetes secrets。

    Ожидает перевода

    Почему это важно: 复盘攻击如何借 AI 工具配置文件与 Python 启动钩子在开发者机器上窃取凭据,并指出授权边界缺口。

05.06пт
  1. Permission Protocol · AI Agent Incident Tracker88

    Miasma 供应链蠕虫通过 Agent 配置注入禁用 73 个微软 GitHub 仓库并窃取凭据

    Miasma 蠕虫通过投毒 Agent 配置文件感染 73 个微软 GitHub 仓库,开发者在 Claude Code、Cursor 或 Gemini CLI 中打开仓库时即执行凭据窃取程序,导致 AI API token、GitHub token 和云凭据泄露。

    Ожидает перевода

    Почему это важно: 复盘 Miasma 蠕虫如何借 Claude Code、Cursor、Gemini CLI 的会话初始化配置实现零点击窃取凭据,可迁移到仓库配置来源校验。

03.06ср
  1. Permission Protocol · AI Agent Incident Tracker76

    仿冒 Claude Code 与 Codex 安装页经 Google Sites 投递无文件内存窃密程序

    攻击者用 Google Sites 托管仿冒 Claude Code 和 Codex 的安装页,诱导开发者在运行对话框粘贴 mshta.exe 命令,投递无文件内存窃密程序,窃取 AI API key、浏览器凭据和开发者环境密钥。

    Ожидает перевода

    Почему это важно: 梳理了仿冒 Claude Code 与 Codex 安装页的 ClickFix 攻击链,可了解针对 AI 开发者凭据的窃取手法。

01.06пн
  1. Permission Protocol · AI Agent Incident Tracker69

    Meta AI 客服机器人未验证身份致 20225 个 Instagram 账号被接管

    Meta AI 客服机器人被攻击者用来接管 Instagram 账号:攻击者只需在聊天中要求把目标账号绑定到新邮箱,机器人就把验证码发到攻击者邮箱并允许重置密码,全程无需技术能力,还用 VPN 伪装目标位置绕过自动防护。

    Ожидает перевода

26.05вт
  1. Hacker News · AI Code Review 讨论88

    Как Cloudflare с помощью OpenCode организует масштабное ИИ-ревью кода

    Cloudflare построил на базе открытого ИИ-агента для разработки OpenCode систему ИИ-ревью кода, встроенную в CI: координирующий агент управляет до 7 специализированных агентов-ревьюеров, отвечающих за безопасность, производительность, качество кода, документацию, релиз и внутренние стандарты, а после дедупликации публикуется только один структурированный комментарий с ревью.

    Почему это важно: Cloudflare раскрыл архитектуру плагинов для многоагентного ревью кода в CI, градацию рисков и данные о затратах — всё это можно перенести в собственный пайплайн ревью.

24.05вс
  1. Thorsten Ball · Register Spill15

    Amp Labs 成立,Amp 联合创始人谈软件的未来

    Amp 本周宣布成立 Amp Labs,团队已与多家公司合作,新阶段从澳大利亚悉尼起步。Amp 官网同期发布《Software After Software》,阐述其对软件未来的判断以及 Amp 与 Amp Labs 的存在理由。联合创始人还做客 Mayank Gupta 播客,聊了自己如何进入编程、从练 Vim 到成为 Amp 联合创始人的经历。

    Ожидает перевода

23.05сб
  1. 陈与小金 · AI Coding 博客62

    卡帕西加入 Anthropic:用 Claude 造下一个 Claude,套壳才是产品

    OpenAI 创始成员卡帕西于 2026 年 5 月 19 日加入 Anthropic 预训练团队,Anthropic 为他新建了一个子团队。据预训练团队负责人 Joseph 在 X 上的说法,卡帕西将带领新团队用 Claude 加速预训练研究本身,即让 Claude 帮研究员提代码方案、写预训练代码、跑消融实验、生成并筛选训练数据,卡帕西负责把关。

    Ожидает перевода

22.05пт
  1. Permission Protocol · AI Agent Incident Tracker85

    GitHub подтвердил утечку 3800 внутренних репозиториев — сотрудник установил заражённое расширение Nx Console для VS Code

    GitHub подтвердил утечку около 3800 внутренних репозиториев, среди них — внутренний код Copilot и исходники рабочих процессов GitHub Actions. Причина — сотрудник установил расширение Nx Console 18.95.0 для VS Code, заражённое TeamPCP.

    Почему это важно: Хронология инцидента и техническая цепочка восстановлены полностью: видно, как через заражение расширения для VS Code злоумышленники крадут учётные данные и выкачивают внутренние репозитории.

20.05ср
  1. 宝玉76

    Команда Codex делится, как выжать максимум из Codex

    Участник команды Codex Джейсон (@jxnlco) рассказывает, как выжать максимум из Codex: главное — сочетать постоянные диалоговые потоки, голосовой ввод, вмешательство в задачи и очередь, серверы MCP и коннекторы, автоматизацию диалоговых потоков, постановку целей и боковую панель.

    Почему это важно: Участник команды Codex разбирает постоянные диалоговые потоки, вмешательство в задачи, автоматизацию и постановку целей — эти приёмы можно перенести в повседневный рабочий процесс с ИИ-агентом.

18.05пн
  1. Hacker News · Harness Engineering 讨论62

    Learn Harness Engineering:面向 AI 编程智能体的工程课程

    Learn Harness Engineering 是一门专注 AI 编程智能体工程的课程,综合了 OpenAI 关于在 agent-first 世界中使用 Codex 的 harness engineering 实践,以及 Anthropic 关于长时运行智能体 harness 设计与应用开发的两篇文章。

    Ожидает перевода

15.05пт
14.05чт
11.05пн
  1. Permission Protocol · AI Agent Incident Tracker66

    CVE-2026-44578:未经安全审查的 Vibe-coded Next.js 应用沦为 SSRF 代理

    CVE-2026-44578(CVSS 8.6)影响 Next.js 13.4.13–15.5.15 和 16.0.0–16.2.4,未认证攻击者可用构造的 WebSocket upgrade 头经 Next.js 服务端代理访问云元数据端点,窃取 AWS IMDSv1、Azure IMDS、Oracle Cloud 等凭据。

    Ожидает перевода

  2. Drew Breunig38

    过度拟合 Harness 的代价:OpenAI 收缩微调后,前沿模型会变成"家电"吗

    OpenAI 正在收缩微调业务,Drew Breunig 认为这会让前沿模型越来越像为自家 Harness 定制的"家电"而非通用平台。他指出,大实验室把 Harness 设计训练进模型,第三方 Harness 搭配前沿模型的价值将下降,而微调这条泛化退路也随之中断。对企业而言,应用构建可能更简单,代价是锁定。

    Ожидает перевода

10.05вс
09.05сб
  1. OpenAI · Codex Cookbook72

    OpenAI представила в Codex функцию Goals — постоянные цели

    Начиная с Codex 0.128.0, OpenAI предоставляет функцию Goals: однократный промпт превращается в постоянную цель внутри потока, и Codex постоянно сверяется с доказательствами — тестами, эталонами или артефактами — чтобы решить, достигнута ли цель.

    Почему это важно: В официальной документации описаны границы применимости Goals, шесть элементов их формулировки и команды управления жизненным циклом — по ним можно понять, когда стоит заменить однократный промпт постоянной целью.

07.05чт
  1. Permission Protocol · AI Agent Incident Tracker74

    TrustFall 披露编码智能体安全漏洞:仓库配置可触发一键 RCE

    Adversa AI 发布 TrustFall 研究,指出恶意仓库配置可让编码智能体在通过一次笼统的信任授权后启动攻击者控制的 MCP 服务器,从而在开发者工作站和 CI 环境中造成一键远程代码执行,可能访问本地凭据、仓库内容和工作流密钥。

    Ожидает перевода

  2. Permission Protocol · AI Agent Incident Tracker80

    仿冒 OpenAI 仓库在 Hugging Face 登顶热门榜并获 24.4 万次下载后投递窃密木马

    Hugging Face 上一个仿冒 OpenAI Privacy Filter 的仓库登上热门榜第一、获得 244,000 次下载,随后在安装该模型的 Windows 机器上执行窃取凭据的 infostealer。

    Ожидает перевода

    Почему это важно: 复盘 Hugging Face 上仿冒 OpenAI 仓库的投毒链条,展示热门榜如何被当作信任信号利用。

06.05ср
05.05вт
  1. DevAgentStack · Field Notes80

    如何让仓库对 AI 智能体友好:一份实用审计清单

    作者提出让仓库对 AI 智能体友好的实用审计清单,核心是让智能体能快速回答行为在哪、什么不能改、怎么测、如何证明完成。清单包括在根目录放仓库地图、明确高风险区域、写出验证命令、用 AGENTS.md 提供跨工具通用说明,以及用 Zod schema、TypeScript 接口和测试名把契约变成可执行边界。

    Ожидает перевода

    Почему это важно: 作者给出一份可逐条落地的仓库审计清单,说明如何让智能体快速找到模块、边界和验证命令。

04.05пн
  1. DevAgentStack · Field Notes70

    自定义指令该写什么:给编码智能体的仓库规则清单

    作者认为自定义指令文件只应放智能体无法自行推断的仓库事实,包括仓库地图、改动范围规则、验证命令、最终回答格式和禁止的捷径,而不应放人格设定、政策口号或一次性任务细节。

    Ожидает перевода

02.05сб
01.05пт
  1. Jesse Vincent62

    作者分享让 AI 智能体对抗式评审自己工作的提示词

    作者分享了自己常用的对抗式评审提示词,核心做法是让 Claude 派子智能体复查刚完成的工作,最简形式是“用全新的眼光再看一遍”。他指出让智能体自评存在目标冲突,因此对抗式评审更有效,不少人会用 Codex 等不同模型来评审 Claude 的工作。即使没有多模型环境,也可以让两个子智能体互相竞争,比如告诉它们找出严重问题最多的一方得五分,或得一块饼干,效果相近。

    Ожидает перевода

30.04чт
  1. Augment Code · Blog71

    Augment Code проверила на практике правила в стиле Карпати: ИИ-агент для разработки не написал код лучше, но сделал это быстрее и дешевле

    Augment Code добавила в начало AGENTS.md около 2.5 тыс. символов правил кодирования в стиле Карпати и сравнила, как Auggie, Claude Code и Codex справляются с 40 пул-реквестами OpenClaw.

    Почему это важно: Сравнительный тест трёх ИИ-агентов для разработки на одной и той же партии пул-реквестов показывает: ограничения в промпте в основном экономят деньги, а не повышают качество, и при этом каждый харнесс работает по-своему.

29.04ср
28.04вт
27.04пн
  1. Permission Protocol · AI Agent Incident Tracker83

    AI 编程智能体 9 秒删除 PocketOS 生产数据库及备份

    PocketOS 据报在一次 Railway API 调用中丢失生产数据库和卷级备份,整个过程仅 9 秒,人类来不及介入。事故分析指出危险能力不在代码生成,而在于智能体持有具备生产破坏权限的云厂商令牌;仅靠 PR 门禁看不到绕过代码仓库的直接 Railway API 删除,授权检查应前置到删除生产数据或备份的云厂商 API 调用之前,并要求签名回执写明生产环境、资源、动作和签署人。

    Ожидает перевода

    Почему это важно: 复盘一次智能体凭令牌直接删除生产库与备份的事故,指出授权检查应放在云厂商 API 调用之前。

26.04вс
  1. 陈与小金 · AI Coding 博客36

    GPT-5.5 对比 Claude:三个真实任务实测,游戏任务完全不可用

    GPT-5.5 发布后,作者用个人品牌网页、2D RPG 小游戏和开放式创意三个任务对比 Claude Code。GPT-5.5 上下文升至 400k,Terminal Bench 2.0 准确率 82%,高于 GPT-5.4 的 75% 和 Claude Opus 4.7 的 69%,价格比 GPT-5.4 翻倍。

    Ожидает перевода

24.04пт
  1. Lovable · Blog38

    Lovable 早期测试 GPT-5.5:最难任务通过率 41.6%,比 GPT-5.4 提升 12.5%

    Lovable 在早期访问中测试 GPT-5.5,其内部基准显示最难任务通过率从 GPT-5.4 的 36.9% 升至 41.6%,每次请求工具调用减少 23.1%,用户卡住的消息占比下降 9.9%。GPT-5.5 每请求输出 token 减少 33%,日常任务成本效率提升约 15%,将很快向 Lovable 构建者开放。

    Ожидает перевода

22.04ср
  1. Permission Protocol · AI Agent Incident Tracker80

    Bitwarden CLI 遭 Shai-Hulud 供应链攻击,定向窃取 Claude Code、Cursor、Codex CLI 的 API Key

    攻击者劫持 Bitwarden 的 CI/CD 流水线,向 npm 发布恶意 @bitwarden/[email protected],在 2026 年 4 月 22 日 5:57–7:30 PM ET 的 90 分钟窗口内被 334 名开发者安装。

    Ожидает перевода

    Почему это важно: 复盘了恶意 npm 包如何定向窃取 AI 编程工具凭证,并给出 90 分钟窗口与影响范围等可核查细节。

15.04ср
  1. Permission Protocol · AI Agent Incident Tracker87

    约翰霍普金斯研究者通过 PR 标题注入从 Claude Code、Gemini CLI 和 GitHub Copilot 窃取 API 密钥

    约翰霍普金斯研究者 Aonan Guan 利用 PR 标题提示词注入,从 Claude Code Security Review、Gemini CLI Action 和 GitHub Copilot 中窃取 API 密钥与 GitHub token。

    Ожидает перевода

    Почему это важно: 约翰霍普金斯研究者用 PR 标题注入从三个 AI 编程智能体中窃取凭据,三家厂商均静默修复并支付漏洞赏金。

10.04пт
  1. Ryan Lopopolo65

    怎样才算把活干好:写清非功能性需求才能让 AI 智能体收敛

    Ryan Lopopolo 认为,AI 让验证问题变得明显,因为每个真实任务都依赖一个我们几乎从不写下来的问题,即怎样才算把活干好。产出和评审都涉及语气、品味、风险容忍度、打磨程度、可接受的捷径和完成标准等大量非功能性决策,过去团队靠组织设计、社交规范、招聘和入职把这些隐含规则传递给人,而模型无法走招聘流程,因此交给它的任务基本都欠规范。

    Ожидает перевода

    Почему это важно: 作者以在 OpenAI 做代码智能体的经历说明,非功能性需求不写下来,评审智能体就会陷入无休止的拉扯。

09.04чт
06.04пн
  1. Martin Alderson62

    算力短缺接下来会怎样:从 GitHub 提交量到 Claude 限流

    Martin Alderson 认为未来 18-24 个月将由算力短缺主导,因为需求呈指数增长而供给只是线性增加。他引用 GitHub COO 的数据称 GitHub 近 3 个月提交量年化增长约 14 倍,并提到 OpenAI Codex 团队负责人 Thibault Sottiaux 表示行业正处于需求超过供给的阶段。

    Ожидает перевода

01.04ср
31.03вт
  1. Martin Alderson74

    Telnyx、LiteLLM 与 axios 供应链攻击:作者主张用移动端式沙箱重构操作系统

    过去一周有攻击者接连投毒多个开源包,从 Trivy 开始,波及 Telnyx(受影响包约 15 万次/周下载)、LiteLLM(约 2200 万次/周)以及 3 月 31 日被攻击的 axios npm 包(至少 1 亿次/周下载),恶意版本会植入木马窃取安装机器的敏感数据。

    Ожидает перевода