AI 编程智能体是否正在制造现有工具难以应对的安全问题?
有开发者在 Reddit 上征集 Claude Code、Codex、Cursor 等 AI 编程智能体的实际安全实践,覆盖运行前扫描恶意 skill、MCP server 与传递依赖,AI 生成 PR 的安全检查与人工审查,以及运行中的工具调用监控、文件系统/网络/凭证访问限制和沙箱隔离。提问者更关注真实事故、险情和现有工具的缺口,并追问提示词注入是否来自 README、skill 或依赖文件。
Ожидает перевода
有开发者在 Reddit 上征集 Claude Code、Codex、Cursor 等 AI 编程智能体的实际安全实践,覆盖运行前扫描恶意 skill、MCP server 与传递依赖,AI 生成 PR 的安全检查与人工审查,以及运行中的工具调用监控、文件系统/网络/凭证访问限制和沙箱隔离。提问者更关注真实事故、险情和现有工具的缺口,并追问提示词注入是否来自 README、skill 或依赖文件。
Ожидает перевода
一位开发者表示,让 AI 智能体使用 vibe-coded 的「AI 优先」工具,产出效果优于通过 MCP 接入为人类设计的现有应用,他打算停止在这类原始软件上做 MCP 接入。他会在 AI 原生工具之上再搭建供人使用的工具,以便自己手动编辑细节。
Ожидает перевода
Разработчик сообщил, что суточный лимит расходов на Claude Code составляет $100. В тот день, работая над одной функцией, он увидел сообщение «Достигнут суточный лимит использования, обновление в xx часов следующего дня» — и тут же подумал: «Раз Claude Code недоступен, лучше пока остановить работу». По его словам, он больше не отлаживает, не тестирует и не исправляет ошибки так, как раньше, и опасается, что такая зависимость может разрушить его карьеру.
2026 年 AI 编程工具已分化为三类:GitHub Copilot 以插件形式嵌入编辑器,Cursor 是独立 AI IDE,Anthropic 的 Claude Code 则是终端优先的智能体。
Ожидает перевода
В ответ на то, что LLM вроде GPT-4 и Claude 3.5 в многошаговых диалогах забывают контекст и поддакивают пользователю (sycophancy), 123sudo выпустил рабочую область с привязкой к проекту 9xChat: она привязывает ИИ к локальным файлам проекта, а не к хрупкой истории чата, и позволяет в одном окне запускать GPT-4 и Claude 3.5 рядом, чтобы они писали код и проверяли друг друга. Контекст остаётся локально и не используется для обучения.
Разработчик Fynn 20 марта 2026 года отлаживал OpenAI-совместимый интерфейс Cursor и увидел в ответе ID модели accounts/anysphere/models/kimi-k2p5-rl-0317-s515-fast. Это значит, что Composer 2 дообучали методом RL на базе Kimi K2.5 от Moonshot AI. За сутки твит набрал 44.4 тысячи просмотров.
Почему это важно: Одна отладочная строка API вытянула наружу и нераскрытую базу Kimi у Cursor, и спор о лицензировании, и расклад затрат на модели между Китаем и США — всё это показывает, как в отрасли принято раскрывать информацию.
ChatGPT 上线 Space,可存页面、上传文件、分 Space 管理并支持多人协作,作者认为它正切入 Obsidian、Notion 所在的知识工作区。
Ожидает перевода
Figma CEO Dylan Field 认为,当代码生成变得人人可及,品味与设计才是真正的差异化护城河。Figma Make 支持通过自然语言提示从零生成完整设计和可运行应用,产物可下沉到 Figma Design 做像素级精修,并通过 CodeConnect 和 MCP 服务器桥接设计与代码。Dylan 将当前阶段比作 AI 的 MS-DOS 时代,认为自然语言只是驱动模型的界面起点。
Ожидает перевода
Nuanced 作者 honest_niceman 复盘自己围绕规划模式打造的桌面开发应用为何失败,认为规划模式正在失去价值。他列出四点原因:把规划与计划混为一谈、模型能力变强后不再需要显式指令、AI 写出的长规格文档难以阅读、以及把规划与开发切成线性流程迫使开发者过早结束思考。
Ожидает перевода
METR 2025 年 7 月的实验让 16 名开源开发者随机在允许和禁止使用 AI 的条件下完成任务,结果用 AI 时反而慢 19%,而参与者自认快了 20%。
Ожидает перевода
一位资深 Python 开发者称,团队被强制推行 vibe coding 后,Cursor 仅凭一句“前端列表加载到某处后后端开始返回 500”的描述,就定位出 MongoDB 中 projection 在 lookup 和 match 之后执行导致内存耗尽、报出 Sort exceeded memory limit,而他自认无 AI 至少要花两小时到两天。
Ожидает перевода
俄罗斯 IT 招聘市场自 2024 年 10 月起岗位数再次下滑,去年夏天简历数首次超过岗位数,Python 岗位竞争达 20 人抢一个位置。H3LLO Cloud 的实践显示,30 人以下团队借助 AI 可搭建完整云平台,但前提是懂得何时该用、何时不该用 LLM,且没有 token 使用量 KPI。
Ожидает перевода
作者称过去两周在 orbs 中借助 Amp 远程完成了全部开发工作,包括新的实验性 provider 后端、产品内 bug 上报功能、orbs 的磁盘与内存告警、启动日志、一个藏在官网里的 Comet Busters 类彩蛋游戏、听写功能的麦克风选择器、主题偏好等,并修复约二十个 bug、删除 5k 行代码。
Ожидает перевода
V2EX 用户讨论 AI 编程圈出现的 SDD+TDD 新范式,有人用 Cursor、Claude 写代码时感到吃惊。多位开发者认为这类做法 ROI 不高,除烧 token 外价值有限,更实用的做法是把项目规范沉淀为 Skill。也有观点认为超过 20 人维护的大型项目从零开始时用 SDD 更利于模型理解项目,基于 spec 文档 AI 会收敛很多,跨模块复杂功能反而节省 token。
Ожидает перевода
Amp 现已推出订阅服务,可与 ChatGPT 订阅搭配获得无限 GPT-5.6 token;同时 Amp 上线智能体间通信,智能体能在任意 Amp 实例或 orb 中派生其他智能体并互发消息与文件。作者还分享了新一季 Raising An Agent 播客、与 Evan Phoenix 等人的对谈,以及 antirez 关于“控制想法而非代码”的观点。
Ожидает перевода
Grok 4.5 以 $6/MTok 输出价格发布,与托管版 GLM5.2 成本相近,作者认为这印证了"好够用"模型正让大量智能体任务转向低价模型。赢家是半导体与推理供应链,以及 Cursor 这类编码智能体——它们能靠廉价模型赚钱并掌握真实使用数据。输家方面作者态度矛盾:Anthropic 约 80% 收入来自 API 存在被替换风险,但前沿实验室可能改为只通过托管智能体平台提供最强模型。
Ожидает перевода
Thorsten Ball 在 Joy & Curiosity #91 中记录 9 岁女儿用 iMovie 学剪辑,由此想到不懂剪辑术语的人难以向 AI 描述需求。
Ожидает перевода
Geoffrey Huntley 在迈阿密的访谈中提出,软件开发已是死路职业,因为任何人都能用 Cursor 等工具生成代码,但"会写代码"和"软件工程师"是两回事。他认为软件开发如今近乎免费、token 比人便宜,开发者数量将爆发式增长;无法演示 coding agent 如何工作的人只是消费者,两年内没有保持好奇心的人可被替代。他还建议,如果公司禁用 AI,就应该辞职。
Ожидает перевода
宝玉观察到 Codex、Claude 桌面版、Cursor 3.0、TRAE SOLO 几乎同时收敛到左侧会话、中间对话、右侧工作区的三栏布局,认为这是 Agent 交互的当前最优解。
Ожидает перевода
Amp 本周发布完全重构版本 Amp Neo,支持远程控制,将插件作为一等功能,并内置无需操心的上下文压缩,比旧版 Amp 更快更高效。该编码智能体被拆分为工具、界面和循环三部分,运行在可无限扩展的系统中;团队整周都在为需求扩容,目前仍在处理扩展问题。
Ожидает перевода
Augment Code 本月新增 Gemini 3.1 Pro,成为其继 Claude、GPT-5 之后的第三个可选模型。作者认为模型、harness 与 orchestration 三层解耦后,切换模型只是改一个设置而非迁移,因此单模型押注已不再成立。文中提到 GPT-5.4 每消息价格比此前所用模型便宜约 2.6 倍,且过去十三个月里领先模型已三次易主。
Ожидает перевода
Delphi Ventures 创始合伙人 José Maria Macedo 在中国考察两周后,对硬件更看好、对软件更看衰。他称深圳硬件供应链让迭代速度远超西方,超 70% 原材料采购自大湾区;但中国闭源模型与西方差距可能扩大,Anthropic 二月收入达 60 亿美元,而中国最好模型 ARR 仅几千万美元。
Ожидает перевода
Geoffrey Huntley 在访谈中提出,软件开发(敲代码、提示 LLM)正因 AI 普及而急剧加速,软件工程则转向设计循环、自动化与安全机制,工程师更像火车司机而非手动编码者。
Ожидает перевода
Martin Fowler 就 OpenAI 的 Harness engineering 实践发表初步思考,该团队以“完全不手写代码”为约束,用 AI 智能体维护一个超过 100 万行代码的产品,历时 5 个月。
Ожидает перевода
作者认为纠结选 Claude Code、Codex 还是 Cursor 是问错了问题,因为三家都在拼通用编码能力这一商品化层,而真正拉开差距的是组织自己的领域术语、数据布局、认证流程和发布规则。
Ожидает перевода
2025 年是从“以模型为中心”转向“以智能体为中心”的一年。Claude Code CLI 于 2 月 24 日以预览版发布,同日 GitHub Copilot 在 VS Code 推出 agent mode。
Ожидает перевода
Thoughtworks 的 Martin Fowler 撰文指出,GenAI 编码助手只能覆盖结对编程的一小部分收益,GitHub 将 Copilot 称为“你的 AI 结对程序员”是对结对实践的误导。结对编程还能带来集体代码所有权、代码库历史与隐性知识共享、改善团队流动与持续集成,并锻炼沟通、共情等协作能力,这些是大语言模型无法提供的。他建议用编码助手让结对更好,而非取代结对。
Ожидает перевода