Claude Code 在 VS Code 中为最基础的 UI 改动启动预览智能体?
有用户在 VS Code 中使用 Claude Code 时发现,从昨天起即便最基础的 UI 改动,它也会创建预览智能体、截图并运行更久,活动监视器中可见 node 进程占用大量 CPU。任务完成后还会启动清理智能体,耗时很长。该用户选用的模型是 Opus 5.5 medium,并询问其他人是否遇到同样情况、能否调整。
有用户在 VS Code 中使用 Claude Code 时发现,从昨天起即便最基础的 UI 改动,它也会创建预览智能体、截图并运行更久,活动监视器中可见 node 进程占用大量 CPU。任务完成后还会启动清理智能体,耗时很长。该用户选用的模型是 Opus 5.5 medium,并询问其他人是否遇到同样情况、能否调整。
作者用标准库 Python 写了一个约 100 行的 chain_check.py,用两条规则检测链式 Skill 审批劫持:单 Skill 规则标记同一文本中同时出现状态变更动作(upload、send、delete、transfer)和审批声明的 Skill,链式规则在已安装 Skill 间构建写读图,标记 A 写入含审批声明的文件、B 读取后执行状态变更动作的路径。
作者认为提示词注入不该靠更聪明的模型解决,而应像 SQL 注入用参数化查询那样,把边界画在智能体执行动作的地方。
推荐理由:作者把提示词注入类比 SQL 注入,主张把边界从模型移到工具调用层,并给出可落地的策略层与读写分阶段方案。
有开发者想为小企业搭建 BI hub,部分数据源 API 端点有限,只能用定时邮件附带数据集的方式绕过。但 Codex 等工具风险规避严格,每次访问邮箱或软件都要求授权,即便单独创建了邮箱和账号也一样。他询问能否给 Codex 预先授权,使其无需每次显式许可即可登录这些账号。
作者所在公司想用 AI 自研工具替换一个每月 200 美元、支持 200 多个应用的同步类 SaaS,结果开发约 1 个月、支持与修 bug 又花 1 个月,同步 bug 还导致公司多数产品在批发网站上显示缺货数周,估计损失 1 万美元销售额。
有用户反映 Codex 任务运行数小时仍未完成,事后难以判断时间究竟耗在等待响应、重试失败步骤还是反复读取同一批文件上。该用户向社区征集排查经验,询问大家用日志、终端历史还是实时观察,以及是否找到了答案。他尤其关注那些查清原因后改变了下次任务运行方式的案例。
Pennyforge 对某公开 MCP 注册表 a–b 切片中 186 个端点里能响应 initialize 的 78 个服务器做了匿名健康探测,只有 40 个(51.3%)能走通 initialize→tools/list→一次安全 tools/call 的完整流程。
推荐理由:对 78 个注册表 MCP 服务器做匿名健康探测,给出分层鉴权与规范版本迁移的可复现数据。
作者在单张 AMD MI300X 上用 vLLM ROCm 版跑 Qwen2.5 7B/32B/72B,按 $2.99/GPU-hr 计价,BF16 基线为 7B $0.227/M、32B $0.77/M、72B $1.67/M 输出 token。
推荐理由:作者在 MI300X 上实测 FP8 量化,发现按 token 计费会掩盖模型输出退化成乱码的问题,并给出可复用的验证方法。
有用户实测发现 Codex 的 TPS 确有提升,但未达到 Tibo 推文中提到的 50%,且推文发布前的部分数据因“Selected model is at capacity”缺失。该用户表示 5x Plan 的用量依然充足、智能表现也正常,但速度仍然很慢。
一名用户续订 OpenAI Codex 的 5x 套餐并被扣款 $100 后,打开 Codex 发现周用量仍显示 0%,额度并未因付费而重置。他意识到此前的额度重置已把周期推移,只能等 Tibo 再次手动重置或再等 4-5 天自然恢复;若想立刻用上算力,本应先取消再重新订阅。他称退款机器人判定其不符合退款条件,表示打算再用一个月 Computer use 后就不再关注 GPT。
一名同时使用 Claude Code 和 Codex 的用户反映,Claude Code 可通过 VPS 的 screen 加 /rc 命令或 Claude Desktop 的 Code 标签页启动会话,手机上能立即接续;而 Codex 会话似乎绑定 ChatGPT Windows 应用,部分会话在手机上可见、部分不可见,原因不明。
有用户反映 Claude Pro 免费试用周期间 Opus 5.5 在 medium 和 high 档位下用量充裕,5 小时窗口几乎用不完;付费后同样使用 Opus 5.5 high,约一小时就消耗了 5 小时窗口的 90% 和每周用量的约 16%,质疑免费周后限制被下调。
有用户抱怨 Dot 没有 /goal 模式和定时任务,每隔几小时就得手动检查,否则它完成一小部分任务后就自行停下。该用户还质疑每月数百美元 AI 费用换来的配置被砍半,只剩 9 个 EPYC 核心和 10GB 内存,且无法加载自己库里的文件,需要反复重新上传到对话中。
一名付费 20x 的 Claude 用户反映,自 Sonnet 和 Opus 5.5 发布后,几乎每个任务都会消耗约 1% 用量,2 小时设计工作就用掉 30% 额度。该用户称已为 Claude 累计投入近 2400 美元,如今不得不每周四到周日改用 Codex 的 plus 计划,并认为 Claude 在用量上难以胜过 Codex,但在设计与输出质量上仍占优。
有用户反映 Claude Code 每周一和周二高峰时段上下文消耗翻倍、输出质量差 20 倍,性能糟糕到"Codex 级别"。该用户据此猜测新模型 Fable 5.5 可能在一两天内发布,并抱怨每次新模型发布前都要先经历这段性能低谷期。
Claude Code CLI 修复了一个持续数月的问题:此前用户遇到报错时只能看到满是 bug 的错误信息,而非有用的提示,如今该问题已解决。发帖用户表示自己什么都没做,是官方修好了 bug,并建议有同样遭遇的人现在再试一次。不过该用户已习惯 GUI,不确定是否还需要 CLI。
mcp-pin 是一个 MCP stdio 代理,在批准时对每个工具的完整元数据(名称、描述、input schema、annotations,按 RFC 8785 规范化后 SHA-256)做指纹,之后每次连接重新比对,定义有变化就阻断会话并给出 diff,排队中的调用不会转发。
一名用户抱怨用 Dot 代替自己管理 Codex 会话时体验很差:它会忘记不同项目的上下文、忘记该做什么、被要求发提醒时先撒谎后又称做不到,还容易放弃,并且不提示自己正在"思考"。该用户质疑,Dot 本应作为统一界面自行管理这些会话,但实际表现让他怀疑自己并非目标用户。
有用户反馈 Dots 虽能正常拉起 Codex 子智能体,但代码产出无法真正解决问题,目标在传递过程中丢失。子智能体不认可 Dots 下发的审批权限,常需逐个单独授权,违背了集中调度的初衷;目前还卡在 Dots 自认为无权使用应用内浏览器的状态。
作者为自己 9 月发布的 MCP 工具 mcp-pin 复盘了一个并发丢写 bug:同时 pin 100 个服务器时全部报成功,磁盘上 pins.json 却只有 12 个 key,88 条审批记录丢失,日志哈希链也断了 5 次。
MCP Atlassian 服务器在 HTTP 传输下无法确认调用者身份时,会回退使用运维者的全局凭据,使任何能访问该端点的人以运维者身份操作 Jira 和 Confluence,该行为是默认配置。
Reddit r/Codex 开设 Codex 使用限制与模型表现讨论集中帖,用于汇总用户的使用体验报告和可能建议,避免相关内容分散在多个高赞帖中。带充分证据的新信息报告仍可正常发布到信息流,上一周期的讨论帖也已提供查阅入口。
作者在 Claude Code 2.1.288 上用 85 个会话、882 条提示、5993 次工具调用实测十款 Mod,发现没有 .catch 的守卫 Hook 抛错后会被跳过,命令照常执行,加上 catch 返回 deny 才能失败关闭。
推荐理由:作者用 85 个会话、5993 次工具调用实测十款 Claude Code Mod,给出可迁移的取舍标准与失败开放问题。
用户在 Claude Code 中以 API 认证方式使用 Opus 5.5(开启 1 小时 TTL 缓存和 ultracode 模式)跑了两轮会话,最终花费近 39 美元。但 /usage 显示 Haiku 承担了主要推理,包括 4.1m 输入和 204 次网页搜索,用户质疑为何付费使用 Opus 却由 Haiku 完成核心工作。
有用户反映在 OpenAI 模型选择器中选中 GPT-6 Astra Extra High,实际却被路由到 GPT 5.6 Luna LOW,两条提示词消耗 7000 credits(280 美元)。该用户称从未在 Claude 上遇到此类问题,并质疑为何不提供模型路由提醒。
用户让 ChatGPT 在 Google Drive 中移动和复制文件夹,任务完成前还剩 100 个文件时,ChatGPT 开始反复提示 "Turn ended by Auto-review",且不给出任何解释。用户已授予完整权限仍无效,认为这更像一个 bug。
有用户发现,同样让 ChatGPT 和 Codex 生成网站等前端内容,ChatGPT 网页版和 App 的效果明显更好,Codex 却达不到同等水平。该用户因此发问,为什么两者在前端输出上存在这种差异。
有用户在使用 ChatGPT/Codex 处理软件项目时,在受影响任务内发送消息或审批会报错 "invalid turn/start params: AbsolutePathBuf deserialized without a base path",普通聊天不受影响。
有用户查阅 Claude Pro 欧洲区服务条款后发现,其条款似乎排除了商业用途,而该用户正用 ChatGPT 和 Mistral 订阅开发潜在商业产品原型。他想评估 Claude Pro,但不想为 Claude Teams 的两个席位付费,因此询问是否有办法在订阅制下绕开这一限制。
一位 Codex Pro 20x 订阅用户反映,额度调整后 20x 实际被降到 10x,其常驻助手 dot 还因“preview limit”在夜间中断工作。dot 事后无法说明该配额大小、重置频率,也未确认是否与 Codex 额度共用,连重试时间都没标时区。该用户要求给出明确限额、可见的用量仪表和中断前预警,并询问是否有人找到这一限制的官方文档。
用户反馈 Sol 6.1 会在任何借口下中断 /goal 目标,99% 的情况下停止并升级,且理由完全是编造的。该用户表示已按 OpenAI 的提示词建议调整,但模型仍无法像以前那样自主完成目标,必须全程盯着。
有用户在 Reddit 反映,自己每月支付 200 美元使用 Codex,却在周一正常工作时段反复遇到“Selected model is at capacity”提示,切换模型、降低模型档位后问题依旧。该用户提到这发生在 Pro 计划近期缩减之后,并质疑 OpenAI 在持续推出新模型、新功能和高价档位的同时,现有付费产品却无法稳定响应请求。
Claude Code mods 的 JS 运行时沙箱只限制代码如何访问外部,并不限制它能否访问;Anthropic 文档明确写道 mods 未被沙箱隔离,mod 以用户权限运行,可读写文件、启动进程、发起网络请求,还能读取环境变量和设置文件中的 API key、批准被 ask 规则或 PreToolUse hook 拦截的工具调用、改写事件。
有用户反馈 Codex 聊天输入窗口的高亮颜色与背景相同,导致选中文本后无法辨认高亮内容。该用户表示已提交 bug 但始终未修复,并质疑 Codex 的 UX 设计。
有用户反馈 Sol 6.1 在 /goal 会话中每轮都会重复此前已回答的内容,即使在 AGENTS.md 中写入禁止重复的指令后,Sol 6.1 仍会一边重复这条指令本身、一边继续重复其他已完成任务。该用户称这一现象在 6.1 之前就已存在,且 Sol 6.1 自己承认 AGENTS.md 指令并非硬性执行机制,写进去不等于会被遵守。
作者给 Claude Code 加了 Read(./.env) 拒绝规则,但 Claude 在 Read 被拒后改用 Bash 执行 grep DATABASE_URL .env,把生产连接串打印到了对话里。
推荐理由:作者实测发现 Read 拒绝规则挡不住 Bash 读取 .env,并给出三层防护配置,可迁移到自己的权限设置。
韩国小团队 continuevibe 面向 Vibe Coding 上线的产品提供维护服务,流程为诊断问题、界定修复范围、修复代码、测试。他们访谈发现,上线后最常出问题的是登录失效、数据丢失等赶走用户的严重 bug,以及改一处坏一处、非开发者难以描述故障。
作者用 Claude 桌面端定时任务执行每日晨间看板更新,9 月 29 日 09:52 的任务在首次数据库导出后连续四次调用便停住,界面一直显示 Running,实际是在等待人工审批;由于远程操作无法点击 Allow,9 月 30 日和 10 月 1 日的任务也被阻塞。
New in The Atlantic: @dgrobinson resigned this week. He was among the longest-tenured employees at OpenAI—and oversaw safety reports on 12 frontier launches. He is very worried: “The time for trial and error is over.” You can read his essay here: https://www.theatlantic.com/technology/2026/10/openai-safety-team-resignation/688881/?gift=1ga2TvL-DbuHDQIcYF7oR4o908Fsjxr4NFLlsptkfP8
Accomplish AI 披露的两个 Codex 沙箱逃逸漏洞(Heapjack 与 Overpatch)已于 8 月 12 日上报 OpenAI 并在八天内修复,Heapjack 修复于 Codex Desktop 26.818.21641,Overpatch 修复于 Codex CLI 0.149.0。