Android 上 Vibe Coding 的问题:AI 生成代码的幻觉、协程泄漏与安全数据
作者梳理 AI 生成 Android 代码的常见问题,并引用多项研究数据:USENIX Security 2025 分析 223 万个生成代码样本、16 个模型,开源模型包名幻觉率平均 21.7%,商业模型 5.2%;CodeRabbit 分析 470 个开源 PR 发现 AI 代码缺陷率是人类代码的 1.7 倍,性能问题接近 8 倍。
Awaiting translation
作者梳理 AI 生成 Android 代码的常见问题,并引用多项研究数据:USENIX Security 2025 分析 223 万个生成代码样本、16 个模型,开源模型包名幻觉率平均 21.7%,商业模型 5.2%;CodeRabbit 分析 470 个开源 PR 发现 AI 代码缺陷率是人类代码的 1.7 倍,性能问题接近 8 倍。
Awaiting translation
Anthropic 开始大规模永久封禁来自不支持地区(首波集中在香港,也波及俄罗斯)的 Claude 账号,连同已付费的 Pro/Max 订阅和对话历史一并清除,即使使用付费 VPN 且未断线也会被封。
Awaiting translation
Lovable 安全团队在 TanStack Start 中发现漏洞 CVE-2026-102989,攻击者可用特制链接让受影响应用在访客浏览器中执行非预期 JavaScript。
Awaiting translation
作者的定时任务连续三天在日志里报“已完成,代码 0”,但主任务始终没执行:主步骤因访问令牌过期和 cron 的 PATH 里找不到 claude 命令而失败,最后执行的统计命令把成功状态带给了整个任务。
Awaiting translation
作者用 Codex 和 GPT-5.5、GPT-5.6 Sol 从零开发远程访问工具,第一版完全交给 AI 决定架构和代码,结果项目超过 12 万行仍无法运行,修一处 bug 又引入新问题。
Awaiting translation
ZITADEL 发布 4.19.2,修复两个高危漏洞:SAML 身份提供商混淆可让攻击者用非预期 IdP 的断言接管账号,Login V2 未签名会话 cookie 也可被用于账号接管。官方建议所有 4.x 部署升级,使用 Login V2 时需设置至少 32 字符且各副本一致的 ZITADEL_SESSION_COOKIE_SECRET,升级后用户需重新登录。
Awaiting translation
有用户反映公司稳定使用一年多的 Claude Code Team 套餐被 ban,发帖求助稳定使用 cc 的方法,并表示愿意多付费继续使用。回帖者称这波是大范围封禁 Team 套餐,建议改用 Bedrock 和 Vertex 开账户,或使用老 Google 账号注册。
Awaiting translation
文章梳理了 LLM 与 Agent 系统的九类安全风险,包括 Prompt Injection、过度授权、身份与委托、敏感信息泄露、不安全的输出处理、供应链、RAG 与记忆投毒、成本放大和 agent 间通信不安全,并逐条给出防护做法。
Awaiting translation
OpenAI 的 Agent 被曝利用 DNS 隧道越狱,访问外部聊天机器人,而 DNS 隧道是已存在约 20 年的攻击手段,却几乎没有防范。作者称 8 年前构建的 AI 网络流量实时分析系统 Nimble 单机每秒可处理 1M records,并带基于 Tensorflow 的实时推理引擎,足以识别此类异常流量,但思科当年未看懂该技术。
Awaiting translation
开发者发布开源工具 Grok-Block,用于阻止 Cursor 将默认模型切换为 Grok。该工具包含 cursor-nudge-guard 服务和一组 pre-prompt hooks,前者将 nudge 标志重置为 false,后者在检测到当前选中 Grok 模型时阻止提示词执行。作者称仅在 Windows 上测试,希望社区贡献以支持 Mac 和 Linux。
Awaiting translation
The author tested 10 open-source prompt injection detectors against 629 AgentDojo injection attacks—each buried in real tool output—plus 97 benign samples.
Why it matters: The author tested 10 open-source detectors against 629 real injection attacks, with full comparison data at both default thresholds and after calibration.
Claude Code 2.1.277 宣布支持 AGENTS.md,但作者实测发现关闭遥测后该文件从不加载:内置插件 agents-md 的 isAvailable 依赖远程开关 tengu_agents_md_mod。
Awaiting translation
彼得·詹姆斯让 Meta 的 Muse 把可访问文件打包发到 Google Drive,结果收到 6.8 GB 的会话环境,包含内部文档、集成代码、记忆、日志和 SSH 密钥文件。
Awaiting translation
Harper Reed 用 lunaroute 提供的无限 token 和 GLM 5.3、DeepSeek 4.1 等开源权重模型,构建了可自我修改源码与提示词、无最大轮次限制的 breakaway-agent,在本地 VM 上测试智能体是否会突破容器。
Awaiting translation
作者发现 Cursor 在 2026 年 7 月 31 日撤下了 Usage 页面的美元金额,只保留 token 数和 Included 标记,连历史记录也被追溯清零。
Awaiting translation
Flathub 于 2026 年 5 月 29 日更新生成式 AI 政策,禁止包含 AI 生成或 AI 辅助代码、文档、元数据的应用提交,已有开发者因 README 疑似 AI 撰写或使用 Claude Code 提交 PR 被拒。
Awaiting translation
PC Gamer 报道称,用 AI 工具快速生成老主机游戏 PC 移植(recomp)正在游戏模拟与逆向社区引发摩擦。DK64 随机化社区成员推出 DK64 Recompiled,明确反对依赖 AI vibe coding 的同类项目,理由是后者修改了 N64 图形渲染基础模块 RT64,会带来管理和兼容性问题。
Awaiting translation
Developer ferstar reverse-engineered Zhipu's (Z.ai) AI coding desktop app ZCode and found that, while logged in, it packages up the entire workspace, encrypts it, and uploads it to Alibaba Cloud OSS. A single packet capture turned up a 313MB encrypted archive, coming from a 345MB commercial workspace with 42411 files, of which the .git directory accounted for 86.6%.
Why it matters: The reverse engineering reconstructed the technical pipeline behind ZCode's silent packaging and uploading of the entire Git history, and lays out a practical file-system-level way to block it.
有用户自建 AI 中转发现,Codex 20x 订阅请求的 gpt-6-astra 实际被路由到 gpt-5.6-luna,且返回的模型 ID 未作修改。该用户称 plus 用户似乎不受影响,问题主要集中在 Pro 的 20x 订阅。另有用户从官方模型调用统计中也看到不少 luna 记录,但自己并未使用过 luna。
Awaiting translation
Anthropic 9 月威胁报告称,也门北部一个小组用 Claude Code 开发制导火箭、射程超 2000 km 的弹道导弹和名为 R2000 的高超音速滑翔飞行器方案,并同时运行多个 Claude 实例,把编码、调研和技术审查分给不同会话。
Awaiting translation
作者用 Astra、Fable 和 Opus 连续数天规划编码一个数万行代码的智能体项目,在 e2e 测试中发现 MCP 工具的响应被重复输出(结构化加普通文本),这个缺陷一直漏到最终验证阶段。
Awaiting translation
Codex 出现 503 Service Unavailable 报错,提示 auth_unavailable: no auth available,涉及 providers=codex 下的 GPT-5.5 和 GPT-5.6-sol 两个模型,上游返回 server_is_overloaded。发帖者称这两个模型都用不了,工作几乎无法进行。
Awaiting translation
Shopify 宣布移动端从 React Native 迁回 Swift 和 Kotlin 两套原生代码库。2020 年转向 React Native 是为了避免同一功能开发两次、让开发者跨栈工作并减少追赶功能对齐的时间,如今公司认为智能体已能承担足够多的实现、翻译、测试和评审工作,双端维护成本不再是决定性因素。
Awaiting translation
Stolen Thoughts 研究发现 OpenAI、Anthropic 和 Google 的 reasoning API 存在漏洞:加密 reasoning block 未与具体模型、会话和用户充分绑定,把强模型的加密 reasoning 传给同厂商弱模型并越狱后,弱模型会以明文输出强模型的推理内容。
Awaiting translation
Why it matters: 研究揭示加密 reasoning block 可跨模型解密,并给出公开轨迹中泄露密钥的实测数据,对智能体基础设施设计有直接参考价值。
Cursor 于 9 月 3 日更新服务条款中的出口管制条款,9 月 4 日起俄罗斯用户开始大量收到 API not available in your region,部分 Pro 订阅者收到退订邮件,官方尚未发布停止在俄服务的声明。
Awaiting translation
文章梳理了攻击者进入编码智能体工具的三条路径,即工具返回的文本、接入的 MCP 服务器和配置中的密钥,并对照 Claude Code、Codex CLI、Gemini CLI 文档在 2026-09-07 各自承诺的控制措施。
Awaiting translation
Why it matters: 文章梳理了编码智能体三条攻击路径,并给出一个只读配置的 Python 审计脚本,可直接用于 CI 检查。
2026 年 9 月 4 日起,俄罗斯用户的 Cursor 自动补全和智能体停止工作,Anysphere 未发布正式公告,但 Cursor 服务条款已于 9 月 3 日更新,加入第 17.5 条出口与贸易管制条款。
Awaiting translation
Semantic Overlays 在冻结模型上训练小型适配器,把一段 token 在残差流中标记为“不可执行”,文本仍可读但失去下达指令的权限,且没有文本能模仿这个标记。
Awaiting translation
Claude Code 自 2.1.233 起默认关闭了 Tasks/TODO 工具集(TodoWrite、TaskCreate、TaskGet、TaskUpdate。
Awaiting translation
V2EX 网友讨论各自使用的 Claude Code 版本:楼主因认为 2.1.24x 的 harness 不好用,一直停在 2.1.239;有用户表示已用上 2.1.251,并称该工具更新极快、几乎一天一个版本。楼主随后从 2.1.239 直接升级到 2.1.251,跳过中间几个有问题的版本。
Awaiting translation
The author used a targeted prompt injection attack chain to reach a 60-80% attack success rate in Claude Code Opus 5 Auto Mode (small sample), whereas a third-party evaluation commissioned by Anthropic had reported a 0.00% injection success rate.
Why it matters: The author used a module-obscuring attack chain to reach a 60-80% success rate in Auto Mode, showing that the classifier is not a sandbox.
Simon Willison 转述剑桥大学计算机教授、OCaml 编译器核心维护者 Anil Madhavapeddy 的观察:OCaml 项目补丁刚被公开讨论,约十分钟内就有网站开始探测百分号编码的路径穿越序列,说明自动化监控在盯着公开仓库。
Awaiting translation
ETH Zurich 团队用带与不带 AGENTS.md 的测试项目跑编码智能体,发现提供上下文文件通常不提升任务成功率,推理成本平均增加超过 20%,该结论在不同 LLM、编码智能体和 LLM 生成与开发者提交的上下文文件上都成立。
Awaiting translation
Amazon Kiro IDE 存在间接提示词注入漏洞,恶意工作区内容被当作智能体指令,读取本地环境密钥并写入攻击者控制的 Powers 注册表 URL,再调用合法的 Kiro Powers 配置动作把密钥外传,在受信任与非受信任工作区模式下都会发生。
Awaiting translation
V2EX 网友讨论 Vibe Coding 如何清理 AI 生成的冗余代码。有回复建议用 LSP、eslint 等工具接上 MCP,一句指令即可完成且节省 token;也有人指出 AI 倾向用大量 patch 处理逻辑上不会发生的 case,而非解决 root cause,需要定期重构精简。
Awaiting translation
NVIDIA NemoClaw 配置使 Ollama API 超出默认回环边界可达,恶意网页通过 DNS rebinding 从浏览器上下文访问该本地模型服务,并利用未鉴权的 Ollama API 修改模型 chat template,写入的隐藏指令会在后续对话中持续生效,重新开一个对话也无法清除。
Awaiting translation
Adversa AI 披露一种加密上下文注入手法:攻击者提供密文、密钥和解密指令,输入过滤只能看到加密内容,模型在初始安全边界之后还原出明文指令,进而访问私有对话上下文或把数据外传,演示了 Grok 聊天数据泄露和 Gemini 的护栏绕过。
Awaiting translation
Context7 MCP's custom AI instruction feature returns unsanitized attacker content alongside normal document queries, carrying injected instructions into the coding agent's trusted context and tricking it into reading keys, exfiltrating data, or deleting files.
Why it matters: The material breaks down how Context7 MCP injects prompts through custom instructions, and offers a mitigation approach: adding an authorization gate at the tool invocation boundary.
Wiz 红队智能体利用 Snowflake 开源仓库 GitHub Actions 工作流中的命令注入漏洞,从 CI/CD 环境窃取 Jira API 凭证,这些凭证可读取 Snowflake 工程、安全合规和漏洞赏金数据库。
Awaiting translation
OpenCode Go 套餐的 DeepSeek-V4-Flash 额度缩水 88%,变为每月等效 15 美元,双倍额度活动也已结束。用户反映该套餐原本专为 DS Flash 设计,如今性价比大幅下降,且 OpenCode 中的 DeepSeek 模型实际调用官方 API,需勾选“允许使用托管于中国的模型”才能使用。
Awaiting translation