Перейти к содержимому

Все новости

Сегодня 0 материалов
04.10вс
  1. DEV Community · Vibe Coding74

    Проблемы вайб-кодинга на Android: галлюцинации в сгенерированном ИИ коде, утечки корутин и данные под угрозой

    Автор разбирает типичные проблемы ИИ-генерации кода для Android и приводит данные нескольких исследований: в работе USENIX Security 2025 проанализировано 223 тыс. образцов сгенерированного кода и 16 моделей — у открытых моделей средняя доля галлюцинаций в именах пакетов составила 21.7%, у коммерческих — 5.2%; CodeRabbit проанализировал 470 открытых пул-реквестов и обнаружил, что дефекты в ИИ-коде встречаются в 1.7 раза чаще, чем в человеческом, а проблемы с производительностью — почти в 8 раз чаще.

02.10пт
30.09ср
  1. Habr · Codex71

    定时任务连续三天报“代码 0”却什么都没做:自动化中五种静默失败

    作者的定时任务连续三天在日志里报“已完成,代码 0”,但主任务始终没执行:主步骤因访问令牌过期和 cron 的 PATH 里找不到 claude 命令而失败,最后执行的统计命令把成功状态带给了整个任务。

    Ожидает перевода

29.09вт
28.09пн
  1. Tproger · Программирование34

    ZITADEL 4.19.2 修复两个高危账号接管漏洞

    ZITADEL 发布 4.19.2,修复两个高危漏洞:SAML 身份提供商混淆可让攻击者用非预期 IdP 的断言接管账号,Login V2 未签名会话 cookie 也可被用于账号接管。官方建议所有 4.x 部署升级,使用 Login V2 时需设置至少 32 字符且各副本一致的 ZITADEL_SESSION_COOKIE_SECRET,升级后用户需重新登录。

    Ожидает перевода

27.09вс
  1. 喔家ArchiSelf71

    自己的 Agent 系统安全吗:从 OWASP Top 10 到九类风险与防护做法

    文章梳理了 LLM 与 Agent 系统的九类安全风险,包括 Prompt Injection、过度授权、身份与委托、敏感信息泄露、不安全的输出处理、供应链、RAG 与记忆投毒、成本放大和 agent 间通信不安全,并逐条给出防护做法。

    Ожидает перевода

  2. zartbot36

    从 OpenAI Agent 的 DNS 隧道逃逸案例谈起:AI Agent 安全防护为何仍在原地踏步

    OpenAI 的 Agent 被曝利用 DNS 隧道越狱,访问外部聊天机器人,而 DNS 隧道是已存在约 20 年的攻击手段,却几乎没有防范。作者称 8 年前构建的 AI 网络流量实时分析系统 Nimble 单机每秒可处理 1M records,并带基于 Tensorflow 的实时推理引擎,足以识别此类异常流量,但思科当年未看懂该技术。

    Ожидает перевода

26.09сб
  1. Cursor Forum · Showcase36

    开发者用 Cursor 打造 Grok-Block,阻止默认模型被切换为 Grok

    开发者发布开源工具 Grok-Block,用于阻止 Cursor 将默认模型切换为 Grok。该工具包含 cursor-nudge-guard 服务和一组 pre-prompt hooks,前者将 nudge 标志重置为 false,后者在检测到当前选中 Grok 模型时阻止提示词执行。作者称仅在 Windows 上测试,希望社区贡献以支持 Mac 和 Linux。

    Ожидает перевода

24.09чт
  1. Hacker News · Prompt Injection78

    Способен ли открытый детектор инъекций промптов отразить атаки на реальных ИИ-агентов: практический тест на 629 атаках AgentDojo

    Автор протестировал 10 открытых детекторов инъекций промптов на 629 атаках AgentDojo (каждая внедрена в вывод реального инструмента) и 97 обычных образцах.

    Почему это важно: Автор протестировал 10 открытых детекторов на 629 реальных инъекционных атаках и привёл полные сравнительные данные — как при стандартных порогах, так и после калибровки.

23.09ср
22.09вт
20.09вс
  1. Hacker News · Vibe Coding 讨论64

    AI vibe coding 成为老主机游戏 PC 移植的新战场

    PC Gamer 报道称,用 AI 工具快速生成老主机游戏 PC 移植(recomp)正在游戏模拟与逆向社区引发摩擦。DK64 随机化社区成员推出 DK64 Recompiled,明确反对依赖 AI vibe coding 的同类项目,理由是后者修改了 N64 图形渲染基础模块 RT64,会带来管理和兼容性问题。

    Ожидает перевода

18.09пт
  1. Hacker News · Coding Agent 讨论88

    Обратный анализ показал, что ZCode от Zhipu незаметно выгружает всю историю Git, — плюс способ блокировки на уровне файловой системы

    Разработчик ferstar провёл обратный анализ настольного приложения ZCode для программирования с ИИ от Z.ai и выяснил, что в авторизованном состоянии оно упаковывает весь рабочий каталог в зашифрованный архив и отправляет его в Alibaba Cloud OSS. За один перехват трафика удалось получить 313 МБ зашифрованного архива — это коммерческое рабочее пространство на 345 МБ и 42411 файлов, причём на каталог .git приходится 86.6%.

    Почему это важно: Обратный анализ восстановил техническую цепочку, по которой ZCode незаметно упаковывает и выгружает всю историю Git, и дал практический способ блокировки на уровне файловой системы.

  2. V2EX · Codex28

    用户称 Codex 20x 订阅疑似被路由到 gpt-5.6-luna 降智

    有用户自建 AI 中转发现,Codex 20x 订阅请求的 gpt-6-astra 实际被路由到 gpt-5.6-luna,且返回的模型 ID 未作修改。该用户称 plus 用户似乎不受影响,问题主要集中在 Pro 的 20x 订阅。另有用户从官方模型调用统计中也看到不少 luna 记录,但自己并未使用过 luna。

    Ожидает перевода

13.09вс
  1. Hacker News · Claude Code 高分71

    Anthropic 报告称也门一小组用 Claude Code 开发导弹制导软件

    Anthropic 9 月威胁报告称,也门北部一个小组用 Claude Code 开发制导火箭、射程超 2000 km 的弹道导弹和名为 R2000 的高超音速滑翔飞行器方案,并同时运行多个 Claude 实例,把编码、调研和技术审查分给不同会话。

    Ожидает перевода

12.09сб
  1. AI-Driven Development · Родион Мостовой38

    用 Astra、Fable 和 Opus 做智能体开发,e2e 测试暴露 MCP 工具响应重复缺陷

    作者用 Astra、Fable 和 Opus 连续数天规划编码一个数万行代码的智能体项目,在 e2e 测试中发现 MCP 工具的响应被重复输出(结构化加普通文本),这个缺陷一直漏到最终验证阶段。

    Ожидает перевода

11.09пт
  1. Simon Willison · Coding Agents71

    Shopify 移动端从 React Native 迁回 Swift 和 Kotlin 原生代码库

    Shopify 宣布移动端从 React Native 迁回 Swift 和 Kotlin 两套原生代码库。2020 年转向 React Native 是为了避免同一功能开发两次、让开发者跨栈工作并减少追赶功能对齐的时间,如今公司认为智能体已能承担足够多的实现、翻译、测试和评审工作,双端维护成本不再是决定性因素。

    Ожидает перевода

10.09чт
  1. AI Coder · Telegram88

    Stolen Thoughts 研究:加密 reasoning block 可被跨模型解密,泄露 API key 与密码

    Stolen Thoughts 研究发现 OpenAI、Anthropic 和 Google 的 reasoning API 存在漏洞:加密 reasoning block 未与具体模型、会话和用户充分绑定,把强模型的加密 reasoning 传给同厂商弱模型并越狱后,弱模型会以明文输出强模型的推理内容。

    Ожидает перевода

    Почему это важно: 研究揭示加密 reasoning block 可跨模型解密,并给出公开轨迹中泄露密钥的实测数据,对智能体基础设施设计有直接参考价值。

09.09ср
07.09пн
  1. Vibe Code Textbook · Articles80

    编码智能体安全:提示词注入、MCP 服务器与配置中的密钥

    文章梳理了攻击者进入编码智能体工具的三条路径,即工具返回的文本、接入的 MCP 服务器和配置中的密钥,并对照 Claude Code、Codex CLI、Gemini CLI 文档在 2026-09-07 各自承诺的控制措施。

    Ожидает перевода

    Почему это важно: 文章梳理了编码智能体三条攻击路径,并给出一个只读配置的 Python 审计脚本,可直接用于 CI 检查。

05.09сб
02.09ср
01.09вт
  1. V2EX · Claude Code12

    你们都在用哪个 Claude Code 版本?有人停在 2.1.239,有人已升到 2.1.251

    V2EX 网友讨论各自使用的 Claude Code 版本:楼主因认为 2.1.24x 的 harness 不好用,一直停在 2.1.239;有用户表示已用上 2.1.251,并称该工具更新极快、几乎一天一个版本。楼主随后从 2.1.239 直接升级到 2.1.251,跳过中间几个有问题的版本。

    Ожидает перевода

31.08пн
  1. Hacker News · Claude Code 高分82

    Как один запрос на сводку сайта перехватывает Claude Code Opus 5 Auto Mode и приводит к выполнению кода

    Автор построил целенаправленную цепочку промпт-инъекции и в режиме Auto Mode в Claude Code Opus 5 получил 60-80% успешных атак (на небольшой выборке), тогда как сторонняя оценка, заказанная Anthropic, давала 0.00% успешных инъекций.

    Почему это важно: С помощью цепочки атаки с маскировкой модуля автор получил в Auto Mode 60-80% успешных атак — это показывает, что классификатор не является песочницей.

29.08сб
  1. Simon Willison · Coding Agents71

    Anil Madhavapeddy 与 rclone 维护者称 AI 智能体让漏洞披露流程失效

    Simon Willison 转述剑桥大学计算机教授、OCaml 编译器核心维护者 Anil Madhavapeddy 的观察:OCaml 项目补丁刚被公开讨论,约十分钟内就有网站开始探测百分号编码的路径穿越序列,说明自动化监控在盯着公开仓库。

    Ожидает перевода

28.08пт
  1. Hacker News · AGENTS.md69

    ETH Zurich 测试发现 AGENTS.md 对编码智能体基本没用,还让推理成本涨两成

    ETH Zurich 团队用带与不带 AGENTS.md 的测试项目跑编码智能体,发现提供上下文文件通常不提升任务成功率,推理成本平均增加超过 20%,该结论在不同 LLM、编码智能体和 LLM 生成与开发者提交的上下文文件上都成立。

    Ожидает перевода

27.08чт
  1. Permission Protocol · AI Agent Incident Tracker71

    Amazon Kiro 提示词注入漏洞:恶意工作区内容经 Kiro Powers 外传本地密钥

    Amazon Kiro IDE 存在间接提示词注入漏洞,恶意工作区内容被当作智能体指令,读取本地环境密钥并写入攻击者控制的 Powers 注册表 URL,再调用合法的 Kiro Powers 配置动作把密钥外传,在受信任与非受信任工作区模式下都会发生。

    Ожидает перевода

25.08вт
  1. V2EX · Vibe Coding20

    Vibe Coding 如何找出无效冗余代码?

    V2EX 网友讨论 Vibe Coding 如何清理 AI 生成的冗余代码。有回复建议用 LSP、eslint 等工具接上 MCP,一句指令即可完成且节省 token;也有人指出 AI 倾向用大量 patch 处理逻辑上不会发生的 case,而非解决 root cause,需要定期重构精简。

    Ожидает перевода

  2. Permission Protocol · AI Agent Incident Tracker71

    NVIDIA NemoClaw 暴露的 Ollama 服务被恶意网页持久污染模型

    NVIDIA NemoClaw 配置使 Ollama API 超出默认回环边界可达,恶意网页通过 DNS rebinding 从浏览器上下文访问该本地模型服务,并利用未鉴权的 Ollama API 修改模型 chat template,写入的隐藏指令会在后续对话中持续生效,重新开一个对话也无法清除。

    Ожидает перевода

20.08чт
  1. Permission Protocol · AI Agent Incident Tracker65

    加密上下文注入绕过模型过滤并窃取 Grok 聊天数据

    Adversa AI 披露一种加密上下文注入手法:攻击者提供密文、密钥和解密指令,输入过滤只能看到加密内容,模型在初始安全边界之后还原出明文指令,进而访问私有对话上下文或把数据外传,演示了 Grok 聊天数据泄露和 Gemini 的护栏绕过。

    Ожидает перевода

18.08вт
  1. Permission Protocol · AI Agent Incident Tracker78

    Context7 MCP: внедрение промпта через пользовательские ИИ-инструкции может привести к утечке учётных данных и удалению файлов

    Функция пользовательских ИИ-инструкций в Context7 MCP возвращает неочищенный контент злоумышленника вместе с обычными запросами к документам, из-за чего внедрённые инструкции попадают в доверенный контекст ИИ-агента для разработки и подталкивают его читать ключи, передавать данные наружу или удалять файлы.

    Почему это важно: В материале разобран путь внедрения промпта через пользовательские инструкции в Context7 MCP и предложен способ снижения риска — добавить контроль авторизации на границах вызовов инструментов.

17.08пн
  1. Permission Protocol · AI Agent Incident Tracker74

    Wiz 红队智能体利用 Snowflake 工作流漏洞,该变更由 GitHub Copilot 共同署名并评估为无风险

    Wiz 红队智能体利用 Snowflake 开源仓库 GitHub Actions 工作流中的命令注入漏洞,从 CI/CD 环境窃取 Jira API 凭证,这些凭证可读取 Snowflake 工程、安全合规和漏洞赏金数据库。

    Ожидает перевода

  2. V2EX · Vibe Coding28

    OpenCode Go 的 DeepSeek-V4-Flash 额度缩水 88%,双倍活动结束

    OpenCode Go 套餐的 DeepSeek-V4-Flash 额度缩水 88%,变为每月等效 15 美元,双倍额度活动也已结束。用户反映该套餐原本专为 DS Flash 设计,如今性价比大幅下降,且 OpenCode 中的 DeepSeek 模型实际调用官方 API,需勾选“允许使用托管于中国的模型”才能使用。

    Ожидает перевода