Перейти к содержимому

#Ревью кода

Сегодня 0 материалов
06.10вт
  1. GitHub Blog · Copilot66

    GitHub 发布 AI 代码评审开放基准 ReviewBench

    GitHub 发布代码评审离线基准 ReviewBench,基于 1.039 亿个 GitHub PR 的分布特征,构建了覆盖 19 种语言、219 个公开 PR 的评测集,并公开数据集、评分规则与 LLM 评审模型配置。

    Ожидает перевода

    Почему это важно: GitHub 公开了 AI 代码评审基准的数据集、评分规则与评测入口,读者可据此对比不同评审智能体。

04.10вс
  1. Ben Holmes58

    Ben Holmes 公开了驱动其软件工厂的多智能体系统:需求来自 Linear issue 或 Slack 讨论,分诊智能体先调研并决定是直接实现还是提问,实现智能体负责构建、必要时先与子智能体协作产出 spec,验证子智能体对实现结果做端到端测试,代码评审智能体与实现智能体循环几轮后再交人工评审上线,监控自动化则响应告警并创建 issue。

    Ожидает перевода

26.09сб
23.09ср
  1. Cursor · Changelog62

    Cursor выпускает двух ботов: Rollouts и Security Review

    Cursor выпустил двух ботов — Rollouts и Security Review, доступных для Team и Enterprise.

    Почему это важно: Официально описаны процессы мониторинга и проверки безопасности для этих двух ботов — читатели могут оценить, можно ли встроить их в существующий конвейер доставки.

15.09вт
  1. Sebastian Raschka36

    Sebastian Raschka 用 Paint UI 复刻同一张图,对比 GPT-5.6 Astra 与 Qwen3.8 Max 的计算机使用(视觉)能力:Astra 默认用几何图形分层绘制,Qwen 则逐像素还原,后者结果天然更接近原图、得分会更高。但他认为不能据此断定 Qwen 的计算机使用或视觉理解更强,这恰恰说明只看最终结果的 benchmark 有多不可靠。

    Ожидает перевода

06.09вс
  1. Thorsten Ball · Register Spill15

    Thorsten Ball 谈 AI 写代码:是代码真的差,还是评审者的“天真干预”偏见

    Thorsten Ball 在 Register Spill 的 Joy & Curiosity #98 中借用《反脆弱》里的扁桃体切除研究,提出工程师对 Sol、Fable、Astra 等模型输出的“代码差、注释蠢”评价,可能源于“天真干预主义”偏见——AI 已在 20 分钟内端到端完成前后端改动、内外部文档和测试,并在无头浏览器中跑完全流程、附上录屏为证。

    Ожидает перевода

13.08чт
  1. Augment Code · Blog62

    Augment Code расширяет Cosmos: код-ревью превращается в замкнутый цикл ИИ-агентов от PR до слияния

    Augment Code расширил свою систему ревью Cosmos с код-ревью до полного замкнутого цикла от PR до слияния, добавив четыре возможности: Verifier, PR Fixer, Review Dashboard и cosmos approve. За анализ рисков, построчную проверку корректности, ревью дизайна, проверку во время выполнения и исправление отвечают отдельные специализированные эксперты.

    Почему это важно: Augment расширил код-ревью до замкнутого цикла от PR до слияния, охватывающего исправление, проверку и согласование, — читатели могут оценить, как на практике распределяются роли между несколькими ИИ-агентами.

20.07пн
  1. OpenAI Developer Blog · Codex71

    Codex Code Review поддерживает пользовательские правила ревью в AGENTS.md

    OpenAI добавила в Codex Code Review возможность задавать собственные правила для репозитория: в AGENTS.md можно описать указания по ревью, и Codex применит их при проверке и сошлётся на источник в выводах. По данным официальных тестов, версия с правилами нашла 98% необходимых кастомных проблем, тогда как в контрольной группе — 58.3%. Правила стоит начинать с неочевидных инвариантов вроде требований к совместимости или границ данных: правила уровня репозитория кладём в корень, правила уровня сервиса — в соответствующий каталог, а форматирование и механические проверки по-прежнему оставляем CI.

    Почему это важно: OpenAI рассказывает, какие возможности даёт настройка правил в Codex Code Review, как их писать и что показывают тесты, — по этому можно решить, как закрепить опыт ревью команды в AGENTS.md.

18.07сб
  1. Thorsten Ball · Register Spill22

    Joy & Curiosity #92:Amp 推出订阅与智能体间通信

    Amp 现已推出订阅服务,可与 ChatGPT 订阅搭配获得无限 GPT-5.6 token;同时 Amp 上线智能体间通信,智能体能在任意 Amp 实例或 orb 中派生其他智能体并互发消息与文件。作者还分享了新一季 Raising An Agent 播客、与 Evan Phoenix 等人的对谈,以及 antirez 关于“控制想法而非代码”的观点。

    Ожидает перевода

08.07ср
  1. AI Hero · Skills Updates65

    Репозиторий skills от AI Hero выпустил v1.1: добавлен /wayfinder, переименованы /to-spec и /to-tickets

    Репозиторий skills от AI Hero выпустил v1.1: /to-prd переименован в /to-spec, /to-plan и /to-issues объединены в /to-tickets, а также добавлены новые Skill — /wayfinder, /research, /prototype и другие.

    Почему это важно: Автор подробно разбирает весь процесс работы со Skill — от grilling до развёртывания — и приводит команды миграции для переименования, объединения и добавления /wayfinder. Будет полезно тем, кто хочет собрать собственный рабочий процесс для разработки с ИИ.

03.07пт
  1. Lovable · Blog88

    花掉 8.5 万美元 token 后,我在 Lovable 扩展智能体编程的经验

    Lovable 一名工程师从今年 1 月到 6 月把个人 token 花费从每月约 600 美元推到 5 月的约 2.5 万美元、累计约 8.5 万美元,同时把每周合并 PR 数从 20-30 个提升到 150 个以上。

    Ожидает перевода

    Почему это важно: 作者公开了自己每月约 2.5 万美元 token 的智能体开发配置,包括风险分级、多智能体评审和上下文管理,可迁移到其他团队。

11.05пн
  1. AI Hero · Skills Updates60

    AI Hero 新增 /handoff 与 /prototype 两个 Skill 并修复多个已有 Skill

    AI Hero 在其 skills 仓库新增 /handoff 和 /prototype 两个 Skill。

    Ожидает перевода

    Почему это важно: 作者公开了 /handoff 与 /prototype 两个 Skill 的设计思路,可看到上下文交接与原型验证如何嵌入智能体工作流。

09.03пн
  1. OpenAI Developer Blog · Codex87

    OpenAI 如何用 Skills 加速 Agents SDK 仓库维护

    OpenAI 用 Codex 配合仓库内的 Skills、AGENTS.md 和 GitHub Actions 维护 Agents SDK 仓库,把验证、发布准备、示例集成测试和 PR 评审变成可重复流程。

    Ожидает перевода

    Почему это важно: OpenAI 官方公开了用 Skills、AGENTS.md 和 GitHub Action 维护 Agents SDK 仓库的完整配置,可迁移到其他开源项目。