Перейти к содержимому

#Обновления продуктов

Сегодня 0 материалов
09.08вс
08.08сб
06.08чт
  1. Simon Willison · Coding Agents71

    Meta 发布编码智能体 Muse Code 与 Muse Spark 1.2

    Meta 发布编码智能体 Muse Code 和面向编码的模型更新 Muse Spark 1.2,后者在代码生成、复杂调试、代码库理解和端到端开发流程上做了改进,并针对长周期编码任务(整仓库生成、大型端到端项目、auto-research)加大训练算力。

    Ожидает перевода

05.08ср
  1. Vercel · v0 Blog62

    Vercel выпустил новую версию API v0 для программного вызова агентов генерации приложений

    Vercel выпустил новую версию API v0 — программный, безголовый доступ к агентам генерации приложений v0: отправляешь промпт, v0 создаёт приложение, поднимает сервер разработки в Vercel Sandbox и возвращает URL превью, который можно встроить в свой интерфейс. API уже доступен.

    Почему это важно: v0 открыл генерацию приложений через API — читатель может прикинуть, как встроить её в свой продукт или в работу агентов.

30.07чт
  1. Terminal-Bench · News62

    Terminal-Bench выпустил новые возможности Harbor: теперь бенчмарк можно обновлять как версионируемый актив

    Команда Terminal-Bench выпустила набор новых возможностей Harbor: датасеты теперь можно публиковать по версиям, а таблицу лидеров — переносить на новую версию, для чего нужно либо переиспользовать, либо переоценить, либо перезапустить trial. Задачи версионируются семантически: при изменениях уровня патча старые результаты просто переиспользуются, при изменениях валидатора достаточно переоценить уже сохранённые артефакты, и только существенные изменения, заметно меняющие среду ИИ-агента, требуют перезапуска. Версия датасета соответствует максимальной версии среди задач, а таблица лидеров через diff перезапускает только задачи с существенными изменениями.

    Почему это важно: Команда Terminal-Bench относится к бенчмарку как к программному обеспечению и описывает конкретный механизм семантического версионирования задач и обновления таблицы лидеров, который можно перенести в собственный процесс оценки.

29.07ср
  1. Lovable · Blog40

    Lovable 应用现可接入终端用户已连接的工具

    Lovable 的 connector 现在可以运行在终端用户自己的数据上,用户用 Google、Microsoft、Slack、Salesforce、HubSpot 等账号登录后,应用会继承其原有权限,凭据由 Lovable 的 connector gateway 短暂持有,不会进入应用或浏览器。

    Ожидает перевода

22.07ср
  1. Lovable · Blog28

    Lovable 成为首个获得 AIUC-1 认证的 AI 编程智能体平台

    Lovable 成为首个获得 AIUC-1 认证的 AI 编程智能体平台,该标准是业界首个专为 AI 智能体打造的安全、保障与可靠性标准。AIUC-1 由 Stanford、MIT、MITRE 和云安全联盟参与制定,包含六大原则下的 51 项要求,覆盖密钥管理、安全代码生成默认设置、沙箱执行、人工监督和企业治理,每项要求均需提供证据并由第三方独立验证,而非自我声明。

    Ожидает перевода

20.07пн
  1. OpenAI Developer Blog · Codex71

    Codex Code Review поддерживает пользовательские правила ревью в AGENTS.md

    OpenAI добавила в Codex Code Review возможность задавать собственные правила для репозитория: в AGENTS.md можно описать указания по ревью, и Codex применит их при проверке и сошлётся на источник в выводах. По данным официальных тестов, версия с правилами нашла 98% необходимых кастомных проблем, тогда как в контрольной группе — 58.3%. Правила стоит начинать с неочевидных инвариантов вроде требований к совместимости или границ данных: правила уровня репозитория кладём в корень, правила уровня сервиса — в соответствующий каталог, а форматирование и механические проверки по-прежнему оставляем CI.

    Почему это важно: OpenAI рассказывает, какие возможности даёт настройка правил в Codex Code Review, как их писать и что показывают тесты, — по этому можно решить, как закрепить опыт ревью команды в AGENTS.md.

15.07ср
  1. Lovable · Blog60

    Lovable 应用可通过 MCP 在 ChatGPT 和 Claude 中使用

    Lovable 上线 agent integrations,任何公开已发布的 Lovable 应用都能添加 MCP server,从而被 ChatGPT、Claude 等 AI 工具直接调用。

    Ожидает перевода

    Почему это важно: Lovable 把已发布应用接入 MCP,读者可据此判断自家应用如何被 ChatGPT、Claude 直接调用。

24.06ср
  1. Andrej Karpathy60

    Anthropic 发布 Claude Tag,团队可在 Slack 中把 Claude 加为团队成员,让它访问指定频道和工具,通过 @ 它来委派任务。Karpathy 认为这是 LLM 交互界面的第三次重大改版:第一代是访问网站,第二代是下载到电脑的应用,第三代则是自带工具和组织级上下文、与人类团队并行工作的持久异步实体。

    Ожидает перевода

    ЦитатаClaude@claudeai

    Introducing Claude Tag, a new way for teams to work with Claude. In Slack, Claude joins as a team member with access to the channels and tools you choose. Tag Claude in and delegate tasks to it while you focus on other work.

18.06чт
  1. AI Hero · Skills Updates69

    AI Hero Skills v1 发布:token 消耗降低 63%,新增 /ask-matt 与 /writing-great-skills

    AI Hero 的 skills 目录发布 v1,通过在各 Skill 上启用 disable-model-invocation: true,让 Skill 描述不再进入模型选择 Skill 时查看的上下文窗口,Skill 描述的 token 成本降低 63%。

    Ожидает перевода

    Почему это важно: v1 用 disable-model-invocation 把 Skill 描述移出上下文窗口,并区分用户调用与模型调用,读者可据此判断自己的 Skill 组织方式。

  2. Augment Code · Blog71

    Augment выпустила на платформе Cosmos инструмент Project Builder, который доводит крупные проекты от проектного документа до слияния кода

    Augment выпустила на платформе Cosmos инструмент Project Builder — эксперта Cosmos, который превращает описание функции в проектный документ на основе реальной кодовой базы; после ручной проверки он распределяет задачи между рабочими агентами, доводит реализацию до слияния.

    Почему это важно: Augment официально раскрыла, как в Project Builder устроены проверка проектного документа и распределение задач, а также привела объём кода и сроки запуска трёх продакшн-проектов — по этим данным можно оценить, насколько жизнеспособен подход «сначала проектирование, затем оркестрация ИИ-агентов».

17.06ср
15.06пн
  1. Jesse Vincent78

    Superpowers 6 发布:构建提速最高 50%、token 花费降低最高 60%

    Superpowers 6 发布,作者称在 Anthropic 评测基准上构建耗时降低 50%、token 花费降低 60%,主要来自合并规范符合性与代码质量两个评审 agent、预先生成评审用的 diff 包让评审者少跑 git,以及调整编排器对任务所需 agent 类型的指引。

    Ожидает перевода

    Почему это важно: 作者用自建评测套件量化了 Superpowers 6 在构建耗时和 token 花费上的改进,并公开了实验记录与失败结论。

19.05вт
18.05пн
  1. Lovable · Blog62

    Lovable 上线 Skills,把重复指令变成可复用技能

    Lovable 上线 Skills 功能,把重复交代的工作方式写成可复用的 markdown 技能文件,在相关任务出现时按需加载。技能以文件夹形式组织,主文件 SKILL.md 含 name、description 和 instructions,description 是决定是否触发的唯一依据,支持文件只在主文件引用且确实需要时才加载。

    Ожидает перевода

    Почему это важно: 官方详解 Lovable Skills 的文件结构、触发机制与写法,并给出可对照的正反示例。

13.05ср
  1. Lovable · Blog22

    Lovable 参与 AIUC-1 认证:为 AI 编程智能体设立安全标准

    Lovable 成为首批寻求 AIUC-1 认证的 AI 编程智能体平台之一,第三方审计计划于 2026 年夏季进行。AIUC-1 是面向 AI 智能体安全、保障与可靠性的标准,此次扩展为首个专为 AI 编程智能体设计的认证框架。该白皮书指出,编程智能体产出源代码、数据库 schema、API 配置等可执行产物,直接接触生产基础设施和真实用户数据,生成代码中的漏洞即是现实的安全暴露。

    Ожидает перевода

04.05пн
  1. Jesse Vincent32

    Superpowers 5.1.0 发布

    Superpowers 5.1.0 发布,重做了 git worktree 的使用方式,以适配 Claude Code 和 Codex 对 worktree 的一等支持。该版本移除了早期遗留的废弃 slash 命令,将 code reviewer 子智能体改为带自定义提示词的普通子智能体,并新增对 Factory Droid 的支持、优化 OpenCode 集成。

    Ожидает перевода

02.05сб
27.04пн
24.04пт
  1. Lovable · Blog38

    Lovable 早期测试 GPT-5.5:最难任务通过率 41.6%,比 GPT-5.4 提升 12.5%

    Lovable 在早期访问中测试 GPT-5.5,其内部基准显示最难任务通过率从 GPT-5.4 的 36.9% 升至 41.6%,每次请求工具调用减少 23.1%,用户卡住的消息占比下降 9.9%。GPT-5.5 每请求输出 token 减少 33%,日常任务成本效率提升约 15%,将很快向 Lovable 构建者开放。

    Ожидает перевода

  2. Jesse Vincent66

    Prime Radiant 发布 Greenfield 与 Iterative Development 研究预览

    Prime Radiant 发布两款新技术的研究预览:Greenfield 把现有软件(代码库、文档、API 客户端等)转成行为规格语料,Iterative Development 则是一套基于 Superpowers 的智能体方法论,把大规格拆成需求、打包成开发 epic 后交给编码智能体实现。

    Ожидает перевода

    Почему это важно: Prime Radiant 公开两套工具的研究预览,读者可了解从旧代码库提取行为规格再驱动智能体重建产品的思路。

18.04сб
17.04пт
03.04пт
  1. Steve Yegge60

    Gas Town 与 Beads 发布 v1.0.0,Beads 改用 Dolt 后端

    Steve Yegge 宣布 Gas Town 和 Beads 同日发布 v1.0.0。Beads 是面向编码智能体的记忆系统与知识图谱,v1.0 用 Dolt 替换了原先 SQLite + JSONL 的架构,双向同步、三方合并和合并冲突等问题被移除,同时支持嵌入式和服务器模式,本周 GitHub star 数突破 20k。

    Ожидает перевода

31.03вт
  1. Paper Compute · Engineering Blog58

    Paper Compute 发布 tapes 与 stereOS,为生产环境运行 AI 智能体提供可观测与隔离基础设施

    Paper Compute 发布面向生产环境 AI 智能体的基础设施,包含 tapes 和 stereOS 两个组件。tapes 是零埋点的可观测层,以反向代理形式部署在智能体与推理服务之间,无需 SDK 或改代码,只需一个环境变量,即可捕获并生成可验证、防篡改的执行记录,并支持异常检测。

    Ожидает перевода

20.03пт
  1. Lovable · Blog38

    Lovable 从建应用扩展到文档、表格、图片与视频生成

    Lovable 不再只构建全栈应用,其 AI 智能体现在能运行代码和 Python 脚本,直接分析文件与数据,并生成可下载的表格、PDF、幻灯片、Word 文档、图片和视频。它支持将 CSV、PDF 或截图转成可用的应用,也能生成营销报告、投资人 deck 和发票等专业文档,并导出为 PDF、PowerPoint、Excel、Word 或 CSV。

    Ожидает перевода

19.03чт
09.03пн
  1. Jesse Vincent67

    Superpowers 5 发布:新增可视化头脑风暴与 spec 评审循环

    Superpowers 5 发布,作者称最喜欢的改动是 Visual Brainstorming 伴随工具,它会在智能体认为有内容需要展示时提示用户,通过本地 web 服务器加载智能体写出的 HTML 片段,并把浏览器里的点击和反馈回传给智能体,以替代 Claude 常生成的 ASCII 图。

    Ожидает перевода

    Почему это важно: 作者是 Superpowers 维护者,文中说明了 5.0 的视觉头脑风暴、spec 评审循环和子智能体开发三项变化,可据此判断是否值得接入现有工作流。

27.02пт
26.02чт
  1. OpenAI Developer Blog · Codex66

    Codex 接入 Figma MCP Server,实现设计与代码双向转换

    OpenAI 宣布 Codex 可通过 Figma MCP Server 生成 Figma 设计文件,并支持设计稿与代码双向流转。

    Ожидает перевода

    Почему это важно: 官方给出 Codex 与 Figma MCP 双向打通的具体操作步骤,读者可据此判断设计到代码的往返流程能否落地。

03.02вт
  1. Vercel · v0 Blog60

    Vercel 发布新版 v0,从生成演示转向生产级应用

    Vercel 发布新版 v0,将其定位从生成演示转向生产级应用和智能体。新版本基于沙箱运行时,可导入任意 GitHub 仓库并自动拉取 Vercel 上的环境变量和配置;新增 Git 面板,让非工程成员也能为每个对话建分支、向 main 提 PR 并在合并后部署;同时提供与 Snowflake 和 AWS 数据库的安全集成,以及默认开启的部署保护和访问控制。

    Ожидает перевода

    Почему это важно: v0 从生成演示转向生产级应用,给出导入 GitHub 仓库、Git 面板和数据库集成等具体能力变化。

18.12чт
  1. Jesse Vincent60

    Superpowers 4.0 发布:代码评审拆分为规格评审与代码评审两个智能体

    Superpowers 4.0 发布,核心改动是把实现步骤后的代码评审拆成两个智能体:先由 spec review 智能体确认实现符合计划,通过后 code review 智能体再检查代码质量,两步都改为循环执行,协调智能体知道实现者修复后要重跑评审。

    Ожидает перевода

12.12пт
  1. Hacker News · AI Code Review 讨论66

    DeepSource 发布 Autofix Bot:静态分析与 AI 混合的代码审查智能体

    DeepSource(YC W20)团队发布 Autofix Bot,一个把静态分析与前沿 AI 智能体结合的代码审查智能体,面向 AI 编码工作流。其混合架构分三步:5000+ 确定性检查器建立高精度基线并由子智能体抑制误报,AI 审查以静态发现为锚点并调用 AST、数据流图、控制流、导入图等工具,最后由子智能体生成修复、静态校验后输出干净的 git patch。

    Ожидает перевода

07.11пт
  1. Terminal-Bench · News62

    Terminal-Bench выпустил версию 2.0 и пакет оптимизаций для оценки в Harbor

    Terminal-Bench выпустил версию 2.0 и пакет Harbor: первый — это более строго проверенный и сложный бенчмарк для оценки агентов, второй — для их оценки и оптимизации. Harbor переписал тестовый фреймворк Terminal-Bench: теперь можно разворачивать контейнеры в облаке, есть интерфейсы rollout для RL и SFT, а также совместимость с любыми агентами, которые упаковываются в контейнер.

    Почему это важно: Вместе с Terminal-Bench 2.0 вышел Harbor — читатели узнают, как проверяются бенчмарки для агентов и как масштабировать их в облаке.