Перейти к содержимому

Все новости

Сегодня 0 материалов
13.10пн
  1. Jesse Vincent37

    让 AI 写出好文风的一个怪招:先让 Claude 读《The Elements of Style》

    开发者 Jesse Vincent 发现,让 Claude 先读 Strunk 1920 年版《The Elements of Style》再写 README,成稿比原来短约 30%,文风也更合他意。他把该书 HTML 转成约 12,000 词的 Markdown,因 Anthropic 的版权过滤机制拒绝处理这本已进入公有领域的书,最终改用 GPT-5 Codex 完成删减。

    Ожидает перевода

12.10вс
  1. Jesse Vincent62

    Superpowers 2.0 发布次日,作者发现 Claude Code 原生 Skills 机制可能让它过时

    作者发布 Superpowers 2.0,把 skills 抽成可 fork 和本地管理的独立 git 仓库,方便添加、定制和分享 skills。随后他在 claude --debug 日志中发现 Claude Code 会把 SKILL.md 的 YAML name 字段转成 SlashCommand,并认为可以自动激活它们,这比他设计的引导方式更可靠。

    Ожидает перевода

10.10пт
  1. OpenAI Developer Blog · Codex50

    Codex 如何支撑 OpenAI DevDay 2025

    OpenAI 第三届 DevDay 首次全程用 Codex 参与搭建,从舞台演示、社区大厅街机到产品本身都由它协助完成。Codex 自行实现 VISCA 协议控制网络摄像头,并搭建灯光 MCP server;Codex CLI 让 Romain Huet 一个下午就完成初版。

    Ожидает перевода

09.10чт
  1. Jesse Vincent78

    Superpowers: как автор в октябре 2025 года использовал ИИ-агент для разработки

    Автор Джесси Винсент выпустил Superpowers — набор Skill на основе новой плагинной системы Claude Code. После установки плагин через hook session-start внедряет вводные подсказки, чтобы Claude сам искал и применял Skill.

    Почему это важно: Автор упаковал свой рабочий процесс с ИИ-агентом для разработки в устанавливаемый плагин Skill — читатели могут напрямую воспользоваться его подходом от мозгового штурма до реализации через TDD.

05.10вс
  1. Jesse Vincent71

    Как я использовал ИИ-агент для разработки в сентябре 2025 года: рабочий процесс с двумя сессиями Claude Code

    Автор описал свой полный процесс работы с Claude Code: сначала изолировал задачи с помощью git worktree, затем с помощью промпта для мозгового штурма заставлял Claude задавать по одному вопросу и поэтапно уточнять дизайн, после чего с помощью промпта для планирования разбивал план на небольшие задачи и записывал их в docs/plans/.

    Почему это важно: Автор разделил работу с Claude Code на две сессии — архитектора и реализатора — и привёл промпты для повторного использования, а также способ изоляции через git worktree.

02.10чт
01.10ср
  1. Hacker News · Context Engineering 讨论76

    Anthropic об эффективном контекстном инжиниринге для ИИ-агентов

    Команда Anthropic, занимающаяся прикладным ИИ, пишет, что контекстный инжиниринг — продолжение промпт-инжиниринга, а его суть в том, чтобы при ограниченном бюджете внимания отобрать минимальный набор токенов с высоким сигналом.

    Почему это важно: Anthropic официально описывает системный подход к контекстному инжинирингу, включая выбор между тремя стратегиями для длительных задач: сжатием, заметками и субагентами.

30.09вт
  1. Harper Reed40

    给 AI 智能体开通社交媒体后,它们开始索要 Lambo

    Harper Reed 团队为 Claude Code 等编程智能体搭建了社交媒体服务器 botboard.biz,让它们在工作时发帖、回复并互相吐槽。团队随后测试了这些社交工具对智能体表现的影响,结果发现它反而成了性能增强器,相关论文已发布。botboard.biz 即将开放试用。

    Ожидает перевода

29.09пн
  1. Jesse Vincent66

    Переписываем правила CLAUDE.md на языке dot из GraphViz

    Автор переписал правила CLAUDE.md — вместо длинного текста получилась блок-схема на языке dot из GraphViz: имена узлов заданы строками в кавычках, разные формы обозначают решения, команды и предупреждения, а у каждого шага есть явное условие запуска.

    Почему это важно: После того как правила CLAUDE.md превратились в граф на dot из GraphViz, Claude стал лучше их соблюдать. Этот подход можно перенести и на свои проекты.

28.09вс
25.09чт
  1. Martin Fowler · Exploring Generative AI62

    把 AI 锚定到参考应用:用 MCP server 做代码模式漂移检测

    Martin Fowler 分享用参考应用(reference application)给编码助手提供可编译、一致的代码样例,做法是建一个 MCP server 让助手访问 Spring Boot 的 repository、service、controller 等典型模式样例,替代在 markdown 里手写代码片段。

    Ожидает перевода

24.09ср
  1. Hacker News · Context Engineering 讨论87

    Практический опыт Manus в контекстной инженерии для ИИ-агентов: шесть принципов

    Команда Manus поделилась опытом контекстной инженерии, накопленным при создании ИИ-агентов. В основе — проектирование с учётом KV-кэша, управление инструментами через маскирование, а не удаление, использование файловой системы как контекста, управление вниманием через повторение списка задач, сохранение ошибочного содержимого и отказ от привязки к few-shot примерам.

    Почему это важно: Команда Manus обобщила опыт четырёх переписываний фреймворка агентов в шесть принципов контекстной инженерии — их можно напрямую применить к собственной реализации агента.

09.09вт
  1. Terminal-Bench · News38

    Terminal-Bench 排行榜回应超时争议:OB-1 重新提交成绩后重回榜首

    OpenBlock Labs 的智能体 OB-1 在按正确超时限制重新提交成绩后,重新成为 Terminal-Bench 排行榜得分最高的智能体。此前该提交将数据集中每个任务的超时统一改为固定 30 分钟,而多数任务原本限时 5 分钟,导致 75 个任务超时被放宽、2 个不变、3 个被缩短。

    Ожидает перевода

29.08пт
  1. OpenAI · Codex Cookbook74

    在 GitLab CI/CD 中用 Codex CLI 自动做代码质量检查与安全修复

    OpenAI Codex Cookbook 给出把 Codex CLI 接入 GitLab CI/CD 的完整做法,用于生成 CodeClimate JSON 代码质量报告、把 SAST 结果整理成 security_priority.md,并让 Codex 输出可 git apply 的补丁。

    Ожидает перевода

    Почему это важно: 官方 Cookbook 给出把 Codex CLI 接入 GitLab CI 的完整配置,含提示词约束、JSON 标记提取与 diff 校验,可直接照搬。

26.08вт
10.08вс
  1. Ryan Lopopolo38

    MCP 如何为 LLM 解决工具发现问题

    MCP 通过提供一份实时、机器可读的工具目录,为 Claude Code、OpenAI Codex 等编程智能体解决工具发现问题——目录包含工具名称、描述、输入 schema 和示例调用。CLI 工具对编程智能体不可读,而 MCP 内置了自动提示模型的机制,让模型无需猜测或搜寻工具。作者认为,智能体优先的开发意味着从工具编写之初就要面向模型提示,这正是 MCP 所内建的。

    Ожидает перевода

03.08вс
  1. Ryan Lopopolo22

    服务网格是组织工具,而非技术工具

    服务网格的价值在于以难以绕开的方式注入策略,包括连接池与 keep alive、重试、超时、数据本地性约束和 AZ 本地路由等。产品工程追求快速迭代与可靠性之间存在一定冲突,而服务网格难以被绕过,能确保默认情况下做正确的事。这也是部署服务网格最简洁的理由:它实现了职责分离,又不需要产品团队额外记住步骤。

    Ожидает перевода

01.08пт
18.07пт
15.07вт
13.07вс
09.07ср
  1. Hacker News · Context Engineering 讨论62

    上下文工程实战:用 n8n 搭建多智能体深度研究工作流

    作者以自己用 n8n 搭建的多智能体深度研究应用为例,说明上下文工程不只是写提示词,而是设计并优化提供给 LLM 的完整上下文。他拆解了搜索规划智能体的系统提示词,涵盖指令、用户输入分隔符、子任务字段定义、结构化输出示例,以及注入当前日期时间让模型推断 start_date 和 end_date 的做法。

    Ожидает перевода

01.07вт
  1. Hacker News · Context Engineering 讨论78

    Контекстная инженерия для агентов: четыре стратегии — запись, выбор, сжатие и изоляция

    В своей статье Лэнс Мартин сводит контекстную инженерию агентов к четырём стратегиям: запись (с помощью scratchpad и памяти сохранять информацию за пределами контекстного окна) и выбор (по необходимости подтягивать память, описания инструментов и знания).

    Почему это важно: В статье контекстное управление агентом сводится к четырём стратегиям — запись, выбор, сжатие и изоляция, — и приводятся конкретные приёмы из разных продуктов, чтобы было удобнее соотнести их со своим текущим рабочим процессом.

  2. Hacker News · Context Engineering 讨论62

    AI 的新技能不是提示词工程,而是上下文工程

    作者认为 AI 领域正从提示词工程转向上下文工程,即设计动态系统,在合适的时间以合适的格式为 LLM 提供正确的信息和工具。他把上下文拆成系统提示词、用户提示词、短期状态与历史、长期记忆、RAG 检索信息、可用工具和结构化输出七类,并指出多数智能体失败已不是模型失败而是上下文失败。

    Ожидает перевода

26.06чт
25.06ср
24.06вт
20.06пт
  1. Terminal-Bench · News22

    Terminal-Bench 新增科学计算与密码学任务:UPC 并行基因组组装与 FEAL 线性密码分析

    Terminal-Bench 新增 parallelize-graph 和 feal-linear-cryptanalysis 两个高难度任务,分别要求智能体用 Unified Parallel C 实现基因组组装的并行 de Bruijn 图构建,以及对 FEAL 类分组密码实施已知明文线性密码分析攻击。

    Ожидает перевода

04.06ср
  1. Martin Fowler · Exploring Generative AI66

    自主编码智能体实测:一次 OpenAI Codex 运行记录

    Martin Fowler 给 OpenAI Codex 布置了一个前端标签格式化的化妆类小任务,并完整公开了 Codex 的日志和生成的 PR。日志显示 Codex 主要靠 grep 反复文本搜索定位代码,中途因把 AGENTS.md 误写成 AGENT.md 来回折腾,还因删掉 .yarnrc 导致测试无法运行,最终 PR 里有两个回归测试失败。

    Ожидает перевода

    Почему это важно: 作者完整记录 Codex 自主完成一次前端小任务的日志,并对比 6 次运行结果,展示后台编码智能体在环境配置和代码复用上的真实短板。

28.05ср
23.05пт
  1. Terminal-Bench · News32

    Anthropic 在 Claude 4 模型卡中引入 Terminal-Bench,Claude 4 Opus 创下 43.2% 新 SOTA

    Anthropic 将 Terminal-Bench 列为 Claude 4 模型卡七项基准之一,Claude 4 Opus 在 Terminal-Bench-Core 上取得 43.2% 的 SOTA 成绩。Dario Amodei 在 Code with Claude 主题演讲中也提及该基准。Terminal-Bench 团队表示将在未来几天验证 Claude 4 的表现并更新官方排行榜。

    Ожидает перевода

22.05чт
  1. Jesse Vincent22

    为 Vibe Coding 做一个“continue”按钮键盘

    Jesse Vincent 用 Raspberry Pi Pico 和一只廉价 Staples Easy Button 改装出专为 AI 编程助手设计的单键键盘,按下即向 Claude Code、Cursor、Cline 等工具发送 "continue",让 AI 接着干活。他还在按钮里保留了原装扬声器播放励志语音,但指出音效很快就让人厌烦,取出电池后键盘功能仍可正常使用。

    Ожидает перевода

19.05пн
  1. Terminal-Bench · News48

    Terminal-Bench 推出研究预览版智能体 Terminus

    Terminal-Bench 团队发布研究预览版智能体 Terminus,用于在终端中一致地评估语言模型驱动自主智能体的能力,发布时其性能在 Terminal-Bench 上仅次于 Claude Code。Terminus 采用单工具设计,仅通过 tmux 会话发送标准按键操作,并借助 LiteLLM 支持几乎所有 API 或本地托管模型,且完全自主运行、不请求用户输入。

    Ожидает перевода

  2. Terminal-Bench · News62

    Terminal-Bench 发布首个终端智能体评测基准

    Terminal-Bench 发布首个版本,用于量化 AI 智能体在终端中执行复杂任务的能力,首发数据集 Terminal-Bench-Core-v0 包含 80 个手工编写并人工验证的任务,每个任务配有独立 Docker 环境、人工验证的解法与测试用例。

    Ожидает перевода

    Почему это важно: Terminal-Bench 给出 80 个带 Docker 环境和测试用例的终端任务,可用来横向比较不同智能体在命令行中的实际表现。

14.05ср
  1. Martin Fowler · Exploring Generative AI62

    用 LLM 构建 PlantUML 分步播放扩展 PlantUMLSteps

    作者用 LLM 构建了 PlantUMLSteps,为 PlantUML 时序图增加按步骤播放功能,把单张复杂图拆成登录、认证、仪表盘等逐步展示的步骤。开发中 Claude 在 Cursor Agent 模式下生成 StepParser 解析逻辑、Gradle 任务和 HTML 查看器,解析器最初在 newPage 属性、首个步骤标记前的声明处理上出错,经测试反馈修正后通过。

    Ожидает перевода