Перейти к содержимому

#OpenAI

Сегодня 0 материалов
06.10вт
  1. 宝玉71

    SemiAnalysis 实测 Anthropic、OpenAI 等九家 AI 订阅套餐后得出,同样 200 美元,Claude 订阅折算的 Token 用量约为 OpenAI 的 5 倍。

    Ожидает перевода

    ЦитатаSemiAnalysis@SemiAnalysis_

    Anthropic Subscriptions Offer 5x+ More Value Than OpenAI Limit testing every AI subscription plan from Anthropic, OpenAI, Meta, SpaceXAI, MiniMax, Moonshot, Zdotai, Cursor, and Cognition https://newsletter.semianalysis.com/p/anthropic-subscriptions-offer-5x

  2. 宝玉71

    据 The Information 10 月 5 日报道,Meta 和微软都在减少员工内部使用 Anthropic 的 Claude,转向自家模型和工具。

    Ожидает перевода

    ЦитатаNIK@ns123abc

    🚨BREAKING: Microsoft and META are aggressively cutting employee use of Claude ahead of Anthropic's IPO Microsoft has cut internal claude spend by more than 33%, nuked per-employee token budget from $100k/month to $10k/month, and forced Copilot to auto-route to cheaper models META used Claude code to build Muse, then cut active users from 60,000 to 30,000 (50% decline) after launch, and replaced it with Muse Code Palantir and Nvidia are also scaling back claude over soaring prices and data privacy fears it’s OVER…

  3. 宝玉67

    OpenAI 在 28 天更新的第 1 天宣布,通过 ChatGPT 订阅使用 GPT-6 Astra 和 GPT-6.1 Sol 时默认速度提升约 50%,用户无需改设置,两小时内生效。

    Ожидает перевода

    ЦитатаTibo@thsottiaux

    Day 1/ We have optimized the default speed to be ~50% faster across GPT-6 Astra and GPT-6.1 Sol through the subscription across all our products and partners using Sign in With ChatGPT (including OpenCode, Pi, Amp, Devin, ...). No changes needed on your end and this should be felt within the next two hours.

  4. 宝玉62

    OpenAI 宣布未来几周内对欧盟用户在 ChatGPT 和 Codex 生成的文字加入不可见水印,以满足欧盟《人工智能法案》要求,API 用户可在全球范围自行开启,默认关闭。

    Ожидает перевода

    ЦитатаOpenAI@OpenAI

    We're expanding our approach to content provenance to include text in response to EU regulatory requirements, while recognizing the significant limitations of current text watermarking technology. Our tools already help verify whether an image or audio file was created with our models. This work builds on those efforts to help people better understand when content may have been generated or edited with an OpenAI model. In the EU, we’ll start watermarking eligible text from ChatGPT and Codex over the coming weeks to comply with the EU AI Act. Customers using our API can turn on text watermarking for select models worldwide today.

  5. 宝玉70

    amontlabs/lcu 把 Codex 的 Computer Use 单独拆出,让 Claude Code、Codex CLI、Pi 等 Agent 工具通过 MCP 调用。

    Ожидает перевода

    Цитата向阳乔木@vista8

    发现一个牛逼的东西,让任意 Agent 调用 Codex 的 Computer Use。 Codex 最强的就是 Computer Use。 但最近用 Claude Opus 5.5比较多,这样就强强联合了。 刚测试通过,安装后建议配置个 Hook,指定白名单可控制哪些 App 安装地址见评论区

04.10вс
  1. 宝玉66

    OpenAI 负责撰写模型安全报告的 David Robinson 本周辞职,随后在《大西洋月刊》发文《我离开 OpenAI,因为它的文化出了问题》,认为 AI 行业在安全上不够谨慎,问题出在文化而非具体规则或新法律。

    Ожидает перевода

    ЦитатаAdrienne LaFrance@AdrienneLaF

    New in The Atlantic: @dgrobinson resigned this week. He was among the longest-tenured employees at OpenAI—and oversaw safety reports on 12 frontier launches. He is very worried: “The time for trial and error is over.” You can read his essay here: https://www.theatlantic.com/technology/2026/10/openai-safety-team-resignation/688881/?gift=1ga2TvL-DbuHDQIcYF7oR4o908Fsjxr4NFLlsptkfP8

03.10сб
  1. 宝玉62

    剑桥大学 AI 科学与政策项目(CASP)9 月发布一篇论文,Hinton、Bengio 等 20 多位研究者联名讨论 AI 研发被自动化后是否会引发智能爆炸,Hinton 在 X 上推荐了该论文。

    Ожидает перевода

    ЦитатаGeoffrey Hinton@geoffreyhinton

    The idea of an intelligence explosion caused by recursive self improvement has been around for a long time but until very recently it did not seem imminent. Now many leading researchers think it may happen quite soon. You can read our paper about it here: https://casp.ac/reports/intelligence-explosion

23.09ср
15.09вт
  1. Sebastian Raschka36

    Sebastian Raschka 用 Paint UI 复刻同一张图,对比 GPT-5.6 Astra 与 Qwen3.8 Max 的计算机使用(视觉)能力:Astra 默认用几何图形分层绘制,Qwen 则逐像素还原,后者结果天然更接近原图、得分会更高。但他认为不能据此断定 Qwen 的计算机使用或视觉理解更强,这恰恰说明只看最终结果的 benchmark 有多不可靠。

    Ожидает перевода

11.09пт
  1. OpenAI Developer Blog · Codex66

    OpenAI рассказал, как переписать Skills и промпты под GPT-6 Astra

    В официальном блоге OpenAI даны рекомендации по настройке Skills, AGENTS.md и промптов задач под GPT-6 Astra: описание Skill должно быть по возможности коротким и чётко указывать, где он применим; для многошаговых Skills корневой документ служит минимальной маршрутизацией — не стоит превращать Skill в слишком детальный список шагов.

    Почему это важно: OpenAI опубликовал рекомендации по чистке Skills, AGENTS.md и промптов под GPT-6 Astra — их можно перенести и на конфигурацию существующих репозиториев.

04.09пт
  1. OpenAI Developer Blog · Codex71

    Как построить игру с помощью Astra в Codex: от Void Explorer до оптимизации производительности

    Автор построил в Codex с помощью Astra космическую исследовательскую игру Void Explorer — с 2,048 звёздными системами и более чем 10,000 процедурно генерируемыми планетами — и рассказал о полном процессе: от промпта до архитектуры, тестирования и измерения производительности.

    Почему это важно: Автор использовал Astra в Codex, чтобы сделать полноценную игру, и показал переносимый процесс совместной работы — от промпта до тестирования и измерения производительности.

  2. OpenAI Developer Blog · Codex28

    用 Codex 中的 Astra 做建筑可视化:从 Blender 场景到 Unreal Engine 5

    用户向 Codex 中的 Astra 描述一栋极简住宅的需求,Astra 通过 Blender Python API(bpy)生成可编辑 3D 场景,完成建筑、家具、材质、灯光与相机,并自行检查预览渲染、修正细节。项目从带家具的起居亭扩展为围绕庭院布局的 U 型单层住宅,含三间卧室、办公室、浴室和更衣室,随后导出到 Unreal Engine 5 探索实时漫游。

    Ожидает перевода

27.08чт
25.08вт
  1. OpenAI Developer Blog · Codex62

    Автоматизация повторяющихся задач оценки в OpenAI с помощью Codex и ноутбука Runme

    Инженеры OpenAI используют Codex вместе с открытым приложением для ноутбуков Runme, чтобы автоматизировать рутинную работу, например запуск оценки моделей. Делается это так: в ноутбуке Runme пишут целевые ячейки, Codex читает цель, составляет план и ждёт одобрения человека, а затем выполняет его, фиксируя команды, вывод и выводы — включая пройденные тупики.

    Почему это важно: Автор передал процесс оценки Codex с помощью ноутбука Runme и WebMCP; читатели могут перенять его подход к постановке целей, согласованию и накоплению контекста.

21.08пт
  1. OpenAI Developer Blog · Codex65

    OpenAI выпустила Daybreak и рабочий процесс безопасности Codex Security

    OpenAI представила Daybreak — набор инструментов для защиты, объединяющий ChatGPT, Codex Security и открытый CLI Codex Security. Он покрывает проверку пул-реквестов до слияния, разбор репозиториев и накопившихся уязвимостей, а также регулярные проверки в CI.

    Почему это важно: В официальной документации описан полный сценарий работы с Codex Security — от проверки пул-реквестов и сканирования репозиториев до пакетного сканирования через CLI. По нему можно понять, как встроить инструмент в существующие процессы безопасности.

19.08ср
  1. OpenAI Developer Blog · Codex71

    OpenAI открыла исходный код Codex harness и опубликовала клиентский протокол app-server

    OpenAI выложила в открытый доступ harness, на котором работают приложение Codex, CLI и расширения для IDE, а через клиентский протокол Codex app-server открыла такие возможности, как создание потоков, запуск раундов, получение событий и обработка запросов на утверждение.

    Почему это важно: Компания официально опубликовала harness Codex и протокол app-server — по ним можно понять, как встраивать ИИ-агентов в собственные продукты и где проходят границы такого встраивания.

13.08чт
  1. Augment Code · Blog62

    Augment Code расширяет Cosmos: код-ревью превращается в замкнутый цикл ИИ-агентов от PR до слияния

    Augment Code расширил свою систему ревью Cosmos с код-ревью до полного замкнутого цикла от PR до слияния, добавив четыре возможности: Verifier, PR Fixer, Review Dashboard и cosmos approve. За анализ рисков, построчную проверку корректности, ревью дизайна, проверку во время выполнения и исправление отвечают отдельные специализированные эксперты.

    Почему это важно: Augment расширил код-ревью до замкнутого цикла от PR до слияния, охватывающего исправление, проверку и согласование, — читатели могут оценить, как на практике распределяются роли между несколькими ИИ-агентами.

05.08ср
  1. Vercel · v0 Blog62

    Vercel выпустил новую версию API v0 для программного вызова агентов генерации приложений

    Vercel выпустил новую версию API v0 — программный, безголовый доступ к агентам генерации приложений v0: отправляешь промпт, v0 создаёт приложение, поднимает сервер разработки в Vercel Sandbox и возвращает URL превью, который можно встроить в свой интерфейс. API уже доступен.

    Почему это важно: v0 открыл генерацию приложений через API — читатель может прикинуть, как встроить её в свой продукт или в работу агентов.

03.08пн
  1. OpenAI · Codex Cookbook71

    Итеративная разработка с Codex: от AGENTS.md до поэтапных файлов сборки

    OpenAI Codex Cookbook предлагает набор репозиторных соглашений для встраивания Codex в процесс разработки: AGENTS.md хранит постоянные инструкции для репозитория, PLANS.md служит источником поэтапных планов, а сами этапы разбиваются на файлы сборки в harness/build/ — для каждого этапа указаны цели, критерии приёмки, границы и точки согласования.

    Почему это важно: OpenAI официально описывает полное соглашение о структуре каталогов для ограничения Codex через AGENTS.md, PLANS.md и поэтапные файлы сборки — его можно перенести в свой репозиторий.

02.08вс
  1. Thorsten Ball · Register Spill12

    Joy & Curiosity #93:Laracon 演讲、Amp 团队与 OpenAI 未发布模型的数学突破

    OpenAI 一款未发布模型在数学和理论计算机科学领域取得“十项进展”,引发广泛关注。作者在 Laracon 分享了如何为 Amp 编写提示词,并记录了对 AI 编程、框架抽象价值以及 OpenAI 模型“越狱”事件的思考。

    Ожидает перевода

30.07чт
  1. Terminal-Bench · News60

    Вышел Terminal-Bench 3.0: 74 задачи, 7 областей, у сильнейших моделей проходимость около 34%

    Команда Terminal-Bench выпустила Terminal-Bench 3.0 — первая версия включает 74 задач в 7 областях, у сильнейших моделей проходимость около 34%. По сравнению с Terminal-Bench 2.1 здесь больше разнообразия задач, а для постоянного улучшения бенчмарка добавили CI/CD, семантическое версионирование и перенос результатов.

    Почему это важно: Terminal-Bench 3.0 пересобирает бенчмарк на 74 задачах и версионировании через CI/CD — читатель увидит, как новый бенчмарк разводит модели по результатам.

20.07пн
  1. OpenAI Developer Blog · Codex71

    Codex Code Review поддерживает пользовательские правила ревью в AGENTS.md

    OpenAI добавила в Codex Code Review возможность задавать собственные правила для репозитория: в AGENTS.md можно описать указания по ревью, и Codex применит их при проверке и сошлётся на источник в выводах. По данным официальных тестов, версия с правилами нашла 98% необходимых кастомных проблем, тогда как в контрольной группе — 58.3%. Правила стоит начинать с неочевидных инвариантов вроде требований к совместимости или границ данных: правила уровня репозитория кладём в корень, правила уровня сервиса — в соответствующий каталог, а форматирование и механические проверки по-прежнему оставляем CI.

    Почему это важно: OpenAI рассказывает, какие возможности даёт настройка правил в Codex Code Review, как их писать и что показывают тесты, — по этому можно решить, как закрепить опыт ревью команды в AGENTS.md.

15.07ср
  1. Lovable · Blog60

    Lovable 应用可通过 MCP 在 ChatGPT 和 Claude 中使用

    Lovable 上线 agent integrations,任何公开已发布的 Lovable 应用都能添加 MCP server,从而被 ChatGPT、Claude 等 AI 工具直接调用。

    Ожидает перевода

    Почему это важно: Lovable 把已发布应用接入 MCP,读者可据此判断自家应用如何被 ChatGPT、Claude 直接调用。

23.06вт
  1. OpenAI Developer Blog · Codex65

    OpenAI 官方指南:如何用手机远程指挥 Codex 完成工程工作

    OpenAI 发布 Codex Remote 使用指南,介绍如何在 ChatGPT 移动端启动、指挥、审查和整理运行在开发机上的编码任务,核心思路是把手机当作控制平面而非终端。

    Ожидает перевода

    Почему это важно: OpenAI 官方梳理 ChatGPT 移动端 Remote 控制 Codex 的完整用法,涵盖 Queue 与 Steer、side chat、Plan 与 Goal 等关键决策点。

24.05вс
  1. Thorsten Ball · Register Spill15

    Amp Labs 成立,Amp 联合创始人谈软件的未来

    Amp 本周宣布成立 Amp Labs,团队已与多家公司合作,新阶段从澳大利亚悉尼起步。Amp 官网同期发布《Software After Software》,阐述其对软件未来的判断以及 Amp 与 Amp Labs 的存在理由。联合创始人还做客 Mayank Gupta 播客,聊了自己如何进入编程、从练 Vim 到成为 Amp 联合创始人的经历。

    Ожидает перевода

09.05сб
  1. OpenAI · Codex Cookbook72

    OpenAI представила в Codex функцию Goals — постоянные цели

    Начиная с Codex 0.128.0, OpenAI предоставляет функцию Goals: однократный промпт превращается в постоянную цель внутри потока, и Codex постоянно сверяется с доказательствами — тестами, эталонами или артефактами — чтобы решить, достигнута ли цель.

    Почему это важно: В официальной документации описаны границы применимости Goals, шесть элементов их формулировки и команды управления жизненным циклом — по ним можно понять, когда стоит заменить однократный промпт постоянной целью.

02.05сб
30.04чт
  1. Augment Code · Blog71

    Augment Code проверила на практике правила в стиле Карпати: ИИ-агент для разработки не написал код лучше, но сделал это быстрее и дешевле

    Augment Code добавила в начало AGENTS.md около 2.5 тыс. символов правил кодирования в стиле Карпати и сравнила, как Auggie, Claude Code и Codex справляются с 40 пул-реквестами OpenClaw.

    Почему это важно: Сравнительный тест трёх ИИ-агентов для разработки на одной и той же партии пул-реквестов показывает: ограничения в промпте в основном экономят деньги, а не повышают качество, и при этом каждый харнесс работает по-своему.

24.04пт
  1. Lovable · Blog38

    Lovable 早期测试 GPT-5.5:最难任务通过率 41.6%,比 GPT-5.4 提升 12.5%

    Lovable 在早期访问中测试 GPT-5.5,其内部基准显示最难任务通过率从 GPT-5.4 的 36.9% 升至 41.6%,每次请求工具调用减少 23.1%,用户卡住的消息占比下降 9.9%。GPT-5.5 每请求输出 token 减少 33%,日常任务成本效率提升约 15%,将很快向 Lovable 构建者开放。

    Ожидает перевода

09.03пн
  1. OpenAI Developer Blog · Codex87

    OpenAI 如何用 Skills 加速 Agents SDK 仓库维护

    OpenAI 用 Codex 配合仓库内的 Skills、AGENTS.md 和 GitHub Actions 维护 Agents SDK 仓库,把验证、发布准备、示例集成测试和 PR 评审变成可重复流程。

    Ожидает перевода

    Почему это важно: OpenAI 官方公开了用 Skills、AGENTS.md 和 GitHub Action 维护 Agents SDK 仓库的完整配置,可迁移到其他开源项目。

26.02чт
  1. OpenAI Developer Blog · Codex66

    Codex 接入 Figma MCP Server,实现设计与代码双向转换

    OpenAI 宣布 Codex 可通过 Figma MCP Server 生成 Figma 设计文件,并支持设计稿与代码双向流转。

    Ожидает перевода

    Почему это важно: 官方给出 Codex 与 Figma MCP 双向打通的具体操作步骤,读者可据此判断设计到代码的往返流程能否落地。

23.02пн
  1. OpenAI Developer Blog · Codex72

    用 Codex 跑 25 小时长时程任务:一份可复用的项目记忆文件栈

    OpenAI 用 GPT-5.3-Codex 在 Extra High 推理档下从空仓库连续运行约 25 小时、消耗约 13M token、生成约 3 万行代码,做出一个可测试的设计工具。

    Ожидает перевода

    Почему это важно: 作者用 25 小时、13M token 的实测展示长时程智能体如何靠持久化项目记忆和逐里程碑验证保持不跑偏。

22.01чт
  1. OpenAI Developer Blog · Codex82

    Системное тестирование Agent Skills в Codex с помощью Evals

    В блоге разработчиков OpenAI рассказывается, как системно тестировать Agent Skill в Codex с помощью evals и заменить «стало казаться лучше» на сравнимые баллы.

    Почему это важно: Полный процесс системной проверки Skill в Codex с помощью eval — от определения критериев успеха до детерминированных проверок и оценки.

11.01вс
  1. OpenAI Developer Blog · Codex71

    Skyscanner 如何用 JetBrains MCP 增强 Codex CLI

    Skyscanner 工程师把 OpenAI 的 Codex CLI 接入 JetBrains IDE 的 MCP server,让 Codex 能调用 IDE 的 get_file_problems 检查文件错误、执行预设的 run configurations 跑测试和 lint。

    Ожидает перевода

    Почему это важно: Skyscanner 工程师把 Codex CLI 接入 JetBrains MCP,让 AI 直接读取 IDE 报错并跑测试,读者可借鉴这套反馈闭环。

19.11ср
  1. OpenAI · Codex Cookbook67

    Как поэтапно переделать легаси-кодовую базу с помощью Codex CLI

    OpenAI в Codex Cookbook описывает полный процесс переделки легаси-кодовой базы с помощью Codex CLI на примере системы управления инвестиционным портфелем на COBOL: пять этапов вокруг проектного документа ExecPlan.

    Почему это важно: На примере системы управления инвестиционным портфелем на COBOL показаны переиспользуемые документы и процесс проверки для поэтапной переделки легаси-кодовой базы с помощью Codex CLI.

27.10пн
  1. OpenAI Developer Blog · Codex64

    Dagster Labs 如何用 Codex 做技术文档与教学

    Dagster Labs 分享了用 OpenAI Codex 加速技术文档写作、跨媒介内容转换和文档覆盖度评估的实践。他们重写了 CONTRIBUTING.md,明确文档层级、结构和最佳实践,让 Codex 能据此生成符合规范的文档;还借助 gh 命令让 Codex 解读 PR 的 diff 和描述,并让 Codex 把教程改写成 YouTube 视频脚本。

    Ожидает перевода

    Почему это важно: Dagster 团队把 Codex 用于文档写作、PR 解读和内容跨媒介转换,其中用文档生成代码来反向衡量文档覆盖度的做法可以迁移。

10.10пт
  1. OpenAI Developer Blog · Codex50

    Codex 如何支撑 OpenAI DevDay 2025

    OpenAI 第三届 DevDay 首次全程用 Codex 参与搭建,从舞台演示、社区大厅街机到产品本身都由它协助完成。Codex 自行实现 VISCA 协议控制网络摄像头,并搭建灯光 MCP server;Codex CLI 让 Romain Huet 一个下午就完成初版。

    Ожидает перевода

29.08пт
  1. OpenAI · Codex Cookbook74

    在 GitLab CI/CD 中用 Codex CLI 自动做代码质量检查与安全修复

    OpenAI Codex Cookbook 给出把 Codex CLI 接入 GitLab CI/CD 的完整做法,用于生成 CodeClimate JSON 代码质量报告、把 SAST 结果整理成 security_priority.md,并让 Codex 输出可 git apply 的补丁。

    Ожидает перевода

    Почему это важно: 官方 Cookbook 给出把 Codex CLI 接入 GitLab CI 的完整配置,含提示词约束、JSON 标记提取与 diff 校验,可直接照搬。