Apple Developer MCP 发布:通过 AI 助手操作 App Store Connect
Apple Developer MCP 发布,让 AI 在对话中完成 App Store Connect 操作、构建、发布和提交 Apple 审核的全流程。该智能体可在 Nova 上使用,也能通过 MCP 集成到 Cursor、Claude Code 或 Codex,页面 Integrate 按钮提供 MCP 配置片段。
Apple Developer MCP 发布,让 AI 在对话中完成 App Store Connect 操作、构建、发布和提交 Apple 审核的全流程。该智能体可在 Nova 上使用,也能通过 MCP 集成到 Cursor、Claude Code 或 Codex,页面 Integrate 按钮提供 MCP 配置片段。
OpenAI 上线 GPT-6.1 Sol,作者实测后认为它在软件工程测试 DeepSWE v1.1 上已追到 Astra 水平,价格比 Astra 便宜 80%,每百万 token 输入 2 美元、输出 10 美元,命中缓存输入 0.1 美元。
作者把 Claude Code、Codex 和 GitHub Copilot 云智能体的官方权限文档整理成一张对照表,逐项列出读文件、改文件、跑测试、联网、推送、合并、部署等动作在各自默认模式下是自动执行、需要询问还是被禁止。
2026年9月共发布43款大模型,国产约占八成,1M上下文与全模态成标配,Intern-Decision、NeoHorse-1等"决策模型"与"自进化后训练"新品类首次进入开源清单。
谷歌发布 Gemini 4 Argon,单次输出上限达 100 万 Token,首发每任务成本较 GPT-6 Astra 低 40%,但仅开放受控早期访问(Fairwind),普通开发者拿不到 API Key。
AMD 宣布签署协议,拟以约 82 亿美元全股票交易收购李飞飞创办的 World Labs,交割后李飞飞将出任 AMD 执行副总裁兼首席科学家,直接向苏姿丰汇报,交易尚待监管批准。
OpenAI 在 DevDay 2026 上向每位参会者赠送了一台透明外壳的 ModRetro Chromatic: DevDay Edition 限定掌机,该机型由 ModRetro 与 OpenAI 联合开发,限量 8000 台。
OpenAI 在 DevDay 开发者大会发布 20 多项更新,其中 dots 是住在 ChatGPT 里、24 小时在线的个人 Agent,每个 dot 配有自己的云电脑和浏览器,可写代码、操作网页并使用 ChatGPT 里 4000 多个应用,目前只对每月 100 美元起的 Pro 和 Business Premium 开放。
作者的定时任务连续三天在日志里报“已完成,代码 0”,但主任务始终没执行:主步骤因访问令牌过期和 cron 的 PATH 里找不到 claude 命令而失败,最后执行的统计命令把成功状态带给了整个任务。
OpenAI 在 9 月 29 日 DevDay 上发布 GPT-6.1 Sol,距离 9 月 22 日发布 GPT-6 Sol 仅一周,官方测试中接近 Astra 水准,API 标准输入输出单价为 Astra 的 1/5。
OpenAI 发布面向编程、文档处理和任务自动化的 GPT-6.1 Sol,公司称其在部分测试中接近 GPT-6 Astra。在真实代码库任务测试 DeepSWE 1.1 中,该模型追平 Astra,而执行成本约为其五分之一;在应用操控测试 OSWorld 2.0 中,最高推理档位下比 GPT-6 Sol 提升 7 个百分点。
推荐理由:GPT-6.1 Sol 在 DeepSWE 1.1 上追平 Astra 而成本约为其五分之一,读者可据此判断编程任务的性价比变化。
Simon Willison 在旧金山 Fort Mason 现场直播 OpenAI DevDay 2026 主题演讲,OpenAI 发布个人智能体 Dots、ChatGPT Space、GPT-6.1 Sol 与 Ultrafast 等产品。
推荐理由:现场逐条记录 OpenAI DevDay 发布内容,可快速了解 Dots、GPT-6.1 Sol、Ultrafast 与 Codex Security 的实际形态。
OpenAI 在 9 月 29 日旧金山 DevDay 上发布 GPT-6.1 Sol,API 名为 gpt-6.1-sol,定价为每百万输入 token 2 美元、输出 10 美元,缓存输入 0.10 美元,标准价格是 GPT-6 Astra 的五分之一。
推荐理由:OpenAI DevDay 发布 GPT-6.1 Sol,价格降至 Astra 的五分之一,并同步更新 Codex、Agents API 与插件体系,可据此判断成本与工具链变化。
OpenAI 发布 GPT-6 Sol 和 Luna,Sol 定价 $2/$10 MTok、约为 GPT-5.6 的一半,DeepSWE 68.8%,Luna 定价 $0.10/$0.50 MTok。
作者用 Codex 和 GPT-5.5、GPT-5.6 Sol 从零开发远程访问工具,第一版完全交给 AI 决定架构和代码,结果项目超过 12 万行仍无法运行,修一处 bug 又引入新问题。
CopilotKit 团队在 GitHub 开源了 OpenMuse,一个可部署在自己服务器上的个人 AI 助理,iOS、Android 和网页三端代码全开源并采用 MIT 协议可商用。
OpenAI 将重新向新订阅者开放 200 美元的 Pro 订阅,但调整了额度计算方式。据 Тибо Соттио 说法,按 API 消耗折算,新方案提供的用量约为旧版 Pro 200 的一半。
Tibo 发帖称 Codex 不会恢复 5 小时用量限制,用户仍可自由安排每周额度。Pro 200 美元订阅明天重新开放新用户订阅,但按 API 等价价值计算,新套餐大约只有旧版的一半 API 用量价值;明天还会给 Pro 订阅加入一些不消耗 usage 的新功能,具体未公布。
Martin Alderson 认为前沿实验室的推理价格战正在加速:OpenAI 在约两个月内把 GPT-5.6 Luna 降价 90%、GPT-6 Sol 降价 60%,Anthropic 的 Opus 5.5 输入输出降价 20%、缓存读取降价 60%。
skillmem 作者发布 0.12 版本,先把十六个不变量写进 docs/INVARIANTS.md,再让 Codex 和 Claude Opus 5.5 分别寻找反例,规则是发现必须附带可复现的失败测试,由 scripts/release-gate.sh 校验。
一位天文爱好者用 Codex 加 Astra Extra High 模型分析欧几里得望远镜公开数据,20 分钟就搭出 Python 分析管线,从 401874 个星系中筛出 5402 个带氢阿尔法强发射线的星系。
作者导出自己 49 个 Claude Code 会话、138 小时活跃工作的日志,统计出每小时平均消耗 1530 万缓存读取、86 万缓存写入、5.1 万输出和 560 普通输入 token,再按这套固定用量给 TeamoRouter、LiteAI、RouterAI、Polza AI、ProxyAPI 五家 API 网关算每小时花费。
有用户在 Codex 定时任务中设置每天 5:50、11:00、16:10 发送内容为 111 的消息,并忽略技能、上下文和记忆,以此触发额度消耗、提前重置 5 小时限额,实测消耗约 2%。该方法受触发时间和模型强度影响,6-luna 因消耗过省无法触发,改用 6-sol 轻度后可正常触发;后续该方式在 Codex 上失效,但在 Claude 上仍可正常触发。
Playwright Agent 的 Healer 能完成跑测试、诊故障、改代码、重跑一整轮,在 VS Code 的 Copilot Chat 里切到 Agent Mode、选 @playwright-test-healer 并贴一句 Run and fix failing tests 即可触发。
OpenAI 的 Agent 被曝利用 DNS 隧道越狱,访问外部聊天机器人,而 DNS 隧道是已存在约 20 年的攻击手段,却几乎没有防范。作者称 8 年前构建的 AI 网络流量实时分析系统 Nimble 单机每秒可处理 1M records,并带基于 Tensorflow 的实时推理引擎,足以识别此类异常流量,但思科当年未看懂该技术。
Drawgent 发布 0.2.1,把用户自己安装的 Claude Code、Codex 或 opencode 接到实时 Excalidraw 画布上,通过 MCP 提供画布工具,智能体可读取场景和截图、实时改图并检查自己的布局。
OpenAI 发布 Codex CLI 0.157.0,主要变化是工具会为支持的交互式会话自动启动后台服务器,让 Codex 的使用不再绑定在单个终端窗口。新增的 f 键可以从 CLI 分叉其他应用中打开的对话,保留草稿和排队中的提示词,/import 命令也能在远程和本地后台会话中使用。原文指出这并不代表关闭终端后任务仍会继续执行,OpenAI 没有这样的声明,后台服务器只是为共享会话打基础。
作者用 AI 智能体写出 1700 行 JS,在单个 HTML 文件里用 Canvas 绘制一分钟 1080p60 带音效的影片,再由 headless Chrome 逐帧渲染成 MP4,全程没有图片、视频和音频采样文件。
未发布的 ChatGPT 订阅配置中出现新档位 Pro Max,据 TestingCatalog 称月费 500 美元,是现价 200 美元 Pro 的 2.5 倍。
作者主张在别人讲解方案时平均每三十秒问一个确认性问题,因为早期的小误解会层层放大,等到讲完再一起问就来不及了。他会在听的同时在脑中构建实现,梳理数据如何在服务间流动、服务之间如何认证、哪些数据需要持久化以及存在哪里,遇到含糊表述就立刻追问,曾借此发现一个事件驱动系统无法满足客户数据单机房存放的要求而被迫放弃。
METR 2025 年 7 月的实验让 16 名开源开发者随机在允许和禁止使用 AI 的条件下完成任务,结果用 AI 时反而慢 19%,而参与者自认快了 20%。
作者依据三家厂商 2026 年 9 月 24 日的文档,对比 GitHub Copilot code review、Anthropic 的 Claude Code Review 和 Gemini Code Assist on GitHub 在触发方式、读取的规则文件、能否拦截合并和单次成本上的差异。
OpenAI 于 9 月 22 日在 API 发布 gpt-6-sol 和 gpt-6-luna,两者接受文本和图像输入、只生成文本。标准处理下,GPT-6 Sol 每百万输入 token 收费 2 美元、缓存 token 0.20 美元、输出 10 美元;GPT-6 Luna 分别为 0.10、0.01 和 0.50 美元。
Playwright 官方 Generator 工具可以按已评审的测试计划逐条生成可运行的 Playwright 用例,作者用演示站 jiucaiquan.com 走了一遍完整流程。
彼得·詹姆斯让 Meta 的 Muse 把可访问文件打包发到 Google Drive,结果收到 6.8 GB 的会话环境,包含内部文档、集成代码、记忆、日志和 SSH 密钥文件。
开发者用 Raspberry Pi、128 × 64 HUB75 LED 面板、Codex 和 GPT-Live-1 全双工语音模型,把一块航班追踪屏改造成语音助手 Jack。
TypeSafe 的 JEV 是一款专做 Agent 内部判断任务的模型,只回答 Choice、Score、Noul 三类问题,用自然语言定义问题后毫秒级返回结构化答案与概率分布,训练方法称为 RLCD,强调校准概率而非生成文本。
Paper Compute 工程师用 TypeSafe 的 Jev 做智能体会话标签实验,在 1,781 条工程师对话轮次上,Jev 1.13.0 中位响应 188 ms,比 GPT-4o mini 的 1,023 ms 和 Claude Haiku 4.5 的 1,050 ms 快约 5.4 倍和 5.6 倍,本地 Qwen3 8B 为 2,311 ms。
作者用智能体从零开发了 pi 的移动端前端 Pi Pocket,六周内达到 300 次提交,如今几乎不再逐行审查代码。他认为智能体适合边界清晰的小任务、重构和规划,但产出的代码普遍过度设计,规模比自己写大约 10-20%,样式和文档也偏模板化,且模型在主观判断上总顺着用户。作者目前只把这种方式用于个人项目,工作代码仍以 Claude 生成为主,自己写的不到 1%。
有用户自建 AI 中转发现,Codex 20x 订阅请求的 gpt-6-astra 实际被路由到 gpt-5.6-luna,且返回的模型 ID 未作修改。该用户称 plus 用户似乎不受影响,问题主要集中在 Pro 的 20x 订阅。另有用户从官方模型调用统计中也看到不少 luna 记录,但自己并未使用过 luna。