用 GPT-Live-1 和 Codex 把 LED 显示屏变成语音助手 Jack
开发者用 Raspberry Pi、128 × 64 HUB75 LED 面板、Codex 和 GPT-Live-1 全双工语音模型,把一块航班追踪屏改造成语音助手 Jack。
开发者用 Raspberry Pi、128 × 64 HUB75 LED 面板、Codex 和 GPT-Live-1 全双工语音模型,把一块航班追踪屏改造成语音助手 Jack。
MiMo-V2.6-Pro debuts as the top open weights model on the Artificial Analysis Intelligence Index (46). At $0.13 per Intelligence Index task, it lands on the Intelligence vs. Cost per Task Pareto frontier @Xiaomi has just released MiMo-V2.6-Pro, an open weights model with major advances in intelligence over its predecessor, MiMo-V2.5-Pro (Intelligence Index: 26). Despite the improvement, it retains the same attractive pricing at $0.435 per 1M input tokens (with a 99% cache-hit discount) and $0.87 per 1M output tokens. This makes MiMo-V2.6-Pro one of the most cost-efficient models to deploy. MiMo-V2.6-Pro is an MoE model with 1.02T total parameters and 42B active parameters. Stay tuned for additional analysis of the model. Check out MiMo-V2.6-Pro full benchmarking breakdown here: https://artificialanalysis.ai
Lovable 与 AWS、CrowdStrike、Databricks、Docker、Google Cloud、Okta、Proofpoint、Salesforce、ServiceNow、Wiz、Zscaler 共同成为 Blueprint Alliance 创始成员,该联盟推动面向企业级 AI 智能体安全与治理的开放参考架构。
Thorsten Ball 在 Register Spill 中称 Jev 不是 LLM,而是“为软件直接使用的快速结构化决策”而建的模型,TypeSafe 将其描述为“非结构化状态输入、带类型的概率决策输出”的前沿智能函数调用。
Lovable 宣布收购 Sutro,Sutro 团队过去五年构建了语言、编译器和后端平台,让应用行为与规则显式化。Sutro 创始人 Tomas Halgas 及三名工程师 Max Gfeller、Tony Zhan、Hirad Arshadi 加入 Lovable,Tomas 将负责 Lovable 的技术布道。
Mitchell Hashimoto 提出“白板答辩”标准:任何面向客户的系统,开发者都应能随时被叫住,清楚解释其工作原理并为自己的决策辩护,这是他对负责任使用 AI 的衡量标准。
Lovable 接入 Salesforce 的 Headless 360,用户可用自然语言构建应用与智能体,直接读写 Accounts、Contacts、Leads、Cases 和 Opportunities,并沿用 Salesforce 的身份与权限。
Lovable 发布用 Rust 从零实现的预览引擎 OJ,它读取现有 vite.config.ts 并通过兼容层运行真实 Vite 插件,单个二进制、不向项目安装工具链。
推荐理由:Lovable 用 Rust 重写预览引擎 OJ,给出与 Vite 的冷启动和内存对比,以及生产环境灰度数据。
Cline 发布开源桌面应用 Cline Desktop 的早期版本,把原本在 VS Code 扩展和 CLI 中的智能体运行框架搬进独立工作区,支持并行会话、定时任务和用于扩展工具与集成的 Marketplace。
推荐理由:官方给出桌面端的能力边界与开放入口,读者可据此判断它是否适合承接多智能体并行任务。
Thorsten Ball 在 Register Spill 中称 Fable 5.1 和 GPT-6 Astra 带来质变,基准分数从 65% 升到 79% 也无法体现这种变化。
GitHub 日本和韩国市场的营销负责人把活动运营流程自动化:用 Issue 表单收集活动信息,用 event-setup 标签触发 GitHub Actions,自动复制落地页、生成 UTM 链接、提交邀请邮件并同步项目看板,原本要花近一天的工作缩短到几分钟。
GitHub Copilot 应用内置 diff、终端和浏览器三个面板,让开发者无需在编辑器、终端和浏览器之间切换即可完成 AI 编码闭环。diff 面板用绿色和红色高亮显示代码的新增、删除和修改,支持接受更改、留下评论或让 Copilot 继续修改;终端面板可直接运行项目命令并支持多窗口切换;浏览器面板则能预览界面并用 Pick & Polish 工具选中元素让智能体调整。
斯德哥尔摩地面工程公司老板 Kedde 与一位懂技术的朋友用 Lovable 搭建物流平台 Kbag,三周、约 500 美元成本做出首个版本,以实时地址定价取代传统分区定价,并通过 API 接入 Volvo Connect Fleet Management 获取车辆路线、油耗、载重与司机剩余驾驶时间数据。
OpenAI 官方博客针对 GPT-6 Astra 给出 Skills、AGENTS.md 和任务提示词的调整建议:Skill 描述要尽量短且明确适用场景,多流程 Skill 用根文档做最小路由,避免把 Skill 写成过于具体的步骤清单。
推荐理由:OpenAI 官方给出 GPT-6 Astra 下 Skills、AGENTS.md 与提示词的清理方法,可迁移到现有仓库配置。
Cursor 推出「项目」功能,用于承接一项功能、一次迁移或一个完整应用这类长周期工作,可在数月内保持上下文并把任务委派给成千上万个子智能体。项目由云端智能体驱动,协调智能体不写代码,只负责规划、分派并交回成果,需要本机测试时再启动本地智能体;每个项目维护一组在云端和本地机器间同步的文件,持续积累研究成果、artifacts 和对代码库的了解。
推荐理由:官方给出项目式多智能体协作的上下文共享与自动触发机制,可据此判断长周期任务如何被接管。
Lovable 正式启动 Partner Program,分为面向独立开发者和小型机构的 Expert 与面向咨询公司、系统集成商的 Solution Partner 两条路径,并提供 Partner Directory 供企业查找和雇佣伙伴。
Lovable 上线 drafts 功能,为项目创建带独立对话和预览的副本,团队可并行探索同一项目的多个版本,改动只有接受并发布后才会应用到线上应用。该功能适用于任何项目,首个版本仅覆盖前端改动,涉及数据库结构或登录设置的修改仍需在项目对话中完成。
Thorsten Ball 在 Register Spill 的 Joy & Curiosity #98 中借用《反脆弱》里的扁桃体切除研究,提出工程师对 Sol、Fable、Astra 等模型输出的“代码差、注释蠢”评价,可能源于“天真干预主义”偏见——AI 已在 20 分钟内端到端完成前后端改动、内外部文档和测试,并在无头浏览器中跑完全流程、附上录屏为证。
GitHub 在 Copilot CLI 中以研究预览形式推出 Project HydraFusion,通过运行时编排在多个提供商的模型间选择执行方案,用户像选普通模型一样选择它,按各模型标准费率计费。
推荐理由:GitHub 官方给出 HydraFusion 的三种编排模式与三项基准的成本质量对比,可据此判断多模型编排在真实编码任务中的取舍。
作者在 Codex 中用 Astra 构建了太空探索游戏 Void Explorer,包含 2,048 个恒星系和超过 10,000 个程序化生成的行星,并分享了从提示词到架构、测试和性能测量的完整流程。
推荐理由:作者用 Astra 在 Codex 中做完整游戏,展示了从提示词到测试、性能测量的可迁移协作流程。
用户向 Codex 中的 Astra 描述一栋极简住宅的需求,Astra 通过 Blender Python API(bpy)生成可编辑 3D 场景,完成建筑、家具、材质、灯光与相机,并自行检查预览渲染、修正细节。项目从带家具的起居亭扩展为围绕庭院布局的 U 型单层住宅,含三间卧室、办公室、浴室和更衣室,随后导出到 Unreal Engine 5 探索实时漫游。
GitHub Copilot 应用支持同时运行多个 AI 智能体会话,每个会话运行在独立的 Git worktree 上,互不干扰,可并行推进同一项目的不同任务。每个会话保留各自的上下文,切换时无需重新说明,用户可在会话视图中查看进度并审阅结果。
Cline 把 VS Code 扩展从约 76,000 行单体核心迁移到 Cline SDK,并自建灰度发布机制:一个安装包内打包 loader、legacy 和 next 两套扩展,由 PostHog 功能开关按百分比决定激活哪套,崩溃时自动回退到 legacy,开关可随时降到 0% 作为 kill switch。
推荐理由:Cline 官方复盘如何把 1100 万用户的 VS Code 扩展迁到新 harness,含灰度机制与前后指标对比。
Mitchell Hashimoto 公布 Superlogical 服务器内存测试结果:在繁忙终端和客户端规模下,其内存占用显著低于 tmux 及其他复用器,而 tmux 空载状态表现优秀。
GitHub Copilot 团队复盘了四项降低 AI 编码成本的改动,核心原则是按完整任务而非单次工具调用衡量效率。
推荐理由:GitHub Copilot 团队复盘四项降本改动,并给出可迁移的评估方法:按完整任务而非单次工具调用衡量成本。
Cursor 支持自托管机器,代码库、构建产物和密钥都保留在自有基础设施的内部机器上,由智能体在本地处理工具调用。My Machines 用于把单台笔记本或 VM 接入个人工作流,团队池则是面向团队或企业的具名 worker 队列,容量随请求扩容、worker 断开时缩容,池不与代码仓库绑定,并支持闲置机器休眠后在重连窗口内恢复。
推荐理由:官方给出自托管机器的池化调度与沙箱接入方式,读者可据此判断工具执行能否留在自有网络内。
Lovable 现已接入 Fable 5.1,早期测试显示其在修复和改进现有应用上比 Fable 5 最高提升 17%,单任务成本最多降低 31%。该模型在中等和高推理强度下的 UI 与视觉设计质量最高提升 3.5%,并会在完成任务前打开浏览器运行应用进行自我验证。Lovable 正将卡住的会话以及更长、更复杂的任务路由到 Fable 5.1。
Thorsten Ball 在 Joy & Curiosity #97 中提出,AI 智能体让 bug 的发现和修复更快、可并行、可异步,开发者应重新校准代码库能容忍的 bug 数量。
Terminal-Bench 发布 4.0 版本,校准任务的时间、CPU 和内存资源,修复 19 个任务并移除 8 个饱和或存在质量问题的任务,所有任务统一设为 8 小时 agent 超时。
Cursor 云端智能体不再需要连接 GitHub 或其他第三方 SCM 提供商,用户可直接输入提示开始工作,Cursor 会在后台创建 Origin 代码仓库。满意后可点击“创建代码仓库”将工作保存到 Origin,并设置私有或内部可见性。Cursor 还能通过端口转发在浏览器中实时预览云端智能体环境,连接 Vercel 账户后点击“发布”即可生成可访问 URL。
斯坦福大学研究人员主导、Terminal-Bench 团队联合全球科研机构专家打造的 Terminal-Bench-Science 0.1 发布,首批含生命、物理、地球、数学和工程科学领域的 70 项任务。
Cline 让八个模型在自家 harness 里做 IMO 2026 六道题,证明由 GPT-5.5 和 Claude Opus 5 双盲按 0–7 分制评分、Gemini 3.1 Pro 仲裁,金牌线为 29 分。
推荐理由:Cline 用同一套 harness 盲评八个模型做 IMO 2026,给出分数与单次成本对照,可看开源权重模型的实际性价比。
GitHub Copilot 应用支持用自动化分诊 Dependabot pull request:用自然语言描述任务,按风险分组、识别安全的补丁与次版本更新、核验 CI 状态并给出摘要。自动化可选手动、每小时、每天、每周或 issue 创建时触发,也可选择在云端或本地运行,每次运行记录都会保存。
Cline 团队用 Cline SDK 搭了一个代码审查智能体,把审查拆成 review 与 judge 两段 agent 循环,再由驱动脚本把存活的问题以一条 COMMENT 事件批量提交到 GitHub PR。
推荐理由:完整拆解一个代码审查智能体的插件、Hook 与两段式循环,可迁移到其他自动化审查场景。