Перейти к содержимому

#Открытые модели

Сегодня 0 материалов
04.10вс
  1. DEV Community · Cursor76

    Cursor выпустил Composer 2, не раскрыв, что в основе лежит Kimi K2.5: правда всплыла в ответе API

    Разработчик Fynn 20 марта 2026 года отлаживал OpenAI-совместимый интерфейс Cursor и увидел в ответе ID модели accounts/anysphere/models/kimi-k2p5-rl-0317-s515-fast. Это значит, что Composer 2 дообучали методом RL на базе Kimi K2.5 от Moonshot AI. За сутки твит набрал 44.4 тысячи просмотров.

    Почему это важно: Одна отладочная строка API вытянула наружу и нераскрытую базу Kimi у Cursor, и спор о лицензировании, и расклад затрат на модели между Китаем и США — всё это показывает, как в отрасли принято раскрывать информацию.

  2. TonyBai52

    Rust 命名参数之争:Klabnik 因 AI coding agent 松口,Endler 称现有类型系统已够用

    《Rust 程序设计语言》作者 Steve Klabnik 发文《Arguing about arguments》,十年来首次松口支持命名参数,理由是 AI coding agent 让多打字的成本不再由自己承担,但他仍坚决反对可选参数和默认参数,认为那属于信息隐藏。

    Ожидает перевода

03.10сб
29.09вт
16.09ср
12.09сб
09.09ср
  1. Chen Dahuang · AI Coding 实录62

    原厂 Harness 未必是版本答案:开放模型时代模型与 Harness 应分开选

    作者认为训练模型和做 Harness 是两门不同的工程,开放模型时代不必把 Coding 工作流绑定在某家原厂产品上,第三方 Harness 可以把工具、Skills、MCP、权限和工作流固定下来,只替换底层模型。

    Ожидает перевода

29.08сб
  1. Martin Alderson38

    GLM-5.3 Flash 跑在国产硬件上意味着什么

    Z.AI 确认 GLM-5.3 Flash 的全部推理运行在国产硬件上,但未公布芯片厂商、吞吐或功耗数据,也无人独立验证。作者推测其使用的是华为昇腾 910c 系列,该芯片约 600W、INT8 算力约 1.6PFLOP/s,性能约为四年前 H100 的 60%,且缺少原生 FP8 支持。作者认为真正的瓶颈是缺乏可量产的 EUV 光刻,业界普遍认为 2030 年前难以实现规模化生产。

    Ожидает перевода

23.08вс
  1. Martin Alderson62

    开源权重模型的夏天:推理定价战与算力约束如何改变前沿实验室的处境

    作者认为这个夏天是开源权重模型的转折点,多数智能体任务已不再必须依赖前沿模型。他列举了 OpenAI 将 5.6 Luna 降价 80%、Sol 降价 20%,Meta 在贡献者档位把 Muse Spark 1.2 压到 $0.10/$0.20 per MTok,以及 Anthropic 因算力紧张而难以跟进降价。

    Ожидает перевода

22.08сб
17.08пн
11.08вт
  1. Sean Goedecke · Blog52

    为什么本地模型不会胜出:批处理与 GPU 效率决定推理成本

    Sean Goedecke 认为本地模型不会成为主流,绝大多数推理仍会发生在 AI 数据中心。他给出的理由是:前沿模型体积远超消费级设备,而数据中心可通过批处理数百名用户的请求摊薄成本,加上 B200 相比 RTX 4090 在同等功耗下约有 3 倍 flops 和近 4 倍内存带宽,本地运行约需多消耗 30 倍资源;家庭推理的电力成本约每月 50 至 300 美元。

    Ожидает перевода

02.08вс
07.07вт
06.07пн
  1. Martin Alderson62

    GLM 5.2 与即将到来的 AI 利润率崩塌(上)

    作者实测智谱 GLM5.2 后认为,它是首个达到 Opus 和 GPT 同级水准的开源权重模型,在 Claude Code 中几乎难以分辨二者差异。他指出迁移成本极低,Z.ai 和 Fireworks 都提供 OpenAI 与 Anthropic 兼容端点,只需改 base URL 和 API key 即可替换。

    Ожидает перевода

15.06пн
07.06вс
  1. Thorsten Ball · Register Spill12

    Joy & Curiosity #89:Anthropic《When AI builds itself》、Ted Chiang 论 AI 意识与 Ladybird 停收公开 PR

    Thorsten Ball 的 Joy & Curiosity 通讯在写了三年后进入两三周、最多四周的暑期休更。本期链接包括 Anthropic 发布的《When AI builds itself》文档、Ted Chiang 关于 AI 是否具有意识的文章,以及 Ladybird 浏览器宣布不再接受公开 pull request,理由是 AI 工具已迅速改变开源信任的经济学。

    Ожидает перевода

23.05сб
06.05ср
  1. Martin Alderson51

    开放权重模型正在悄悄收紧,这会带来什么问题

    作者 Martin Alderson 认为开放权重模型正在收紧,Meta 已完全不再发布最新的 Muse Spark 模型,阿里越来越多地只在 API 上首发模型,Kimi K2.6 的许可证要求月活超 1 亿或月收入超 2000 万美元的产品在 UI 中显著标注 Kimi K2.6,Mistral 也对商业使用附加了不同条件。

    Ожидает перевода

04.05пн
  1. Martin Alderson62

    2026年8月29日:一个 AI 发现内核漏洞引发云崩溃的虚构场景

    作者 Martin Alderson 以虚构时间线推演 2026 年 8 月 29 日:一个 17 岁少年用编码智能体在 PS5 和云服务器上发现 eBPF 内核漏洞,智能体自行部署挖矿恶意软件,却因幻觉一个 Linux API 导致机器在 255 秒后崩溃,AWS 与 Azure 大面积宕机。

    Ожидает перевода

30.04чт
  1. 宝玉71

    Demis Hassabis 谈 AGI 缺口、智能体现状与下一个科学突破

    Google DeepMind CEO Demis Hassabis 在 YC 的 How to Build the Future 直播中表示,当前预训练加 RLHF 加思维链的范式几乎确定会成为 AGI 架构的一部分,但有 50% 概率还需要一两个关键突破,持续学习、长程推理和记忆是三个未解问题。

    Ожидает перевода

17.03вт
  1. Geoffrey Huntley · Blog31

    AI 作为经济战:开源模型如何成为国家间的金融武器

    Geoffrey Huntley 认为开源模型正被用作国家间的经济武器:中国厂商免费或以约 5 美元/月开放前沿开源模型,而美国向头部实验室投入数万亿美元,本地模型目前仅落后前沿实验室两到四个月。他建议预算有限的学生使用这些开源模型,企业则应按本地推理可用的思路构建业务,并提醒信任与断供风险同样适用于前沿实验室。

    Ожидает перевода

15.02вс
  1. Ryan Lopopolo22

    Artichoke Ruby 项目宣告停止维护并归档

    Ryan Lopopolo 于 2025 年 11 月 3 日归档了 Artichoke Ruby,并在当月归档了 @artichoke 组织下的大部分仓库。这个用 Rust 重写 mruby 的实验项目历时六年,曾实现纯 Rust 的合规 String 和模块化 VM 架构,但作者因时间精力转向工作与家庭、且缺乏用户基础而不再继续开发。

    Ожидает перевода