Перейти к содержимому

#Qwen

Сегодня 0 материалов
05.10пн
04.10вс
  1. DEV Community · Vibe Coding38

    Qwen 3.6 Plus против Claude Opus 4.6: что из этого действительно годится для продакшена?

    Разработчик сравнил Qwen 3.6 Plus и Claude Opus 4.6 в продакшене: время ответа Qwen 3.6 Plus снизилось с 39.1 секунды у Qwen 3.5 Plus до 13.9 секунды, на OpenRouter модель бесплатна, но ограничена 65,536 токенами на выходе — это вдвое меньше, чем 128,000 у Claude Opus 4.6.

  2. DEV Community · Cursor76

    Cursor выпустил Composer 2, не раскрыв, что в основе лежит Kimi K2.5: правда всплыла в ответе API

    Разработчик Fynn 20 марта 2026 года отлаживал OpenAI-совместимый интерфейс Cursor и увидел в ответе ID модели accounts/anysphere/models/kimi-k2p5-rl-0317-s515-fast. Это значит, что Composer 2 дообучали методом RL на базе Kimi K2.5 от Moonshot AI. За сутки твит набрал 44.4 тысячи просмотров.

    Почему это важно: Одна отладочная строка API вытянула наружу и нераскрытую базу Kimi у Cursor, и спор о лицензировании, и расклад затрат на модели между Китаем и США — всё это показывает, как в отрасли принято раскрывать информацию.

03.10сб
02.10пт
  1. Shreya Shankar36

    用决策模型(如 Jev)逐行调用 API 处理数千行数据效率极低,无法利用查询规划。在单张 H100 上,Qwen3-4B 对 5k 条电影评论做一次 AI 过滤的理论最快速度约为 6.6 秒,目前包括开源 AI-SQL 引擎 Quail 在内的任何系统都远未接近。新博客文章介绍了 Quail 如何基于这一速度上限估算 AI 过滤器的成本。

    Ожидает перевода

01.10чт
  1. Paper Compute · Engineering Blog62

    用自己智能体会话的标注数据微调编码模型

    作者搭建了一条流水线,把 Paper Compute 导出的带标签编码智能体会话用于微调模型:会话、轮次和标签先导入 Databricks 的 Unity Catalog,再用 golden、regression、pushback、apology、no-outcome 等标签筛选训练样本和评测用例。

    Ожидает перевода

30.09ср
  1. Habr · Вайбкодинг20

    Гига Писарь 发布 Mac 端大更新:重做设置界面并减少打扰

    Гига Писарь 为 Mac 端推出其史上最明显的更新,设置窗口按 macOS 系统设置风格完全重做,用左侧分区、卡片和图片取代原来的四个标签页与表格。新增「Мозг」区域可用 GigaChat 或 Qwen 本地模型改写听写文本,本地模型约 2GB 起、可一键删除,并支持多个云端服务按各自密钥切换。更新提示改为菜单栏图标上的小红点,不再弹出窗口打断用户。

    Ожидает перевода

  2. 快刀青衣36

    Meta Muse 火了,但个人 AI 助手真正要过的是平台和用户两道门槛

    Meta 的 AI 助手 Muse 上线不到三周下载量超 340 万次,登上美国 App Store 免费榜第一,超 8 万条评分达 4.9 分。它靠读取邮箱识别遗忘订阅并代为取消、接入 Stripe 旗下 Link 完成付款,切中省钱这类琐碎生活场景。

    Ожидает перевода

27.09вс
  1. Tproger · Программирование32

    Qwen Code 0.24.6 发布:引入 Managed Runtime v2 与受管会话恢复

    Qwen Code 0.24.6 发布,新增 Managed Runtime v2 契约,支持启动、状态查询和取消操作,并加入受管会话日志与故障后切换机制。CLI 新增 /batch-api 批处理场景,Java SDK 获得 Hosted Harness 客户端及重启后绑定恢复能力。官方称冷启动时 CLI 就绪时间减半、RSS 内存占用降低 60%,但未提供独立验证结果。

    Ожидает перевода

22.09вт
  1. Paper Compute · Engineering Blog48

    Paper Compute 实验:用 Jev 给智能体会话打标签,188 ms 中位延迟、100% 召回

    Paper Compute 工程师用 TypeSafe 的 Jev 做智能体会话标签实验,在 1,781 条工程师对话轮次上,Jev 1.13.0 中位响应 188 ms,比 GPT-4o mini 的 1,023 ms 和 Claude Haiku 4.5 的 1,050 ms 快约 5.4 倍和 5.6 倍,本地 Qwen3 8B 为 2,311 ms。

    Ожидает перевода

21.09пн
  1. The Agentic Engineer · Blog80

    Как запустить Claude Code с любой моделью через OpenRouter

    Автор рассказывает, как подключить Claude Code к любой модели через OpenRouter: достаточно положить OPENROUTER_API_KEY в ~/.config/openrouter.env.

    Почему это важно: На примере примерно двадцати строк shell автор показывает, как отвязать harness Claude Code от конкретной модели, и подробно разбирает маршрутизацию по четырём слотам моделей и подводные камни.

18.09пт
15.09вт
  1. Sebastian Raschka36

    Sebastian Raschka 用 Paint UI 复刻同一张图,对比 GPT-5.6 Astra 与 Qwen3.8 Max 的计算机使用(视觉)能力:Astra 默认用几何图形分层绘制,Qwen 则逐像素还原,后者结果天然更接近原图、得分会更高。但他认为不能据此断定 Qwen 的计算机使用或视觉理解更强,这恰恰说明只看最终结果的 benchmark 有多不可靠。

    Ожидает перевода

02.09ср
17.08пн
06.08чт
  1. Chen Dahuang · AI Coding 实录38

    给 DeepSeek V4 Flash 补上多模态:用 Qwen-3.7-Flash 识图的路由方案

    DeepSeek V4 Flash 缺多模态能力,可用 Qwen-3.7-Flash 作视觉补充,通过路由组合补齐读图场景。方案是输入带图片走 Qwen-3.7-Flash 识图并输出结构化描述,纯文本继续走 V4 Flash 推理,也可把描述交给 V4 Flash 做深度推理、写代码和总结。

    Ожидает перевода

08.07ср
  1. Martin Fowler · Exploring Generative AI71

    在本地小模型上做智能体编码的实测体验

    Martin Fowler 在 M3 Max 48GB 和 M5 Pro 64GB 上实测 Qwen3.6 35B MoE、Gemma 4 31B/26B、Qwen Coder Next 80B 等本地小模型的智能体编码能力,按内存、速度、工具调用、代码正确性、上下文、任务复杂度、代码质量逐层筛选。

    Ожидает перевода

    Почему это важно: 作者用两个具体任务对比多款本地小模型的智能体编码表现,并给出可复用的任务选择标准。

07.07вт
22.06пн
06.05ср
  1. Martin Alderson51

    开放权重模型正在悄悄收紧,这会带来什么问题

    作者 Martin Alderson 认为开放权重模型正在收紧,Meta 已完全不再发布最新的 Muse Spark 模型,阿里越来越多地只在 API 上首发模型,Kimi K2.6 的许可证要求月活超 1 亿或月收入超 2000 万美元的产品在 UI 中显著标注 Kimi K2.6,Mistral 也对商业使用附加了不同条件。

    Ожидает перевода

04.05пн
  1. Martin Alderson62

    2026年8月29日:一个 AI 发现内核漏洞引发云崩溃的虚构场景

    作者 Martin Alderson 以虚构时间线推演 2026 年 8 月 29 日:一个 17 岁少年用编码智能体在 PS5 和云服务器上发现 eBPF 内核漏洞,智能体自行部署挖矿恶意软件,却因幻觉一个 Linux API 导致机器在 255 秒后崩溃,AWS 与 Azure 大面积宕机。

    Ожидает перевода

13.03пт
  1. Martin Alderson78

    Как распознавать документы через OCR с помощью моделей серии Qwen 3.5

    Автор прогнал PDF через OCR с помощью открытых мультимодальных моделей серии Qwen 3.5: сначала экспортировал каждую страницу в изображение с разрешением 100 dpi через PyMuPDF, а затем отдал его модели на распознавание. По результатам тестов Qwen3.5-9B — это баланс между качеством и скоростью, а модели поменьше, от 0.8B до 2B, на сложных документах часто сбиваются и начинают пересказывать содержимое.

    Почему это важно: Автор протестировал модели Qwen 3.5 разных размеров на OCR для PDF и описал два воспроизводимых пути — локальный и через OpenRouter — вместе с данными о затратах.

07.03сб
  1. Martin Alderson66

    AI 算力紧缺已经到来:从 Anthropic 降级产品看推理供给压力

    作者认为 AI 算力紧缺已经不是“即将到来”而是正在发生。Anthropic 上周可用性一度跌到“一个 9”,员工称源于难以预测的增长,公司为此把 Opus 4.6 默认 effort 降到 medium、在 Claude Code 中暂时移除 Opus 4、4.1 和 Sonnet 4.5,并关闭 prompt suggestions。

    Ожидает перевода