Google DeepMind 发布 Gemini 4 Argon,输出上限提至 1M tokens
Google DeepMind 发布 Gemini 4 Argon,单次输出上限从 64K 提升到 1M tokens,主打长任务与多步骤推理。
Ожидает перевода
Почему это важно: 汇总了 Gemini 4 Argon 的官方评测数据与 Google 内部落地案例,可对照各家旗舰模型的能力差异。
Релизы ведущих моделей и изменения их возможностей в программировании.
Google DeepMind 发布 Gemini 4 Argon,单次输出上限从 64K 提升到 1M tokens,主打长任务与多步骤推理。
Ожидает перевода
Почему это важно: 汇总了 Gemini 4 Argon 的官方评测数据与 Google 内部落地案例,可对照各家旗舰模型的能力差异。
OpenAI выпустила GPT-6.1 Sol для программирования, работы с документами и автоматизации задач. По словам компании, в部分 тестах модель почти догнала GPT-6 Astra. В тесте DeepSWE 1.1 на задачах с реальными кодовыми базами она сравнялась с Astra, а стоимость выполнения оказалась примерно в пять раз ниже. В тесте OSWorld 2.0 на управлении приложениями при максимальном уровне рассуждений модель обошла GPT-6 Sol на 7 процентных пунктов.
Почему это важно: GPT-6.1 Sol сравнялась с Astra на DeepSWE 1.1, а стоимость — примерно в пять раз ниже; по этим данным можно судить, как изменилось соотношение цены и качества для задач программирования.
29 сентября на DevDay в Сан-Франциско OpenAI представила GPT-6.1 Sol; API называется gpt-6.1-sol, цена — 2 доллара за миллион входных токенов и 10 долларов за миллион выходных, кэшированный ввод — 0.10 доллара. Это пятая часть стандартной цены GPT-6 Astra.
Почему это важно: На DevDay OpenAI выпустила GPT-6.1 Sol, снизив цену до пятой части от Astra, а заодно обновила Codex, Agents API и систему плагинов — по этим изменениям можно оценить затраты и эволюцию инструментария.
22 сентября Anthropic выпустила флагманскую модель Claude Opus 5.5 — для разработчиков и команд, которые поручают ИИ-агентам многошаговые задачи вроде программирования и анализа данных. По заявлению компании, по сравнению с Opus 5 модель работает быстрее и стоит дешевле.
Почему это важно: Опубликованные Anthropic цены и снижение стоимости при типовой нагрузке помогут разработчикам оценить затраты на переход к длительным задачам ИИ-агентов.
NVIDIA выпустила Nemotron 3.5 Lightning — настраиваемую открытую модель для постоянно работающих ИИ-агентов, которая уже бесплатно доступна в Cline.
Почему это важно: Новая открытая модель NVIDIA бесплатно доступна в Cline; читатели могут оценить, стоит ли переходить на неё при частых вызовах ИИ-агентов.