Перейти к содержимому

#Релизы моделей

Сегодня 0 материалов
03.10сб
01.10чт
  1. cxuanAI85

    Google DeepMind 发布 Gemini 4 Argon,输出上限提至 1M tokens

    Google DeepMind 发布 Gemini 4 Argon,单次输出上限从 64K 提升到 1M tokens,主打长任务与多步骤推理。

    Ожидает перевода

    Почему это важно: 汇总了 Gemini 4 Argon 的官方评测数据与 Google 内部落地案例,可对照各家旗舰模型的能力差异。

30.09ср
  1. Habr · Codex76

    OpenAI выпустила GPT-6.1 Sol — цена API примерно в пять раз ниже, чем у Astra

    OpenAI выпустила GPT-6.1 Sol для программирования, работы с документами и автоматизации задач. По словам компании, в部分 тестах модель почти догнала GPT-6 Astra. В тесте DeepSWE 1.1 на задачах с реальными кодовыми базами она сравнялась с Astra, а стоимость выполнения оказалась примерно в пять раз ниже. В тесте OSWorld 2.0 на управлении приложениями при максимальном уровне рассуждений модель обошла GPT-6 Sol на 7 процентных пунктов.

    Почему это важно: GPT-6.1 Sol сравнялась с Astra на DeepSWE 1.1, а стоимость — примерно в пять раз ниже; по этим данным можно судить, как изменилось соотношение цены и качества для задач программирования.

29.09вт
  1. Tproger · Программирование88

    OpenAI выпустила GPT-6.1 Sol на DevDay — цена всего пятая часть от Astra

    29 сентября на DevDay в Сан-Франциско OpenAI представила GPT-6.1 Sol; API называется gpt-6.1-sol, цена — 2 доллара за миллион входных токенов и 10 долларов за миллион выходных, кэшированный ввод — 0.10 доллара. Это пятая часть стандартной цены GPT-6 Astra.

    Почему это важно: На DevDay OpenAI выпустила GPT-6.1 Sol, снизив цену до пятой части от Astra, а заодно обновила Codex, Agents API и систему плагинов — по этим изменениям можно оценить затраты и эволюцию инструментария.

23.09ср
  1. Tproger · Программирование62

    OpenAI 在 API 发布 GPT-6 Sol 和 GPT-6 Luna

    OpenAI 于 9 月 22 日在 API 发布 gpt-6-sol 和 gpt-6-luna,两者接受文本和图像输入、只生成文本。标准处理下,GPT-6 Sol 每百万输入 token 收费 2 美元、缓存 token 0.20 美元、输出 10 美元;GPT-6 Luna 分别为 0.10、0.01 和 0.50 美元。

    Ожидает перевода

  2. Tproger · Программирование80

    Anthropic выпустила флагманскую модель Claude Opus 5.5

    22 сентября Anthropic выпустила флагманскую модель Claude Opus 5.5 — для разработчиков и команд, которые поручают ИИ-агентам многошаговые задачи вроде программирования и анализа данных. По заявлению компании, по сравнению с Opus 5 модель работает быстрее и стоит дешевле.

    Почему это важно: Опубликованные Anthropic цены и снижение стоимости при типовой нагрузке помогут разработчикам оценить затраты на переход к длительным задачам ИИ-агентов.

22.09вт
  1. Sebastian Raschka72

    小米发布开源权重模型 MiMo-V2.6-Pro,在 Artificial Analysis 智能指数上以 46 分成为开源权重模型第一,每任务成本 0.13 美元,输入 0.435 美元/1M tokens、输出 0.87 美元/1M tokens,采用 1.02T 总参数、42B 激活参数的 MoE 架构。

    Ожидает перевода

    ЦитатаArtificial Analysis@ArtificialAnlys

    MiMo-V2.6-Pro debuts as the top open weights model on the Artificial Analysis Intelligence Index (46). At $0.13 per Intelligence Index task, it lands on the Intelligence vs. Cost per Task Pareto frontier @Xiaomi has just released MiMo-V2.6-Pro, an open weights model with major advances in intelligence over its predecessor, MiMo-V2.5-Pro (Intelligence Index: 26). Despite the improvement, it retains the same attractive pricing at $0.435 per 1M input tokens (with a 99% cache-hit discount) and $0.87 per 1M output tokens. This makes MiMo-V2.6-Pro one of the most cost-efficient models to deploy. MiMo-V2.6-Pro is an MoE model with 1.02T total parameters and 42B active parameters. Stay tuned for additional analysis of the model. Check out MiMo-V2.6-Pro full benchmarking breakdown here: https://artificialanalysis.ai

11.08вт
  1. Cline · Blog60

    NVIDIA Nemotron 3.5 Lightning появился в Cline и доступен бесплатно

    NVIDIA выпустила Nemotron 3.5 Lightning — настраиваемую открытую модель для постоянно работающих ИИ-агентов, которая уже бесплатно доступна в Cline.

    Почему это важно: Новая открытая модель NVIDIA бесплатно доступна в Cline; читатели могут оценить, стоит ли переходить на неё при частых вызовах ИИ-агентов.

10.06ср
  1. Andrej Karpathy75

    Andrej Karpathy 评价 Claude Fable 5 发布,指出它与 Mythos 是同一底层模型,只是增加了安全防护,在几乎所有基准上以明显优势达到 SOTA。

    Ожидает перевода

    ЦитатаClaude@claudeai

    Fable 5 is state-of-the-art on nearly all tested benchmarks, with exceptional performance in software engineering, knowledge work, scientific research, and vision. The longer and more complex the task, the larger Fable 5’s lead over our other models.