Перейти к содержимому
Популярное событиеНаблюдение

V-Rubrics 开源细粒度视觉强化学习框架

1 публикация1 источник публикацийОбновлено 2 дня назад

Что произошло

Обзор ИИ

南洋理工大学 S-Lab、A*STAR 和 UIUC 团队提出 V-Rubrics,把视觉强化学习的奖励拆成可逐项检查的细粒度准则。据 2026 年 10 月 5 日报道,该工作将 50,248 个视觉样本拆解为 352,938 条准则,让视觉事实、推理步骤和任务要求分别参与奖励计算,从而细化多模态强化学习的奖励信号。目前公开的信息集中在方法本身:以准则为单位组织奖励,而非依赖单一的整体评分。报道未披露模型规模、训练数据来源、评测基准结果或代码与权重的开放情况,也未说明与既有视觉强化学习方案的对比数据。

Создано ИИ на основе публикаций · Обновлено 12 часов назад

Хронология публикаций

Следите за публикациями, чтобы увидеть разные стороны события.

05.10
  1. 青稞AI
    V-Rubrics 用 35 万条细粒度准则细化多模态强化学习奖励

    南洋理工大学 S-Lab、A*STAR 和 UIUC 团队提出 V-Rubrics,将 50,248 个视觉样本拆成 352,938 条可逐项检查的准则,让视觉事实、推理步骤和任务要求分别参与奖励计算。

Динамика интереса к событию

Текущий интерес 3·Пик в сопоставимом диапазоне 3(6 окт., 16:00)·Изменение за 24 часа в сопоставимом диапазоне –

0123406.1016:0006.1018:0006.1021:0006.1023:00

График сравнивает одних и тех же участников при непрерывном полном наблюдении, поэтому охват может быть уже, чем у текущего индекса. Наведите указатель или нажмите на график для просмотра почасовых данных; используйте стрелки влево и вправо для навигации.