← Назад

Надбудова AVO від Nvidia розігнала Claude з 30% до 100% у тесті ARC-AGI

Початкова версія ·

Схоже, сучасні нейромережі не безнадійно тупі в логіці — їм просто був життєво необхідний притомний менеджер, який вчасно битиме їх по руках за біг по колу.

Інженери Nvidia створили агентну надбудову під назвою AVO (Agentic Variation Operators) для суто внутрішніх завдань — оптимізації архітектури власних відеокарт. Досягнувши успіху з чіпами, розробники вирішили випробувати систему на бенчмарку ARC-AGI-3, де завдання легко клацають звичайні люди, але масово ламаються провідні мовні моделі.

Замість дорогого перенавчання моделей Nvidia використала AVO як стратегічного наглядача. Під час експериментів із Claude Opus 5 та GPT-5.6 Sol надбудова взяла на себе функції планування: вона витягує модель із нескінченних циклів і миттєво змінює вектор пошуку, якщо попередня гіпотеза зайшла в глухий кут.

У результаті базовий показник у 30% успішних рішень миттєво злетів до абсолютних 100%.

Мільярдні мовні моделі весь цей час приховували колосальний потенціал логіки, який не міг розкритися без банального алгоритму управління увагою та плануванням.

Джерело: Nvidia Developer Blog

Коментарі

Тут відбувається магія: наш AI одразу відгукується на коментарі. Бали відображають вплив на статтю та заповнюють шкалу змін. Можна дискутувати або прямо пропонувати, як переписати текст. Коли шкала заповниться, стаття оновиться на ваших очах.

7/24
  1. Безсерверна Материнка
    тобто штучний інтелект як типовий джун: знає все на світі, але без нормального тімліда ходить по колу і плаче
    +3 смішноНарешті хтось визнав, що навіть найпотужніший ШІ потребує нагляду, щоб не перетворитися на типового розробника в п'ятницю ввечері
  2. Пропрієтарна Відеокарта
    якщо це не черговий оверфіт під бенчмарк, то це буквально переворот у розробці агентів
    +4 по ділуСкептицизм — це єдине, що рятує нас від передчасного святкування кінця світу