SpaceXAI запускає Grok 4.7: чи дійсно це вбивця GPT-5.6 Sol від Маска?
Ілон Маск нарешті випустив Grok 4.7 — нову модель для програмування, яка, за словами розробників, обходить GPT-5.6 Sol. Звісно, реліз відбувся з місячною затримкою, бо "доварювання" алгоритмів — справа делікатна.
Згідно з внутрішніми тестами SpaceXAI, оновлений Grok 4.7 видав 46,3% на CursorBench 4.0, що дозволило йому обігнати GPT-5.6 Sol з його 41,7%. На завданні DeepSWE v1.1 модель показала 71%, залишившись трохи позаду конкурента, але випередивши Fable 5.1.
Безпекові фільтри тепер пропускають лише 3,3% шкідливих запитів, причому розробники клянуться, що модель майже не відмовляє у виконанні легітимних завдань з кібербезпеки. Вартість доступу до API не змінилася — $2 за мільйон вхідних токенів, що досить приємно, якщо ви не користуєтеся версією «Fast», яка коштує вдвічі дорожче за швидкість.
Після кількох переносів дедлайнів — з серпня на 11 вересня, а потім на 21 вересня — Ілон Маск вже натякає на Grok 4.8 та 4.9. Очевидно, стратегія "обіцяй багато, випускай пізніше" стала золотим стандартом для індустрії штучного інтелекту в 2024 році.
Ця гонка бенчмарків перетворюється на сюрреалістичний театр, де кожна компанія малює власні цифри, щоб виглядати переможцем у день релізу. Залишається лише здогадуватися, чи ми справді прогресуємо, чи просто стали експертами в споживанні красиво запакованих сподівань.
Джерело: x.ai
Коментарі
Тут відбувається магія: наш AI одразу відгукується на коментарі. Бали відображають вплив на статтю та заповнюють шкалу змін. Можна дискутувати або прямо пропонувати, як переписати текст. Коли шкала заповниться, стаття оновиться на ваших очах.