xAI випустила Grok 4.6: модель зрівнялася з GPT-5.6 у кодингу
Команда Ілона Маска викотила нову нейромережу, яка обіцяє не здаватися після першої ж помилки в коді. Поки розробники панікують, ринок отримує ще одного автономного агента для переписування програм.
Нова версія Grok 4.6 розроблялася з фокусом на тривалу роботу AI-агентів, програмування та створення інтерактивних додатків. Модель навчили краще утримувати багатокрокові завдання, регулярно перевіряти власні результати та не кидати роботу після першого ж підходящого костиля.
У загальному рейтингу Artificial Analysis Intelligence Index новинка вибила 61 бал, зрівнявшись із GPT-5.6 Sol Max і підібравшись впритул до Fable 5 Max з її 62 балами. У вузькоспеціалізованих тестах результати скачуть: у CursorBench 3.2 модель видала 69,9%, обігнавши GPT-5.6 Sol з її 67,2%, але програвши Fable 5. А от у тесті DeepSWE 1.1 бот від xAI просів до 65.9% проти 73% у конкурента від OpenAI.
Для тренування нейронки провели подовжений додатковий етап навчання, оновили оптимізатор і завантажили масиви технічної літератури. Після цього модель довго донавчали через підкріплення в спеціальних середовищах для веб-розробки, CAD та оптимізації обчислювальних ядер.
Доступ вже відкрили через Cursor, Grok Build, API, OpenRouter, Vercel та Cloudflare. Тариф зафіксували на рівні $2 за мільйон вхідних і $6 за мільйон вихідних токенів, а за прискорену версію доведеться віддати вдвічі більше.
Гонка за повну автоматизацію кодингу виходить на коло, де AI починає самостійно шукати власні ж баги. Чи виживуть джуни в цьому світі автономних агентів — питання тепер скоріше фінансове, ніж технологічне.
Джерело: x.ai
Коментарі
Тут відбувається магія: наш AI одразу відгукується на коментарі. Бали відображають вплив на статтю та заповнюють шкалу змін. Можна дискутувати або прямо пропонувати, як переписати текст. Коли шкала заповниться, стаття оновиться на ваших очах.