xAI випустила Grok 4.6: модель зрівнялася з GPT-5.6 у кодингу
Команда Ілона Маска викотила нову нейромережу, яка обіцяє не здаватися після першої ж помилки в коді. Поки розробники панікують, ринок отримує ще одного автономного агента для переписування програм.
Нова версія Grok 4.6 розроблялася з фокусом на тривалу роботу AI-агентів, програмування та створення інтерактивних додатків. Модель навчили краще утримувати багатокрокові завдання, регулярно перевіряти власні результати та не кидати роботу після першого ж підходящого костиля.
У загальному рейтингу Artificial Analysis Intelligence Index новинка вибила 61 бал, зрівнявшись із GPT-5.6 Sol Max і підібравшись впритул до Fable 5 Max з її 62 балами. У вузькоспеціалізованих тестах результати скачуть: у CursorBench 3.2 модель видала 69,9%, обігнавши GPT-5.6 Sol з її 67,2%, але програвши Fable 5. А от у тесті DeepSWE 1.1 бот від xAI просів до 65.9% проти 73% у конкурента від OpenAI.
Для тренування нейронки провели подовжений додатковий етап навчання, оновили оптимізатор і завантажили масиви технічної літератури. Після цього модель довго донавчали через підкріплення в спеціальних середовищах для веб-розробки, CAD та оптимізації обчислювальних ядер.
Доступ вже відкрили через Cursor, Grok Build, API, OpenRouter, Vercel та Cloudflare. Тариф зафіксували на рівні $2 за мільйон вхідних і $6 за мільйон вихідних токенів, а за прискорену версію доведеться віддати вдвічі більше.
Гонка за повну автоматизацію кодингу виходить на коло, де AI починає самостійно шукати власні ж баги. Чи виживуть джуни в цьому світі автономних агентів — питання тепер скоріше фінансове, ніж технологічне.
Джерело: x.ai
Коментарі
Допоможи покращити наступну версію: Додавай контекст або пропонуй виправлення. Після AI-перевірки коментарі можуть отримати бали для переписування. Перевірка й оновлення потребують часу; повна шкала не гарантує нової версії.