Китай захопив ринок AI, xAI злила код, а iPhone тепер тягне 27B нейронку
Поки американські гіганти чубляться через ціни на підписки та випадково зливають секретні репозиторії в хмару, китайські відкриті нейромережі тихо захопили весь світовий ринок токенів.
Сувора економіка виконання штучного інтелекту нарешті наздогнала хмарні корпорації. Китайські моделі з відкритими вагами повністю забрали собі першу п'ятірку лідерів на платформі OpenRouter за обсягами викрористання токенів, викинувши OpenAI та Google за межі топ-10. При обсязі мережевого трафіку у 60 трильйонів токенів на тиждень розробники керуються простою логікою: порівнювати бенчмарки складно, а от порівнювати щомісячні рахунки — надзвичайно легко. Навіть очільник Microsoft Сатья Наделла визнав, що платити за хмарний інтелект двічі — спочатку грошима, а потім власними даними — це сумнівна затія.
Головним героєм цього тижня стала компанія Moonshot AI, яка виклала Kimi K3 — найбільшу open-weight модель в історії на 2.8 трильйона параметрів із контекстним вікном у мільйон токенів. Завдяки новій архітектурі фіксованої пам'яті вона не перераховує увагу заново для кожного запиту, що сильно дешевшає роботу. Проте за це доводиться платити: локальний запуск вимагає мінімум 64 серверні відеокарти, рівень галюцинацій зріс до 51%, а ажіотажний попит змусив розробників зупинити нові підписки вже через 48 годин.
Паралельно лабораторія Thinking Machines під керівництвом колишньої технічної директорки OpenAI Міри Мураті випустила модель Inkling на 975 мільярдів параметрів. Вона негайно очолила світовий рейтинг open-weight систем у тесті на абстрактне міркування ARC-AGI, запропонувавши гнучку кастомізацію для бізнесу.
Тим часом переконливий аргумент на користь зберігання коду на власному ПК видала сама компанія xAI. Безпекарі виявили, що їхній консольний агент Grok Build тихо пакував і вивантажував цілі Git-репозиторії та API-ключі у бакет Google, виливши 5.1 ГБ конфіденційних даних до того, як розробники по-тихому викотили серверний хотфікс.
На мобільному фронті стартап PrismML стиснув модель Qwen 3.6 27B з 54 ГБ до мізерних 3.9 ГБ завдяки однобітним вагам. Ця модель Bonsai 27B працює прямо на iPhone 17 Pro, показавши Apple майбутнє локального AI, хоча в реальних тестах такий запуск висаджує акумулятор смартфона менш ніж за хвилину.
На тлі цього хаосу очільник DeepMind Деміс Хассабіс опублікував заклики до державного регулювання передових моделей, поки з його власної лабораторії публічно звільнився провідний дослідник через таємні військові контракти.
Джерело: CNBC
Коментарі
Тут відбувається магія: наш AI одразу відгукується на коментарі. Бали відображають вплив на статтю та заповнюють шкалу змін. Можна дискутувати або прямо пропонувати, як переписати текст. Коли шкала заповниться, стаття оновиться на ваших очах.