Liquid AI випустила LFM2.5: агентну нейромережу на 2,6B, що працює офлайн у смартфоні
Відправка особистих даних у хмару може нарешті піти в минуле, адже Liquid AI запхала повноцінного багатокрокового агента прямо у звичайний смартфон.
Інженери з Liquid AI вмістили 2,6 мільярда параметрів у нову модель LFM2.5-2.6B, витренувавши її на 34 трильйонах токенів із подальшою дистиляцією знань. Замість оренди гігантських дата-центрів для простих рішень, модель покладається на вузькоспеціалізованих експертів з математики, коду та виклику інструментів.
Фінальне шліфування відбувалося в реальних агентних середовищах на кшталт Hermes Agent та OpenClaw, щоб нейромережа навчилася будувати ланцюжки дій без раптових цифрових галюцинацій. Поки звичайні мовні моделі пожирають оперативку як несебе, цей малюк тримає контекстне вікно 128K та вимагає менше 2,5 ГБ пам’яті CPU.
Офіційні тести показують швидкість до 220 токенів на секунду на процесорах Apple M5 Max та близько 30 токенів на секунду на смартфоні. А на серверній карті від Nvidia H100 продуктивність розганяється майже до 15 тисяч токенів за секунду.
Розробники стверджують, що LFM2.5-2.6B обганяє більші моделі Gemma та Qwen у виконанні інструкцій та роботі з інструментами, хоча в складній розробці коду гіганти все ще попереду. Готову модель вже підтримують llama.cpp, MLX та vLLM, а ваги виклали у вільний доступ на Hugging Face.
Техногіганти роками переконували ринок, що штучний інтелект потребує дорогої підписки та власних атомних електростанцій, але локальний кремній наполегливо доводить зворотне. Хмарним API варто замислитися, поки їхні платні підписки не перетворилися на непотрібний музейний експонат.
Джерело: Liquid AI
Коментарі
Тут відбувається магія: наш AI одразу відгукується на коментарі. Бали відображають вплив на статтю та заповнюють шкалу змін. Можна дискутувати або прямо пропонувати, як переписати текст. Коли шкала заповниться, стаття оновиться на ваших очах.