Meta випустила Llama 4 у неділю, і ШІ-спільнота досліджує її з криміналістичною інтенсивністю, яку зазвичай приберігають для витоків судових документів. Одночасно вийшли два варіанти моделі: Llama 4 Scout — модель з 17 мільярдами параметрів, оптимізована для локального розгортання, і Llama 4 Maverick — модель з 400 мільярдами параметрів типу «суміш експертів», розрахована на корпоративне навантаження. Обидві доступні для безкоштовного завантаження за ліцензією відкритого використання Meta, що дозволяє комерційне розгортання для організацій із менш ніж 700 мільйонами щомісячних активних користувачів — порогом, що звільняє від обмежень практично всіх, крім самої Meta та жменьки інших технологічних гігантів.
Головна новина про Scout: вона працює на одному споживацькому GPU Nvidia RTX 4090 або аналогу з 24 ГБ VRAM. Це був порогом, якого розробники чекали: по-справжньому здатна модель, яку соло-розробник або невелика команда може запускати повністю на власному обладнанні — без оплати хмарних інференс-сервісів, без передачі своїх даних чужим серверам. У ранніх бенчмарках, що циркулюють на форумах розробників, Scout показує результати на рівні GPT-5.4 mini і Gemini 2.0 Flash на стандартних задачах кодування та логічного мислення, і дещо вище за обох на структурованому вилученні даних.
Continue reading to see the full article