Meta (META) анонсировала запуск семейства Llama 4 — продвинутых мультимодальных моделей искусственного интеллекта, способных обрабатывать текст, изображения и видео в едином контексте, сообщает Reuters.
Новые модели уже начали интеграцию в чат-бот Meta AI, ИИ-помощника для WhatsApp, Instagram и Messenger, и доступны для разработчиков на специальных платформах.
В семейство входят модели Scout, Maverick и Behemoth. Scout при компактных 17 млрд активных параметров обрабатывает до 48 изображений за запрос, работает на одной видеокарте NVIDIA H100 и демонстрирует производительность выше, чем у Google Gemma 3. Контекстное окно Scout составляет до 10 млн токенов — это эквивалент 20 часов видео или 5000 страниц текста.
Maverick и Behemoth обучены на массивном датасете объёмом 30 трлн токенов, включающем данные на 200 языках, для 100 из которых собрано не менее 1 млрд примеров. Meta заявляет, что Maverick превосходит GPT-4o и Gemini 2.0 Flash по результатам множества тестов, а Behemoth опережает GPT-4.5, Claude Sonnet 3.7 и Gemini 2.0 Pro в ряде направлений.
Пока мультимодальные функции доступны только на английском языке и лишь на территории США, однако Meta AI на базе Llama 4 уже работает в 40 странах.