
23 июля 2024 года компания Meta представила Llama 3.1 — набор моделей искусственного интеллекта (ИИ) с открытым исходным кодом , призванных произвести революцию в области обработки естественного языка (NLP) . В релиз входит модель Llama 3.1 405B, которая, по утверждению Meta, является самой большой и наиболее функциональной из доступных в мире базовых моделей, а также обновленные версии моделей 8B и 70B.
По словам генерального директора Meta Марка Цукерберга, последнее поколение Llama положит начало новым приложениям и парадигмам моделирования, включая генерацию синтетических данных для улучшения и обучения моделей меньшего размера, а также дистилляцию моделей — возможность, которая никогда ранее не достигалась в таком масштабе в проектах с открытым исходным кодом.
Лама 3.1 модели похвастаться самыми современными возможностями в общие знания, управляемость, математика, использование инструментов и многоязычный перевод, Модель 405Б, в частности, соперничает с топом AI модели и превосходит GPT-4o и Антропный's Клод 3.5 Сонет по нескольким критериям. Meta обучила модель, используя обширный набор данных, содержащий 15 триллионов токенов, с актуальной информацией до 2024 года.

Одним из ключевых преимуществ Llama 3.1 является её открытый исходный код . В отличие от закрытых моделей, веса моделей Llama доступны для загрузки, что позволяет разработчикам полностью настраивать модели под свои нужды и приложения, обучать их на новых наборах данных и проводить дополнительную тонкую настройку. Это позволяет более широкому сообществу разработчиков в полной мере реализовать возможности генеративного ИИ и развернуть технологию в любой среде, включая локальные системы, облако или даже локальный ноутбук — и всё это без обмена данными с Meta.
Компания Meta также внесла изменения в свою лицензию, разрешив разработчикам использовать результаты работы моделей Llama, включая модель 405B, для улучшения других моделей. Это может иметь важные последствия для взаимодействия моделей и экономические последствия для окупаемости инвестиций в более мелкие модели.

Модели Llama 3.1 доступны для загрузки на llama.meta.com и Hugging Face , а также для немедленной разработки на широкой экосистеме партнерских платформ Meta, включая такие крупные облачные сервисы, как AWS, Azure и Google. Такие компании, как Scale.AI, Dell, Deloitte и другие, готовы помочь предприятиям внедрить Llama и обучить собственные модели на своих данных.
Наряду с выпуском Llama 3.1 компания Meta расширяет сферу применения своего продукта на базе Llama. AI помощник для дополнительных стран и языков, а также представляет новую функцию, которая позволяет генерация изображения основанный на человеке's уникальный внешний вид. Мета AI помощник теперь доступен в 22 странах, с пользователями, способными взаимодействовать через WhatsApp, Instagram, Messenger и Facebook на новых языках, включая французский, немецкий, хинди, итальянский, португальский и испанский..

Сообщество уже создало впечатляющие приложения на основе прошлых моделей Llama, например AI Study Buddy, внедренный в WhatsApp и Messenger, программа LLM, адаптированная для медицинской сферы, и некоммерческий стартап в сфере здравоохранения в Бразилии, который оптимизирует передачу информации пациентам. С выпуском Llama 3.1 Meta ожидает всплеска инноваций и разработки большего количества продвинутые чат-боты, инструменты с более широкими возможностями рассуждения и лучшие агенты компьютерного кодирования.
Как AI гонка продолжает накаляться, Мета's Приверженность разработке ПО с открытым исходным кодом отличает его от растущей тенденции секретности среди AI компании. Хотя некоторые разработчики критиковали Meta за неполную прозрачность некоторых аспектов ее моделей, таких как данные обучения, выпуск Llama 3.1 представляет собой значительный шаг вперед в демократизации AI технологии.


