Появление чат-ботов, основанных на генеративном искусственном интеллекте, популяризировало термин «модель большого языка» — лежащую в основе технологию искусственного интеллекта, которая работает «за кулисами». Модели больших языков (LLM) генерируют выходные данные на основе прогнозируемого набора языков в ответ на ввод пользователя, создавая впечатление, будто ИИ способен думать самостоятельно.
Но LLM — не единственные доступные крупные модели; Модели большого действия (LAM) могут стать следующей прорывной технологией в области искусственного интеллекта. Проверять Некоторые большие проблемы с ChatGPT OpenAI.

Быстрые ссылки
Что такое модель большого бизнеса (LAM)?
Модель большого действия (LAM) — это модель искусственного интеллекта, которая способна понимать действия человека и выполнять соответствующие действия, что позволяет ей взаимодействовать с миром подобно человеку. Это немного другой подход, чем модели ИИ, которые фокусируются исключительно на генерации ответов. Термин «большая бизнес-модель» впервые был введен компанией Rabbit Inc, разработчиком Rabbit R1. В видеоролике, посвященном запуску Rabbit R1, компания говорит, что LAM — это новая основополагающая модель, которая помогает перевести ИИ от слов к действиям.
LAM обучаются на больших наборах данных о действиях пользователей; Следовательно, они учатся, имитируя действия человека или демонстрируя их. Посредством демонстрации модель LAM может понимать пользовательские интерфейсы различных веб-сайтов или мобильных приложений и перемещаться по ним, а также выполнять определенные действия на основе ваших инструкций. В соответствии с кроликLAM может добиться этого, даже если интерфейс немного изменился.
Вы можете думать о LAM как о расширении существующих возможностей LLM. В то время как генеративный вывод текста или мультимедиа в LLM зависит от ввода пользователя путем прогнозирования следующего слова или токена (вы задаете вопрос, а модель LLM обеспечивает вывод текста или мультимедиа), LAM идут дальше, добавляя возможность реализации. . Комплексные процедуры от вашего имени. Проверять Стоит ли использовать местную модель LLM? Преимущества, недостатки и лучшие практики.
Что могут сделать LAM?
LAM предназначены для выполнения сложных действий от вашего имени. Однако важным моментом, на который следует обратить внимание, является способность выполнять сложные процедуры. Это делает LAM более полезными для сложных задач, но это не значит, что они не могут выполнять более простые процедуры.
Теоретически это означает, что вы можете, например, попросить модель LAM сделать что-то от вашего имени, например заказать кофе в местном кафе или поездку на Uber, и даже забронировать номер в гостинице. Поэтому это отличается от выполнения простых задач, таких как просьба к Google Assistant, Siri или Alexa включить телевизор или свет в гостиной.
Под капотом, согласно видению Rabbit Inc., модель LAM может получить доступ к соответствующему веб-сайту или приложению, такому как Uber, и перемещаться по его интерфейсу, чтобы выполнить действие, например заказать поездку или отменить ее, если вы измените свой разум. Проверять Почему выпуск незаконченных технологических продуктов стал более распространенным, чем когда-либо?.
LAM превзойдут LLM, но они еще не готовы (пока)
Концепция LAM интересна, возможно, даже больше, чем LLM. Модели больших действий (LAM) — это будущее после генеративного искусственного интеллекта, которое позволит нам компенсировать рутинные задачи и сосредоточиться на других приносящих удовлетворение действиях. Однако, как бы захватывающе это ни звучало, LAM еще не готовы.
Первый коммерческий продукт, обещавший использовать LAM (Rabbit r1), не полностью выполнил свое маркетинговое обещание выполнять действия от имени своих пользователей. Устройство настолько провалилось по своей основной торговой точке, что многие отзывы из первых рук описывали его как довольно бесполезное.
Хуже того, расследование YouTuber Coffeezilla в сотрудничестве с избранной группой инженеров-программистов, имеющих доступ к части базы Rabbit r1, показало, что Rabbit использовал сценарии Playwright для выполнения действий вместо LAM. Таким образом, вместо того, чтобы машина выполняла уникальную модель ИИ, она на самом деле просто выполняла набор операторов If > then; Далеко от обещанной модели LAM.
Если есть что-то, что можно отнять у Кролика r1, так это то, что видение есть. Однако до реализации необходимо проделать работу, так что пока не волнуйтесь. Теперь вы можете просмотреть Подробное руководство по началу работы и эффективному использованию модели Llama 2..









