“`html
Groq представил модели Llama-3-Groq-70B-Tool-Use и Llama-3-Groq-8B-Tool-Use: открытые модели нового поколения с точностью более 90% на лидерборде Berkeley Function Calling
Недавно Groq выпустил две инновационные открытые модели для использования инструментов: Llama-3-Groq-70B-Tool-Use и Llama-3-Groq-8B-Tool-Use. Эти модели разработаны в сотрудничестве с Glaive и предназначены для продвижения возможностей использования инструментов и вызова функций в ИИ.
Производительность моделей
Модель Llama-3-Groq-70B-Tool-Use является наиболее производительной моделью на лидерборде Berkeley Function Calling Leaderboard (BFCL), превосходя все другие открытые и закрытые модели. Достигнув впечатляющей общей точности 90,76%, она установила новый стандарт в этой области. Аналогично, модель Llama-3-Groq-8B-Tool-Use также продемонстрировала выдающуюся производительность с общей точностью 89,06%, занимая третье место на BFCL. Эти модели теперь доступны на GroqCloud Developer Hub и Hugging Face под той же лицензией свободного использования, что и оригинальные модели Llama-3.
Тренировочный процесс
Разработка этих моделей включала тщательный подход к обучению, который объединял полное донастройку и оптимизацию прямого предпочтения (DPO). Важно отметить, что в процессе обучения не использовались данные пользователей; вместо этого модели обучались с использованием этично сгенерированных данных. Этот подход гарантирует, что модели обладают высокой производительностью и соответствуют этическим стандартам в разработке ИИ. Также в процессе обучения проводился тщательный анализ загрязнения с использованием метода LMSYS. Это привело к низкому уровню загрязнения всего 5,6% для данных SFT и 1,3% для данных DPO, что указывает на минимальное переобучение на оценочном бенчмарке.
Практическое применение
Помимо специализированных возможностей использования инструментов, модели Llama-3 Groq Tool Use рекомендуются для использования в гибридном подходе с общими языковыми моделями. Эта стратегия включает в себя реализацию системы маршрутизации, которая анализирует поступающие запросы пользователей, чтобы определить наиболее подходящую модель для каждого запроса. Для запросов, связанных с вызовом функций, взаимодействием с API или манипуляциями структурированными данными используются модели Llama-3 Groq Tool Use. Для общих знаний, свободных бесед или задач, не связанных специально с использованием инструментов, рекомендуется использовать общую языковую модель, например, неизмененную модель Llama-3 70B. Этот подход гарантирует, что каждый запрос обрабатывается наиболее подходящей моделью, максимизируя общую производительность и возможности системы ИИ.
Доступность и приглашение к сотрудничеству
Модели Llama-3-Groq-70B-Tool-Use и Llama-3-Groq-8B-Tool-Use доступны для предварительного доступа через Groq API, с идентификаторами моделей llama3-groq-70b-8192-tool-use-preview и llama3-groq-8b-8192-tool-use-preview соответственно. Groq призывает сообщество начать создавать и экспериментировать с этими моделями через GroqCloud Developer Hub, устраивая путь для будущих инноваций в области использования инструментов в ИИ.
Заключение
Groq представил модели Llama-3-Groq-Tool-Use с передовой производительностью и лицензированием свободного использования. Эти модели готовы оказать существенное влияние на исследования и разработку ИИ. Обязательства Groq по этическому развитию ИИ и его совместный подход с сообществом подчеркивают лидерство компании в этой области.
Если вы хотите узнать больше о том, как использовать ИИ в вашем бизнесе, свяжитесь с нами по адресу https://t.me/flycodetelegram
Попробуйте использовать ИИ-ассистента в продажах от Flycode.ru по ссылке https://flycode.ru/aisales/. Этот ИИ-ассистент в продажах поможет вам отвечать на вопросы клиентов, генерировать контент для отдела продаж и снизить нагрузку на первую линию.
Узнайте, как ИИ может изменить ваши процессы с решениями от Flycode.ru.
“`