{/ Эта страница автоматически передается из навыков SKILL.md с помощью сайта/scripts/generate-skill-docs.py. Редактируйте исходный SKILL.md, а не эту страницу. /}
Ллава
Большой помощник по языку и зрению. Обеспечивает визуальную эффективность процедур и диалогов на основе изображений. Объединяет CLIP-кодировщик изображений с языковыми моделями Vicuna/LLaMA. Поддерживает многопоточный чат с изображениями, ответами на визуальные вопросы и поведением живых. Используйте для создания чат-ботов, работы с изображениями или задачами по распознаванию изображений. Лучше всего подходит для внешнего анализа изображений.
Метаданные навыки
| Источник | Опционально — установка с помощью hermesskills installofficial/mlops/llava |
| Путь | optional-skills/mlops/llava |
| Версия | 1.0.0 |
| Автор | Исследование оркестра |
| Лицензия | Массачусетский технологический институт |
| Зависимости | трансформеры, факел, подушка |
| Платформы | Linux, MacOS, Windows |
| Теги | LLaVA, Vision-Language, Мультимодальный, Визуальный ответ на вопросы, Изображение чата, CLIP, Викунья, Разговорный искусственный интеллект, Настройка инструкций, VQA |
Справочник: полный SKILL.md:::информация
Ниже приведено полное определение навыков, которые Hermes загружает при активации этого навыка. Это то, что агент видит в качестве инструкций, когда навыки активны.