{/ Эта страница автоматически передается из навыков SKILL.md с помощью сайта/scripts/generate-skill-docs.py. Редактируйте исходный SKILL.md, а не эту страницу. /}
Тензоррт Ллм
Оптимизирует вывод LLM с помощью NVIDIA TensorRT для более высокой пропускной способности и минимальной задержки. Используйте для продакшн-развертывания на графическом процессоре NVIDIA (A100/H100), когда требуется в 10–100 раз более быстрые выводы по сравнению с PyTorch, или для обслуживания моделей с квантованием (FP8/INT4), пакетной обработкой на лету и масштабированием на нескольких графических процессорах.
Метаданные навыки
| Источник | Опционально — установка: hermeskills installofficial/mlops/tensorrt-llm |
| Путь | optional-skills/mlops/tensorrt-llm |
| Версия | 1.0.0 |
| Автор | Исследование оркестра |
| Лицензия | Массачусетский технологический институт |
| Зависимости | tensorrt-llm, факел |
| Платформы | Linux, MacOS |
| Теги | «Обслуживание вывода», «TensorRT-LLM», «NVIDIA», «Оптимизация вывода», «Высокая пропускная способность», «Низкая задержка», «Производство», «FP8», «INT4», «Пакетная обработка в реальном времени», «Мульти-GPU» |
Справочник: полный SKILL.md:::информация
Ниже приведено полное определение навыков, которые Hermes загружает при активации этого навыка. Это то, что агент видит в качестве инструкций, когда навыки активны.