Traduction en cours…
evaluation
Par nvidia · model-optimizer
Évalue la précision des LLM quantifiés ou non quantifiés à l'aide de NeMo Evaluator Launcher (NEL). Se déclenche sur « evaluate model », « benchmark accuracy », « run MMLU », « evaluate quantized model », « run nel ». Gère le déploiement, la génération de config et l'exécution des évaluations. Non destiné à la quantification de modèles (utiliser ptq), au déploiement/service de modèles (utiliser deployment), ou à la comparaison de résultats baseline-vs-quantized complétés (utiliser compare-results).
npx skills add https://github.com/nvidia/model-optimizer --skill evaluation
Skills similaires
Générer du code d'évaluation Python à partir de traces de production LLM Datadog.
Générer et exécuter des configurations YAML d'évaluation de modèles LLM via NeMo Evaluator.
Générer et exécuter des configurations YAML d'évaluation de modèles via NeMo Evaluator.
Valider l'intégration d'un modèle Megatron-Bridge dans le backend NeMo-RL via tests E2E.
Quantifier un modèle pré-entraîné en checkpoint optimisé via ModelOpt PTQ.