Benchmark
Un benchmark en intelligence artificielle est un ensemble de tests standardisés utilisés pour évaluer et comparer les performances de différents modèles ou algorithmes.
Par exemple, le benchmark GLUE est souvent utilisé pour évaluer la performance des modèles de compréhension du langage naturel comme GPT-4 ou Llama sur différentes tâches linguistiques.
Un benchmark en intelligence artificielle est un ensemble de tests standardisés utilisés pour évaluer et comparer les performances de différents modèles ou algorithmes.
Par exemple, le benchmark GLUE est souvent utilisé pour évaluer la performance des modèles de compréhension du langage naturel comme GPT-4 ou Llama sur différentes tâches linguistiques.
Benchmark et LLM sont deux concepts liés mais distincts dans l'écosystème IA. Pour approfondir : LLM, Foundation model.
On utilise des cookies de mesure d'audience (Google Analytics, Meta, PostHog) pour comprendre ce qui t'intéresse et améliorer le site. Tu décides. En savoir plus