Twelve Labs est un système d’IA pour rechercher et analyser des vidéos à l’aide de requêtes textuelles en langage naturel. Il reconnaît les objets, les actions, la parole et les scènes en combinant des signaux visuels et audio, afin de retrouver les moments pertinents par le sens, et pas seulement par les noms de fichiers ou les métadonnées. Il peut aussi générer des descriptions et extraire des informations clés à partir de vidéos.
À quoi il sert
Rechercher dans de vastes bibliothèques vidéo des moments, sujets ou événements précis
Créer des résumés et des descriptions pour des contenus vidéo
Extraire des détails clés à partir d’enregistrements pour revue ou analyse
Déploiement et adéquation
Conçu pour être utilisable sans connaissances techniques spécialisées
Adapté aux médias, aux plateformes éducatives, aux analystes et aux grandes archives vidéo
Conçu pour passer à l’échelle sur de grandes collections et prendre en charge une protection des données de niveau entreprise
Comparé à des outils comme Google Video AI et Microsoft Video Indexer, Twelve Labs met l’accent sur la recherche en langage naturel et la compréhension multimodale de la vidéo, de l’audio et du texte, avec une attention particulière à la précision de la reconnaissance et à une intégration simple.

