TwelveLabs rende disponibili a livello globale, attraverso Amazon Bedrock, i propri modelli di intelligenza artificiale per la comprensione multimodale dei video. L’obiettivo è affrontare il problema dei dati non strutturati, una parte consistente dei quali non può essere individuata con le modalità di ricerca tradizionali. Grazie ai modelli Marengo e Pegasus, i contenuti audiovisivi vengono interpretati come una storia completa, considerando immagini, suoni e contesto temporale.
twelvelabs porta la comprensione video nelle aziende
La tecnologia sviluppata da TwelveLabs consente di analizzare i video in modo simile alla percezione umana, integrando elementi visivi, audio e informazioni temporali. La soluzione è già stata adottata da realtà del settore dei media, tra cui MLSE e The Washington Post, oltre che da aziende attive nella pubblicità, nella produzione e nell’ambito governativo.
L’azienda collabora inoltre con fornitori di sistemi per la gestione degli asset multimediali, tra cui Mimir, Iconik e Adobe. Queste integrazioni favoriscono l’utilizzo dell’intelligenza artificiale all’interno dei flussi di lavoro dedicati all’archiviazione, alla ricerca e alla valorizzazione dei contenuti video.
marengo e pegasus: ricerca e analisi dei video
marengo individua i contenuti attraverso il linguaggio naturale
Marengo è un modello di embedding multimodale che rileva gli elementi visivi e sonori, insieme al contesto spaziale e temporale. Il sistema abilita una ricerca video da qualsiasi elemento verso qualsiasi altro elemento, permettendo di recuperare informazioni anche all’interno di archivi composti da milioni di ore di registrazioni.
La ricerca non deve più basarsi esclusivamente su parole chiave, etichette inserite manualmente o catalogazioni effettuate dagli operatori. È possibile formulare richieste in linguaggio naturale, come individuare la prima meta realizzata durante una partita o trovare la scena in cui due protagonisti si incontrano per la prima volta.
pegasus trasforma i video in dati utilizzabili
Pegasus è un modello linguistico dedicato ai video. Analizza il materiale e produce diversi tipi di output testuali, tra cui riassunti, analisi, metadati e file JSON. In questo modo, gli archivi audiovisivi possono essere integrati più facilmente nei processi operativi e nei sistemi utilizzati dalle aziende.
amazon bedrock sostiene la scalabilità dell’intelligenza artificiale video
La distribuzione tramite Amazon Bedrock consente a TwelveLabs di portare i propri modelli presso aziende di tutto il mondo senza dover costruire autonomamente ogni canale commerciale e operativo. L’infrastruttura cloud è pensata per gestire la scala e la complessità dei video, considerati una delle forme più articolate di dati non strutturati.
La ricerca tradizionale mostra infatti evidenti limiti quando deve gestire archivi contenenti milioni di ore di materiale. L’intelligenza artificiale permette invece di riattivare contenuti rimasti inutilizzati, rendendoli ricercabili, analizzabili e disponibili per nuovi impieghi.
twelvelabs valorizza gli archivi video nei media e nelle imprese
La soluzione può trovare applicazione in emittenti televisive, piattaforme di streaming, sistemi di sicurezza e aziende che conservano registrazioni formative o operative. La crescita dei video brevi, delle riunioni online e delle telecamere di sorveglianza ha aumentato rapidamente la quantità di contenuti prodotti, ma una parte rilevante degli archivi non viene più consultata perché difficile da individuare.
Il modello di TwelveLabs punta quindi a trasformare i video in risorse consultabili e conoscenza organizzata. L’unione tra ricerca e generazione definisce due funzioni complementari: Marengo trova le informazioni, Pegasus le interpreta e le descrive. Questa combinazione trasforma il materiale audiovisivo da archivio chiuso a base di conoscenza accessibile.








Lascia un commento