Open source · votre propre inférence

Le harnais d'agent pour la vidéo. Voit l'écran. Entend les mots. Vérifie les faits.

Un agent gratuit et open source qui transforme n'importe quelle vidéo en données structurées et liées aux preuves, directement depuis votre terminal.

De la vidéo à des données réellement exploitables

La plupart des outils vous remettent une transcription et appellent ça des données. Lirovo vous donne les faits : les affirmations, décisions et chiffres contenus dans la vidéo, structurés, notés, traçables jusqu'à la seconde exacte d'où ils proviennent, et confrontés à leurs sources.

01Ingestion

Déposez n'importe quelle vidéo

Collez un lien ou téléversez un fichier. Une vidéo YouTube, un enregistrement Zoom ou Teams, un webinaire, un MP4. Lirovo la récupère et s'occupe des parties pénibles pour vous.

Voir les sources prises en charge
02Capture

Il entend chaque mot et lit chaque écran

Lirovo transcrit l'audio et lit en même temps ce qui est à l'écran : diapositives, graphiques, sous-titres, texte à l'écran. La moitié qui est dite et la moitié qui est montrée, toutes deux capturées.

Voir comment fonctionne la capture
03Chronologie

Il relie les deux sur une seule chronologie

Les mots prononcés et les moments à l'écran sont alignés seconde par seconde, puis connectés dans un graphe vivant des personnes, sujets, chiffres, affirmations et décisions présents dans la vidéo.

Voir le graphe
04Schéma

Vous obtenez des données propres, conformes à votre schéma

Indiquez à Lirovo les champs souhaités : noms, affirmations, décisions, chiffres, sujets. Il renvoie du JSON typé avec un score de confiance sur chaque valeur, prêt pour un tableur, une base de données ou votre application.

Voir un exemple
05Preuves

Chaque valeur porte sa preuve

Chaque valeur renvoie à la seconde exacte d'où elle provient, et indique si elle a été dite à voix haute ou montrée à l'écran. Lirovo signale les désaccords entre les deux et confronte les affirmations à leurs sources, pour que vous puissiez vérifier chaque résultat vous-même.

Comment fonctionnent les preuves
Utilisez-le seul, ou dans votre agent :Application terminalPluginVotre propre inférenceOpen source
claude · ~/lirovo
❯Try “build a timeline of every number he cites”
⏵⏵ auto mode on(shift+tab to cycle)·lirovoMCP connected
Seul, ou dans votre agent

Lancez-le dans votre terminal, ou dans votre agent

Lirovo tourne comme sa propre application de terminal, ou comme plugin dans le harnais d'agent que vous utilisez déjà. Donnez-lui un lien, recevez du JSON typé avec une citation pour chaque valeur, le tout sur votre propre inférence.

  • extract() donnez-lui une vidéo et un schéma
  • get_job() récupérez du JSON typé
  • get_graph() parcourez le graphe de connaissances
  • get_evidence() citez le moment exact
  • deliver() envoyez-le là où vous travaillez
une commandelirovo extract <url>

Pourquoi les développeurs choisissent Lirovo

Minutes
De la vidéo au JSON typé

La plupart des vidéos sont traitées de bout en bout en minutes, pas en heures. Le gros du travail média, détection de scènes et déduplication des images, s'exécute avant tout appel de modèle, donc votre inférence ne sert que là où ça compte.

En savoir plus
100 %
Des valeurs sont traçables

Chaque valeur extraite renvoie à la seconde exacte d'où elle provient, avec sa modalité enregistrée. Les affirmations sont confrontées à leurs sources, donc rien n'est une boîte noire.

En savoir plus
1 pipeline
Audio, visuel et raisonnement

Transcription, lecture de l'écran et raisonnement s'exécutent comme un seul pipeline local, sur l'inférence que vous utilisez déjà. Rien à configurer, et votre vidéo ne quitte jamais votre machine.

En savoir plus

Questions fréquentes

D'autres questions ? Nous sommes ravis de vous aider à cadrer votre cas d'usage.

Parlez-nous

Commencez à transformer la vidéo en données

Accès anticipé