Aller au contenu

Documentation technique

Comment Similiter compare les vidéos et où il s’arrête.

Ce guide décrit le comportement vérifiable du moteur actuel. Il distingue les doublons identiques, les correspondances visuelles de vidéos complètes et les cas non pris en charge. Les seuils créent des candidats à réviser, pas une autorisation de retrait. Utilisez ces éléments pour interpréter un résultat et savoir quand rescanner.

Pipeline progressive

La comparaison commence par les contrôles les moins coûteux et n’atteint la vérification finale que pour les candidats plausibles. Un préfiltre échantillonné précède le SHA-256 complet ; cinq images assurent le screening, vingt-quatre construisent l’empreinte et quarante-huit vérifient le résultat. Une vérification incomplète reste en attente ou échoue de façon sûre.

  • SHA-256 complet pour les mêmes octets.
  • 5 images pour le screening initial.
  • 24 pour l’empreinte temporelle.
  • 48 pour la vérification finale.

Interpréter les résultats

Un doublon exact possède une preuve cryptographique. “Même vidéo” et “match probable” reposent sur la cohérence des empreintes visuelles pendant la durée et exigent de vérifier images, chemin, taille et qualité. La confiance permet de prioriser la révision mais ne remplace pas la décision de l’utilisateur ni ne justifie un retrait automatique.

  • Doublon exact : SHA-256 complet identique.
  • Même vidéo : forte cohérence visuelle globale.
  • Match probable : à réviser, pas à supprimer.

Limites techniques actuelles

La pipeline aligne les échantillons à des positions relatives de la même durée ; elle ne cherche pas une séquence dans une autre vidéo. Segments, offsets, montages, vitesse, reverse, crop, recadrage et réutilisation en timeline restent donc peu fiables. L’audio est exclu et aucun graphe de projet NLE n’est lu.

  • Aucune recherche de segment.
  • Aucune comparaison audio.
  • Aucune interprétation de projet NLE.
  • Aucune normalisation de crop, miroir, reverse ou vitesse.

Performances et benchmarks

Aucun benchmark reproductible n’est publié pour les grandes bibliothèques ; cette documentation ne promet donc aucun temps pour des milliers de fichiers ou des téraoctets. Un benchmark crédible devra préciser version, matériel, corpus, codecs, fichiers, heures et TB, premier scan, cache, erreurs, faux positifs et critères de vérification.

  • Les rescans peuvent réutiliser les données des fichiers inchangés.
  • La vitesse dépend du codec, de la durée, du stockage et du décodage.
  • Les chiffres seront publiés avec corpus et méthode reproductibles.

Parlons-en

Demander des informations

Guide technique et limites de Similiter Configurez la demande. Nous répondrons avec la disponibilité et le prix confirmé.

Seuls le nom et l’e-mail sont obligatoires.

En envoyant la demande, vous confirmez avoir lu la politique de confidentialité.